{"id":25806136,"url":"https://github.com/yandex-cloud-examples/yc-speechkit-async-recognizer","last_synced_at":"2026-06-11T08:31:08.801Z","repository":{"id":277792149,"uuid":"769055733","full_name":"yandex-cloud-examples/yc-speechkit-async-recognizer","owner":"yandex-cloud-examples","description":"SpeechKit Asynchronous Batch Recognizer.","archived":false,"fork":false,"pushed_at":"2025-06-05T08:16:10.000Z","size":203,"stargazers_count":1,"open_issues_count":1,"forks_count":0,"subscribers_count":4,"default_branch":"main","last_synced_at":"2025-06-05T09:27:08.430Z","etag":null,"topics":["asr-model","python3","speech-recognition","speechkit","yandex-cloud","yandex-speechkit-api","yandexcloud"],"latest_commit_sha":null,"homepage":"","language":"Python","has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":"apache-2.0","status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/yandex-cloud-examples.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":null,"funding":null,"license":"LICENSE","code_of_conduct":null,"threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null}},"created_at":"2024-03-08T08:53:07.000Z","updated_at":"2025-06-05T08:16:13.000Z","dependencies_parsed_at":"2025-02-16T06:38:14.753Z","dependency_job_id":null,"html_url":"https://github.com/yandex-cloud-examples/yc-speechkit-async-recognizer","commit_stats":null,"previous_names":["yandex-cloud-examples/yc-speechkit-async-recognizer"],"tags_count":0,"template":false,"template_full_name":null,"purl":"pkg:github/yandex-cloud-examples/yc-speechkit-async-recognizer","repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/yandex-cloud-examples%2Fyc-speechkit-async-recognizer","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/yandex-cloud-examples%2Fyc-speechkit-async-recognizer/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/yandex-cloud-examples%2Fyc-speechkit-async-recognizer/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/yandex-cloud-examples%2Fyc-speechkit-async-recognizer/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/yandex-cloud-examples","download_url":"https://codeload.github.com/yandex-cloud-examples/yc-speechkit-async-recognizer/tar.gz/refs/heads/main","sbom_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/yandex-cloud-examples%2Fyc-speechkit-async-recognizer/sbom","scorecard":null,"host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":286080680,"owners_count":34190582,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2026-05-26T15:22:16.424Z","status":"online","status_checked_at":"2026-06-11T02:00:06.485Z","response_time":57,"last_error":null,"robots_txt_status":"success","robots_txt_updated_at":"2025-07-24T06:49:26.215Z","robots_txt_url":"https://github.com/robots.txt","online":true,"can_crawl_api":true,"host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["asr-model","python3","speech-recognition","speechkit","yandex-cloud","yandex-speechkit-api","yandexcloud"],"created_at":"2025-02-27T19:59:39.110Z","updated_at":"2026-06-11T08:31:08.782Z","avatar_url":"https://github.com/yandex-cloud-examples.png","language":"Python","funding_links":[],"categories":[],"sub_categories":[],"readme":"# SpeechKit Asynchronous Batch Recognizer\n\nДанный скрипт берет аудио-файлы из бакета [Object Storage](https://cloud.yandex.ru/services/storage), отправляет их на распознавание в сервис [SpeechKit](https://cloud.yandex.ru/services/speechkit), после чего – сохраняет результат распознавания обратно в [бакет](https://cloud.yandex.ru/docs/storage/concepts/bucket) Object Storage.\n\nПроцесс распознавания длинных аудио – асинхронный, поэтому требуется, после первичной отправки аудио-файла сохранить его `operation-id`, и затем - периодически проверять статус задания. \nЕсли задание выполнено – можно сохранить результат, и убрать файл из последующих проверок статуса задания.\n\nСкрипт написан на Python поэтому может быть легко разобран, доработан и оптимизирован под ваш сценарий.\n\u003cbr\u003e\u003cbr\u003e\n\n## Процесс распознавания\n\n\u003cimg src=\"img/diag-1.jpg\" width=\"1200px\" alt=\"Процесс распознавания длинных аудио файлов\" /\u003e\n\u003cbr\u003e\u003cbr\u003e\n\n\n1. Пользователь загружает аудио-файлы в [поддерживаемых форматах](https://cloud.yandex.ru/docs/speechkit/formats) в бакет Object Storage, в директорию (префикс) `input`. Также, может быть загружен файл `config.json`,  чтобы задать [язык](https://cloud.yandex.ru/docs/speechkit/stt/models) распознавания речи (по умолчанию, и при отсутствии файла `config.json` — будет использован русский язык `[ru-RU]`). \n\n    `config.json` имеет простой формат, содержит только один параметр в формате JSON:\n    ```\n    {\n        'lang': 'ru-RU'\n    }\n    ```\n\n2. Скрипт проверяет содержимое папки `input` в бакете, составляет список файлов, которые необходимо отправить на распознавание, исключая файлы неподдерживаемого формата, и исключает файлы, которые уже находятся в процессе распознавания (за счет проверки наличия файла в папке `log`). Также, проверяется наличие файла `config.json` и применяется тот язык распознавания, который в нем указан.\n\n3. Скрипт отправляет в Transcribe API [прямые ссылки](https://cloud.yandex.ru/docs/storage/concepts/pre-signed-urls) на файлы из списка, составленного ранее.\n\n4. Сервис SpeechKit получает файл из бакета по подписанной ссылке, создает задание `LongRunningRecognitionTask`, возвращает ID операции распознавания.\n\n5. ID операции распознавания сохраняется в папке `log`, для каждого из отправленных на обработку файлов.\n\n6. Периодически, в зависимости от расписания запуска скрипта, скрипт проверяет папку `log` на предмет наличия аудио-файлов в процессе обработки.\n\n7. Если в файле содержится параметр `{'done': 'false'}` – скрипт отправляет ID операции в сервис Operations API, чтобы проверить статус операции.\n\n8. Если операция завершена – результат операции сохраняется в папку `out` в формате JSON, а аналогичный файл в папке `log` изменяется на файл с содержимым `{'done': 'true'}`, чтобы исключить его из дальнейших проверок статуса операции.\n\n## Использование\n\nСкрипт может быть запущен локально, для этого необходимо указать следующие переменные окружения:\n\n| Переменная        | Описание \n| -------------     | ------------- \n| S3_BUCKET         | Имя [бакета](https://cloud.yandex.ru/docs/storage/concepts/bucket) в Object Storage\n| S3_PREFIX         | Префикс (или директория) для входящих файлов, например, `input`\n| S3_PREFIX_LOG     | Префикс (или директория) для файлов в процессе обработки, например, `log`\n| S3_PREFIX_OUT     | Префикс (или директория) для результатов обработки, например, `out`\n| S3_KEY            | ID [статического ключа доступа](https://cloud.yandex.ru/docs/iam/operations/sa/create-access-key)\n| S3_SECRET         | Секрет [статического ключа доступа](https://cloud.yandex.ru/docs/iam/operations/sa/create-access-key)\n| API_SECRET        | Секрет [API-ключа](https://cloud.yandex.ru/docs/iam/operations/api-key/create)\n\nРекомендуется разделить обрабатываемые, обработанные и файлы для обработки при помощи разных префиксов (подпапок), иначе можно получить непредсказуемое поведение.\n\nДля того, чтобы создать ключ для S3 и API-ключ – необходимо [создать сервисную учетную запись](https://cloud.yandex.ru/docs/iam/operations/sa/create), а также – [назначить роли](https://cloud.yandex.ru/docs/iam/operations/sa/assign-role-for-sa) `storage.editor` и `ai.speechkit-stt.user`.\n\u003cbr\u003e\u003cbr\u003e\n\n## Примеры использования\n\nМожно воспользоваться готовым [Terraform модулем](examples/asr-batch-function), который создает все необходимые ресурсы для начала обработки длинных аудио-файлов.\n\nМожно установить [cronjob](examples/k8s-cronjob) для Kubernetes, который выполняет обработку входящих файлов по расписанию.","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fyandex-cloud-examples%2Fyc-speechkit-async-recognizer","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Fyandex-cloud-examples%2Fyc-speechkit-async-recognizer","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fyandex-cloud-examples%2Fyc-speechkit-async-recognizer/lists"}