{"id":30388569,"url":"https://github.com/thawancomt/ai-transcriber-audio-video-cli-tool","last_synced_at":"2026-05-18T15:13:14.542Z","repository":{"id":310413251,"uuid":"1032137474","full_name":"thawancomt/AI-Transcriber-Audio-Video-CLI-Tool","owner":"thawancomt","description":"Transcriber of audios and Videos CLI tool","archived":false,"fork":false,"pushed_at":"2025-08-17T22:52:55.000Z","size":969,"stargazers_count":0,"open_issues_count":0,"forks_count":0,"subscribers_count":0,"default_branch":"master","last_synced_at":"2025-08-18T00:22:42.234Z","etag":null,"topics":["ai","cli-tool","ctranslate2","documentation","nvidia-cuda","python","whisper"],"latest_commit_sha":null,"homepage":"","language":"Python","has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":"mit","status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/thawancomt.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":null,"funding":null,"license":"LICENSE","code_of_conduct":"CODE_OF_CONDUCT.md","threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null,"zenodo":null}},"created_at":"2025-08-04T21:40:46.000Z","updated_at":"2025-08-10T20:30:00.000Z","dependencies_parsed_at":"2025-08-18T00:22:46.885Z","dependency_job_id":"eec0f83b-c6f6-4a46-8368-2b4d858183e1","html_url":"https://github.com/thawancomt/AI-Transcriber-Audio-Video-CLI-Tool","commit_stats":null,"previous_names":["thawancomt/ai-transcriber-audio-video-cli-tool"],"tags_count":1,"template":false,"template_full_name":null,"purl":"pkg:github/thawancomt/AI-Transcriber-Audio-Video-CLI-Tool","repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/thawancomt%2FAI-Transcriber-Audio-Video-CLI-Tool","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/thawancomt%2FAI-Transcriber-Audio-Video-CLI-Tool/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/thawancomt%2FAI-Transcriber-Audio-Video-CLI-Tool/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/thawancomt%2FAI-Transcriber-Audio-Video-CLI-Tool/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/thawancomt","download_url":"https://codeload.github.com/thawancomt/AI-Transcriber-Audio-Video-CLI-Tool/tar.gz/refs/heads/master","sbom_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/thawancomt%2FAI-Transcriber-Audio-Video-CLI-Tool/sbom","scorecard":null,"host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":271442275,"owners_count":24760353,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2022-07-04T15:15:14.044Z","status":"online","status_checked_at":"2025-08-21T02:00:08.990Z","response_time":74,"last_error":null,"robots_txt_status":"success","robots_txt_updated_at":"2025-07-24T06:49:26.215Z","robots_txt_url":"https://github.com/robots.txt","online":true,"can_crawl_api":true,"host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["ai","cli-tool","ctranslate2","documentation","nvidia-cuda","python","whisper"],"created_at":"2025-08-21T07:17:33.270Z","updated_at":"2026-05-18T15:13:09.503Z","avatar_url":"https://github.com/thawancomt.png","language":"Python","funding_links":[],"categories":[],"sub_categories":[],"readme":"\n# Transcritor de Mídia com IA\n\nUm script de linha de comando eficiente para transcrever arquivos de áudio e vídeo em legendas `.srt` usando a tecnologia **Whisper**.\n\n## 📖 Sobre o Projeto\n\nEste projeto foi criado para automatizar a tarefa de transcrever aulas, palestras, reuniões e outros conteúdos de mídia. Utilizando o poder dos modelos de IA da família Whisper, este script oferece uma solução robusta e flexível que pode ser executada localmente, com suporte para aceleração via GPU para um desempenho ainda maior.\n\nO objetivo é fornecer uma ferramenta simples, mas poderosa, para que usuários possam obter transcrições de alta qualidade sem depender de serviços online.\n\n## ✨ Funcionalidades Principais\n\n- **Menu Interativo**: Selecione facilmente qual arquivo transcrever a partir de uma lista de mídias válidas no diretório.\n- **Suporte a Vários Formatos**: Transcreva os formatos de áudio e vídeo mais comuns (mp3, mp4, wav, m4a, webm, etc.).\n- **Saída em .srt**: Gera arquivos de legenda no formato SubRip (.srt), prontos para uso em players de vídeo ou para leitura.\n- **Aceleração por GPU**: Suporte total para processamento em GPUs NVIDIA (CUDA) para uma transcrição significativamente mais rápida.\n- **Seleção de Modelo**: Escolha entre diferentes tamanhos de modelo (`tiny`, `base`, `small`, `medium`, `large-v3`) para balancear velocidade e precisão.\n- **Feedback em Tempo Real**: Acompanhe o progresso da transcrição diretamente no seu terminal.\n\n## 📂 Documentação Completa\n\nToda a documentação formal do projeto, incluindo a **Especificação de Requisitos do Usuário (URS)**, a **Especificação de Requisitos do Software (SRS)**, o **Desenho da Arquitetura (SDS)** com fluxogramas está disponível na pasta `/docs` deste repositório.\n\n## 🛠️ Pré-requisitos\n\nAntes de começar, certifique-se de que você tem os seguintes softwares instalados:\n\n- **Python 3.12**\n- **astral-uv**\n\n\nPara aceleração GPU, instale:\n- Nvidia Cuda ToolKit\n- Nvidia cuNND\n- Nvidia CuBlas\n\n## 🚀 Instalação\n\n1. Clone o repositório:\n\n   ```bash\n   git clone https://github.com/thawancomt/whisper-transcript.git\n   cd whisper-transcript\n   ```\n\n2. Instale as dependencias:\n\n   ```bash\n   uv sync\n   ```\n\n\n## (Como Usar)\n\n1. Coloque os arquivos de áudio ou vídeo que você deseja transcrever na pasta do projeto.\n2. Execute o script no seu terminal.\n\n\n\n### Uso Básico (com CPU):\n\n(Modelos disponíveis: `tiny`, `base`, `small`, `medium`, `large-v2`, `large-v3`)\n\n```bash\npython app.py [--cpu-threads] [--model=modelo_desejado]\n```\n\nO script irá listar os arquivos disponíveis e você poderá escolher um número para iniciar a transcrição.\n\n### Uso com GPU (Requer NVIDIA CUDA) e drivers instalados no sistema:\n\n```bash\npython app.py --cuda [--cpu-threads] [--model=modelo_desejado]\n```\n\n\n\n## 📜 Licença\n\nEste projeto está licenciado sob a **Licença MIT**. Veja o arquivo [LICENSE](LICENSE) para mais detalhes.\n\n\n# Instalação para rodar no linux\n","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fthawancomt%2Fai-transcriber-audio-video-cli-tool","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Fthawancomt%2Fai-transcriber-audio-video-cli-tool","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fthawancomt%2Fai-transcriber-audio-video-cli-tool/lists"}