{"id":28331172,"url":"https://github.com/rafaluz/scraping-to-speech","last_synced_at":"2026-04-09T20:40:45.529Z","repository":{"id":295295739,"uuid":"989727806","full_name":"rafaluz/scraping-to-speech","owner":"rafaluz","description":"🎙️ Projeto scraping-to-speech: Geração de voz a partir de texto via web scraping com Streamlit. Converte textos longos em áudios usando vozes realistas do site openai.fm.","archived":false,"fork":false,"pushed_at":"2025-05-24T17:55:06.000Z","size":134,"stargazers_count":0,"open_issues_count":0,"forks_count":0,"subscribers_count":0,"default_branch":"main","last_synced_at":"2025-06-03T05:28:11.072Z","etag":null,"topics":["automation","openai","python","selenium","streamlit","text-to-speech","voice-generation","web-scraping"],"latest_commit_sha":null,"homepage":"","language":"Python","has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":null,"status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/rafaluz.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":null,"funding":null,"license":null,"code_of_conduct":null,"threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null,"zenodo":null}},"created_at":"2025-05-24T17:45:05.000Z","updated_at":"2025-05-24T18:09:27.000Z","dependencies_parsed_at":"2025-05-24T18:49:49.611Z","dependency_job_id":null,"html_url":"https://github.com/rafaluz/scraping-to-speech","commit_stats":null,"previous_names":["rafaluz/scraping-to-speech"],"tags_count":0,"template":false,"template_full_name":null,"purl":"pkg:github/rafaluz/scraping-to-speech","repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/rafaluz%2Fscraping-to-speech","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/rafaluz%2Fscraping-to-speech/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/rafaluz%2Fscraping-to-speech/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/rafaluz%2Fscraping-to-speech/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/rafaluz","download_url":"https://codeload.github.com/rafaluz/scraping-to-speech/tar.gz/refs/heads/main","sbom_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/rafaluz%2Fscraping-to-speech/sbom","host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":260046227,"owners_count":22950818,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2022-07-04T15:15:14.044Z","host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["automation","openai","python","selenium","streamlit","text-to-speech","voice-generation","web-scraping"],"created_at":"2025-05-26T18:28:31.439Z","updated_at":"2026-04-09T20:40:40.502Z","avatar_url":"https://github.com/rafaluz.png","language":"Python","funding_links":[],"categories":[],"sub_categories":[],"readme":"# Scraping to Speech\n\n![Interface](interface.PNG)\n\n**Scraping to Speech** é uma aplicação em Python com interface em Streamlit que permite gerar áudios realistas a partir de um texto, usando vozes do site [https://www.openai.fm/](https://www.openai.fm/). A geração é feita via web scraping, simulando interações reais na página com Selenium.\n\n---\n\n## 🌍 Visão Geral\n\nO usuário insere:\n\n* Um **texto longo (prompt)**\n* **Instruções de entonação e estilo**\n* A **voz desejada** (ex: Ash, Nova, Coral...)\n\nO sistema divide o texto em partes de até 999 caracteres, envia cada uma ao site openai.fm, gera os áudios, baixa automaticamente e permite baixar todos em um .zip.\n\n---\n\n## 🧱 Tecnologias utilizadas\n\n* **Python 3.10+**\n* **Streamlit** — para a interface web\n* **Selenium + ChromeDriver** — para automação de interações no site\n* **BeautifulSoup** (opcional, não essencial neste projeto)\n* **zipfile** — para empacotamento dos áudios\n* **Pydub** — (caso queira manipular os áudios futuramente)\n\n---\n\n## ⚡ Como rodar o projeto\n\n1. **Clone o repositório:**\n\n```bash\ngit clone https://github.com/seu-usuario/scraping-to-speech.git\ncd scraping-to-speech\n```\n\n2. **Crie um ambiente virtual (recomendado):**\n\n```bash\npython -m venv env\nsource env/bin/activate  # Linux/macOS\nenv\\Scripts\\activate   # Windows\n```\n\n3. **Instale as dependências:**\n\n```bash\npip install -r requirements.txt\n```\n\n4. **Execute a aplicação:**\n\n```bash\nstreamlit run app.py\n```\n\n5. Acesse no navegador:\n\n```\nhttp://localhost:8501\n```\n\n\u003e Obs: Certifique-se de que o **ChromeDriver** está instalado e compatível com a sua versão do Google Chrome.\n\u003e Você pode baixar em: [https://sites.google.com/a/chromium.org/chromedriver/](https://sites.google.com/a/chromium.org/chromedriver/)\n\n---\n\n## 🔍 Exemplo de uso\n\n1. Digite seu texto longo no campo \"Prompt\"\n2. Ajuste as instruções de estilo, entonação e pontuação\n3. Escolha uma das 11 vozes disponíveis\n4. Clique em **Gerar Voz**\n5. Ao final, clique em **Baixar todos os áudios** para obter um .zip com as partes\n\n---\n\n## 🚧 Diretórios ignorados\n\nCertos arquivos e pastas não são versionados:\n\n* `audio_downloads/`: onde os áudios são salvos temporariamente\n* `env/`: ambiente virtual\n* `*.zip`: pacotes gerados para download\n\n\u003e Veja o arquivo `.gitignore` para a lista completa.\n\n---\n\n## 🌐 Licença\n\nEste projeto é de uso pessoal/demonstrativo e não está afiliado oficialmente à OpenAI ou à plataforma openai.fm.\n","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Frafaluz%2Fscraping-to-speech","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Frafaluz%2Fscraping-to-speech","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Frafaluz%2Fscraping-to-speech/lists"}