{"id":27020486,"url":"https://github.com/carvalhoandre/coletor-tweets","last_synced_at":"2026-05-19T09:03:11.065Z","repository":{"id":281914224,"uuid":"940178877","full_name":"carvalhoandre/coletor-tweets","owner":"carvalhoandre","description":"Criado para coletar e armazenar tweets utilizando a API do Twitter. Inicialmente inspirado no caso de uso do livro Um Voluntário na Campanha de Obama, este projeto tem como objetivo demonstrar a importância do monitoramento no X. O coletor permite buscar tweets sobre qualquer termo desejado","archived":false,"fork":false,"pushed_at":"2025-06-04T18:55:07.000Z","size":117,"stargazers_count":0,"open_issues_count":0,"forks_count":0,"subscribers_count":1,"default_branch":"main","last_synced_at":"2025-06-04T23:53:40.492Z","etag":null,"topics":["data-analysis","mongodb","python","twiter-analysis","twitter"],"latest_commit_sha":null,"homepage":"","language":"Python","has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":"mit","status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/carvalhoandre.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":null,"funding":null,"license":"LICENSE","code_of_conduct":null,"threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null,"zenodo":null}},"created_at":"2025-02-27T18:34:38.000Z","updated_at":"2025-03-31T17:22:18.000Z","dependencies_parsed_at":"2025-04-04T18:42:33.580Z","dependency_job_id":null,"html_url":"https://github.com/carvalhoandre/coletor-tweets","commit_stats":null,"previous_names":["carvalhoandre/coletor-tweets"],"tags_count":0,"template":false,"template_full_name":null,"purl":"pkg:github/carvalhoandre/coletor-tweets","repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/carvalhoandre%2Fcoletor-tweets","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/carvalhoandre%2Fcoletor-tweets/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/carvalhoandre%2Fcoletor-tweets/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/carvalhoandre%2Fcoletor-tweets/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/carvalhoandre","download_url":"https://codeload.github.com/carvalhoandre/coletor-tweets/tar.gz/refs/heads/main","sbom_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/carvalhoandre%2Fcoletor-tweets/sbom","host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":261504410,"owners_count":23168827,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2022-07-04T15:15:14.044Z","host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["data-analysis","mongodb","python","twiter-analysis","twitter"],"created_at":"2025-04-04T18:31:31.805Z","updated_at":"2026-05-19T09:03:06.010Z","avatar_url":"https://github.com/carvalhoandre.png","language":"Python","funding_links":[],"categories":[],"sub_categories":[],"readme":"# Coletor de Tweets\n\nO **Coletor de Tweets** é um projeto em Python criado para coletar e armazenar tweets utilizando a API do Twitter. Inicialmente inspirado no caso de uso do livro *Um Voluntário na Campanha de Obama*, este projeto tem como objetivo demonstrar a importância do monitoramento de redes sociais. Agora, o coletor permite buscar tweets sobre **qualquer termo desejado** via **parâmetro de busca (`search`)**, tornando-o altamente flexível para análises e pesquisas.\n\n## 🚀 **Funcionalidades**\n- 📡 **Coleta de tweets em tempo real**.\n- 🔍 **Busca personalizada** por palavras-chave, hashtags ou usuários via parâmetro `search`.\n- 📊 **Extração de métricas avançadas**, como sentimentos e engajamento (likes, retweets, respostas).\n- 💾 **Armazenamento em formatos CSV, JSON e banco de dados MongoDB**.\n- 🔥 **Cálculo de hype score**, que mede o nível de engajamento dos tweets.\n\n---\n\n## 🛠️ **Tecnologias Utilizadas**\n- **Python 3.x**\n- **Flask** (API)\n- **MongoDB** (Armazenamento de tweets e métricas)\n- **Tweepy** (Acesso à API do Twitter)\n- **Pandas** (Processamento de dados)\n- **NLTK** (Análise de sentimentos)\n\n---\n\n## 📌 **Pré-requisitos**\nAntes de iniciar, certifique-se de ter instalado:\n\n- **Python 3.x**\n- **pip** (gerenciador de pacotes do Python)\n- **MongoDB** (opcional, caso utilize armazenamento em banco de dados)\n\n---\n\n## ⚙️ **Instalação**\n\n1. **Clone o repositório:**\n\n   ```bash\n   git clone https://github.com/carvalhoandre/coletor-tweets.git\n   cd coletor-tweets\n   ```\n\n2. **Crie e ative um ambiente virtual (opcional, mas recomendado):**\n   python -m venv venv\n   \n   #### Para Linux/macOS:\n   ```source venv/bin/activate```\n   \n   #### Para Windows:\n   ```venv\\Scripts\\activate```\n\n3. **Instale as dependências:**\n   \n   ```pip install -r requirements.txt```\n\n---\n\n## 🔑 Configuração\n\n1. **Obtenha as credenciais da API do Twitter:**\n\nPara utilizar o coletor, você precisará das credenciais da API (API Key, API Secret, Access Token e Access Token Secret). Essas credenciais podem ser obtidas ao criar um aplicativo no Twitter Developer.\n\n2. **Configure as credenciais:**\nCrie um arquivo de configuração, por exemplo, config.py ou um arquivo .env com as seguintes variáveis:\n\n#### Exemplo de config.py\n```\nTWITTER_API_KEY = 'sua_api_key'\nTWITTER_API_SECRET = 'sua_api_secret'\nTWITTER_ACCESS_TOKEN = 'seu_access_token'\nTWITTER_ACCESS_TOKEN_SECRET = 'seu_access_token_secret'\n```\n\n3. **Banco de Dados (Opcional):**\n   Se deseja armazenar os tweets em MongoDB, adicione a variável de ambiente:\n    ```\n    DATABASE_MONGO_URI='mongodb://localhost:27017'\n    ```\n\n---\n\n## 🚀 Uso\nPara iniciar a coleta de tweets, utilize o seguinte comando:\n```\npython coletor.py --keywords \"Copa do Mundo\" --output tweets.csv\n```\n\n📡 Acessando a API\nOs endpoints permitem buscar tweets sobre qualquer assunto, especificado pelo parâmetro search.\n\n### Parâmetros Comuns:\n- --keywords: Define as palavras-chave ou hashtags para filtrar os tweets.\n- --output: Especifica o nome do arquivo onde os tweets coletados serão salvos.\n- Outros parâmetros podem ser implementados conforme a necessidade do projeto.\n\n### Exemplo de Uso\nColetar tweets contendo a palavra-chave Neymar e salvar no arquivo coleta.csv:\n```\npython coletor.py --keywords \"Neymar\" --output coleta.csv\n```\n\n## 🔥 API Endpoints\n\nA seguir, estão listados os endpoints disponíveis na API do projeto:\n\n### 1️⃣ GET Buscar Tweets  `/fetch_tweets`\n\n- **Descrição:**  \n Busca tweets relacionados ao termo especificado no parâmetro search.\n\n- **Parâmetros de Consulta:**\n  - `force_refresh` (opcional): Se definido como `true`, força a atualização dos tweets.\n  - `search` (obrigatório): Define o termo de busca (exemplo: \"Messi\", \"Bitcoin\").\n\n- **Resposta:**\n  - **Sucesso (200):**  \n    JSON com status verdadeiro, mensagem \"Tweets retrieved\" e os dados dos tweets.\n  - **Nenhum tweet encontrado (404):**  \n    JSON com status falso e mensagem \"No tweets available\".\n  - **Erros (400 ou 500):**  \n    JSON com status falso e mensagem de erro (400 para erros de validação e 500 para erros internos).\n\n### 2️⃣ GET Análise de Sentimentos `/feelings`\n\n- **Descrição:**  \n  Busca tweets, processa os sentimentos extraídos dos mesmos e retorna o resultado como JSON.\n\n- **Parâmetros de Consulta:**\n  - `force_refresh` (opcional): Se definido como `true`, força a atualização dos tweets.\n  - `search` (obrigatório): Define o termo de busca (exemplo: \"Messi\", \"Bitcoin\").\n\n- **Resposta:**\n  - **Sucesso (200):**  \n    JSON com status verdadeiro, mensagem \"Feelings retrieved\" e os dados dos sentimentos processados.\n  - **Nenhum tweet encontrado (404):**  \n    JSON com status falso e mensagem \"No tweets available\".\n  - **Erros (400 ou 500):**  \n    JSON com status falso e mensagem de erro.\n\n### 3️⃣ GET Métricas Horárias e Indicador de Hype `/hourly_metrics`\n\n- **Descrição:**  \n  Processa os tweets para extrair métricas horárias e retorna o resultado como JSON.\n\n- **Parâmetros de Consulta:**\n  - `force_refresh` (opcional): Se definido como `true`, força a atualização dos dados.\n  - `search` (obrigatório): Define o termo de busca (exemplo: \"Messi\", \"Bitcoin\").\n\n- **Resposta:**\n  - **Sucesso (200):**  \n    JSON com status verdadeiro, mensagem \"Feelings retrieved\" e os dados das métricas horárias.\n  - **Nenhum dado disponível (404):**  \n    JSON com status falso e mensagem \"No tweets available\".\n  - **Erros (400 ou 500):**  \n    JSON com status falso e mensagem de erro.\n\n---\n## 🎯 Principais Melhorias\n\n✅ Busca dinâmica por qualquer termo via search.\n\n✅ Novo indicador de hype score, analisando engajamento e sentimentos.\n\n✅ Métricas horárias detalhadas para insights profundos.\n\n✅ Análises de sentimentos com NLP para entender reações do público.\n\n✅ Otimização da coleta e processamento de tweets.\n\n---\n## 📌 Contribuição\n🚀  Contribuições são bem-vindas!\n\nEm breve: Arquivo CONTRIBUTING.md para mais detalhes.\n\n---\n\n## 📜 Licença\nEste projeto está licenciado sob a [MIT License](LICENSE) .\n\n---\n","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fcarvalhoandre%2Fcoletor-tweets","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Fcarvalhoandre%2Fcoletor-tweets","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fcarvalhoandre%2Fcoletor-tweets/lists"}