Dados De Notícias Estruturados
Nossa API structured news data fornece uma maneira simples de acessar artigos de notícias de todo o mundo. Nós fornecemos uma API simples, consistente e fácil de usar para acessar artigos de notícias de milhares de fontes.
title
O título do artigo de notícias.
href
O URL do artigo de notícias.
description
Uma descrição do artigo de notícias.
body
O conteúdo completo do artigo de notícias.
published_at
Data em que o artigo foi publicado.
image
A imagem do artigo de notícias.
língua
A língua do artigo noticioso.
🔥 Traduções
Tradução em inglês do título e da descrição para artigos não em inglês.
Categorias
As categorias do artigo de notícias.
Tópicos
Os tópicos do artigo de notícias.
Indústrias
As indústrias do artigo de notícias.
sentimento
O sentimento do artigo de notícias.
🔥 story
Agrupe os artigos em histórias.
Fonte
Informações da fonte do artigo.
🔥 esta_quebrando
Detecção de notícias de última hora.
is_duplicate
Detecção de duplicados.
é_grátis
Se o artigo é livremente acessível (detecção de paywall).
links
Os links do artigo de notícias.
media
A mídia do artigo de notícias.
Palavras-chave
As palavras-chave do artigo de notícias.
read_time
O tempo estimado para ler o artigo em minutos.
sentences_count
O número de frases no artigo.
contagem_de_parágrafos
O número de parágrafos do artigo.
words_count
O número de palavras no artigo.
characters_count
O número de caracteres no artigo.
Perguntas frequentes
- Cada artigo inclui campos principais (título, descrição, corpo, URL, data de publicação, imagem) mais dados enriquecidos: análise de sentimento, categoria, tópico, classificação setorial, idioma, uma tradução em inglês do título e da descrição, informações da fonte com classificação da editora, ID de cluster de histórias e métricas de conteúdo como contagem de palavras e tempo de leitura. Também extraímos entidades, hashtags, links e mídia do conteúdo do artigo.
- Sim. Cada artigo carrega um bloco de traduções com uma tradução automática para o inglês do seu título e descrição, cobrindo 48 idiomas de origem. A tradução é pré-calculada durante o processamento, portanto, não custa tempo extra de solicitação e não requer nenhum parâmetro para ativar. O título e a descrição originais permanecem no idioma de origem e nunca são substituídos, e o campo de idioma ainda informa o próprio idioma do artigo — para artigos em inglês, o bloco está presente, mas vazio. O corpo do artigo não é traduzido.
- Nossa análise de sentimento usa modelos NLP treinados em conteúdo de notícias para classificar artigos como positivos, negativos ou neutros. Cada artigo recebe uma pontuação de polaridade e um nível de confiança. O modelo analisa o texto completo do artigo, não apenas os títulos, alcançando alta precisão em 59 idiomas. Você pode filtrar os resultados da pesquisa por sentimento para encontrar tons emocionais específicos.
- O agrupamento de histórias agrupa artigos relacionados que cobrem o mesmo evento ou tópico. Quando múltiplos editores relatam a mesma notícia, atribuímos a eles o mesmo ID de história. Isso ajuda você a acompanhar como as histórias se desenvolvem ao longo do tempo, identificar tópicos em tendência, medir a amplitude da cobertura e evitar processar conteúdo duplicado de diferentes fontes.
- Nosso algoritmo de detecção de duplicatas analisa o conteúdo do artigo, entidades e tempo de publicação para identificar quando múltiplos editores cobrem a mesma história. Cada artigo tem uma flag is_duplicate. Isso ajuda a filtrar conteúdo redundante e focar em notícias únicas. Combinado com o agrupamento de histórias, você pode obter um artigo por história ou rastrear a cobertura completa.
- APITube suporta múltiplos formatos de exportação: JSON (padrão), CSV, TSV, XLSX (Excel), XML e feeds RSS. Todos os formatos incluem os mesmos campos de dados. Escolha o formato que melhor se adapta ao seu fluxo de trabalho - JSON para APIs, CSV/XLSX para planilhas e ferramentas de BI, RSS para leitores de feed, XML para sistemas legados.
- O ranking do editor (OPR - Overall Publisher Rank) é pontuado de 0 a 10 com base em múltiplos fatores: autoridade do domínio, volume de tráfego, qualidade do conteúdo, frequência de publicação e padrões editoriais. Fontes com classificações mais altas (6 ) geralmente incluem grandes meios de comunicação. Use este filtro para priorizar fontes autorizadas ou excluir conteúdo de baixa qualidade.
- Nosso NER (Reconhecimento de Entidades Nomeadas) extrai pessoas, organizações, locais, marcas, eventos e mais do texto do artigo. Cada entidade inclui seu tipo e contagem de menções. Use dados de entidades para monitoramento de marca, rastreamento de empresas específicas, análise de cobertura geográfica ou construção de grafos de conhecimento a partir de conteúdo de notícias.
- A API retorna ambos os campos: descrição (resumo/excerto) e corpo (texto completo do artigo). O campo de corpo contém o conteúdo do artigo completamente limpo com HTML removido. Alguns artigos por trás de paywall podem ter conteúdo de corpo limitado - verifique a flag is_paywall. Acesso ao corpo completo está incluído em todos os planos, sem custo adicional.
API de Dados de Notícias Estruturados: Além dos Artigos Brutos
APITube fornece dados de notícias estruturados com esquemas consistentes em mais de 500.000 fontes. Cada artigo inclui campos normalizados: título, corpo, data de publicação, metadados de origem e enriquecimento NLP abrangente.
Os campos de enriquecimento incluem pontuações de sentimento (positivo/negativo/neutro), entidades extraídas (pessoas, organizações, locais, marcas), classificação de tópicos e categorias, tags de indústria e métricas de legibilidade. O agrupamento de histórias agrupa artigos relacionados automaticamente.
Para engenheiros de dados e analistas, a saída estruturada elimina a complexidade de análise. Esquemas JSON consistentes funcionam diretamente com bancos de dados, plataformas de análise e pipelines de ML. Exportação para CSV, XLSX ou XML para integração de planilhas e ferramentas de BI.