Dados De Notícias Estruturados

Nossa API structured news data fornece uma maneira simples de acessar artigos de notícias de todo o mundo. Nós fornecemos uma API simples, consistente e fácil de usar para acessar artigos de notícias de milhares de fontes.

title

O título do artigo de notícias.

href

O URL do artigo de notícias.

description

Uma descrição do artigo de notícias.

body

O conteúdo completo do artigo de notícias.

published_at

Data em que o artigo foi publicado.

image

A imagem do artigo de notícias.

língua

A língua do artigo noticioso.

🔥 Traduções

Tradução em inglês do título e da descrição para artigos não em inglês.

Categorias

As categorias do artigo de notícias.

Tópicos

Os tópicos do artigo de notícias.

Indústrias

As indústrias do artigo de notícias.

sentimento

O sentimento do artigo de notícias.

🔥 story

Agrupe os artigos em histórias.

Fonte

Informações da fonte do artigo.

🔥 esta_quebrando

Detecção de notícias de última hora.

is_duplicate

Detecção de duplicados.

é_grátis

Se o artigo é livremente acessível (detecção de paywall).

links

Os links do artigo de notícias.

media

A mídia do artigo de notícias.

Palavras-chave

As palavras-chave do artigo de notícias.

read_time

O tempo estimado para ler o artigo em minutos.

sentences_count

O número de frases no artigo.

contagem_de_parágrafos

O número de parágrafos do artigo.

words_count

O número de palavras no artigo.

characters_count

O número de caracteres no artigo.

Perguntas frequentes

Cada artigo inclui campos principais (título, descrição, corpo, URL, data de publicação, imagem) mais dados enriquecidos: análise de sentimento, categoria, tópico, classificação setorial, idioma, uma tradução em inglês do título e da descrição, informações da fonte com classificação da editora, ID de cluster de histórias e métricas de conteúdo como contagem de palavras e tempo de leitura. Também extraímos entidades, hashtags, links e mídia do conteúdo do artigo.
Sim. Cada artigo carrega um bloco de traduções com uma tradução automática para o inglês do seu título e descrição, cobrindo 48 idiomas de origem. A tradução é pré-calculada durante o processamento, portanto, não custa tempo extra de solicitação e não requer nenhum parâmetro para ativar. O título e a descrição originais permanecem no idioma de origem e nunca são substituídos, e o campo de idioma ainda informa o próprio idioma do artigo — para artigos em inglês, o bloco está presente, mas vazio. O corpo do artigo não é traduzido.
Nossa análise de sentimento usa modelos NLP treinados em conteúdo de notícias para classificar artigos como positivos, negativos ou neutros. Cada artigo recebe uma pontuação de polaridade e um nível de confiança. O modelo analisa o texto completo do artigo, não apenas os títulos, alcançando alta precisão em 59 idiomas. Você pode filtrar os resultados da pesquisa por sentimento para encontrar tons emocionais específicos.
O agrupamento de histórias agrupa artigos relacionados que cobrem o mesmo evento ou tópico. Quando múltiplos editores relatam a mesma notícia, atribuímos a eles o mesmo ID de história. Isso ajuda você a acompanhar como as histórias se desenvolvem ao longo do tempo, identificar tópicos em tendência, medir a amplitude da cobertura e evitar processar conteúdo duplicado de diferentes fontes.
Nosso algoritmo de detecção de duplicatas analisa o conteúdo do artigo, entidades e tempo de publicação para identificar quando múltiplos editores cobrem a mesma história. Cada artigo tem uma flag is_duplicate. Isso ajuda a filtrar conteúdo redundante e focar em notícias únicas. Combinado com o agrupamento de histórias, você pode obter um artigo por história ou rastrear a cobertura completa.
APITube suporta múltiplos formatos de exportação: JSON (padrão), CSV, TSV, XLSX (Excel), XML e feeds RSS. Todos os formatos incluem os mesmos campos de dados. Escolha o formato que melhor se adapta ao seu fluxo de trabalho - JSON para APIs, CSV/XLSX para planilhas e ferramentas de BI, RSS para leitores de feed, XML para sistemas legados.
O ranking do editor (OPR - Overall Publisher Rank) é pontuado de 0 a 10 com base em múltiplos fatores: autoridade do domínio, volume de tráfego, qualidade do conteúdo, frequência de publicação e padrões editoriais. Fontes com classificações mais altas (6 ) geralmente incluem grandes meios de comunicação. Use este filtro para priorizar fontes autorizadas ou excluir conteúdo de baixa qualidade.

Nosso NER (Reconhecimento de Entidades Nomeadas) extrai pessoas, organizações, locais, marcas, eventos e mais do texto do artigo. Cada entidade inclui seu tipo e contagem de menções. Use dados de entidades para monitoramento de marca, rastreamento de empresas específicas, análise de cobertura geográfica ou construção de grafos de conhecimento a partir de conteúdo de notícias.
A API retorna ambos os campos: descrição (resumo/excerto) e corpo (texto completo do artigo). O campo de corpo contém o conteúdo do artigo completamente limpo com HTML removido. Alguns artigos por trás de paywall podem ter conteúdo de corpo limitado - verifique a flag is_paywall. Acesso ao corpo completo está incluído em todos os planos, sem custo adicional.

API de Dados de Notícias Estruturados: Além dos Artigos Brutos

APITube fornece dados de notícias estruturados com esquemas consistentes em mais de 500.000 fontes. Cada artigo inclui campos normalizados: título, corpo, data de publicação, metadados de origem e enriquecimento NLP abrangente.

Os campos de enriquecimento incluem pontuações de sentimento (positivo/negativo/neutro), entidades extraídas (pessoas, organizações, locais, marcas), classificação de tópicos e categorias, tags de indústria e métricas de legibilidade. O agrupamento de histórias agrupa artigos relacionados automaticamente.

Para engenheiros de dados e analistas, a saída estruturada elimina a complexidade de análise. Esquemas JSON consistentes funcionam diretamente com bancos de dados, plataformas de análise e pipelines de ML. Exportação para CSV, XLSX ou XML para integração de planilhas e ferramentas de BI.

Utilizamos cookies

Ao clicar em "aceitar", concorda com o armazenamento de cookies no seu dispositivo para fins funcionais e analíticos.