Strukturierte Nachrichtendaten

Unsere strukturierte Nachrichtendaten-API bietet eine einfache Möglichkeit, auf Nachrichtenartikel aus der ganzen Welt zuzugreifen. Wir bieten eine einfache, konsistente und benutzerfreundliche API für den Zugriff auf Nachrichtenartikel aus Tausenden von Quellen.

title

Der Titel des Nachrichtenartikels.

href

Die URL des Nachrichtenartikels.

description

Eine Beschreibung des Nachrichtenartikels.

body

Der vollständige Inhalt des Nachrichtenartikels.

published_at

Das Datum, an dem der Nachrichtenartikel veröffentlicht wurde.

image

Das Bild des Nachrichtenartikels.

sprachlich

Die Sprache des Nachrichtenartikels.

🔥 Übersetzungen

Englische Übersetzung des Titels und der Beschreibung für nicht-englische Artikel.

Kategorien

Die Kategorien des Nachrichtenartikels.

Themen

Die Themen des Nachrichtenartikels.

Branchen

Die Branchen des Nachrichtenartikels.

Stimmung

Die Stimmung des Nachrichtenartikels.

🔥 story

Gruppieren Sie die Artikel in Geschichten.

Quelle

Informationen zur Artikelquelle.

🔥 ist_breaking

Erkennung aktueller Nachrichten.

is_duplicate

Duplikaterkennung.

kostenlos

Ob der Artikel frei zugänglich ist (Paywall-Erkennung).

links

Die Links aus dem Nachrichtenartikel.

media

Die Medien aus dem Nachrichtenartikel.

Schlüsselwörter

Die Schlüsselwörter aus dem Nachrichtenartikel.

read_time

Die geschätzte Zeit zum Lesen des Artikels in Minuten.

sentences_count

Die Anzahl der Sätze im Artikel.

Absätze_Anzahl

Die Anzahl der Absätze im Artikel.

words_count

Die Anzahl der Wörter im Artikel.

characters_count

Die Anzahl der Zeichen im Artikel.

Häufig gestellte Fragen

Jeder Artikel enthält Kernfelder (Titel, Beschreibung, Text, URL, Veröffentlichungsdatum, Bild) sowie angereicherte Daten: Sentimentanalyse, Kategorie, Thema, Branchenklassifizierung, Sprache, eine englische Übersetzung der Schlagzeile und Beschreibung, Quelleninformationen mit Rang des Herausgebers, Story-Clustering-ID und Inhaltsmetriken wie Wortanzahl und Lesezeit. Wir extrahieren auch Entitäten, Hashtags, Links und Medien aus dem Artikelinhalt.
Ja. Jeder Artikel enthält einen Übersetzungsblock mit einer maschinellen englischen Übersetzung seiner Schlagzeile und Beschreibung, der 48 Quellsprachen abdeckt. Die Übersetzung wird während der Verarbeitung vorab berechnet, sodass sie keine zusätzliche Anfragezeit kostet und keine Parameter zum Aktivieren benötigt. Originaltitel und -beschreibung bleiben in der Quellsprache und werden niemals ersetzt. Das Sprachfeld meldet weiterhin die eigene Sprache des Artikels — für englische Artikel ist der Block vorhanden, aber leer. Der Artikeltext wird nicht übersetzt.
Unsere Sentimentanalyse verwendet NLP-Modelle, die auf Nachrichten-Inhalten trainiert wurden, um Artikel als positiv, negativ oder neutral zu klassifizieren. Jeder Artikel erhält einen Polaritätswert und einen Konfidenzgrad. Das Modell analysiert den gesamten Artikeltext, nicht nur die Schlagzeilen, und erzielt eine hohe Genauigkeit in 59 Sprachen. Sie können Suchergebnisse nach Sentiment filtern, um spezifische emotionale Töne zu finden.
Storyclusterung gruppiert verwandte Artikel, die dasselbe Ereignis oder Thema behandeln. Wenn mehrere Herausgeber über dieselbe Nachricht berichten, weisen wir ihnen dieselbe Story-ID zu. Dies hilft Ihnen, die Entwicklung von Geschichten im Laufe der Zeit zu verfolgen, Trending-Themen zu identifizieren, die Berichterstattungsbreite zu messen und zu vermeiden, doppelte Inhalte von verschiedenen Quellen zu verarbeiten.
Unser Duplikat-Erkennungsalgorithmus analysiert Artikelinhalt, Entitäten und Publikationszeitpunkt, um zu identifizieren, wann mehrere Herausgeber dieselbe Geschichte behandeln. Jeder Artikel hat eine is_duplicate-Kennzeichnung. Dies hilft Ihnen, redundante Inhalte herauszufiltern und sich auf einzigartige Nachrichten zu konzentrieren. In Kombination mit Storyclusterung können Sie einen Artikel pro Geschichte erhalten oder die vollständige Berichterstattung verfolgen.
APITube unterstützt mehrere Exportformate: JSON (Standard), CSV, TSV, XLSX (Excel), XML und RSS-Feeds. Alle Formate enthalten die gleichen Datenfelder. Wählen Sie das Format, das am besten zu Ihrem Arbeitsablauf passt - JSON für APIs, CSV/XLSX für Tabellenkalkulationen und BI-Tools, RSS für Feed-Reader, XML für Altsysteme.
Publisher-Rang (OPR - Overall Publisher Rank) wird von 0-10 basierend auf mehreren Faktoren bewertet: Domain-Autorität, Traffic-Volumen, Inhaltsqualität, Veröffentlichungsfrequenz und redaktionelle Standards. Quellen mit höherem Rang (6 ) umfassen in der Regel wichtige Nachrichtenagenturen. Verwenden Sie diesen Filter, um autoritative Quellen zu priorisieren oder Inhalte von geringer Qualität auszuschließen.
Unsere NER (Named Entity Recognition) extrahiert Personen, Organisationen, Orte, Marken, Ereignisse und mehr aus dem Artikeltext. Jede Entität enthält ihren Typ und die Anzahl der Erwähnungen. Nutzen Sie Entitätsdaten für Markenmonitoring, Verfolgung spezifischer Unternehmen, Analyse geografischer Abdeckung oder Aufbau von Wissensdiagrammen aus Nachrichteninhalten.
Die API gibt beide Felder zurück: Beschreibung (Zusammenfassung/Auszug) und Text (vollständiger Artikeltext). Das Textfeld enthält den vollständig bereinigten Artikelinhalt ohne HTML. Einige Artikel hinter Bezahlschranken können eingeschränkten Textinhalt haben - überprüfen Sie die Paywall-Markierung. Vollständiger Textzugang ist in allen Tarifen enthalten, ohne Zusatzkosten.

Strukturierte Nachrichten-Daten-API: Über rohe Artikel hinaus

APITube liefert strukturierte Nachrichtendaten mit konsistenten Schemas aus über 500.000 Quellen. Jeder Artikel enthält normmialisierte Felder: Titel, Text, Veationrö,metadatenadatenende NLP-Anreicherung.

Anreicherungsfelder umfassen Sentimentwerte (positiv/negativ/neutral), extrahierte Entitäten (Personen, Organisationen, Orte, Marken), Themen- und Kategorienklassifizierung, Branchentags und Lesbarkeitsmetriken. Storyclusterung gruppiert verwandte Artikel automatisch.

Für Dateningenieure und Analysten beseitigt strukturierte Ausgabe Parsing-Komplexität. Konsistente JSON-Schemas arbeiten direkt mit Datenbanken, Analyseplattformen und ML-Pipelines. Export zu CSV, XLSX oder XML für Tabellenkalkulationsprogramme und BI-Tool-Integration.

Wir verwenden Cookies

Indem Sie auf "Akzeptieren" klicken, stimmen Sie der Speicherung von Cookies auf Ihrem Gerät zu Funktions- und Analysezwecken zu.