Automatisch Nachrichtenbeiträge in NocoDB scrapen und zusammenfassen
Dieser Automatisierungs-Workflow wurde entwickelt, um Organisationen dabei zu helfen, effizient Nachrichteninhalte von Websites ohne RSS-Feeds zu sammeln und zu verarbeiten.
Er verwendet Web-Scraping-Techniken, um die neuesten Nachrichtenbeiträge zu extrahieren, nutzt KI-gestützte Zusammenfassung und Schlüsselwortextraktion, um wichtige Informationen zu destillieren, und speichert die Ergebnisse in einer NocoDB-Datenbank für weitere Analysen und Berichte. Der Workflow wird wöchentlich ausgelöst, sodass die aktuellsten Nachrichten konsistent erfasst und verarbeitet werden. Durch die Automatisierung dieser wiederholten Datensammlungs- und Verarbeitungsaufgaben ermöglicht diese Lösung Teams, über Branchentrends und Entwicklungen informiert zu bleiben, ohne den Aufwand manueller Überwachung und Zusammenfassung.
Wie Latenode Zeit und Kosten schätzt
Latenode berechnet die Workflow-Laufzeit in CPU-Sekunden. Die ersten 10.000 CPU-Sekunden sind jeden Monat kostenlos, danach gilt die Pay-as-you-go-Preisgestaltung pro CPU-Sekunde. Plug-and-Play (PnP) AI-Knoten werden separat abgerechnet — jedes PnP-Token kostet 1 USD, pay-as-you-go zum Herstellerpreis plus einer kleinen Bearbeitungsgebühr, ohne erforderliche API-Schlüssel.
Vollständige Preise — So funktionieren CPU-Sekunden →Workflow-Vorschau
Was diese Vorlage macht
- Extrahiert Nachrichteninhalte von Websites ohne RSS-Feeds mittels Web-Scraping-Techniken
- Erstellt KI-gestützte Zusammenfassungen und extrahiert Schlüsselwörter aus Nachrichtenbeiträgen
- Speichert die verarbeiteten Nachrichtendaten in einer NocoDB-Datenbank zur weiteren Analyse
- Plant den Workflow zur Datenerfassung und -verarbeitung für einen wöchentlichen Lauf
- Spart Zeit und Mühe durch Automatisierung der wiederkehrenden Nachrichtenüberwachung und Zusammenfassungsaufgaben
So funktioniert es
Wöchentlicher Scrape-Trigger
Dieser Automatisierungs-Workflow wird jeden Mittwoch um 4:32 Uhr ausgelöst, um die neuesten Nachrichteninhalte von einer Website ohne RSS-Feed zu scrapen.
Nachrichtenseite abrufen
Der Workflow verwendet eine Headless-Browser-Integration, um die Ziel-Nachrichtenwebsite zu laden und deren HTML-Inhalt abzurufen.
Nachrichtenlinks extrahieren
Eine JavaScript-Integration wird verwendet, um das HTML zu parsen und die URLs aller einzelnen Nachrichtenbeiträge auf der Website zu extrahieren.
Veröffentlichungsdaten extrahieren
Die JavaScript-Integration extrahiert außerdem das Veröffentlichungsdatum für jeden Nachrichtenbeitrag aus dem HTML der Website.
Aktuelle Beiträge filtern
Der Workflow filtert dann die Liste der Nachrichtenbeiträge, sodass nur diejenigen enthalten sind, die innerhalb der letzten 7 Tage veröffentlicht wurden, um sicherzustellen, dass die aktuellsten Inhalte verarbeitet werden.
Jeden aktuellen Beitrag verarbeiten
Für jeden aktuellen Nachrichtenbeitrag führt der Workflow die folgenden Schritte aus, um den Inhalt zu extrahieren, zusammenzufassen und zu speichern.
Beitragsinhalt abrufen
Die Headless-Browser-Integration wird verwendet, um den vollständigen Inhalt des aktuellen Nachrichtenbeitrags zu laden.
Beitragsdetails extrahieren
Eine JavaScript-Integration extrahiert den Titel und den vollständigen Inhalt des aktuellen Nachrichtenbeitrags aus dem geladenen HTML.
Zusammenfassung erstellen
Der Workflow verwendet eine OpenAI-Integration, um eine präzise Zusammenfassung des aktuellen Nachrichtenbeitrags zu erstellen.
Schlüsselwörter extrahieren
Eine weitere OpenAI-Integration wird verwendet, um die 3 wichtigsten Schlüsselwörter im aktuellen Nachrichtenbeitrag zu identifizieren.
In NocoDB speichern
Schließlich werden die Beitragsdetails, die Zusammenfassung und die Schlüsselwörter in einer NocoDB-Datenbank für weitere Analysen und Berichte gespeichert.
Einrichtungsanleitung
OpenAI-API-Anmeldeinformation hinzufügen
1. Fügen Sie im Latenode-Anmeldeinformationen-Panel eine neue Anmeldeinformation für die OpenAI-Integration hinzu. 2. Geben Sie Ihren OpenAI-API-Schlüssel ein.
NocoDB-Datenbankverbindung konfigurieren
1. Fügen Sie im Latenode-Anmeldeinformationen-Panel eine neue Anmeldeinformation für die NocoDB-Integration hinzu. 2. Geben Sie Ihre NocoDB-Projekt-ID und Ihr API-Token ein.
Web Scraping mit Headless Browser einrichten
1. Fügen Sie im Latenode-Visual-Builder einen Headless-Browser-Knoten hinzu. 2. Konfigurieren Sie den Knoten so, dass er die Ziel-News-Website-URL besucht. 3. Richten Sie bei Bedarf eine Anmeldung oder Cookie-Verwaltung ein, um auf die Nachrichteninhalte zuzugreifen.
News-Beitrags-Links und -Daten extrahieren
1. Fügen Sie im Latenode-Visual-Builder einen Code-Knoten nach dem Headless-Browser-Knoten hinzu. 2. Schreiben Sie JavaScript-Code, um die Links und Daten der News-Beiträge aus dem HTML der Webseite zu extrahieren.
News-Beitragsdaten in NocoDB speichern
1. Fügen Sie im Latenode-Visual-Builder einen NocoDB-Knoten nach den vorherigen Schritten hinzu. 2. Konfigurieren Sie den Knoten so, dass die News-Beitragsdaten (Titel, Datum, Link, Zusammenfassung, Schlüsselwörter) in der NocoDB-Datenbank gespeichert werden.
Anforderungen
FAQ