Extrair e resumir automaticamente postagens de notícias no NocoDB
Este fluxo de trabalho automatizado foi projetado para ajudar organizações a coletar e processar eficientemente conteúdo de notícias de sites sem feeds RSS.
Ele usa técnicas de web scraping para extrair as postagens de notícias mais recentes, aproveita a geração de resumos com IA e a extração de palavras-chave para destilar informações importantes e salva os resultados em um banco de dados NocoDB para análise e relatórios adicionais. O fluxo de trabalho é acionado em uma programação semanal, garantindo que as notícias mais recentes sejam capturadas e processadas de forma consistente. Ao automatizar essas tarefas repetitivas de coleta e processamento de dados, esta solução permite que as equipes se mantenham informadas sobre tendências e desenvolvimentos do setor sem a sobrecarga de monitoramento e resumo manual.
Cómo Latenode estima el tiempo y el coste
Latenode factura el tiempo de ejecución del workflow en segundos de CPU. Los primeros 10.000 segundos de CPU son gratuitos cada mes; después, el uso sigue el precio pay-as-you-go por segundo de CPU. Los nodos AI Plug-and-Play (PnP) se facturan por separado: cada token PnP cuesta 1 USD, con pago pay-as-you-go al coste del proveedor más una pequeña comisión de procesamiento, sin necesidad de claves API.
Precios completos — cómo funcionan los segundos de CPU →Vista previa del workflow
Qué hace esta plantilla
- Extrai conteúdo de notícias de sites sem feeds RSS usando técnicas de web scraping
- Gera resumos com inteligência artificial e extrai palavras-chave de postagens de notícias
- Armazena os dados processados das notícias em um banco de dados NocoDB para análises futuras
- Agenda a coleta de dados e o fluxo de trabalho de processamento para execução semanal
- Economiza tempo e esforço automatizando tarefas repetitivas de monitoramento e sumarização de notícias
Cómo funciona
Acionamento Semanal de Raspagem
Este fluxo de trabalho automatizado é acionado toda quarta-feira às 4:32 AM para raspar o conteúdo de notícias mais recente de um site sem feed RSS.
Buscar Site de Notícias
O fluxo de trabalho usa uma integração de navegador headless para carregar o site de notícias alvo e recuperar seu conteúdo HTML.
Extrair Links de Notícias
Uma integração JavaScript é usada para analisar o HTML e extrair as URLs de todas as postagens de notícias individuais no site.
Extrair Datas de Postagem
A integração JavaScript também extrai a data de publicação de cada postagem de notícias a partir do HTML do site.
Filtrar Postagens Recentes
Em seguida, o fluxo de trabalho filtra a lista de postagens de notícias para incluir apenas aquelas publicadas nos últimos 7 dias, garantindo que o conteúdo mais recente seja processado.
Processar Cada Postagem Recente
Para cada uma das postagens recentes, o fluxo de trabalho executa os seguintes passos para extrair, resumir e salvar o conteúdo.
Buscar Conteúdo da Postagem
A integração de navegador headless é usada para carregar o conteúdo completo da postagem de notícias atual.
Extrair Detalhes da Postagem
Uma integração JavaScript extrai o título e o conteúdo completo da postagem de notícias atual a partir do HTML carregado.
Gerar Resumo
O fluxo de trabalho usa uma integração OpenAI para gerar um resumo conciso da postagem de notícias atual.
Extrair Palavras-chave
Outra integração OpenAI é usada para identificar as 3 palavras-chave mais importantes na postagem de notícias atual.
Salvar no NocoDB
Finalmente, os detalhes da postagem, o resumo e as palavras-chave são armazenados em um banco de dados NocoDB para análises e relatórios adicionais.
Guía de configuración
Adicionar credencial da API OpenAI
1. No painel de Credenciais do Latenode, adicione uma nova credencial para a integração com OpenAI. 2. Insira sua chave de API da OpenAI.
Configurar conexão com o banco de dados NocoDB
1. No painel de Credenciais do Latenode, adicione uma nova credencial para a integração com NocoDB. 2. Insira o ID do projeto e o token da API do NocoDB.
Configurar raspagem web com Navegador Headless
1. No construtor visual do Latenode, adicione um nó de Navegador Headless. 2. Configure o nó para visitar a URL do site de notícias alvo. 3. Defina o tratamento de login ou cookies necessário para acessar o conteúdo de notícias.
Extrair links e datas das postagens de notícias
1. No construtor visual do Latenode, adicione um nó de Código após o nó de Navegador Headless. 2. Escreva código JavaScript para extrair os links e as datas das postagens de notícias do HTML da página.
Salvar dados das postagens de notícias no NocoDB
1. No construtor visual do Latenode, adicione um nó NocoDB após as etapas anteriores. 2. Configure o nó para salvar os dados da postagem de notícias (título, data, link, resumo, palavras-chave) no banco de dados NocoDB.
Requisitos
FAQ