Extrair e resumir automaticamente postagens de notícias no NocoDB
Este fluxo de automação foi projetado para ajudar organizações a coletar e processar eficientemente conteúdo de notícias de sites sem feeds RSS.
Ele usa técnicas de web scraping para extrair as postagens de notícias mais recentes, aproveita a geração de resumo com IA e a extração de palavras-chave para destilar informações importantes, e salva os resultados em um banco de dados NocoDB para análise e relatórios adicionais. O fluxo é acionado em uma programação semanal, garantindo que as notícias mais recentes sejam consistentemente capturadas e processadas. Ao automatizar essas tarefas repetitivas de coleta e processamento de dados, esta solução permite que as equipes se mantenham informadas sobre tendências e desenvolvimentos do setor sem o trabalho manual de monitoramento e resumo.
Como a Latenode estima tempo e custo
A Latenode cobra o tempo de execução do workflow em segundos de CPU. Os primeiros 10.000 segundos de CPU são gratuitos a cada mês; depois, o uso segue o preço pay-as-you-go por segundo de CPU. Nós AI Plug-and-Play (PnP) são cobrados separadamente — cada token PnP custa US$ 1, cobrado pay-as-you-go ao custo do fornecedor mais uma pequena taxa de processamento, sem necessidade de chaves de API.
Preços completos — como funcionam os segundos de CPU →Visualização do workflow
O que este modelo faz
- Extrai conteúdo de notícias de sites sem feeds RSS usando técnicas de web scraping
- Gera resumos com inteligência artificial e extrai palavras-chave de postagens de notícias
- Armazena os dados de notícias processados em um banco de dados NocoDB para análise posterior
- Agenda o fluxo de trabalho de coleta e processamento de dados para execução semanal
- Economiza tempo e esforço automatizando tarefas repetitivas de monitoramento e sumarização de notícias
Como funciona
Acionador de Raspagem Semanal
Este fluxo de trabalho de automação é acionado toda quarta-feira às 4:32 da manhã para raspar o conteúdo de notícias mais recente de um site sem feed RSS.
Buscar Site de Notícias
O fluxo de trabalho usa uma integração de navegador headless para carregar o site de notícias alvo e recuperar seu conteúdo HTML.
Extrair Links de Notícias
Uma integração JavaScript é usada para analisar o HTML e extrair as URLs de todas as postagens de notícias individuais no site.
Extrair Datas de Publicação
A integração JavaScript também extrai a data de publicação de cada postagem de notícias do HTML do site.
Filtrar Postagens Recentes
O fluxo de trabalho então filtra a lista de postagens de notícias para incluir apenas aquelas publicadas nos últimos 7 dias, garantindo que o conteúdo mais recente seja processado.
Processar Cada Postagem Recente
Para cada uma das postagens de notícias recentes, o fluxo de trabalho realiza as seguintes etapas para extrair, resumir e salvar o conteúdo.
Buscar Conteúdo da Postagem
A integração de navegador headless é usada para carregar o conteúdo completo da postagem de notícias atual.
Extrair Detalhes da Postagem
Uma integração JavaScript extrai o título e o conteúdo completo da postagem de notícias atual do HTML carregado.
Gerar Resumo
O fluxo de trabalho usa uma integração OpenAI para gerar um resumo conciso da postagem de notícias atual.
Extrair Palavras-chave
Outra integração OpenAI é usada para identificar as 3 palavras-chave mais importantes na postagem de notícias atual.
Salvar no NocoDB
Finalmente, os detalhes da postagem, o resumo e as palavras-chave são armazenados em um banco de dados NocoDB para análise e relatórios adicionais.
Guia de configuração
Adicionar credencial da API OpenAI
1. No painel de Credenciais do Latenode, adicione uma nova credencial para a integração com OpenAI. 2. Insira sua chave de API do OpenAI.
Configurar conexão com banco de dados NocoDB
1. No painel de Credenciais do Latenode, adicione uma nova credencial para a integração com NocoDB. 2. Insira o ID do projeto NocoDB e o token da API.
Configurar web scraping com Headless Browser
1. No construtor visual do Latenode, adicione um nó Headless Browser. 2. Configure o nó para visitar a URL do site de notícias alvo. 3. Configure qualquer login ou manipulação de cookies necessária para acessar o conteúdo das notícias.
Extrair links e datas das postagens de notícias
1. No construtor visual do Latenode, adicione um nó Code após o nó Headless Browser. 2. Escreva código JavaScript para extrair os links e as datas das postagens de notícias do HTML da página.
Salvar dados da postagem de notícias no NocoDB
1. No construtor visual do Latenode, adicione um nó NocoDB após as etapas anteriores. 2. Configure o nó para salvar os dados da postagem de notícias (título, data, link, resumo, palavras-chave) no banco de dados NocoDB.
Requisitos
FAQ