# Google News Scraper Brasil API - Monitor de Notícias e Marcas (`brasildados/google-news-scraper-brasil-api`) Actor

Monitore notícias, marcas, empresas e temas no Google News com buscas em português e foco no Brasil. Informe uma ou várias consultas e exporte título, fonte, autores, link, domínio, imagens e data de publicação em JSON, CSV ou Excel para clipping, reputação, pesquisa de mercado e alertas.

- **URL**: https://apify.com/brasildados/google-news-scraper-brasil-api.md
- **Developed by:** [BrasilDados.org - Hub de APIs de Dados do Brasil](https://apify.com/brasildados) (community)
- **Categories:** Lead generation, News, Other
- **Stats:** 2 total users, 2 monthly users, 58.8% runs succeeded, 0 bookmarks
- **User rating**: No ratings yet

## Pricing

from $150.00 / 1,000 por notícia retornadas

This Actor is paid per event. You are not charged for the Apify platform usage, but only a fixed price for specific events.
Since this Actor supports Apify Store discounts, the price gets lower the higher subscription plan you have.

Learn more: https://docs.apify.com/actors/running/actors-in-store.md#pay-per-event

## What's an Apify Actor?

Actors are web data automations that power AI and operations. They run on the Apify platform to scrape websites, process data, connect APIs, and automate workflows.
In Batch mode, an Actor accepts a well-defined JSON input, performs an action which can take anything from a few seconds to a few hours,
and optionally produces a well-defined JSON output, datasets with results, or files in key-value store.
In Standby mode, an Actor provides a web server which can be used as a website, API, or an MCP server.
Actors are written with capital "A".

## How to integrate an Actor?

If asked about integration, you help developers integrate Actors into their projects.
You adapt to their stack and deliver integrations that are safe, well-documented, and production-ready.
The best way to integrate Actors is as follows.

- **AI agents and MCP clients** — the [Apify MCP server](https://docs.apify.com/integrations/mcp.md) at `https://mcp.apify.com` (remote, streamable HTTP, OAuth on first use).
- **Agentic workflows and local Actor development** — [Agent Skills](https://apify.com/.well-known/agent-skills/index.json) with the [Apify CLI](https://docs.apify.com/cli/docs.md): `npm install -g apify-cli`, then `apify login`.
- **JavaScript/TypeScript projects** — the official [JS/TS client](https://docs.apify.com/api/client/js/docs.md): `npm install apify-client`.
- **Python projects** — the official [Python client](https://docs.apify.com/api/client/python/docs.md): `pip install apify-client`.
- **Any other language** — the [REST API](https://docs.apify.com/api/v2.md).

For usage examples, see the [API](#api) section below.

For more details, see Apify documentation as [Markdown index](https://docs.apify.com/llms.txt) and [Markdown full-text](https://docs.apify.com/llms-full.txt).

# README

### Google News Scraper Brasil API para monitorar notícias, marcas e temas

Transforme buscas do Google News em dados organizados para clipping, monitoramento de marca, reputação, pesquisa de mercado e acompanhamento de concorrentes. Informe um ou vários termos e receba uma linha por notícia com título, veículo, autores, link normalizado, domínio, imagens e data de publicação.

O Actor pesquisa em português, com foco no Brasil, e permite limitar o período às últimas 24 horas, 7 dias, 30 dias ou qualquer data disponível. Os resultados podem ser usados na Apify, exportados em JSON, CSV ou Excel e consumidos diretamente por API.

### O que você pode fazer

- Monitorar menções a marcas, empresas, produtos e executivos.
- Montar clipping de notícias para clientes ou equipes internas.
- Acompanhar setores, tecnologias, regulamentações e concorrentes.
- Alimentar dashboards, alertas e automações com dados estruturados.
- Usar operadores como `"nome exato"`, `site:dominio.com.br` e termos negativos.

### Como usar

1. Adicione suas buscas em **Termos**. Para uma única busca, mantenha uma lista com um item.
2. Escolha o período das notícias.
3. Defina o máximo de notícias por termo.
4. Opcionalmente, filtre por veículo em **Filtrar por fonte**.
5. Inicie a execução e abra a aba **Dataset** para visualizar ou exportar os resultados.

Exemplo de entrada:

```json
{
  "termos": ["inteligência artificial Brasil", "energia solar"],
  "period": "7d",
  "maxResultsPerQuery": 20,
  "fonteNoticia": ["exame", "globo"]
}
```

`fonteNoticia` é opcional. Mantém só notícias cujo veículo (`sourceName`) ou domínio (`articleDomain`) contenha um dos textos informados — por exemplo, `"globo"` bate em "O Globo", "g1.globo.com" e "valor.globo.com". O filtro é aplicado depois da busca: não reduz o custo da consulta, só o que é entregue e cobrado.

### Dados entregues

| Campo | Descrição |
| --- | --- |
| `resultPosition` | Posição sequencial da notícia na saída. |
| `queryPosition` | Posição dentro do termo após ordenar da mais recente para a mais antiga. |
| `sourcePosition` | Posição original informada pela pesquisa, quando disponível. |
| `title` | Título público da notícia. |
| `sourceName` | Nome do veículo, quando disponível. |
| `sourceIconUrl` | Ícone público do veículo, quando disponível. |
| `authors` | Lista de autores informados. |
| `articleUrl` | Link público da notícia. |
| `articleDomain` | Domínio extraído do link. |
| `thumbnailUrl` | Imagem de destaque, quando disponível. |
| `smallThumbnailUrl` | Miniatura reduzida, quando disponível. |
| `hasImage` | Indica se alguma imagem foi encontrada. |
| `publishedAt` | Data de publicação em ISO 8601, quando disponível. |
| `publishedDate` | Data de publicação no formato `AAAA-MM-DD`. |
| `publishedAtText` | Data relativa ou textual exibida na notícia. |
| `ageHours` | Idade aproximada da notícia em horas no momento da coleta. |
| `termo` | Termo responsável pelo resultado. |
| `period` | Período solicitado. |
| `language` | Idioma configurado: `pt-BR`. |
| `country` | País configurado: `Brasil`. |
| `collectedAt` | Data e hora da coleta em ISO 8601. |

Exemplo completo de resultado (dado real de uma execução):

```json
{
  "resultPosition": 1,
  "queryPosition": 1,
  "sourcePosition": 48,
  "title": "A inteligência artificial vai acabar com a humanidade?",
  "sourceName": "Brasil 247",
  "sourceIconUrl": "https://encrypted-tbn1.gstatic.com/faviconV2?url=https://www.brasil247.com&client=NEWS_360&size=96&type=FAVICON&fallback_opts=TYPE,SIZE,URL",
  "authors": [],
  "articleUrl": "https://www.brasil247.com/geral/a-inteligencia-artificial-vai-acabar-com-a-humanidade/",
  "articleDomain": "brasil247.com",
  "thumbnailUrl": "https://www.brasil247.com/wp-content/uploads/2026/09/222e6512-5b39-4daa-b4ee-cb0f45eeb66c.png?quality=76&strip=all&w=400",
  "smallThumbnailUrl": "https://news.google.com/api/attachments/CC8iK0NnNW1VVGQzWTNwQloxYzRibTVzVFJEaEFSaVFBeWdLTWdZUkpKQ3RHUWc",
  "hasImage": true,
  "publishedAt": "2026-09-09T23:07:00.000Z",
  "publishedDate": "2026-09-09",
  "publishedAtText": "09/09/2026, 11:07 PM, +0000 UTC",
  "ageHours": 0,
  "termo": "inteligência artificial Brasil",
  "period": "7d",
  "language": "pt-BR",
  "country": "Brasil",
  "collectedAt": "2026-09-09T23:40:48.069Z"
}
```

### Executar em Batch

```bash
curl -X POST "https://api.apify.com/v2/acts/brasildados~google-news-scraper-brasil-api/run-sync-get-dataset-items" \
  -H "Authorization: Bearer SEU_TOKEN_APIFY" \
  -H "Content-Type: application/json" \
  -d '{"termos":["inteligência artificial Brasil","energia solar"],"period":"7d","maxResultsPerQuery":20}'
```

Cada notícia é gravada como uma linha no Dataset padrão, pronta para exportação.

### Preço

A cobrança é por notícia entregue no Dataset. Notícias duplicadas, registros inválidos e buscas sem resultados não são cobrados. O custo estimado é a quantidade de termos multiplicada por `maxResultsPerQuery`, limitada pelos resultados realmente encontrados e pelo limite de gasto configurado na execução. Veja o preço vigente na aba **Pricing**.

### Limitações

- A cobertura e a ordem por relevância dependem das notícias disponíveis no momento da consulta.
- Nem todas as fontes informam autores, imagens ou uma data ISO; nesses casos, os campos opcionais retornam `null` ou lista vazia.
- O Actor não abre nem extrai o conteúdo integral das páginas encontradas.
- O filtro de período usa a data reconhecida pela pesquisa e não garante um arquivo histórico completo.
- Links recebem tratamento para remover parâmetros comuns de rastreamento, e a mesma notícia encontrada por mais de um termo é entregue uma única vez por execução.

### Actors relacionados da BrasilDados

- [Editais e licitações abertas no Brasil](https://apify.com/brasildados/editais-licitacoes-brasil?fpr=t5lwzq) para monitorar oportunidades públicas.
- [Monitor do Diário Oficial da União](https://apify.com/brasildados/dou-monitor?fpr=t5lwzq) para acompanhar publicações federais por palavra-chave.
- [Reputação de empresas por CNPJ](https://apify.com/brasildados/api-reputacao-empresas-cnpj?fpr=t5lwzq) para complementar o monitoramento de marca.
- [Todos os Actors da BrasilDados](https://apify.com/brasildados?fpr=t5lwzq) para outras consultas empresariais no Brasil.

### Suporte

Se encontrar um resultado incompatível com este README, envie o input utilizado, o ID da execução e uma descrição do comportamento pela aba **Issues** do Actor. Não inclua tokens ou outras credenciais.

# Actor input Schema

## `termos` (type: `array`):

Marcas, empresas, pessoas ou temas que deseja monitorar. Aceita operadores de busca como aspas e site:.

## `period` (type: `string`):

Filtra as notícias pela data de publicação.

## `maxResultsPerQuery` (type: `integer`):

Limite de notícias entregues e cobradas para cada termo.

## `fonteNoticia` (type: `array`):

Mantém só notícias cujo veículo ou domínio contenha um dos textos informados. Ex.: "exame", "globo". Filtro aplicado localmente após a busca; não reduz o custo da consulta, só o que é entregue e cobrado.

## Actor input object example

```json
{
  "termos": [
    "inteligência artificial Brasil",
    "energia solar"
  ],
  "period": "7d",
  "maxResultsPerQuery": 20,
  "fonteNoticia": [
    "exame",
    "globo"
  ]
}
```

# Actor output Schema

## `results` (type: `string`):

Dataset com uma linha por notícia encontrada, ordenada por termo e por data de publicação.

# API

You can run this Actor programmatically using our API. Below are code examples in JavaScript, Python, and CLI, as well as the OpenAPI specification and MCP server setup.

## JavaScript example

```javascript
import { ApifyClient } from 'apify-client';

// Initialize the ApifyClient with your Apify API token
// Replace the '<YOUR_API_TOKEN>' with your token
const client = new ApifyClient({
    token: '<YOUR_API_TOKEN>',
});

// Prepare Actor input
const input = {
    "termos": [
        "inteligência artificial Brasil",
        "energia solar"
    ],
    "period": "7d",
    "maxResultsPerQuery": 20,
    "fonteNoticia": [
        "exame",
        "globo"
    ]
};

// Run the Actor and wait for it to finish
const run = await client.actor("brasildados/google-news-scraper-brasil-api").call(input);

// Fetch and print Actor results from the run's dataset (if any)
console.log('Results from dataset');
console.log(`💾 Check your data here: https://console.apify.com/storage/datasets/${run.defaultDatasetId}`);
const { items } = await client.dataset(run.defaultDatasetId).listItems();
items.forEach((item) => {
    console.dir(item);
});

// 📚 Want to learn more 📖? Go to → https://docs.apify.com/api/client/js/docs

```

## Python example

```python
from apify_client import ApifyClient

# Initialize the ApifyClient with your Apify API token
# Replace '<YOUR_API_TOKEN>' with your token.
client = ApifyClient("<YOUR_API_TOKEN>")

# Prepare the Actor input
run_input = {
    "termos": [
        "inteligência artificial Brasil",
        "energia solar",
    ],
    "period": "7d",
    "maxResultsPerQuery": 20,
    "fonteNoticia": [
        "exame",
        "globo",
    ],
}

# Run the Actor and wait for it to finish
run = client.actor("brasildados/google-news-scraper-brasil-api").call(run_input=run_input)

# Fetch and print Actor results from the run's dataset (if there are any)
print(f"💾 Check your data here: https://console.apify.com/storage/datasets/{run.default_dataset_id}")
for item in client.dataset(run.default_dataset_id).iterate_items():
    print(item)

# 📚 Want to learn more 📖? Go to → https://docs.apify.com/api/client/python/docs/quick-start

```

## CLI example

```bash
echo '{
  "termos": [
    "inteligência artificial Brasil",
    "energia solar"
  ],
  "period": "7d",
  "maxResultsPerQuery": 20,
  "fonteNoticia": [
    "exame",
    "globo"
  ]
}' |
apify call brasildados/google-news-scraper-brasil-api --silent --output-dataset

```

## MCP server setup

```json
{
    "mcpServers": {
        "apify": {
            "type": "http",
            "url": "https://mcp.apify.com/?tools=fetch-actor-details,brasildados/google-news-scraper-brasil-api"
        }
    }
}

```

The hosted server signs you in with OAuth on first connect, so no API token belongs in this config. Clients without OAuth support can send an `Authorization: Bearer <APIFY_API_TOKEN>` header instead, using a token from API & Integrations in Apify Console (https://console.apify.com/settings/integrations).

## OpenAPI specification

Download the OpenAPI definition: https://api.apify.com/v2/actors/r8qe9YfMPlnA9hYlf/builds/FZycd5sin50tuUcOm/openapi.json
