Skip to content
Alexandre Caramaschi edited this page Jul 8, 2026 · 3 revisions

Papers — GEO Multi-Vertical Citation Tracker

Pesquisa empírica longitudinal sobre como modelos de linguagem (ChatGPT, Claude, Gemini, Perplexity e Groq) citam empresas brasileiras em quatro setores da economia: Fintech, Varejo, Saúde e Tecnologia. O projeto produz um dataset público (MIT) rumo a um paper revisado por pares.

Snapshot desta Wiki: 08 de julho de 2026 · janela confirmatória v2 no dia 77 de 90. Os números abaixo são fotografias datadas; a fonte viva é data/dashboard_data.json, regenerada a cada coleta e exposta em alexandrecaramaschi.com/research.


Em uma frase

A cada dia, duas rodadas automatizadas enviam as mesmas queries pré-registradas a cinco LLMs e medem, sem intervenção manual, quais empresas brasileiras são citadas espontaneamente — registrando posição na resposta, atribuição, sentimento e latência. Ao final de 90 dias o dataset é congelado e submetido como paper.

Números do dia (08-jul-2026, dia 77/90)

Métrica Valor
Queries no banco 63.940
Citações detectadas 22.530 (35,2% · IC95 34,9–35,6)
Análises de contexto 25.143
Rodadas de coleta 240
Entidades monitoradas 127 (79 BR reais + 32 âncoras internacionais + 16 decoys)
Specificity (anti-alucinação) 100% na calibração de 01/06/2026 (0 menções orgânicas a decoys em 37.017 respostas)

Ranking ao vivo por LLM (taxa de citação)

LLM Modelo Taxa
Perplexity sonar 76,0%
Claude claude-haiku-4-5 42,0%
ChatGPT gpt-4o-mini 34,4%
Groq llama-3.3-70b 28,2%
Gemini gemini-2.5-pro 19,9%

Taxa por vertical

Fintech 42,0% · Varejo 39,2% · Tecnologia 30,3% · Saúde 29,3%

Marcas reais mais citadas (todo o dataset)

Nubank (3.609) · Mercado Livre (2.090) · Magazine Luiza (1.902) · Totvs (954) · EMS (857)


Navegue pela Wiki


Princípios

  1. Empírico antes de opinativo. Todo número vem do papers.db, versionado no repositório.
  2. Aberto desde o primeiro registro. Licença MIT, sem embargo, sem versão privada.
  3. Reprodutível bit-a-bit. Temperatura 0, seeds fixos, manifest SHA-256, imagem Docker pinada.
  4. Anti-alucinação por desenho. Decoys fictícios detectam falsos positivos automaticamente.

Autor: Alexandre Caramaschi — Founder & CEO da Brasil GEO, ex-CMO da Semantix (Nasdaq), cofundador da AI Brasil. ORCID 0009-0004-9150-485X.

Repositório: github.com/alexandrebrt14-sys/papers · Licença: MIT (arquivo LICENSE no repositório desde 08/07/2026; SECURITY.md define o canal privado para reporte de vulnerabilidades)

Clone this wiki locally