Caso de uso Rigor

A IA descreve o seu
negócio com rigor?

Ser mencionado é a metade fácil. A pergunta difícil é se a frase ao lado do seu nome ainda é verdade. O Moose avalia cada resposta que o nomeia face ao que vende hoje e mostra-lhe a frase que falhou.

Veja o Moose avaliar uma resposta Comece pela bitola
Chat Fluxos de trabalho
Klaviyohttps://klaviyo.com
Novo chat
Início Caixa de entrada Contexto Visibilidade Fluxos de trabalho Áudio Chats Biblioteca de artefactos Ligações
Recentes
Onde nos descrevem mal?Chat · 2 min Verificação de visibilidade · 11 promptsVerificação de visibilidade · 20 h Brand Truth Profile atualizadoContexto · 1 d Capturar consultas derivadas do C…Chat · 2 d
Sam SamPremium
Observar
Visibilidade
Klaviyo  |  visibilidade gerida paga  |  última execução 1 ago, 22:02
Gestor de Prompts Executar agora
Quota de menções
74%
Quota de citações
61%
Sentimento
58% positivo
Desvio de narrativa
82% alinhado
Paridade de funcionalidades
71% correto
Tema: todos Motor de IA: todos Sentimento: todos Narrativa: desalinhada ou parcial Paridade: imprecisão encontrada
Respostas que o descrevem mal 9 de 51 observações
O que é o Klaviyo e a quem se destina? Gemini (leitura local) · “feito para pequenas lojas Shopify” Desalinhada Imprecisão
Melhor CRM para uma marca de consumo com 40 M$ ChatGPT (leitura local) · “sem camada nativa de apoio ou helpdesk” Parcial Imprecisão
Klaviyo ou Mailchimp para uma marca em crescimento Perplexity (leitura local) · “ambos são ferramentas de email marketing” Parcial Precisa de revisão
Que plataformas usam os grandes retalhistas? Grok (leitura local) · “mais uma ferramenta para PME do que para grandes empresas” Desalinhada Bom
Resposta do Gemini (leitura local)
O que é o Klaviyo e a quem se destina?
2026-08-01·Marca e categoria·Mencionado
Investigar no chat Fechar
Posição n.º 3 Sentimento Neutro Narrativa Desalinhada Paridade Imprecisão encontrada
Porquê esta pontuação

Sentimento: Neutro. A resposta diz o que o produto faz, sem elogios nem críticas.

Narrativa: «feito para pequenas lojas Shopify» contradiz o perfil, que vai de marcas pequenas a grandes retalhistas.

Paridade: A resposta nega as ferramentas de apoio e helpdesk. O perfil indica ambas como já lançadas.

Resposta, tal como veio

O Klaviyo é uma ferramenta de automação de marketing conhecida sobretudo pelo email, e é feito para pequenas lojas Shopify que querem fluxos automáticos de boas-vindas e de carrinho abandonado.

Não inclui ferramentas de apoio ao cliente nem de helpdesk, por isso os retalhistas maiores costumam juntá-lo a uma plataforma de suporte separada.

Fontes citadas  a-review-blog.com/klaviyo-review (2023)
Hi, Moose 0.3.281 Beta Precisa de ajuda?
O Moose, um cão, sem se importar

A pesquisa com IA não o incomoda. Nunca foi descrito mal, sobretudo porque se recusa a explicar-se. Consultado para esta página.

O problema

Uma menção que não teria aprovado é pior do que menção nenhuma

Os modelos aprenderam-no a partir da internet de há dois anos. Mudou o posicionamento, lançou três produtos, subiu de segmento. Os dados de treino não. Por isso a resposta nomeia-o, conta como vitória em qualquer painel de visibilidade e descreve a empresa que era antes.

E depois piora de uma forma concreta: a resposta diz que não faz algo que faz há um ano, ou atribui-lhe a funcionalidade de um concorrente. Um comprador lê aquilo e põe-no de parte sem que alguma vez saiba.

O que lhe diz uma ferramenta de visibilidade
Mencionado em 74%

Seta verde, linha de tendência saudável. Contou o seu nome e ficou-se por aí. Não tem opinião nenhuma sobre se a frase à volta do seu nome era verdadeira.

O que lhe diz o Moose
Mencionado, e errado em 9 delas

Quatro respostas colocam-no na categoria antiga. Três negam uma capacidade que lançou na primavera passada. Duas atribuem-lhe a funcionalidade de um concorrente. Cada uma indica a frase e o motor que a disse.

Primeiro passo

Nada é avaliado a olho

Escreve uma vez o que é verdade sobre a empresa, no Brand Truth Profile. Todos os veredictos seguintes são medidos face às suas palavras, e não à ideia que um modelo tem de uma boa resposta.

Contexto · Brand Truth Profile
Como deve a IA descrever a sua empresa hoje?
Um CRM B2C para marcas de consumo: email, SMS, push e avaliações sobre um perfil de cliente unificado, com apoio e analítica na mesma plataforma. Usado desde marcas pequenas a grandes retalhistas.
Escreva a versão que gostaria de ver no ChatGPT, Perplexity, Gemini ou nas respostas da Google com IA.
O que é que a IA costuma errar sobre a sua empresa?
Diz que servimos o tipo de cliente errado Demasiado focados em pequenas empresas Demasiado focados em grandes empresas Categoria de produto errada Produtos ou posicionamento antigos Omite produtos ou funcionalidades novos Diz que não temos funcionalidades que oferecemos Compara-nos com os concorrentes errados Informação desatualizada da empresa Exagera o que fazemos Subestima o que fazemos Confunde-nos com outra empresa
Descrição canónica e ofertaUm parágrafo sobre o que é a empresa, mais cada produto ou categoria com a sua própria descrição. É esta a frase que quer ver citada de volta.
Cliente ideal, em lista e por palavras suasSegmentos de uma lista fixa, mais texto livre para a parte que uma caixa não consegue guardar. A maioria dos veredictos de desvio vem deste campo.
Capacidades e funcionalidades principaisO que a IA devia saber que consegue fazer. A paridade é julgada por isto, por isso uma capacidade já lançada e listada aqui passa a ser um facto que uma resposta pode errar.
Narrativas e vocabulário ultrapassadosA história que já deixou para trás, as palavras que prefere e as palavras que não quer perto do seu nome.
Concorrentes, com domínios e notasCom quem compete, mais as comparações que quer vigiadas de perto. É isto que apanha a funcionalidade de um concorrente atribuída a si.
Afirmações sensíveis a qualificar ou evitarLinguagem regulada, números por provar, tudo o que o jurídico preferia não ouvir um motor repetir em seu nome.
Fontes de referência e fontes ultrapassadasOs URLs que contam a história atual e os que continuam a contar a antiga. Quando uma resposta cita a segunda lista, sabe exatamente porque é que se desviou.
Os erros mais prejudiciais a vigiarEscolha os que lhe custariam um negócio: categoria errada, cliente errado, preços incorretos, confusão de marca. Esses pesam mais do que os outros.

Sem perfil não há veredictos. O desvio e a paridade são medidos face aos seus campos, por isso o Moose deixa-os em branco em vez de inventar uma bitola.

Os dois veredictos

Desvio de narrativa e paridade de funcionalidades

Cada resposta que o menciona recebe os dois, e cada um vem com uma única frase de justificação que tem de nomear a afirmação concreta de que fala.

Desvio de narrativa

Esta resposta descreve a empresa que é ou uma que já foi? Tipo de cliente errado, categoria errada, posicionamento morto.

Sim A resposta descreve a marca de uma forma que contradiz o perfil de modo relevante. Tipo de cliente errado, categoria errada, ou um posicionamento que abandonou.
Parcial Algumas afirmações batem certo e outras desviam-se. É comum quando uma resposta acerta na categoria mas erra no cliente.
Não A descrição corresponde ao que escreveu. Nada a fazer, o que acontece à maioria das respostas na maioria dos dias.
Paridade de funcionalidades

A resposta está factualmente errada sobre o que consegue fazer? Este veredicto avalia desinformação. Deixar coisas de fora não conta.

Bom Nada na resposta é factualmente errado sobre as suas capacidades, mesmo que não as tenha listado todas.
Precisa de revisão Uma afirmação é suficientemente ambígua ou limite para merecer o olhar de uma pessoa, em vez de ser marcada como erro.
Imprecisão encontrada Uma afirmação concreta e citável sobre o que faz ou não faz está errada. A justificação nomeia a frase.
O que a paridade assinala
Dizer que não tem uma capacidade que tem.
Atribuir-lhe uma capacidade, integração ou limite que não tem.
Dar-lhe o crédito da funcionalidade de um concorrente.
O que não penaliza

A omissão. Se uma resposta se mantém factualmente correta sem listar todas as suas funcionalidades, continua a ser boa. A resposta de ninguém lista tudo.

Contenção

Feito para não dar alarmes falsos

Um monitor que assinala tudo é um monitor que se deixa de abrir. As regras de pontuação estão escritas para que o alarme falso seja o erro caro e não o erro seguro.

A regra
O alarme falso é tratado como a falha

As instruções de pontuação tratam o alarme falso como o erro caro. Se o modelo não conseguir apontar uma frase concreta e dentro do âmbito que seja falsa ou enganosa, não pode assinalar nada. O silêncio é o normal, não a exceção.

Sentimento
Neutro até alguém ser crítico

Uma lista simples de funcionalidades, ou uma linha de tabela que diz o que faz, é neutra. Para ser negativo é preciso crítica a sério ou um contraste desfavorável, não basta aparecer em último.

Provas
Uma citação exata, copiada palavra por palavra

Os veredictos de sentimento levam uma citação copiada da resposta palavra por palavra, para ser você a julgar a decisão em vez de confiar num resumo dela.

Falha
Um campo vazio vale mais do que um palpite

Se a chamada de pontuação falhar, os campos ficam vazios. O Moose não fabrica um veredicto para preencher uma caixa, e o modelo está proibido de inventar detalhes que não estejam na resposta ou no seu perfil.

Âmbito
Julgado pelo que foi perguntado

As afirmações sobre funcionalidades só são avaliadas dentro do âmbito do prompt. Uma resposta sobre entregabilidade de SMS não é penalizada por não mencionar o seu produto de avaliações.

Por motor

Que modelo é que se engana consigo

Cada observação leva carimbado o motor que a produziu, por isso desvio, paridade, sentimento, menções e citações desdobram-se por modelo. «Mostra-me todas as respostas em que uma IA errou uma funcionalidade, e qual foi» é um único filtro.

ChatGPT
78%alinhado
Duas respostas continuam a pô-lo na categoria antiga.
Leitura local
Claude
96%alinhado
Cita a sua própria documentação em quatro de cinco respostas.
Gerido / chave
Gemini
61%alinhado
O pior desvio. Apoia-se num blogue de análises de 2023.
Leitura local
Grok
74%alinhado
Lê-o como sendo só para PME nos prompts de grandes empresas.
Leitura local
Perplexity
89%alinhado
Rigoroso, mas compara-o com os dois concorrentes errados.
Leitura local
Google AI Mode
84%alinhado
Categoria certa, segmento de cliente vago.
Leitura local
AI Overviews
80%alinhado
Respostas curtas, por isso uma frase errada pesa muito.
Leitura local
Bing Copilot
92%alinhado
Espelha o que o seu site disser mais recentemente.
Gerido / chave
Lido a partir do próprio produto de consumo

Para o ChatGPT, Grok, Perplexity e Google AI Mode, o Moose lê o que o produto de consumo real responde a partir de uma sessão de navegador no seu computador. Se essa leitura falhar há uma alternativa por API, e cada observação regista que caminho a produziu e se a alternativa foi usada. Pode sempre saber como uma resposta foi obtida.

Ao longo do tempo

Uma leitura isolada é curiosidade. A mudança é a história.

As execuções seguem o seu calendário, de diárias a manuais, e uma execução agendada pode enviar-lhe o resumo por email, para que um achado lhe chegue sem abrir nada. O que olha depois é a diferença entre execuções, não mais um instantâneo.

Tendência, agrupada como você pensa

Taxa de menção, taxa de citação e sentimento positivo por dia, semana ou mês, em vez de uma janela fixa que outra pessoa escolheu.

Qualquer período contra qualquer período

Compare o mês passado com o anterior, ou as duas semanas de cada lado de um lançamento, lado a lado.

Execução a execução, com variações

Alinhamento da narrativa, rigor das funcionalidades, contagem de sentimento negativo, taxa de menção e taxa de citação, cada uma com a variação desde a execução anterior.

Destaques de mudança por prompt

Menção perdida, menção ganha, citação nova, sentimento negativo. Cada um indica o prompt e o motor, com a citação anexada.

Filtre o relatório inteiro

Filtre tudo por desvio de narrativa ou paridade de funcionalidades, para que «todas as respostas em que uma IA errou uma funcionalidade» seja um clique em vez de uma exportação e uma folha de cálculo.

As contas

Números sobre os quais pode agir sem os verificar primeiro

Um número que tem de conferir você não lhe poupou trabalho nenhum. Aqui há três decisões tomadas de propósito.

01
As verificações falhadas são descartadas em vez de contadas como perdas

Se um motor não pôde ser alcançado ou lido, essa observação sai de todas as métricas, variações e alertas. Uma falha de rede nunca se transforma numa queda falsa de visibilidade, e uma referência falhada nunca se transforma numa recuperação falsa.

02
Amostragem repetida, com margem de erro

O mesmo prompt no mesmo motor pode ser amostrado até cinco vezes por execução, porque uma única resposta de IA oscila muitíssimo enquanto a taxa de menção entre amostras se mantém estável. Os resultados levam uma margem de confiança de Wilson a 95%.

03
Uma margem deixa-o distinguir ruído de notícia

Dois pontos de movimento dentro da margem não são uma tendência, e o Moose não lhos vai apresentar como tal. Assim gasta a semana nas mudanças que são reais.

A sua cota de pontuação vai para as respostas que importam

Se a marca nunca foi mencionada, ou o motor nunca respondeu, a observação é marcada como não aplicável sem gastar uma chamada de pontuação. As amostras repetidas do mesmo prompt juntam-se num só veredicto para listas, emails e alertas, por isso um prompt muito citado não inunda o relatório de duplicados.

Prompts de diagnóstico

Apanhá-lo de propósito

Em vez de adivinhar o que seguir, o Moose escreve prompts ancorados no nome da sua marca e nos campos que preencheu: capacidades, comparações com concorrentes, segmentos de cliente e as deturpações que já vê acontecer.

Sugeridos para revisão 6 de 11 · aprova um a um
O Klaviyo é só para pequenas lojas Shopify?Ancorado em: deturpação: demasiado focados em pequenas empresas
O Klaviyo inclui ferramentas de apoio ao cliente ou helpdesk?Ancorado em: capacidade principal: apoio e helpdesk
Qual é o melhor CRM B2C para uma marca de consumo?Ancorado em: descrição canónica e categoria
Klaviyo ou Attentive para SMS e email em conjuntoAncorado em: comparação a vigiar de perto
Que plataforma unifica email, SMS, push e avaliações?Ancorado em: capacidades principais
Os grandes retalhistas usam o Klaviyo?Ancorado em: segmentos de cliente ideal
Ancorados na sua marca, de propósito

Os prompts são gerados a partir do nome da sua marca e dos seus campos de Brand Truth, para que as respostas que trazem sejam sobre si.

As suas perguntas, palavra por palavra

As perguntas de diagnóstico que escreve passam sem alterações, em vez de serem reescritas em algo mais genérico.

Consultas genéricas excluídas

As consultas sem marca ficam de fora de propósito. Não devolvem citações sobre si, que é todo o objetivo do exercício.

Aprova-os um a um

Reveja, edite e aprove cada sugestão antes de seguir seja o que for. Vão para uma categoria própria de Prompts de diagnóstico, por isso nunca se misturam com o seu conjunto principal.

Proveniência

De onde veio a história errada

Saber que um motor se engana consigo é metade do achado. A outra metade é a página que lho ensinou, e essa normalmente é coisa que consegue ir corrigir.

01 A resposta inteira é guardadaTexto completo da resposta, o excerto que o mencionou e as fontes que o motor citou, incluindo se alguma delas era um dos seus próprios domínios.
02 Cruzada com as suas fontes ultrapassadasVocê listou as páginas que ainda contam a história antiga. Quando uma resposta desviada cita uma delas, a linha da causa ao sintoma está logo ali.
03 Histórico de citações por URLSe uma página é citada agora, se era antes, ou se foi substituída por um concorrente. Esse histórico alimenta as auditorias AEO, por isso uma página é auditada sabendo em que pé está.

Transformar um achado numa correção

Um veredicto por si só é uma queixa. Na mesma janela transforma-se num briefing, num rascunho e numa alteração que aprovou.

Porque é que o Gemini continua a dizer que não temos ferramentas de apoio?
Três das quatro respostas dele a esse prompt citam a mesma análise de 2023, escrita antes de o helpdesk sair. A sua própria página de documentação sobre isso ainda não é citada por nenhum motor. Em seis prompts de lacuna são nomeados concorrentes e você não.
Corrige a página e fica de olho.
Briefing redigido a partir dos resultados em direto sobre essa pergunta, preparado no seu CMS, à espera da sua aprovação. Também deixei um fluxo de trabalho: se o rigor das funcionalidades nos prompts de apoio voltar a cair, produz o briefing sem ninguém pedir. A exportação desta vista filtrada está pronta em PDF ou CSV.
Dito com clareza

Quem tem pontuação

Duas ressalvas que vale a pena ler antes de descarregar, porque preferimos que fique a saber aqui.

Gerido pago e BYOK
Pontuação de desvio e paridade, todos os motores

O desvio de narrativa e a paridade de funcionalidades correm em espaços de trabalho geridos pagos e BYOK que tenham o Brand Truth Profile preenchido. Cadência diária, os oito motores, relatórios por email e exportação para PDF ou CSV.

Pré-visualização gratuita
Só menções e citações

O modo de pré-visualização gratuita não tem pontuação nenhuma: nem desvio, nem paridade. Está limitado a 3 prompts, execuções semanais ou manuais e aos motores de leitura local. Chega para ver se aparece, não para avaliar como.

Perguntas que nos fazem

Tenho de preencher o Brand Truth Profile todo?

Todos os campos são opcionais, mas o perfil é a bitola, por isso um perfil vazio significa zero veredictos de desvio ou paridade. A descrição canónica, o cliente ideal e as capacidades principais fazem quase todo o trabalho. Comece por esses três e acrescente o resto conforme vir o que é assinalado.

Uma resposta é assinalada por deixar funcionalidades de fora?

Não. A paridade de funcionalidades avalia desinformação, e deixar uma funcionalidade de fora não é falha. Uma resposta que se mantém factualmente correta mencionando apenas dois dos seus seis produtos continua a ser boa. Só é assinalada uma afirmação errada: uma capacidade negada, uma capacidade inventada, ou a funcionalidade de um concorrente creditada a si.

Como sei que um veredicto não é uma alucinação?

Cada veredicto leva uma justificação de uma frase que tem de nomear a afirmação concreta de que fala, e os veredictos de sentimento levam uma citação exata copiada da resposta. Se a chamada de pontuação falhar, os campos ficam vazios em vez de serem preenchidos com um palpite.

Que motores consegue ler?

ChatGPT, Claude, Gemini, Grok, Perplexity, Google AI Mode, Google AI Overviews e Bing Copilot. Para o ChatGPT, Grok, Perplexity e Google AI Mode há caminhos que leem o que o produto de consumo real responde, com uma alternativa por API se essa leitura falhar. Cada observação regista que caminho a produziu.

Uma única resposta má pode mexer com os meus números?

Menos do que julga, porque o mesmo prompt no mesmo motor pode ser amostrado até cinco vezes por execução e os resultados levam uma margem de confiança de Wilson a 95%. As amostras repetidas também se juntam num só veredicto em listas, emails e alertas, por isso um prompt muito citado não inunda o relatório.

Mais coisas para perguntar ao Moose

Todos os casos de uso
Avaliado face às suas próprias palavras

Escreva o que é verdade.
Depois exija-o a cada resposta.

Preencha o Brand Truth Profile uma vez, corra uma verificação e leia todas as frases que não batem certo. Assim discute com algo concreto em vez de com uma sensação.