MindGPT
Mesmo prompt, vários modelos no MindGPT
Por Emerson Amorim, fundador do KingFy · Atualizado 2026-08-16
Uma pergunta. A mesma informação. Quatro famílias no mesmo chat. Ninguém leva um troféu: cada resposta foi mais útil num critério diferente.
O experimento (repetível no seu login)
Pedido fixo, copiado palavra por palavra: “Explica o que é PIX para um adolescente e para um avô. Português claro. No máximo 120 palavras. Não invente taxa, banco nem promoção.”
Critérios, sempre os mesmos: clareza (dá para ler em voz alta?), estrutura (dois públicos ou um bloco só?), tamanho (respeitou 120 palavras?), aderência (falou só de PIX?), erros (inventou instituição ou tarifa?).
O texto abaixo reconstitui um teste no MindGPT — o tipo de diferença que aparece quando só o nome no seletor muda. Modelos mudam. Rode de novo no seu chat. Isto não é um benchmark de laboratório nem um ranking da internet.
O que cada família fez com o mesmo pedido
GPT: um bloco só, fluido, quase uma conversa. Clareza alta. Estrutura fraca para “adolescente e avô” — misturou os dois. Tamanho dentro do limite. Aderência boa. Risco: frase simpática demais que parece dica de banco.
Claude: dois parágrafos explícitos (“para o neto” / “para o avô”). Clareza alta. Estrutura a mais fiel ao pedido. Tamanho controlado. Aderência alta. Risco: tão cuidadoso que omite um detalhe prático (PIX é instantâneo) se você não pediu.
Gemini: começou por definição curta e depois os dois públicos. Clareza boa. Estrutura ok. Tamanho às vezes estoura se você não repetir o limite. Aderência boa. Risco: puxar “como cadastrar no app do banco” — útil, mas o pedido não pediu tutorial.
Llama (resposta rápida): lista em tópicos. Clareza média-alta para quem gosta de lista. Estrutura rígida. Tamanho curto. Aderência boa. Risco: seco demais para o avô; o adolescente entende, o avô pede “explica de novo”.
Quando cada resposta foi mais útil — sem campeão
Mandar no grupo da família: Claude (dois tons). Recado rápido no WhatsApp da loja: Llama. Aula de 2 minutos: GPT. Página de ajuda com “o que é” no topo: Gemini.
Nenhum venceu em erro zero. Qualquer um pode inventar uma taxa se o pedido for vago. O valor do experimento é ver o desacordo no mesmo fio — o guia “por que comparar” explica o motivo; este mostra o caso.
Como repetir em casa, na escola ou na loja
Escolha um pedido da sua vida (boletim, aviso de horário, receita). Cole uma vez. Troque só o nome no seletor. Não reescreva o pedido. Marque os cinco critérios num papel. Fique com uma voz e edite você.
Kimi e Qwen entram como quinto e sexto ângulo se as quatro famílias empataram. Não rode dez nomes por esporte: gasta crédito e não melhora o texto.
Mesmo prompt — critérios lado a lado
Julgamento editorial de um teste no MindGPT. Não é nota oficial das empresas. Não há vencedor absoluto.
| Critério | GPT | Claude | Gemini | Llama |
|---|---|---|---|---|
| Clareza | Alta, tom de papo | Alta, tom paciente | Alta, tom de definição | Boa em tópicos |
| Estrutura | Um bloco | Dois públicos separados | Definição + dois públicos | Lista |
| Tamanho | Dentro do limite | Dentro do limite | Pode estourar | Curto |
| Aderência ao pedido | Boa | A mais literal | Boa; às vezes vira tutorial | Boa e seca |
| Quando foi mais útil | Explicar falando | Mandar para duas idades | Abrir com “o que é” | Recado curto |
Prompt: o que é PIX, dois públicos, 120 palavras, sem inventar taxa. Rode no MindGPT: o seletor muda, o pedido não.
Fontes
Perguntas frequentes
Qual modelo ganhou?
Nenhum. Claude estruturou melhor os dois públicos. Llama foi o recado mais curto. GPT falou melhor. Gemini definiu melhor. O “melhor” é o critério da vez.
Isso vale para código ou PDF?
O método vale. O prompt deste teste é PIX, de propósito: qualquer idade entende. Código e documento têm o guia de tarefa.
Posso publicar a resposta da IA direto?
Não. Confira fato (PIX não tem a taxa que a IA inventar). Depois escolha o tom.