Teste ARC-AGI: quebra-cabeças de raciocínio por padrões
Quebra-cabeças de lógica visual · Grátis · Sem cadastro

Teste de raciocínio abstrato

Olhe grades coloridas minúsculas, descubra a regra de transformação escondida e complete a saída que falta. Sem trivia, sem fórmulas, só raciocínio visual.

⚠️ Atenção: estes quebra-cabeças vêm do ARC-AGI-1 original (2019). Modelos atuais como GPT-5.4 e Claude Opus 4.6 (março de 2026) resolvem tudo isso com facilidade. O desafio aqui é para você, não um teste atual de IA.
5
Desafios
60%
Média humana
~0%
IA antiga
Grátis
Sempre

Teste também: você consegue vencer o ChatGPT?

10 perguntas em que a IA tropela: pegadinhas de lógica, contagem e 1 desafio ARC. O GPT-4o acerta 1/10.

Créditos: os desafios desta página foram criados no estilo do formato do benchmark ARC-AGI. O ARC-AGI foi criado por François Chollet (© 2019). ARC-AGI-2 © ARC Prize Foundation. Ambos publicados sob a Licença Apache, Versão 2.0. Conjuntos de dados de origem: github.com/fchollet/ARC-AGI · github.com/arcprize/ARC-AGI-2 · arcprize.org. Os desafios desta página são criações originais no formato ARC-AGI; não são reproduções diretas do conjunto de dados.

O que é o ARC-AGI?

O ARC-AGI (Abstraction and Reasoning Corpus for Artificial General Intelligence) foi criado por François Chollet, autor do Keras e pesquisador de IA no Google, como um teste rigoroso de inteligência geral. Enquanto outros benchmarks premiam quem decorou os dados de treino, o ARC-AGI cobra uma habilidade que qualquer pessoa usa sem esforço: aprender uma regra nova com poucos exemplos e aplicá-la a um caso inédito.

Cada quebra-cabeça é uma transformação de grades coloridas. Você vê de 2 a 3 pares de entrada e saída, deduz a regra e completa um caso novo. As grades são pequenas, as cores são simples e nenhum conhecimento específico é exigido. Mesmo assim, essas tarefas continuam extraordinariamente difíceis para a IA.

Por que a IA falha no ARC-AGI?

Quando o ARC-AGI-2 saiu, em março de 2025, o resultado foi duro: GPT-4o marcou 0%, Claude 3.7 Sonnet marcou 0% e Gemini 2.0 Flash marcou 1,3%, contra uma média humana de 60%. Cada tarefa já tinha sido resolvida por pelo menos duas pessoas em menos de duas tentativas. Essa distância revela uma diferença de fundo entre o reconhecimento de padrões da IA e o raciocínio humano:

O que é o ARC Prize?

A ARC Prize Foundation organiza uma competição anual que oferece milhões de dólares para sistemas de IA capazes de igualar o desempenho humano nas tarefas do ARC-AGI sem custos astronômicos de processamento. A disputa empurrou muita pesquisa séria sobre raciocínio de máquina, e os resultados melhoram a cada ano. O benchmark ARC-AGI-1 já é considerado praticamente resolvido pelos melhores sistemas; o ARC-AGI-2 é a fronteira atual.

Todos os dados do benchmark ARC-AGI são abertos, sob a Licença Apache 2.0, e ficam livres para pesquisa, educação e ferramentas como esta.

🤖
Teste também: você consegue vencer o ChatGPT?
10 falhas de IA documentadas: pegadinhas de contagem, charadas de lógica e mais. O GPT-4o acerta 1/10.

Gosta de entender como a mente funciona?

O NerdSip tem cursos de IA, ciência cognitiva, lógica e centenas de outros temas, em microaulas gamificadas de 5 minutos.

Baixar o NerdSip de graça