A inteligência artificial ultrapassou a era da previsão bruta de tokens. Em 21 de setembro de 2026, exploramos a transição definitiva para computação de inferência (System-2), enxames de agentes autônomos e pesos abertos de ponta.
O compilado curado dos maiores saltos técnicos, anúncios de laboratórios de fronteira e marcos regulatórios registrados até 21 de setembro de 2026.
Compare as métricas reais dos principais sistemas em raciocínio formal, engenharia de software, janela de contexto e eficiência de custo.
| Modelo | Laboratório | Paradigma | SWE-bench Verified | FrontierMath / AIME | Acesso |
|---|---|---|---|---|---|
| Google Gemini 3.8 Live | Google DeepMind | Multimodal + Ext. Thinking | 82.4% | 41.6% (FrontierMath) | API / Cloud |
| OpenAI GPT-6 Astra (o3) | OpenAI | Adaptive Inference Scaling | 81.9% | 96.8% (AIME) | API / Enterprise |
| Claude 5.1 Fable | Anthropic | Constitutional AI 3.0 | 79.1% | 94.2% (AIME) | API / Enterprise |
| DeepSeek V4 (MoE) | DeepSeek AI | Open Weights + RL Reasoning | 76.5% | 91.2% (AIME) | Open Weights (MIT/Permissive) |
| Moonshot Kimi K3 | Moonshot AI | Long-Horizon Synthesis | 74.8% | 89.4% (AIME) | API Platform |
| Meta Llama 4 (Reasoning) | Meta FAIR | Open Foundation + MoE | 75.2% | 90.1% (AIME) | Open Weights |
Nossa atuação concentra-se em resolver os gargalos fundamentais para que a IA do futuro seja confiável, verificável e acessível.
Desenvolvimento de suites de avaliação dinâmicas e verificadas formalmente (Lean 4, execução em micro-containers) para testar raciocínio genuíno fora de distribuição.
Investigação de leis de escalabilidade em tempo de inferência, Process Reward Models (PRMs) e cadeias de pensamento transparentes e auditáveis por humanos.
Criação de guardrails formais, isolamento de ferramentas, barreiras contra injeção de prompt indireta e protocolos de execução segura para enxames multi-agente.
Publicação contínua de relatórios técnicos, datasets de alinhamento com licença permissiva e ferramentas que capacitam pesquisadores e desenvolvedores em todo o mundo.
O nome Make AI Better não é apenas uma aspiração técnica — é um compromisso ético e científico. À medida que sistemas de inteligência ganham agência no mundo real, a responsabilidade de medir com rigor, abrir o conhecimento e estabelecer salvaguardas torna-se a missão mais importante da nossa geração.