stamatios
← Voltar ao feed
Vitrais coloridos em forma de cérebro e lente de câmera, alusão aos novos modelos MAI da Microsoft
IA & Modelos · Big Tech

Microsoft lança MAI-Thinking-1 e MAI-Image-2.6 no top 2 do Arena

resumo de ~3 min

MAI-Thinking-1

A Microsoft anunciou o MAI-Thinking-1, seu modelo de raciocínio de porte médio, já disponível em preview público no Microsoft Foundry. Trata-se de um modelo sparse Mixture of Experts com 35 bilhões de parâmetros ativos e cerca de 1 trilhão no total, projetado para oferecer raciocínio competitivo em matemática, conhecimento e codificação dentro de sua classe de peso, com custo de inferência menor que modelos muito maiores.

A empresa afirma que o MAI-Thinking-1 iguala o Claude Opus 4.6 no SWE-Bench Pro, alcança 97,0% no AIME 2025 e 94,5% no AIME 2026, e foi preferido ao Claude Sonnet 4.6 em avaliações humanas cegas lado a lado. Essas avaliações, feitas com a Surge, envolveram 1.276 tarefas em conversas de turno único e múltiplo, com foco em utilidade real e avanço dos objetivos do usuário.

Treinamento sem destilação e dados rastreáveis

A Microsoft destaca que o modelo foi treinado do zero, sem destilação de modelos de terceiros e sem dados opacos. O discurso central é que capacidades devem ser aprendidas, não herdadas, e que dados limpos, rastreáveis e de nível empresarial são essenciais para qualidade, procedência e controle.

O anúncio também apresenta o conceito de "Hill-Climbing Machine": um pipeline de desenvolvimento feito para melhorar continuamente cada componente do modelo - dados, recompensas, ambientes e computação. A proposta inclui autossuficiência em toda a stack, com aceleradores próprios da Microsoft e framework próprio de reinforcement learning.

Recursos para empresas

O MAI-Thinking-1 vem com janela de contexto de 256 mil tokens, suficiente para um documento de cerca de 600 páginas, suporte a function calling, instruções de desenvolvedor e compatibilidade com a API Chat Completions. A Microsoft afirma que o modelo segue múltiplas camadas de instruções e foi alinhado para necessidades empresariais, com segurança e compliance via Microsoft Foundry.

No aspecto de segurança, a empresa diz tratar tanto respostas inseguras quanto recusas desnecessárias como defeitos, usando o mesmo loop de reinforcement learning para treinar capacidade e segurança.

MAI-Image-2.6

O texto também menciona o lançamento do MAI-Image-2.6, que teria estreado em 2º lugar no Arena, à frente de Google, Meta e xAI. No entanto, diferente do MAI-Thinking-1, não há detalhes técnicos ou benchmarks desse modelo no conteúdo disponível.