Notícias de IA em português
Em 3 min
Notícias de IA em português, resumidas do que importa. Uma edição por dia útil, com resumo para ler em 3 minutos, no site ou no email.

LLaDA2.X: modelos de linguagem por difusão para texto e agentes
LLaDA2.X são modelos de linguagem por difusão abertos, voltados a geração de texto e workflows agênticos. O projeto expande arquiteturas alternativas aos transformers autorregressivos tradicionais.

Molt: framework PyTorch para aprendizado por reforço agêntico
Molt é um framework PyTorch-nativo que trata o agente como programa, suportando recompensas Python customizadas, ferramentas, ambientes multimodais e juízes LLM. A stack combina Ray, vLLM, NVIDIA AutoModel e FSDP2 para escalar treino até modelos MoE de trilhões de parâmetros.

Moonshot libera pesos do modelo Kimi K3, um MoE de 2,8T
A Moonshot liberou os pesos e o relatório técnico do Kimi K3, um modelo Mixture-of-Experts de 2,8 trilhões de parâmetros com compreensão visual nativa e contexto de 1 milhão de tokens. A arquitetura entrega 2,5x mais inteligência por unidade de compute e a empresa abriu também kernels de atenção, biblioteca MoE e infraestrutura para agentes.

Nvidia é a maior publicadora mundial de modelos abertos de IA
A Nvidia se consolidou como a maior publicadora de modelos abertos de IA do mundo, expandindo estratégia para a era de modelos abertos. O artigo detalha como a empresa construiu esse portfólio.

Octane: biblioteca UI React sem virtual DOM
Octane é uma biblioteca que substitui React, mantendo a mesma API mas removendo virtual DOM, waterfalls de Suspense, regras de hooks e arrays de dependência. O compilador gera código próximo à performance de DOM escrito à mão.

PorTAL: framework da Ramp Labs para LoRA cross-modelo
A Ramp Labs abriu o PorTAL, framework que aprende uma representação latente de tarefa base-agnostic e gera pesos LoRA por camada. Uma tarefa pode ser treinada uma vez e exportada como adapter PEFT Hugging Face padrão.

Scriptc: compilador que transforma TypeScript em executáveis nativos
Scriptc compila TypeScript padrão em executáveis nativos sem JavaScript engine, oferecendo modos estático e dinâmico. A ferramenta foca em inicialização rápida e eficiência de memória.

Seal: padrão aberto para provar autenticidade de arquivos
Seal é um padrão aberto que cria artefatos selados verificáveis por qualquer pessoa, provando integridade, tempo e certificado emissor. Os seals são ancorados em um ledger público verificável para sempre.

Nvidia defende open weights como estratégia de liderança americana em IA
Nvidia publicou posicionamento a favor de políticas públicas dos EUA que apoiem modelos open-weight. Argumenta que abertura acelera pesquisa e inovação, alinhando-se a esforços da indústria por transparência.

SANA-Video 2.0 da Nvidia gera vídeos longos em GPU única
SANA-Video 2.0 combina atenção linear com camadas softmax periódicas para gerar vídeos até 720p em uma única GPU. Modelos de 5B e 14B mantêm qualidade competitiva com latência muito menor para geração longa em alta resolução.
Silicon Valley dividida sobre barrar IA open source chinesa
Anthropic e OpenAI defendem modelos fechados por segurança, enquanto o resto da indústria apoia abertura. O rápido avanço da China em modelos open source intensifica o debate nos EUA sobre banimento amplo ou abordagem como questão de segurança nacional.

Análise defende open source em IA contra 'gatekeepers'
Críticos pedem acesso controlado a IA, mas software open source é fundamental e impossível de suprimir, com interesses comerciais diversos espalhados pelo globo.

Black Forest Labs lança FLUX 3 multimodal com áudio-vídeo
FLUX 3 gera imagens e clipes de áudio-vídeo de até 20 segundos a partir de um único prompt. Arquitetura abre caminho para uso em percepção e ação robótica.

DeepSeek publica benchmarks do treinamento em chips Huawei
Consórcio liderado pela Huawei publicou relatório técnico mostrando pós-treinamento da família DeepSeek V4 em chips Ascend, com utilização de FLOPs de 34,22%. Resultados atraíram céticos.

Ditto clona qualquer site em código Next.js ou Vite em minutos
Ferramenta open source determinística copia sites gerando código componentizado em Next.js ou Vite em até cinco minutos.

OneCLI injeta credenciais de API em agentes com segurança
Gateway open source injeta chaves em agentes de IA sem expô-las diretamente, com armazenamento criptografado, roteamento por padrão e suporte multi-agente.

DOE e Arcee AI anunciam Genesis-Science-1, modelo aberto para ciência
O Departamento de Energia dos EUA e a Arcee AI apresentarão o Genesis-Science-1 (GS1), modelo aberto voltado a workflows de computação científica com registros reproduzíveis. A Arcee lidera o desenvolvimento e a DOE contribui com dados e tarefas; contribuições abertas até 6 de agosto.

Laboratórios estariam otimizando modelos para o teste do pelicano de bicicleta?
Testes com diversos modelos não encontraram evidências claras de que laboratórios estejam otimizando especificamente para o benchmark informal do pelicano andando de bicicleta. A análise não descarta ajustes sutis.

Petals permite rodar LLMs grandes em casa via rede P2P de GPUs
Petals permite rodar modelos como Llama 3.1, Mixtral, Falcon e BLOOM em casa usando uma rede peer-to-peer que distribui partes do modelo em GPUs de consumo ou Google Colab. Suporta fine-tuning flexível e métodos de sampling customizados.

Estado da simulação para IA física: MuJoCo, Isaac Sim e Newton
Comparativo dos principais engines de simulação para IA física, como MuJoCo, Isaac Sim e Newton, cada um com foco em aplicações como reinforcement learning e geração sintética de dados. Ferramentas GPU-accelerated e open-source estão ampliando o acesso à robótica.

Geopolítica dos pesos abertos: China não é tão uniforme quanto parece
Apesar da fama da China em liberar modelos open-weight, nem todas as empresas chinesas seguem a mesma estratégia. O artigo discute nuances e implicações geopolíticas da abertura de pesos.

Gigatoken: tokenizador mil vezes mais rápido para pré-processamento de LLMs
O Gigatoken é um tokenizador compatível com CPUs comuns e praticamente todos os tokenizadores do mercado. Atinge velocidades de gigabytes por segundo, cerca de mil vezes mais rápido que os tokenizers do Hugging Face.

Google libera emojis 3D como arquivos .OBJ open-source
Para o Dia Mundial do Emoji, a Google anunciou o Noto Emoji 3D em arquivos .OBJ sob licença aberta. Qualquer pessoa pode usar os emojis em mundos de VR, apps e memes, após estreia em maio com recepção mista.

Mage: família leve de modelos multimodais da Microsoft para pesquisa
Lançada pela Microsoft, a família Mage reúne modelos multimodais compactos, voltados a experimentação controlada, pós-treinamento e aplicações verticais com orçamento realista de compute. Mantém competitividade com sistemas abertos maiores em seus nichos.

Poolside lança Laguna S 2.1, modelo MoE para coding agentic de longa duração
O Laguna S 2.1 tem 118B de parâmetros totais, 8B ativados por token, contexto de 1M e foco em tarefas agentic e raciocínio persistente. Foi liberado sob licença OpenMDW-1.1.

Qwen-Image 3.0: geração de imagens com texto longo e renderização de interfaces
O Qwen-Image 3.0 aceita até 4.5k tokens de entrada, renderiza 12 idiomas e simula interfaces como páginas web, jogos e lives. O modelo se posiciona como ferramenta pronta para uso real em aplicações de geração de imagem.

Análise: 'Kimi K3 ativa só 16 dos 896 especialistas por token'
Estratégia 'sparse by design' mantém o compute por token quase fixo enquanto infla capacidade total - inteligência comprada via mais especialistas, não mais FLOPs por token.

Datatype: fonte OpenType variável que vira texto em gráficos inline
Expressões de texto viram mini-gráficos sem JavaScript, sem imagens e sem biblioteca de renderização.

IA americana fechada e proprietária está perdendo para estratégia chinesa aberta
Controles de exportação e abordagem fechada prejudicam competitividade dos EUA; modelos abertos chineses permitem mais inovação e adaptabilidade.

Moonshine: servidor headless de game streaming para Moonlight no Linux
Permite streaming de jogos do PC para qualquer dispositivo via Moonlight clients.

Nativ: app open-source para rodar modelos de IA locais em Apple Silicon
Sem contas, assinaturas ou cloud; execução local de modelos no chip da Apple.

Wigolo: ferramenta web local-first para agentes de IA sem API keys
Permite busca, fetch, crawl e extract para agentes sem chaves de API; engine múltipla em ambiente privado.
Um email por dia útil, lido em ~3 min · grátis · sem spam