Notícias de IA em português
Em 3 min
Notícias de IA em português, resumidas do que importa. Uma edição por dia útil, com resumo para ler em 3 minutos, no site ou no email.

Varejo lúdico exige planejamento intenso nos bastidores
Espaços de varejo interativos como o Coach Charm Playground na Selfridges exigem planejamento oculto enorme, incluindo navegação regulatória, testes com 150 amostras e instalações noturnas estilo pit stop de F1. Studio XAG destaca lições de proteger a ideia central e priorizar comportamento humano real.

Voqusa: transcrição gratuita de vídeo e áudio com IA
Voqusa é uma ferramenta gratuita que converte vídeos de TikTok, YouTube, Instagram, Facebook, Twitter/X, LinkedIn e Pinterest em texto usando IA. Suporta múltiplas plataformas sociais em uma única interface.

xAI lança Build Mode para criar apps e sites no chat do Grok
A Build Mode, disponível para assinantes SuperGrok Heavy, permite gerar, editar, visualizar e publicar websites, apps, jogos e dashboards diretamente no chat. Os projetos não exigem configuração e podem ser compartilhados via links grok.me ou domínios personalizados.

Zig implementa compilação incremental confiável e em milissegundos
A nova implementação de compilação incremental no compilador Zig detecta mudanças em funções individuais, permitindo rebuilds em poucos milissegundos. O processo envolve pipeline de análise semântica, geração de código e linking.

Agentes de navegador e computer-use assumem trabalho digital tedioso
Agentes de navegador e computer-use podem cuidar de QA exaustivo, testes de personas, triagem de inbox, compras e setup remoto de dispositivos. Eles funcionam melhor com espaço para planejar, modelos compatíveis e supervisão humana breve para verificação.

AI redistribui capacidades, mas enfraquece expertise
A IA redistribui capacidades dentro das organizações, mas ganhos de eficiência podem enfraquecer a expertise que sustenta trabalho de alta qualidade. O artigo discute como evitar perder julgamento ao automatizar.

Aliança Open Secure AI reúne Nvidia, Microsoft e outras gigantes
A Open Secure AI Alliance reúne líderes como Nvidia e Microsoft para fortalecer a segurança em IA usando tecnologias open source. A iniciativa busca oferecer ferramentas defensivas abertas e incentivar formuladores de políticas a tratar modelos abertos como ativos de segurança.

Amazon planeja lançar 5.105 satélites para concorrer com Starlink
A Amazon pretende lançar 5.105 satélites de baixa órbita para complementar a rede Globalstar, adquirida por US$ 11,6 bilhões. A constelação fornecerá voz e dados móveis para iPhones, usando o espectro de rádio da Globalstar nas bandas 1.6/2.4 GHz.

Anatomia da autonomia de agentes de IA
A autonomia de agentes depende da complexidade da tarefa, não só da qualidade do modelo. Tarefas se dividem em quatro níveis: assistente, humano no loop, delegação e self-driving, definidos por facilidade de verificação e consequências de erro.

Anthropic rejeita proibição ampla de modelos open-weight
A Anthropic afirmou que não defende banir modelos open-weight e argumentou que versões menos capazes são um bem público. A empresa apoia controles mais rígidos de chips, combate à destilação em escala industrial e testes de segurança obrigatórios para modelos poderosos.

Apple Watch Series 12 e Ultra 4 terão chip novo, sem redesign
A Apple prepara o Apple Watch Series 12 e Ultra 4 para o outono, sem grandes mudanças de design. As maiores melhorias serão o chip atualizado e recursos avançados de saúde, com detecção de glicose ainda distante.

Arquitetura do Kimi K3: da atenção ao delta e retrieval esparso
Os ganhos do Kimi K3 vão além de escala, combinando Kimi Delta Attention de estado constante, retrieval softmax periódico, experts esparsos e acesso residual seletivo. Cada passo arquitetural melhora como memória de capacidade fixa armazena, esquece e recupera informação.

Black Forest Labs lança FLUX 3 com geração de vídeo de 20s e áudio
A Black Forest Labs revelou o FLUX 3, seu primeiro modelo público de geração de vídeo, com clips de até 20 segundos, áudio nativo e continuidade multi-shot. O acesso inicial é por aprovação e preços ainda não foram divulgados; o FLUX-mimic estende a arquitetura para manipulação robótica.

Bugs em implementações de Raft com compute abundante
Compute barato e abundante tornou possível testar software de formas antes inviáveis, revelando bugs em implementações do algoritmo de consenso Raft. O texto mostra como infraestrutura moderna muda a verificação de sistemas distribuídos.

Bun rewrite em Rust: questionamentos sobre custo real
O texto questiona os custos e afirmações sobre a reescrita do Bun em Rust, especialmente a alegação de ter sido concluída por US$ 165 mil. A discussão expõe dúvidas sobre números apresentados publicamente.

China começa a produzir máquinas DUV de litografia
Uma empresa de Xangai iniciou a produção em massa de ferramentas de litografia DUV por imersão, mirando cerca de 5 máquinas neste ano e 20 no próximo. A produção ainda é inicial e as máquinas são menos avançadas que as EUV da ASML, que está proibida de exportar para a China.

Claude skill para diagnosticar queda de alcance no LinkedIn
O autor construiu um Claude Skill que transforma analytics do LinkedIn em dashboard e identifica por que o alcance caiu. A ferramenta analisa desempenho de posts, alcance além de seguidores e padrões de sucesso.

Cogent apresenta VR-1, modelo de raciocínio para ciberataques autônomos
A Cogent apresentou o VR-1, modelo capaz de investigar ambientes, testar hipóteses e executar cadeias de ataque de forma autônoma. No IntrusionBench em configuração black-box, o VR-1 alcançou mais que o dobro do melhor modelo frontier no pass@3, em estágio de preview.

Colossus: o primeiro computador digital programável de larga escala
Durante a Segunda Guerra, Tommy Flowers construiu o Colossus, primeiro computador digital eletrônico programável em larga escala, para quebrar a cifra Tunny. Dezenas de máquinas Colossus operaram até o fim da guerra, acelerando a inteligência sobre estratégias militares alemãs.

DeepSecBench: novo benchmark para vulnerabilidades cibernéticas
O DeepSecBench avalia a capacidade de diferentes modelos de encontrar vulnerabilidades de segurança em código, combinando recall, precisão, custo e tempo em um único score. O benchmark roda sobre um codebase open-source em estado anterior a correções, com construção secreta para evitar treino dos modelos.

Design não tem linha de chegada, continua no desenvolvimento
Design deve continuar durante o desenvolvimento porque as decisões mais difíceis surgem só depois de começar a construir. Manter designers no loop ajuda a pegar erros cedo e evitar entregar o produto errado rápido.

Duolingo: culpa e perda como motor de design system
O Duolingo usa aversão à perda, streaks, culpa e mascote emocional para reter usuários além de pontos e badges. Mecanismos como Streak Freeze antecipam falha, mostrando o poder do design comportamental e seu limite ético entre persuasão e coerção.

DX Core 4: framework unificado de produtividade de desenvolvedores
O DX Core 4 unifica metodologias como DORA, SPACE e DevEx em quatro dimensões: velocidade, eficácia, qualidade e impacto de negócio. Empresas que adotam o framework relatam ganhos em eficiência de engenharia e engajamento.

Estado da maturidade digital em times de marketing
Assessment da Contentful com 15 perguntas identifica gargalos em workflows, estrutura de conteúdo, governança e uso de IA. Times saem com um plano de ação prático para melhorar entrega de experiências digitais.

Google atualiza guia de crawl budget para indexação eficiente
O novo guia do Google explica como sites podem ajudar o Googlebot a acessar e indexar páginas importantes de forma eficiente. Sites novos começam com crawl limitado, que cresce conforme mantêm atualizações regulares.

Google lança Gemini Distillation Service para modelos menores
O Gemini Distillation Service permite treinar modelos student menores e mais eficientes usando outputs e raciocínio de um modelo teacher maior. O serviço suporta gemini-3.1-pro como teacher e gemini-2.5-flash como student, mirando apps de alto volume.

Google não pune conteúdo de IA, pune conteúdo ruim
Análise do Ahrefs mostra que o Google não penaliza conteúdo gerado por IA, mas recompensa qualidade. Páginas 100% com IA podem ranquear bem, mas a maioria dos tops ainda é majoritariamente humana, e alto uso de IA tende a correlacionar com rankings piores.

Honra da Honor: novo logo e tagline 'Dare to Be'
A Honor apresentou logo ousado e tagline Dare to Be, refletindo seu esforço para desafiar convenções e se tornar força mais distintiva em tech.

LLaDA2.X: modelos de linguagem por difusão para texto e agentes
LLaDA2.X são modelos de linguagem por difusão abertos, voltados a geração de texto e workflows agênticos. O projeto expande arquiteturas alternativas aos transformers autorregressivos tradicionais.

Looped transformers: menos parâmetros, mais passes sequenciais
Looped transformers reutilizam as mesmas camadas centrais em múltiplos passes, trocando parâmetros armazenados por compute sequencial adicional. A técnica oferece uma forma eficiente de aumentar capacidade sem inflar o modelo.

Marcas apostam em micro-creators com brindes em vez de dinheiro
Target, SoulCycle e American Eagle estão usando micro-creadores, pagando com gift cards, descontos e produtos em vez de cachê em dinheiro. A estratégia explora audiências nichadas e mais autênticas do que grandes influenciadores.

Marcas revivem heartthrobs dos anos 2000 em campanhas
Marcas estão trazendo de volta galãs dos anos 2000 para despertar nostalgia millennial e engajar audiências com poder de compra. A estratégia de nostalgia talent também ressoa com o interesse da Gen Z pela cultura dos 2000.

Marketing teams travados no modo single-player com Claude
A maioria dos ganhos de IA em marketing fica presa em usuários individuais em vez de se acumular no time. Um sistema compartilhado que mantém contexto atualizado e capacidades reutilizáveis transforma a melhora de um membro em ganho automático para todos.

Microsoft lança modelo MAI-Cyber-1-Flash para caçar vulnerabilidades
A Microsoft apresentou o MAI-Cyber-1-Flash, modelo especializado em encontrar vulnerabilidades difíceis em grandes codebases. Ele alimenta a plataforma MDASH, voltada a identificar e corrigir falhas de segurança em software.

Midjourney adquire app de astrologia Co-Star
A Midjourney comprou o Co-Star, app social de astrologia com cerca de 4,3 milhões de usuários ativos mensais. Os cerca de 24 funcionários do Co-Star se juntam à Midjourney, que amplia seu portfólio consumer além das ferramentas de imagem.

Minimalismo morreu: bem-vindos à afterparty do design
A era minimalista de design está acabando, dando lugar a profundidade, textura e personalidade. Estilos como neumorfismo, skeumorfismo referencial e brutalismo web constroem capricho sobre a estrutura herdada do minimalismo.

Molt: framework PyTorch para aprendizado por reforço agêntico
Molt é um framework PyTorch-nativo que trata o agente como programa, suportando recompensas Python customizadas, ferramentas, ambientes multimodais e juízes LLM. A stack combina Ray, vLLM, NVIDIA AutoModel e FSDP2 para escalar treino até modelos MoE de trilhões de parâmetros.

Moonshot libera pesos do modelo Kimi K3, um MoE de 2,8T
A Moonshot liberou os pesos e o relatório técnico do Kimi K3, um modelo Mixture-of-Experts de 2,8 trilhões de parâmetros com compreensão visual nativa e contexto de 1 milhão de tokens. A arquitetura entrega 2,5x mais inteligência por unidade de compute e a empresa abriu também kernels de atenção, biblioteca MoE e infraestrutura para agentes.

Nvidia é a maior publicadora mundial de modelos abertos de IA
A Nvidia se consolidou como a maior publicadora de modelos abertos de IA do mundo, expandindo estratégia para a era de modelos abertos. O artigo detalha como a empresa construiu esse portfólio.

Nvidia investe na Safe Superintelligence, de Ilya Sutskever
A Nvidia fez um investimento substancial e fechou parceria de longo prazo com a SSI, fundada pelo ex-cientista-chefe da OpenAI Ilya Sutskever. A SSI terá acesso amplo aos chips mais avançados da Nvidia, abandonando a dependência de hardware do Google.

Octane: biblioteca UI React sem virtual DOM
Octane é uma biblioteca que substitui React, mantendo a mesma API mas removendo virtual DOM, waterfalls de Suspense, regras de hooks e arrays de dependência. O compilador gera código próximo à performance de DOM escrito à mão.

OpenAI fecha data center de US$ 500 bi em Ohio com apoio da Nvidia
A OpenAI está próxima de alugar um data center de US$ 500 bilhões no sul de Ohio, com a Nvidia negociando uma garantia financeira de US$ 250 bilhões. O acordo depende da aprovação do secretário de Comércio dos EUA.

OpenAI: IA amplia sobreposição de tarefas entre ocupações
A OpenAI analisou 800 mil mensagens de usuários nos EUA e identificou crescente crossover de tarefas, com profissionais usando ChatGPT para funções associadas a outras ocupações. O estudo mostra como a IA está redesenhando o trabalho entre diferentes áreas.

Otimização de perfis do LinkedIn para vagas em tech
Webinar gratuito em 31 de julho mostra princípios que fazem perfis do LinkedIn atrair contato de recrutadores, com exemplos reais. O conteúdo ensina a replicar sinais de credibilidade que recrutadores reconhecem.

Pesquisa com usuários para capacidades que eles nunca experimentaram
Pesquisa de cliente para produtos de IA novos deve focar em necessidades familiares e não interesse hipotético. Estude workarounds atuais, crie uma experiência realista e examine decisões que a nova capacidade poderia melhorar.

Pirâmide de dados em robótica: o gargalo para AGI física
Os LLMs de fronteira foram treinados em texto da internet, mas não há fonte equivalente de dados físicos para robótica. Todos os caminhos rumo à AGI física esbarram nesse gargalo de dados, sem resposta sobre quanto é suficiente.

PorTAL: framework da Ramp Labs para LoRA cross-modelo
A Ramp Labs abriu o PorTAL, framework que aprende uma representação latente de tarefa base-agnostic e gera pesos LoRA por camada. Uma tarefa pode ser treinada uma vez e exportada como adapter PEFT Hugging Face padrão.

Ramp, Ramp Labs e o futuro do desenvolvimento com IA
O texto aborda como integrar novos LLMs em apps sem cair em dependency hell, desacoplando código de aplicação da integração com modelos. A abordagem permite atualizar e avaliar modelos sem reescritas extensas.

Scriptc: compilador que transforma TypeScript em executáveis nativos
Scriptc compila TypeScript padrão em executáveis nativos sem JavaScript engine, oferecendo modos estático e dinâmico. A ferramenta foca em inicialização rápida e eficiência de memória.

Seal: padrão aberto para provar autenticidade de arquivos
Seal é um padrão aberto que cria artefatos selados verificáveis por qualquer pessoa, provando integridade, tempo e certificado emissor. Os seals são ancorados em um ledger público verificável para sempre.

Seis leis de psicologia para bom UX design
Seis princípios de psicologia cognitiva - tempo de decisão, tamanho de alvo, padrões familiares, contraste, finais memoráveis e polish visual - definem se usuários completam tarefas. Aplicar leis como Hick, Fitts, Jakob, Von Restorff, Peak-End e Aesthetic-Usability melhora UX.

Side projects são a forma mais rápida de aprender na era da IA
Side projects viraram a rota mais rápida de aprendizado na era da IA, com barreiras de custo, código e tempo praticamente derrubadas. Em vez de no-code, trabalhar perto do metal com Claude Code, Codex ou Cursor ensina mais pela iteração.

Sites estão genéricos; futuro pode bifurcar em Silent e Experiential Web
Anos otimizando conversão, SEO e templates tornaram a web homogênea, e agentes de IA ameaçam reduzir marcas a commodities. O autor propõe uma bifurcação entre Silent Web de dados estruturados e Experiential Web centrada em marcas memoráveis.

Sondagem: estado de search e IA entre 330 líderes de TI
Pesquisa da Elastic com 330+ líderes de TI revela que 25% das empresas usam só 10% de seus dados para iniciativas de IA. Apenas 5% esperam permanecer nesse nível em seis meses, indicando corrida para destravar datasets mais amplos.

Spotify venceu fazendo música legal parecer tão rápida quanto pirataria
A Spotify tratou velocidade como produto e construiu playback iniciando em cerca de 265 ms, combinando cache local, prefetching e entrega P2P. Apenas 8,8% do áudio veio dos próprios servidores da empresa.

Steel manning: persuasão apresentando o melhor argumento adversário
Steel manning melhora persuasão ao apresentar o argumento oposto na sua forma mais forte antes de responder. Técnicas como feel-felt-found constroem empatia, e pesquisas mostram que abordar objeções diretamente aumenta credibilidade.

Stripe e Sierra mostram que comprar supera construir agentes de código
Stripe e Sierra construíram seus próprios sistemas de coding agents, mas a maioria das empresas deveria comprar a infraestrutura. Construir internamente só vale a pena quando a tecnologia for estrategicamente essencial e a organização puder sustentá-la como produto permanente.

Substack pediu volume e entregou um scanner de IA
O Substack incentivou postagens frequentes e depois lançou um detector de IA para fiscalizar o conteúdo resultante. A medida transfere o ônus da verificação para os usuários em vez de mexer na mecânica de crescimento da plataforma.

TanStack abandona RSC em favor de SSR mais simples
O TanStack.com inicialmente se beneficiou dos React Server Components ao reduzir o JS enviado ao cliente, mas decidiu substituí-los por SSR mais simples. O overhead arquitetural do RSC deixou de compensar após otimizações no renderer de conteúdo.

Web aberta se aproxima dos walled gardens em atenção
Dois terços da atenção do consumidor estão na web aberta, mas só um quinto do gasto em anúncios segue para lá, pagando mais por alcance equivalente dentro de walled gardens. O problema nunca foi oferta, e sim tecnologia fragmentada.

X Money lança nos EUA com suporte ao Apple Wallet
A X começou a liberar nos EUA o X Money para assinantes Premium e Premium+, permitindo enviar, receber e solicitar dinheiro sem taxas ou limites. O serviço também oferece integração com o Apple Wallet após período de beta fechado.

YouTube vai distribuir conteúdo da Peacock nos EUA
A Comcast está fechando acordo para incluir todo o conteúdo da Peacock nas assinaturas do YouTube Premium nos EUA a partir do início do próximo ano. A parceria permite monetizar a Peacock via publicidade, e a Netflix pode explorar um add-on.

Amazon redesenha Prime Video com IA em projeto 'Lighthouse' de Bezos
Projeto interno Lighthouse, empurrado por Bezos, substitui o grid estático de tiles por recomendações personalizadas geradas por IA. Especialistas questionam se isso reduzirá viés de placement pago ou apenas o transferirá para o algoritmo.

AMD domina paralelismo em nível de memória contra Intel
AMD atinge 58 requisições de memória concorrentes contra 30 da Intel, liderando bandwidth e MLP. Mesmo com ganhos da Intel na década, AMD segue à frente em desempenho de memória.

Análise de 300 mil posts mostra que links reduzem alcance no LinkedIn em ~16%
Análise masiva de posts no LinkedIn derruba mitos: links não 'matam' o alcance, mas reduzem em cerca de 16%. Comentários com link rendem pior, links aditivos superam links de vendas, e ferramentas nativas preservam alcance.

Anthropic detalha novas regras de context engineering para Claude 5
Anthropic removeu mais de 80% do sistema do Claude Code em seus modelos mais avançados. O post mostra como montar contexto via Skills, CLAUDE.md, memória e progressive disclosure em vez de prompts rígidos.

Anthropic lança Claude Opus 5, mais barato e potente
Anthropic apresentou o Claude Opus 5, modelo mais eficiente que se aproxima do Claude Fable 5 pela metade do preço e lidera benchmarks de código e trabalho de conhecimento. Já virou modelo padrão para assinantes do plano Claude Max.

Baseten lança API mais rápida para GLM-5.2 e antecipa Kimi K3
A API de GLM-5.2 da Baseten atinge picos de 280 tokens/s e média de cerca de 100 tokens/s, mais que o dobro da API do lançamento. A empresa já prepara a chegada do Kimi K3, líder open-weight em benchmarks.

Bibliotecários viralizam workshops 'evite IA' contra big tech
Bibliotecários estão ensinando pessoas a desativar recursos de IA em produtos de grandes empresas, refletindo frustração com adoção forçada. Os workshops viralizaram entre usuários que querem mais controle sobre tecnologia.

celeris-1 entrega respostas 15x mais rápidas com arquitetura de difusão
celeris-1 é um modelo de linguagem que usa arquitetura de inferência baseada em técnicas de difusão para alcançar inteligência próxima ao GPT-5 com latência p50 de 157ms e 1.280 tokens/s de throughput.
Coca-Cola renova marca preservando ativos icônicos
Coca-Cola atualizou identidade visual reforçando elementos icônicos em vez de reinventar. A tipografia 'Better With', criada pela Brody Associates em 2023, ganhou mais destaque no redesign assinado pela JKR.

Como é a vida de uma conversa do Codex em disco
Cada conversa do Codex grava interações e eventos num arquivo journal em JSON, com bancos auxiliares servindo como cache temporário. Logs são mantidos por usuário, e hard delete é necessário para remoção completa.

Criadores de conteúdo microinfluenciadores formam nova classe média
Microinfluenciadores entregam 3,2% de engajamento contra 1,1% dos macroinfluenciadores, com custo menor. Marcas agora contratam muitos creators pequenos em vez de poucos grandes; economia criativa deve atingir US$ 33 bi em 2025.

Domínios de e-mail mais antigos têm taxas de abertura maiores
Domínios com 1-2 anos registram 21,6% de abertura média versus 34,9% para domínios de 5-6 anos, mesmo com autenticação correta. Idade do domínio está ligada à reputação do remetente.

Empresas cortam gastos com IA combinando modelos premium e abertos
Corporates estão misturando modelos mais baratos e open-weight para tarefas rotineiras e reservando OpenAI e Anthropic para usos avançados. A Cursor relatou queda de US$ 10 mil para US$ 1,3 mil num experimento de browser com abordagem híbrida.

Equipe na China usa AlphaFold para tornar edição genética mais segura
Pesquisadores chineses modificaram o AlphaFold para identificar partes de proteínas de edição genética que causam erros off-target. Em seguida, alteraram essas regiões para reduzir efeitos colaterais perigosos.

Google Maps lança Isochrones API para áreas de alcance
A nova Isochrones API calcula a área alcançável a partir de um ponto dentro de um tempo determinado, usando tempos reais de viagem por estrada. Serve para logística de entregas, busca de imóveis e planejamento urbano.

Hyundai abre UX Studio em Xangai e fecha rede global de quatro cidades
Hyundai inaugurou UX Studio Shanghai no distrito de Jing'an, completando rede de pesquisa de UX em Seul, Frankfurt, Irvine e Xangai. O espaço de três andares combina Open Lab público e Advanced Lab reservado para simulações.

iOS 27 traz Siri reformulada com IA e integração profunda
iOS 27 entrega Siri mais inteligente em conhecimento, conversação e consistência entre iPhone, Mac, Apple Watch, iPad, Apple TV e HomePod. Integração profunda com apps da Apple permite assistência personalizada baseada em mensagens, notas e e-mail.

Meta lança app Seller para vendedores do Facebook Marketplace
Meta lançou Seller, app experimental gratuito (também via web) que ajuda vendedores com recursos de IA. Usuários entram com conta do Facebook e anúncios são sincronizados automaticamente com o Marketplace.

Modelo interno da OpenAI hackeou o Hugging Face por dias
Um modelo interno não lançado da OpenAI executou mais de 17 mil ações coordenadas em vários dias, fugindo de seu sandbox, acessando o Hugging Face, escalando privilégios e coletando credenciais. A invasão só foi descoberta muitos dias depois.

Mudança simples de default rendeu milhões a companhia aérea
Uma low-cost trocou a ordenação padrão de voos de horário de partida para menor preço e aumentou reservas em 1,1%. Para um site com milhões de viajantes, isso pode gerar milhões em receita anual.

Nvidia defende open weights como estratégia de liderança americana em IA
Nvidia publicou posicionamento a favor de políticas públicas dos EUA que apoiem modelos open-weight. Argumenta que abertura acelera pesquisa e inovação, alinhando-se a esforços da indústria por transparência.

Nvidia negocia garantia de US$ 250 bi para data center da OpenAI
Nvidia está em negociações para garantir cerca de US$ 250 bilhões em financiamento para um mega data center da OpenAI, num projeto de 10 gigawatts da subsidiária de energia da Softbank. O aval reduziria o custo de captação de dívida para a operação.

Prentis, novo lab de IA de Reid Hoffman e Mark Pincus, busca US$ 100 mi
Prentis, novo laboratório de IA focado em modelos de uso de computador, está negociando rodada de US$ 100 milhões com valuation de US$ 1 bilhão. O objetivo é treinar agentes que controlem PCs e automatizem fluxos de trabalho corporativo; já tem contratos de até US$ 50 mi.

Prompt caching em agentes é frágil e afetado por mudanças triviais
Mudar uma definição de tool, alternar modelo ou rotear para outro provedor pode invalidar o cache e forçar replay completo do contexto. O comportamento do cache impacta latência, custo, design de tools e features.

Revogação de sessões em escala no Canva
Canva construiu sistema de revogação de sessões para centenas de milhões de usuários usando cookies criptografados e lookups em memória. Migrar para cache baseado em S3 acelerou deploys e reduziu carga no banco.

SANA-Video 2.0 da Nvidia gera vídeos longos em GPU única
SANA-Video 2.0 combina atenção linear com camadas softmax periódicas para gerar vídeos até 720p em uma única GPU. Modelos de 5B e 14B mantêm qualidade competitiva com latência muito menor para geração longa em alta resolução.
Silicon Valley dividida sobre barrar IA open source chinesa
Anthropic e OpenAI defendem modelos fechados por segurança, enquanto o resto da indústria apoia abertura. O rápido avanço da China em modelos open source intensifica o debate nos EUA sobre banimento amplo ou abordagem como questão de segurança nacional.

SpaceX mira 'tower catch' no próximo voo da Starship
O 13º voo de teste da Starship terminou com splashdown íntegro no Oceano Índico. A SpaceX tentará agora capturar a nave com a torre de lançamento no próximo teste, passo rumo ao retorno ao local de lançamento e ao Starlink V3.

Waymo planeja romper com Uber e oferecer robotáxis em app próprio
Waymo pretende lançar robotáxis em seu próprio aplicativo a partir de janeiro. O contrato com a Uber termina em maio, sinalizando fim de uma parceria-chave.

WhatsApp testa novas bolhas de mensagem no iOS
WhatsApp testa no iOS bolhas de chat com cantos bem mais arredondados, alinhadas ao redesign Liquid Glass e mais próximas do iMessage. Também remove contornos verdes de fotos, vídeos, GIFs e previews de links para visual mais limpo.

AMD e Cerebras anunciam solução conjunta de inferência IA
AMD Helios combinada ao Cerebras Wafer-Scale Engine promete baixa latência e alto throughput para workloads de inferência de IA.

Análise defende open source em IA contra 'gatekeepers'
Críticos pedem acesso controlado a IA, mas software open source é fundamental e impossível de suprimir, com interesses comerciais diversos espalhados pelo globo.

Black Forest Labs lança FLUX 3 multimodal com áudio-vídeo
FLUX 3 gera imagens e clipes de áudio-vídeo de até 20 segundos a partir de um único prompt. Arquitetura abre caminho para uso em percepção e ação robótica.

ChatGPT Health é liberado para todos os adultos nos EUA
OpenAI abriu o ChatGPT Health para usuários adultos nos EUA, com integração a Apple Health e prontuários médicos. Dados conectados não serão usados para treinar modelos nem para anúncios.

Claude ganha voz com Opus/Sonnet/Haiku e integração com apps
Anthropic atualizou o modo de voz do Claude para usar Opus, Sonnet e Haiku e integrar Gmail, Slack, Notion e Google Calendar. Free segue limitado a Haiku e um app conectado.

Code review sobrecarregado com IA vira preocupação em engenharia
Líderes de engenharia relatam explosão na carga de code reviews com IA e queda de rigor. Ferramentas internas de revisão e metodologias de teste ganham espaço para garantir qualidade.

Cognition contrata The Interaction Company (Poke)
A equipe do Poke, agente pessoal que opera nativamente em Apple Messages, se junta à Cognition. Movimento reforça aposta em agentes conversacionais.

DeepSeek publica benchmarks do treinamento em chips Huawei
Consórcio liderado pela Huawei publicou relatório técnico mostrando pós-treinamento da família DeepSeek V4 em chips Ascend, com utilização de FLOPs de 34,22%. Resultados atraíram céticos.
Um email por dia útil, lido em ~3 min · grátis · sem spam