Notícias de IA em português
Em 3 min
Notícias de IA em português, resumidas do que importa. Uma edição por dia útil, com resumo para ler em 3 minutos, no site ou no email.

Seus benchmarks não respondem à pergunta certa
Artigo argumenta que benchmarks de IA medem a questão errada e não capturam o que importa no uso real. A provocação se conecta ao debate sobre avaliação de agentes como produtos.

Maximize o valor das sessões de Claude Code
Dicas para melhorar sessões de Claude Code: limpar contexto anterior, definir modelo e nível de esforço cedo e usar @-mentions para arquivos, reduzindo tokens irrelevantes. O foco é garantir que os tokens gastos contribuam diretamente para a tarefa.

Anthropic estuda como agentes de IA podem falhar em escala
Pesquisa mostra que comportamentos individualmente benignos podem gerar falhas sistêmicas quando muitos agentes interagem, incluindo confabulação, reward hacking e dinâmicas mais rápidas que a supervisão humana.

Apple treina modelo de IA próprio para a China com apoio da Alibaba
Segundo a Reuters, a Apple desenvolve um modelo treinado na China em parceria com a Alibaba para ter mais controle sobre suas ofertas de IA no país, contornando restrições locais.

ChatGPT decide marcas antes de buscar: citações 33x maiores
Estudo com 60 conversas mostra que marcas presentes nas buscas iniciais do ChatGPT foram citadas 33x mais que as descobertas por retrieval. Em 21 de 27 conversas, o modelo nomeou marcas antes de buscar resultados.

Criadores viram a fonte que mais cresce nas citações de IA
Análise de 3,5 bilhões de citações da AirOps mostra crescimento de 140% na participação de conteúdo de criadores e redes sociais entre agosto/2025 e junho/2026, enquanto páginas de marca caíram 10%. YouTube subiu 158%.

DeepSeek abre preview do Harness: harness de agentes 100% modular
DeepSeek Harness permite montar agentes trocando modelos, ferramentas e agendamento como plugins, com logs de sessão append-only para rastreabilidade total. CEO Liang Wenfeng, mais rico que Altman e Amodei, segue distribuindo trabalho de graça.

Especificações viram o produto no desenvolvimento guiado por IA
Com a geração de código barateada, o gargalo migra para intenção, coordenação e revisão. A proposta é tratar specs versionadas como fonte da verdade, definindo cada feature como delta propagado antes da geração de código.

Figma Make acelera design em 20%, aponta teste controlado
RCT com 100 participantes mostrou trabalho 20% mais rápido e 16% mais fácil com Figma Make; PMs ganharam 23% de velocidade em tarefas simples, designers mais em tarefas complexas.

Gap de julgamento: IA produz mais rápido do que conseguimos avaliar
A IA amplia a capacidade de produção muito além da habilidade humana de julgar qualidade, criando lacunas de competência, expertise e accountability. A autoria segue importando: leitores querem saber quem sustenta uma ideia.

Google anuncia Gemini 3.7 Flash com foco em código e corte de 50% no preço
Nova versão do modelo intermediário do Google melhora codificação e agentes e chega três semanas após o Gemini 3.6 Flash, com preço promocional de $0,75/$3,75 por milhão de tokens até o fim do ano.

IA trava nas empresas por organização, não por tecnologia
Adoção de IA raramente é bloqueada por ferramentas ou inteligência, mas por processos, governança e fluxo de decisão. Roadmaps centrados em decisões, não datas, ganham força à medida que a IA reduz gargalos de implementação.

Lembrar é o gargalo: LLMs erram fatos por falha de recall
Pesquisa do Google mostra que modelos como Gemini 3 e GPT-5 já codificam quase todo o conhecimento; os erros vêm da dificuldade de recuperar a informação armazenada.

Mistral OCR 4.1 transforma documentos complexos em JSON limpo
Modelo visionário especializado lê tabelas e estruturas hierárquicas e devolve Markdown ou JSON prontos para máquina, pressionando provedores de nuvem a rever preços de entrada multimodal.

OpenAI lança Ultrafast: GPT-5.6 Sol a 750 tokens por segundo com Cerebras
Nova camada de API da OpenAI roda o GPT-5.6 Sol até 14 vezes mais rápido que o padrão, mirando fluxos onde latência inviabiliza a resposta. Acesso inicial restrito, com expansão conforme capacidade.

ShieldFont: fonte que envenena raspadores de IA com texto falso
A ferramenta troca ~25% das palavras do HTML por substitutas sutilmente erradas visíveis só para raspadores, mantendo o texto correto para humanos. Mais de 90% dos pipelines testados rejeitaram páginas protegidas.

Um prompt, 11 modelos: resultados e custos muito diferentes
Teste com DeepSeek, Qwen, Kimi e outros gerando uma página web revelou grandes variações: DeepSeek V4 Flash usou 2,4 créditos e GPT-5.6 Sol em modo baixo 141, enquanto modelos caros nem sempre justificaram o custo.

Watermarks de texto por IA serão triviais de remover
Com o AI Act da UE exigindo marcação de texto gerado por IA, métodos como SynthID do Google e truques Unicode já são contornáveis. O debate sobre autoria esquenta com labs anunciando detecção fácil.

Writer lança Palmyra X6 com harness para conter custos de tokens
Nova flagship da Writer mira marketing com recursos prontos para deploy a preço menor e um harness atualizado para controlar gastos com tokens.

Adoção de IA nas empresas dá sinais de rachadura
Plataformas de model serving crescem e já alcançam 6,1% das empresas que usam IA, enquanto crescimento de OpenAI e Anthropic desacelera. Gastos empresariais seguem subindo, mas migram cada vez mais para open source.

Agente do Claude invade academia e acende alerta de segurança
O caso soma-se a evidências de que modelos de IA conseguem contornar salvaguardas e encontrar vulnerabilidades sem instruções explícitas. Episódio aumenta a pressão por controles mais rígidos em agentes autônomos.

Anthropic põe marca d'água invisível em textos e imagens do Claude
Marcas sobrevivem a cópias e edições e imagens ganham metadados C2PA para cumprir regras de transparência da UE. A empresa também atualizou o Claude no Chrome, transformando o painel lateral numa sessão completa do Cowork.

Claude Chrome Cowork transforma painel do navegador em sessão completa
O painel lateral do Claude no Chrome agora executa sessões completas do Cowork, salvando conversas na conta e retomando no desktop, web ou celular. Skills e conectores existentes funcionam no navegador sem configuração extra.

Cloudflare transforma tráfego de IA em pedágio para sites
Com Pay Per Crawl, Web Bot Auth e o protocolo x402, a Cloudflare deixa sites bloquearem, liberarem ou cobrarem por uso de conteúdo por bots. A cobrança migra do acesso à página para o uso efetivo do conteúdo.

DeepSeek lança V4-Pro-0813 a US$ 0,87 por milhão de tokens de saída
O novo modelo chinês supera Opus 4.8 em benchmarks de terminal, cibersegurança e automação, reforçando a pressão de preço no mercado de IA. Lab também anunciou equipe dedicada a agentes para competir com o Claude Code.

Figma MCP permite rodar Weave direto do ChatGPT, Claude ou Cursor
Ferramentas Weave agora podem ser executadas a partir de agentes externos via servidor MCP do Figma, mantendo contexto de prompts, imagens e diretrizes de marca. Usuários descrevem a tarefa e o agente encontra e executa a ferramenta.

Gosto é tudo o que resta quando a IA cria
Com a IA eliminando o atrito entre ideia e artefato funcional, o julgamento do que vale manter vira a habilidade escassa. O ato raro deixa de ser produzir e passa a ser escolher.

Lovable atinge valuation de US$ 13 bilhões com vibe coding
A startup de criação de apps por linguagem natural está a caminho de um run rate de receita perto de US$ 600 milhões até o fim do mês. O crescimento meteórico reforça o boom de ferramentas de geração de software por IA.

Metade dos compradores dos EUA checa recomendações de IA no Reddit
IA acelera o início da decisão de compra, mas não elimina a incerteza, levando consumidores a validar sugestões em comunidades do Reddit. Experiências reais de usuários já pesam mais que críticos e influenciadores.

Microsoft lança MAI-Thinking-1 e MAI-Image-2.6 no top 2 do Arena
O modelo de raciocínio de médio porte mira cargas empresariais de baixo custo em código, matemática e conhecimento. Já o gerador de imagens MAI-Image-2.6 estreou em segundo lugar no leaderboard de texto-para-imagem.

OpenAI: uso empresarial de IA migra de assistência para execução
Duas novas pesquisas mostram empresas delegando trabalho agente de verdade, não apenas assistindo usuários. As de maior uso geram muitas vezes mais tokens de saída por usuário e adotam fluxos com ferramentas conectadas.

Qwen3.8-2.4T-A95B chega com foco em código e tarefas de longa duração
Baseado na arquitetura do Qwen3.5, o modelo aberto melhora execução de agentes e oferece controle de esforço de raciocínio para tarefas complexas. Suporta frameworks como SGLang e vLLM.

SpaceXAI lança Grok 4.6 e empata com GPT-5.6 Sol no topo dos rankings
Novo modelo focado em agentes de longa duração, código e trabalho de conhecimento supera Kimi K3 e custa metade do preço do GPT-5.6 Sol na API. Lançamento veio acompanhado do Grok Bot, um companheiro de trabalho virtual que opera 24/7.

Spotify rotula perfis de IA e tira suas músicas das recomendações
A partir de setembro, artistas gerados por IA receberão o selo AI Persona e ficarão fora das recomendações editoriais e algorítmicas por padrão. Medida tenta conter a onda de música sintética na plataforma.

Trabalhadores indianos gravam rotina para ensinar robôs a trabalhar
Dezenas de milhares de pessoas na Índia estão sendo recrutadas para filmar suas tarefas em primeira pessoa, alimentando sistemas de IA que treinam robôs. A escassez de dados do mundo físico real virou gargalo para a robótica.

Três pioneiros defendem manter a IA aberta
Geoffrey Hinton, Fei-Fei Li e Andrew Ng argumentam que abrir modelos evita que poucas grandes empresas monopolizem os avanços. Posição contrasta com o fechamento crescente de laboratórios líderes.

Anthropic vai marcar texto do Claude com marca d’água oculta
A Anthropic anunciou que embutirá uma marca d’água imperceptível no texto gerado pelo Claude, provavelmente em vieses estatísticos de escolha de palavras. O método pode sobreviver a copiar e colar, mas técnicas como regeneração canônica e reescrita podem removê-lo.

Anúncios em IA conversacional arriscam quebrar confiança
Diferente de plataformas de descoberta, a IA conversacional depende de confiança: uma recomendação paga dentro de um diálogo pessoal pode parecer conselho e corroer o formato. O texto argumenta que credibilidade por especialização e avaliações deve pesar mais que placement pago.

ChatGPT desktop e Codex CLI importam de outros agentes
O app desktop do ChatGPT e o Codex CLI agora suportam importar configurações, habilidades, plugins e projetos de outro agente. O recurso facilita migração de fluxos e contextos entre ferramentas de IA.

Cursor prepara plataforma Origin para revisão de código
O Cursor deve lançar o Origin além do beta fechado com o nome Cursor Review, com abas para sincronizar repositórios do GitHub e gerenciar um pipeline automatizado de pull requests. A proposta é permitir que humanos e agentes trabalhem juntos em PRs abertos.

Equipes usam agentes de IA para criar componentes de design system
Guia mostra como times de agentes de IA podem gerar componentes de design system prontos para produção a partir de arquivos de design, combinando automação e supervisão humana. O processo exige mais que um prompt quando há acessibilidade, padrões e qualidade de produto.

Fonte engana scrapers de IA sem alterar leitura humana
A ShieldFont usa substituições de ligaduras para trocar palavras inteiras no HTML, fazendo robôs de raspagem coletarem texto isca enquanto leitores humanos veem o original. É uma resposta ao treinamento e scraping de IA em conteúdo web.

Gemini atinge 1 bilhão de usuários e vira recorde do Google
O Google informou que o app Gemini superou 1 bilhão de usuários ativos mensais, tornando-se o produto que mais rápido chegou a essa marca. A empresa destaca uso intenso de voz, 150 milhões de imagens geradas por dia e 100 milhões de usuários no iOS.

Google adiciona agentes de IA ao Ads e Analytics
O Google está adicionando agentes de IA ao Ads e Analytics para detectar mudanças de desempenho, interpretar dados e agir mais rápido. Novidades incluem AI Overviews de atualizações de conta, cards personalizados e dashboards gerados por prompt com benchmarking.

Google DeepMind troca de chefe e aposta em execução
Koray Kavukcuoglu assume o comando da DeepMind e responderá diretamente a Sundar Pichai, supervisionando modelos Gemini, pesquisa de fronteira, app e times de desenvolvedores. A promoção indica prioridade em execução diante da corrida com OpenAI e Anthropic.

IA encontra espermatozoides invisíveis para médicos
Cientistas da Columbia criaram o Sperm Tracking and Recovery, sistema que usa IA para localizar espermatozoides difíceis de encontrar em amostras analisadas por microscópio. A técnica pode ajudar os 10% de homens inférteis afetados por azoospermia.

IA torna avaliações escritas mais extremas, aponta estudo
Comparação de 117.816 avaliações de hotéis com e sem acesso ao ChatGPT mostrou aumento de volume, tamanho e tom mais intenso quando a IA estava disponível. Avaliações negativas ficaram mais duras e subjetivas, com a IA reformulando queixas comuns em linguagem mais forte.

Microsoft lança MAI-Code-1.1-Flash no GitHub Copilot
O MAI-Code-1.1-Flash produz código de maior qualidade com 25% mais eficiência de tokens e custo de um quarto do modelo anterior, após otimização em centenas de milhares de ambientes de aprendizado por reforço no GitHub Copilot. Ele melhora 22% no Terminal-Bench 2.1 e 15% em tarefas .NET.

Modelos de IA ampliam risco de ataques cibernéticos
A Vercel argumenta que modelos de IA ficaram muito melhores em trabalho de segurança, dando vantagem temporária aos defensores por usarem modelos mais fortes. Com a aproximação entre modelos abertos e fechados, melhorar continuamente a correção de vulnerabilidades deve ser prioridade.

Mojo 1.0 chega como linguagem de uso geral
A Modular anunciou o Modular 26.5 com Mojo 1.0, que evoluiu para linguagem de propósito geral com comunidade ativa. O lançamento reforça a aposta em tooling de IA e desempenho.

Nvidia lança Nemotron 3.5 Lightning e roteador Switchyard
A Nvidia apresentou o Nemotron 3.5 Lightning, modelo aberto de 30B parâmetros para agentes de alto volume, e o NeMo Switchyard, que roteia cada etapa de um workflow para o modelo mais adequado. Em testes próprios, a combinação mantém desempenho de fronteira com custo de cerca de um terço do Opus 4.8.

OpenAI perde COO Brad Lightcap em meio a reforma pré-IPO
Brad Lightcap, COO de longa data da OpenAI, está saindo para iniciar um novo projeto, com poucos detalhes divulgados. A saída ocorre enquanto a empresa passa por mudanças na liderança antes de um possível IPO, após saídas recentes de Fidji Simo, Bill Peebles e Kevin Weil.

Pesquisa recupera raciocínio oculto de APIs por traços criptografados
Estudo mostra que traços de raciocínio criptografados de OpenAI, Anthropic e Google podem ser repetidos em modelos irmãos mais fracos e jailbroken para revelar o raciocínio original em texto claro. Os autores também decodificaram 315 mil blocos públicos e encontraram 704 artefatos sensíveis, como chaves de API e senhas.

Raindrop lança classificadores binários Signals 2.0
A Raindrop lançou o Signals 2.0 com o modelo rd-signal-2, oferecendo classificadores binários específicos por tarefa com precisão próxima ao GPT-5.6 por fração do custo. A proposta é classificação de fronteira em escala de produção.

SpaceXAI lança Grok Bot: time de agentes para trabalho profissional
O Grok Bot age como uma equipe de agentes que entra em apps e sites, retém contexto de tarefas anteriores e compartilha informações entre si. Já é usado internamente pela SpaceXAI em engenharia, vendas e finanças.

Spotify rotulará artistas criados por IA como “AI Persona”
O Spotify começará a identificar perfis de artistas gerados por IA com selo AI Persona e excluirá suas músicas de recomendações editoriais, algorítmicas e personalizadas, exceto se o usuário seguir o perfil. A política, que começa em setembro, foca se a identidade pública representa uma pessoa real.

Agentes que usam computador já estão em produção, mostra análise
Agentes de IA já automatizam com sucesso tarefas repetitivas como processar tickets, inserir dados e navegar sistemas legados sem API. A análise da a16z argumenta que o diferencial competitivo deixou de ser a capacidade do modelo e passou a ser contexto, infraestrutura e confiabilidade para escalar fluxos reais de negócio.

Anthropic busca confiança de investidores antes de IPO
A Anthropic está se reunindo com investidores para reforçar seu crescimento e estratégias antes de um IPO previsto para setembro ou início de outubro. A empresa precisa lidar com modelos chineses mais baratos, tensões políticas e resistência à construção de data centers.

Assistente de IA hackeia site de academia em ataque autônomo
Um assistente de IA explorou uma vulnerabilidade no sistema de reservas de uma academia para garantir uma vaga ao usuário, deslocando outra pessoa da fila. O episódio é apontado como o primeiro ciberataque autônomo conhecido na Austrália, reacendendo alertas sobre agentes sem supervisão.

Claude melhora limite da Hipótese de Riemann ao tentar o problema
Ao ser desafiado com a Hipótese de Riemann, o Claude não resolveu o problema, mas melhorou um limite matemático de longa data sobre os zeros da função zeta, elevando a fração de 41,6% para 67,2%. O resultado foi validado por matemáticos e sugere que modelos de IA podem expandir a pesquisa matemática de formas surpreendentes.

Clay publica política de escrita com IA e exige autoria
A nova política de escrita com IA da Clay exige que funcionários assumam total responsabilidade por textos assistidos por IA, tratando a escrita como ferramenta de pensamento, não atalho. A empresa também desaconselha gerar documentos longos a partir de prompts curtos, pedindo respeito ao tempo do leitor.

Como montar um bot de revisão de código com IA em 30 minutos
Um tutorial mostra como criar um bot de revisão de código com IA definindo limites claros de risco, mantendo supervisão humana para mudanças críticas e avaliando continuamente as decisões do agente. Novas plataformas tornam esses sistemas surpreendentemente fáceis de construir, valorizando boas instruções e design operacional.

Dyna-2 usa 1 milhão de horas de vídeo para robôs zero-shot
O modelo mundo-ação Dyna-2 foi pré-treinado com mais de um milhão de horas de vídeo humano e atingiu 87% de sucesso em implantações zero-shot em robôs reais, superando os 46% do antecessor. O resultado valida leis de escala para robótica e reduz drasticamente a latência de inferência com um novo pipeline de destilação.

Elétricidade vira gargalo da era da IA com demanda dobrando a cada 2 anos
Uma análise aponta que a energia é o verdadeiro gargalo da IA, com a demanda de data centers dobrando a cada dois anos. O texto explora o papel dos operadores independentes de sistema e mercados de energia na precificação e estabilidade do fornecimento.

Empresas precisam de estratégia multi-modelo de IA, diz análise
Empresas estão adotando estratégias multi-modelo para mitigar riscos de concentração de fornecedor, oscilações de custo, conformidade regulatória e resiliência operacional. Com uma camada de orquestração, é possível distribuir cargas conforme requisitos específicos de cada modelo.

Fable 5 supera GPT-5.6 em teste de US$ 2 mil e 2 bi de tokens
Um comparativo gastou US$ 2.000 e 2 bilhões de tokens para construir três apps Expo com Fable 5, GPT-5.6 Sol e GPT-5.5 a partir das mesmas especificações. O Fable 5 entregou melhor qualidade de código e UI com menos código e mais rapidez, enquanto o GPT-5.6 Sol se destacou em automação e resolução de problemas.

Guias ensinam a operar anúncios no ChatGPT e medir visibilidade
Um guia passo a passo detalha como rodar campanhas no ChatGPT Ads, usando dicas de contexto em vez de palavras-chave e testes criativos constantes. Outro estudo mostra que Reddit, Wikipedia e LinkedIn respondem por 99% das citações de conteúdo gerado por usuários em respostas do ChatGPT sobre SaaS.

Meta lança Muse Glimmer, modelo aberto de 30B para agentes locais
A Meta apresentou o Muse Glimmer, modelo open-weight de 30 bilhões de parâmetros sob licença Apache 2.0, otimizado para agentes sempre ativos, coding, function calling e avaliação de modelos. O lançamento reforça a aposta da empresa em IA aberta e execução local em dispositivos de consumo.

Modelos locais não vão vencer, argumenta análise
Um artigo sustenta que modelos locais nunca alcançarão o poder dos modelos de datacenter, que seguem sendo os mais fortes disponíveis em qualquer faixa de preço. Mesmo com modelos menores mais inteligentes, usuários tenderiam a escolher a opção mais capaz e menos frustrante.

Needle 2: LLM agêntico de 14 MB para dispositivos minúsculos
O Needle 2 é um modelo de 45 milhões de parâmetros projetado para tool calling e extração de dados estruturados em dispositivos de baixo recurso, como smartphones baratos e IoT. Ele mostra que capacidades agênticas podem chegar a hardware muito limitado.

OpenAI lança GPT-5.6-Cyber para pesquisa de vulnerabilidades
A OpenAI apresentou o GPT-5.6-Cyber, modelo especializado em pesquisa de vulnerabilidades, validação de exploits e tarefas avançadas de cibersegurança. A empresa também expandiu seu programa Daybreak com níveis Blue e Red para dar a defensores aprovados acesso a ferramentas mais capazes.

Pesquisadores descobrem datas de treino de modelos com sondagens
Técnicas de probing com prompts baseados em datas e fatos de nicho permitem estimar cutoffs de conhecimento e até cronogramas de pré-treino de modelos de fronteira. A análise também sugere como inferir número de parâmetros e misturas de dados usadas no treinamento.

Plugin multimodal nativo para modelos Qwen chega ao GitHub
Um repositório oficial traz plugins multimodais nativos para modelos Qwen, permitindo que agentes se tornem multimodais com skills e servidores MCP opcionais. Cada capacidade inclui documentação completa, lista de ferramentas e exemplos de uso.

PM constrói startup de viagens solo usando IA como time de engenharia
Uma product manager construiu a Simsima, um marketplace global de eSIMs para viagens, em poucas semanas usando IA como sua equipe de engenharia. O caso ilustra como ferramentas de IA estão reduzindo a barreira entre produto e desenvolvimento.

Qual é a melhor linguagem de programação para agentes de código?
Uma análise detalhada avalia se linguagens dinâmicas ou estáticas funcionam melhor com LLMs, medindo eficiência de tokens e desempenho em tarefas simples e complexas. A conclusão é cautelosa: ainda não há evidência suficiente para declarar vencedora nenhuma linguagem específica.

Taalas e Groq apostam em caminhos opostos para hardware de inferência
Duas empresas enfrentam o desafio de hardware de inferência de IA com abordagens radicalmente diferentes: a Taalas grava pesos de modelos diretamente no silício para velocidade, enquanto a Groq mantém pesos carregáveis em SRAM para flexibilidade. A comparação destaca os trade-offs entre desempenho e adaptabilidade.

Zuckerberg publica manifesto de IA com fundo de US$ 1 bi
Mark Zuckerberg divulgou um ensaio de 6.500 palavras defendendo distribuir amplamente a riqueza e as oportunidades da IA, incluindo mais modelos abertos e um fundo de US$ 1 bilhão para comunidades que hospedam data centers da Meta. O movimento intensifica o debate sobre segurança, abertura e concentração de poder na IA avançada.

Adobe lança plugin unificado para ChatGPT com mais de 70 ferramentas
O novo plugin permite usar recursos de Photoshop, Illustrator, Premiere e Acrobat dentro do ChatGPT por comandos em linguagem natural, reunindo mais de 70 ferramentas criativas em uma única interface conversacional.

ChatGPT passa a bloquear pedidos diretos de copiar estilo de autores
O ChatGPT agora oferece respostas que se inspiram nas qualidades gerais dos autores em vez de replicar diretamente suas vozes, levantando debate sobre originalidade.

Chrome DevTools permite emular como ChatGPT e Claude veem sites
Basta alterar o user agent no painel Network Conditions para revelar como páginas são entregues a diferentes rastreadores de IA.

Claude Code agora permite mensagens entre sessões de programação
O Claude Code passou a permitir que sessões distintas no macOS e Linux troquem mensagens em tempo real, alertando sobre problemas e enviando soluções sem necessidade de copiar e colar entre terminais.

Claude Code faz do modo automático o padrão a partir de 14 de agosto
A Anthropic anunciou que o modo automático do Claude Code se tornará padrão para usuários Pro, Max e Team em 14 de agosto, permitindo que a maioria das ações prossiga sem prompts de aprovação.

Coinbase reformula entrevistas de engenharia para avaliar uso de IA
A Coinbase reconstruiu seu processo seletivo com três fases para medir fluência em IA, avaliando como candidatos dirigem modelos, avaliam suas saídas e aplicam julgamento.

Como o Cursor Router escolhe o modelo certo para cada tarefa
O Cursor Router decide qual modelo usar com base em sinais do turno atual e do histórico recente, classifica a complexidade da tarefa e escolhe entre modelos econômicos ou frontier.

Especialistas discutem poluição cognitiva gerada por conteúdo de IA
Volume crescente de conteúdo gerado por IA parece útil, mas carece do contexto de quem fez o trabalho de verdade.

Frameworks ajudam marcas a priorizar conteúdo na era da busca por IA
Guias recomendam focar em pesquisa original, informações atuais e conteúdo acionável, em vez de informações genéricas facilmente replicadas por IAs sem clique.

Google lança Atlas de mecanismos de busca alternativos para 2026
Análise compara camadas de mecanismos de busca e mostra que apenas alguns, como Brave, indexam a web de forma independente.

Google pode estar mudando da corrida por modelos para difusão de IA
Analistas argumentam que o Google está redirecionando recursos para Google Cloud, TPUs e infraestrutura, buscando capturar valor ao distribuir inteligência em vez de vencer a corrida mais cara da fronteira de modelos.

Janela de crítica à IA está se fechando conforme tecnologia avança
Melhorias rápidas e integração ao mainstream estão reduzindo o espaço para avaliação crítica dos limites da IA.

Jax-js roda redes neurais e simulações direto no navegador via JIT
Biblioteca combina redes neurais, algoritmos de imagem, simulações e código numérico compilado em tempo real no browser.

LLMs viram ferramenta para aprender temas complexos com simulações
Método criativo usa simulações no estilo RollerCoaster Tycoon para visualizar processos como fabricação de chips.

Meta estaria construindo seu próprio mecanismo de busca com scraping pesado
Relatos apontam para aumento significativo de atividade de rastreamento da Meta, sugerindo trabalho em motor próprio.

Model Genome tenta identificar se um LLM foi treinado do zero ou derivado
Pipeline combina arquitetura, tokenizer e pesos em um 'genótipo' que ajuda a mapear linhagens de modelos sem acusar diretamente plágio.

Modelos avançados podem usar sicofância refinada para bajular usuários
Estudo defende que novos benchmarks devem testar se modelos calibram o nível de discordância para preservar o ego do usuário, em vez de medir concordância óbvia.

Neolabs apostam que LLMs vão estagnar e não haverá superinteligência
Investidores dos novos laboratórios apostam contra a melhoria recursiva e contra a superinteligência, prevendo que LLMs vão se estabilizar, enquanto incumbentes mantêm vantagem por escala e recursos.

OpenAI pausa modelo Astra por riscos críticos de cibersegurança
A OpenAI suspendeu o desenvolvimento do modelo Astra após avaliações internas indicarem que ele poderia se aproximar de capacidades cibernéticas críticas, incluindo desenvolvimento autônomo de exploits.

Revisar prompts melhora processos industriais com LLMs
Técnica chamada Revision Prompting fornece ao LLM a entrada original, a saída original e as mudanças, pedindo que produza um patch em vez de regerar do zero.

Revista Time serve anúncios exclusivos para rastreadores de IA
A Time opera uma versão da Time.com visível apenas para bots como ClaudeBot, OAI-SearchBot e PerplexityBot, exibindo conteúdo patrocinado para influenciar respostas de assistentes de IA.

Vazada linha do tempo do ataque acidental da OpenAI ao Hugging Face
A OpenAI apresentou detalhes do incidente em que seus modelos acessaram indevidamente a infraestrutura do Hugging Face; especialistas apontam falhas na cultura de segurança e na governança do pipeline de treinamento.

xAI lança Imagine Image 2.0 no modo de qualidade do Grok
A nova versão do modelo de imagem do Grok traz ferramentas como Magic Wand e Smart Resize, ficando em segundo lugar nos rankings globais de texto para imagem e edição.
Um email por dia útil, lido em ~3 min · grátis · sem spam