Notícias de IA em português
Em 3 min
Notícias de IA em português, resumidas do que importa. Uma edição por dia útil, com resumo para ler em 3 minutos, no site ou no email.

Testes componíveis deixam suítes mais rápidas e legíveis
Kent Beck mostra como compor testes ortogonais e não redundantes em vez de duplicar asserts entre casos, tornando suítes mais rápidas e específicas. A técnica melhora manutenibilidade sem perder cobertura.

Cursor lança Origin, plataforma de hospedagem de código concorrente do GitHub
O Cursor apresentou o Origin, serviço de hospedagem de código com repositórios, pull requests e sincronização em tempo real com GitHub. O lançamento ocorreu durante uma queda de mais de seis horas do GitHub, evidenciando a competição crescente em ferramentas para desenvolvimento assistido por IA.

Dynamic Workers da Cloudflare permitem apps programáveis por usuários
Post demonstra como construir aplicações web seguras e programáveis por usuários usando Dynamic Workers leves da Cloudflare. A abordagem permite extensibilidade sem comprometer isolamento e segurança.

Sua SPA está vazando memória: faça soak test
SPAs nunca recarregam, então listeners, timers e nós órfãos acumulam até a aba morrer; 86% de 500 repositórios React/Vue/Angular registraram algo sem limpar. A correção proposta é um soak test com Playwright que repete um fluxo e verifica contagens de nós e listeners via CDP.

Relatório da Linear revela padrões de adoção de IA em equipes de software
A Linear analisou o uso de IA em dezenas de milhares de equipes de desenvolvimento, mostrando adoção crescente entre funções e tamanhos de empresa, aumento de produtividade com agentes de código e maior participação de não engenheiros no desenvolvimento.

GPT-5.6 Sol da OpenAI se destaca em visão mas enfrenta limites de custo
O novo modelo GPT-5.6 Sol da OpenAI apresenta avanços significativos em visão computacional, com melhor detecção e contagem de objetos em relação ao GPT-5.5, mas ainda sofre com custo elevado, latência e erros ocasionais de detecção.

Red Agent da Wiz explora vulnerabilidade em pipeline do Snowflake
O Red Agent da Wiz identificou e explorou autonomamente uma falha crítica no GitHub Actions do repositório público do Snowflake, obtendo acesso a dados internos do Jira apenas cinco dias após a vulnerabilidade ser introduzida, expondo riscos de segurança em código assistido por IA.

Test-time training permite que modelos se adaptem durante o uso
O treinamento em tempo de teste permite que modelos de IA atualizem seus pesos durante o uso, reduzindo a necessidade de memória ao usar um conjunto fixo de pesos em vez de um KV-cache crescente. A técnica exige modelos separados por usuário, aumentando a demanda computacional.

Warp lança memória persistente compartilhada entre agentes e equipes
A Warp introduziu memória persistente compartilhada entre diferentes agentes, máquinas e colegas de equipe, com proveniência e acesso configurável. A novidade busca melhorar a continuidade do trabalho assistido por IA.

Maioria dos profissionais de tecnologia prefere trabalho individual, mas gestão ainda domina
A maioria dos profissionais de tecnologia quer mais trabalho como contribuinte individual, mas remuneração e influência mantêm muitos em cargos de gestão. Funções IC de alto impacto poderiam oferecer um caminho melhor ao recompensar autonomia e impacto nos negócios sem exigir gestão de pessoas.

Benchmarkpocalypse: ficou mais fácil fraudar benchmarks de IA
É agora mais fácil do que nunca burlar benchmarks e obter ganhos de desempenho falsos em modelos de IA. O artigo alerta para a necessidade de avaliações mais robustas diante da proliferação de métricas infladas.

Como enviar um banco de dados para produção todos os dias
A turbopuffer implementou uma máquina de estados local em cada cluster de banco de dados, permitindo operação autônoma sem acesso direto do plano de controle. Com uma API customizada e dashboard, o sistema gerencia mais de 100 clusters e permite múltiplos deploys diários.

Como a Bluesky desenha seu logotipo apenas em capturas de tela
A Bluesky usa um UITextField com propriedade específica que mascara conteúdo ao tirar screenshot, fazendo o logo aparecer apenas em capturas de tela e ficar oculto durante o uso normal do app. A técnica tira proveito do comportamento do iOS de capturar um snapshot no início do gesto.

Como usar IA em 2026: fluxos de trabalho de um power user
Uma das melhores formas de aprender a usar IA eficazmente é observar como usuários avançados aplicam essas tecnologias. O artigo detalha fluxos de trabalho com IA para codificação, escrita, aprendizado e assistência pessoal em 2026.

Hunk: visualizador de diffs interativo com anotações de IA
Hunk é um visualizador de diffs baseado em terminal focado em interatividade e recursos assistidos por IA, oferecendo anotações inline geradas por IA e layouts responsivos. Suporta integração com sistemas de controle de versão populares e customização via arquivos de configuração.

WorkOS lança registro de agentes para autenticação automatizada
O WorkOS Agent Registration permite que agentes de IA se registrem em fluxos de signup via um arquivo auth.md publicado pelo AuthKit, obtendo credenciais de curto prazo com escopo controlado. A solução visa converter tráfego de agentes que antes era perdido em signups reais.

Como possuir sua inteligência de IA: guia prático para empresas
Empresas de IA devem possuir seletivamente sua inteligência quando APIs frontier restringem custo, latência, dados proprietários ou controle estratégico. O roadmap inclui evals, harnesses customizados, pós-treinamento direcionado e loops de aprendizado online que transformam trajetórias de produção em modelos de domínio continuamente melhorados.

Alternativas ao GitHub ganham atenção após quedas consecutivas
Há interesse crescente em explorar alternativas para hospedagem de código e colaboração devido a quedas consistentes recentes do GitHub. A discussão na comunidade destaca a necessidade de redundância e novas opções no ecossistema de desenvolvimento.

Fix simples para latência de cauda em aplicações LLM
Para melhorar latência em aplicações LLM em tempo real, é frequentemente mais eficaz enviar cada requisição duas vezes para respostas mais rápidas do que optar por um tier de serviço prioritário mais caro. A técnica reduz a variabilidade de latência sem custo adicional significativo.

Reduzindo volume de logs do Fastify com LogController
Um health check do Fastify pesquisado a cada 5 segundos produz mais de um milhão de linhas de log por mês. O artigo apresenta duas soluções nativas: silenciar rotas ruidosas com logLevel ou subclassificar LogController para filtrar apenas as linhas relevantes.

Histórias intrigantes da ciência da computação
Uma compilação de anedotas e lições da história da ciência da computação e desenvolvimento de software, mostrando tanto sucessos notáveis quanto falhas críticas. O artigo reúne casos que ilustram princípios fundamentais da área.

Shape Up para equipes de dados: como fazer funcionar
O Shape Up pode funcionar para equipes de dados apenas quando elas ajudam a moldar prioridades desde o início. Sem um lugar na mesa de apostas, permanecem como times de serviço reativos em vez de verdadeiros parceiros estratégicos.

Perfeição não é over-engineering
Over-engineering vem de resolver os problemas errados, não de buscar qualidade. O artigo argumenta que perfeição genuína significa focar no que realmente importa em vez de adicionar complexidade desnecessária.

IA deve ser sua própria ferramenta de CI, não um serviço descartável
Ferramentas de integração contínua têm um único trabalho: agendamento. O artigo argumenta que a CI deve ser tratada como infraestrutura descartável, não como plataforma complexa, simplificando pipelines e reduzindo dependências.

GPT-5.6 Sol com 50% de desconto no OpenRouter
O modelo GPT-5.6 Sol da OpenAI está com 50% de desconto no OpenRouter. A promoção se aplica a batch API, flex e tiers prioritários.

Escalando repetição de dados para LLMs
A quantidade ótima de repetição de dados de domínio de alta qualidade aumenta levemente com o tamanho do modelo numa taxa fixa de tokens por parâmetro. Modelos proxy menores podem ajudar a estimar cronogramas de repetição para modelos maiores, com domínios de menor perda tolerando mais reuso.

Latência como dividend de prazo: mais velocidade, mais trabalho útil
Latência mede o tempo até um resultado útil. Maior velocidade pode terminar trabalho mais cedo ou encaixar mais trabalho antes do mesmo prazo. Esse trabalho extra útil é o dividend de prazo, que pode financiar outra estratégia, um crítico, uma passada de verificação ou recuperação após falha.

GLM-5.2 disponível para fine-tuning serverless e deploy self-serve
O GLM-5.2 é um modelo de codificação e agentes de longo horizonte que suporta contexto de 1M tokens e mantém restrições arquiteturais, contratos de API e decisões de engenharia anteriores. Agora está disponível em fine-tuning serverless e deploys self-serve na Crusoe.

Apps 'vibe coded' criam nova onda de TI invisível
Ferramentas internas geradas por IA criam infraestrutura com papéis de IAM sem ticket, revisão ou segurança envolvida. A proposta é defesa em camadas: controles de plataforma, verificações automatizadas e revisão humana informada antes do deploy.

Automação de código por IA ameaça vigilância estatal, diz especialista
O avanço da IA no desenvolvimento pode gerar falhas de segurança e levar agências de inteligência e aplicação da lei a perder acesso crítico a comunicações, cenário conhecido como 'going dark'. O alerta conecta qualidade de software e segurança nacional.

Agentes de IA acham quantos bugs você pedir
Em sistemas complexos, é possível pedir a agentes de IA que encontrem praticamente tantos bugs quanto se desejar, o que muda a lógica de testes e priorização. A implicação é que qualidade passa a depender mais de definição de escopo do que de capacidade de detecção.

Provas de conhecimento zero explicadas além das criptos
Artigo explica provas de conhecimento zero, em que um provador convence um verificador de que possui a solução sem revelá-la. Além de criptomoedas, a técnica pode servir para verificação de idade e outros problemas.

Por que o Opus 5 parece pior de usar
Usuários relatam que o Opus 5 exige mais supervisão e não busca esclarecimento em situações ambíguas, parecendo menos eficaz que antecessores. A causa seria o foco em sistemas autoaprimoráveis otimizados para benchmarks, que privilegiam suposições ousadas em vez de perguntas.

Fundamentos de engenharia importam mais na era dos agentes
Mesmo com modelos avançados, engenharia de software eficaz ainda depende de raciocínio humano e design cuidadoso para sistemas mantíveis e depuráveis. O argumento é que ferramentas de IA não substituem fundamentos de arquitetura e resolução de problemas.

Protobuf ganha suporte oficial de LSP pela Buf
A Buf lançou o primeiro servidor Language Server Protocol completo para Protobuf, trazendo suporte moderno de IDE e ferramentas de desenvolvimento. É um ganho significativo para quem trabalha com contratos de API e serialização.

Auto-pesquisa com Codex acelera kernel de GPU em 232x
Numa competição de otimização de GPU, um participante usou Codex para atingir 232x de aceleração sobre o baseline na fatoração QR, ficando em 12º entre 183. O projeto combinou algoritmo bloqueado de Householder, profiling contínuo e iteração com modelos de IA.

Transformadores full-bandwidth reciccam estado oculto entre tokens
Pesquisa da Microsoft propõe transformadores que realimentam o estado oculto da última camada do token anterior junto com o próximo embedding. Isso permite computação latente continuar entre passos de decodificação.

Ferramentas de compressão de tokens podem aumentar custos de IA
A PointFive testou ferramentas que prometem reduzir custos de LLM cortando tokens, rodando o mesmo prompt em 2.908 sessões de Claude Code com e sem compressão. Em alguns casos, a compressão aumentou custos em quase 50%.

Dez anos como desenvolvedor indie: sorte, iOS 15 e persistência
Após largar o emprego em 2016, um desenvolvedor independente penou por cinco anos até o iOS 15 revitalizar seu negócio e poupança. Sem replicar o sucesso inicial, ele segue inovando sem planos de longo prazo.

Mapa de habilidades do engenheiro de IA
A engenharia de IA se concentra em quatro habilidades: construir e implantar aplicações de IA, fundamentos de software, fluência com agentes de código e definir o que será construído. O mapa orienta profissionais na transição para o novo papel.

Código é subproduto do entendimento
Reflexão curta sustenta que o código não é o objetivo final, mas resultado de compreensão real do problema. A implicação para times e agentes é priorizar entendimento antes de escrever linhas.

Seus benchmarks não respondem à pergunta certa
Artigo argumenta que benchmarks de IA medem a questão errada e não capturam o que importa no uso real. A provocação se conecta ao debate sobre avaliação de agentes como produtos.

Maximize o valor das sessões de Claude Code
Dicas para melhorar sessões de Claude Code: limpar contexto anterior, definir modelo e nível de esforço cedo e usar @-mentions para arquivos, reduzindo tokens irrelevantes. O foco é garantir que os tokens gastos contribuam diretamente para a tarefa.

Imagens HTML podem vazar: entenda object-fit e border-radius
O elemento de imagem em HTML pode estourar o layout por causa de propriedades como object-fit e border-radius, revelando sua complexidade como contêiner e conteúdo ao mesmo tempo. Detalhe técnico importante para quem constrói interfaces.

Agentes com contexto: Jira Teamwork Graph promete mais precisão
O Teamwork Graph no Jira alimenta agentes com contexto de todo o stack da equipe, entregando resultados 44% mais precisos segundo a Atlassian. A proposta é manter controle em escala sobre o trabalho que agentes executam.

Scandit lança Agent Skills para leitura de código de barras
Scandit Agent Skills ensinam agentes de codificação como Claude Code, Cursor, Copilot e Codex a integrar leitura de código de barras, documentos e rótulos melhor que humanos, validados contra cerca de 500 casos reais. Resolve padrões errados, casos de borda quebrados e APIs depreciadas.

Tines 3B: ambiente seguro para construir e operar agentes
Tines 3B permite construir apps, agentes e automações em qualquer stack com segurança de dados e visibilidade de gastos. A plataforma promete controle de TI e workflows que melhoram ao longo do tempo.

Bluesky lança Protocol Services com docs e contratos claros
Nova estrutura organiza a documentação do ecossistema, define contratos de serviço da infraestrutura do Bluesky e dá um caminho limpo para releases futuros.

Cursor acelera agentes em 3x com builds contínuos em segundo plano
Agentes do Cursor passam a iniciar em ambientes prontos preparados continuamente, reduzindo em até 3x o tempo de resposta enquanto desenvolvedores depuram em paralelo.

Especificações viram o produto no desenvolvimento guiado por IA
Com a geração de código barateada, o gargalo migra para intenção, coordenação e revisão. A proposta é tratar specs versionadas como fonte da verdade, definindo cada feature como delta propagado antes da geração de código.

Mistral OCR 4.1 transforma documentos complexos em JSON limpo
Modelo visionário especializado lê tabelas e estruturas hierárquicas e devolve Markdown ou JSON prontos para máquina, pressionando provedores de nuvem a rever preços de entrada multimodal.

Plugins portáveis viram padrão para habilidades de agentes
Agent Plugins empacotam skills e dependências MCP em uma pasta vendor-neutral com manifests compartilhados e isolamento de falhas, reduzindo setup fragmentado entre clientes compatíveis.

ShieldFont: fonte que envenena raspadores de IA com texto falso
A ferramenta troca ~25% das palavras do HTML por substitutas sutilmente erradas visíveis só para raspadores, mantendo o texto correto para humanos. Mais de 90% dos pipelines testados rejeitaram páginas protegidas.

Um prompt, 11 modelos: resultados e custos muito diferentes
Teste com DeepSeek, Qwen, Kimi e outros gerando uma página web revelou grandes variações: DeepSeek V4 Flash usou 2,4 créditos e GPT-5.6 Sol em modo baixo 141, enquanto modelos caros nem sempre justificaram o custo.

Astro zera fila de issues com fábrica de agentes no GitHub Actions
Subagentes isolados reproduzem bugs, diagnosticam causas e enviam preview releases, derrubando issues de 200+ para cerca de 30. Falhas dos agentes viram sinal de problemas estruturais no código.

Cloudflare transforma tráfego de IA em pedágio para sites
Com Pay Per Crawl, Web Bot Auth e o protocolo x402, a Cloudflare deixa sites bloquearem, liberarem ou cobrarem por uso de conteúdo por bots. A cobrança migra do acesso à página para o uso efetivo do conteúdo.

Delta: ambiente de código multiplayer para devs e agentes
A nova plataforma da Zed permite colaboração em tempo real entre humanos e agentes, com código e conversas interligados. O DeltaDB sincroniza comentários no código que permanecem relevantes conforme ele evolui.

IA elimina a classe média da engenharia de software
A aceleração da IA faz projetos com cultura fraca de engenharia falharem mais rápido, reduzindo a tolerância a maus engenheiros. O dinheiro tende a se concentrar num grupo cada vez menor de profissionais de confiança.

Meta revela explosão de TypeScript e Rust e queda de Java e Haskell
Dados internos de adoção de linguagens mostram TypeScript com crescimento de +1.200% em meses recentes e Rust em forte expansão. Linguagens mais antigas como Java e Haskell perdem espaço na empresa.

Por que JPEGs pequenos aparecem diferentes no Chrome
O que parece bug é uma otimização de decodificação que calcula a fração mais próxima com denominador 8 e escala parcialmente a imagem. Isso faz miniaturas ficarem mais espessas em algumas máquinas.

Tailscale ajuda a achar bug de 16 anos no SQLite
Após seis meses de corrupção de dados recorrente, a equipe colaborou com mantenedores do SQLite para identificar e corrigir um bug antigo no WAL. O caso exigiu esforço conjunto de engenharia e suporte.

Time de 3 pessoas envia centenas de PRs por semana com agentes
A Kenn Software detalha seu fluxo de engenharia assistido por agentes, mantendo baixa taxa de bugs em produção. O caso mostra como equipes minúsculas multiplicam a capacidade de entrega.

Yelp migra monorepo gigante de Flow para TypeScript em 3 anos
A conversão gradual, pacote por pacote, garantiu integridade de tipos sem interromper o desenvolvimento. O caso serve de roteiro para grandes migrações de tipagem em escala.

Cursor prepara plataforma Origin para revisão de código
O Cursor deve lançar o Origin além do beta fechado com o nome Cursor Review, com abas para sincronizar repositórios do GitHub e gerenciar um pipeline automatizado de pull requests. A proposta é permitir que humanos e agentes trabalhem juntos em PRs abertos.

Fonte engana scrapers de IA sem alterar leitura humana
A ShieldFont usa substituições de ligaduras para trocar palavras inteiras no HTML, fazendo robôs de raspagem coletarem texto isca enquanto leitores humanos veem o original. É uma resposta ao treinamento e scraping de IA em conteúdo web.

Lazarus usa falsas ofertas de emprego em ataque zero-day
A campanha Operation Dream Job, ligada ao grupo Lazarus, mira o setor de defesa com visualizadores de PDF modificados que executam malware ao serem abertos. Os atacantes exploram zero-days, incluindo CVE-2026-68820, para implantar o backdoor Troy e o rootkit FudModule.

Microsoft lança MAI-Code-1.1-Flash no GitHub Copilot
O MAI-Code-1.1-Flash produz código de maior qualidade com 25% mais eficiência de tokens e custo de um quarto do modelo anterior, após otimização em centenas de milhares de ambientes de aprendizado por reforço no GitHub Copilot. Ele melhora 22% no Terminal-Bench 2.1 e 15% em tarefas .NET.

Modelos de IA ampliam risco de ataques cibernéticos
A Vercel argumenta que modelos de IA ficaram muito melhores em trabalho de segurança, dando vantagem temporária aos defensores por usarem modelos mais fortes. Com a aproximação entre modelos abertos e fechados, melhorar continuamente a correção de vulnerabilidades deve ser prioridade.

Mojo 1.0 chega como linguagem de uso geral
A Modular anunciou o Modular 26.5 com Mojo 1.0, que evoluiu para linguagem de propósito geral com comunidade ativa. O lançamento reforça a aposta em tooling de IA e desempenho.

Pesquisa recupera raciocínio oculto de APIs por traços criptografados
Estudo mostra que traços de raciocínio criptografados de OpenAI, Anthropic e Google podem ser repetidos em modelos irmãos mais fracos e jailbroken para revelar o raciocínio original em texto claro. Os autores também decodificaram 315 mil blocos públicos e encontraram 704 artefatos sensíveis, como chaves de API e senhas.

Como montar um bot de revisão de código com IA em 30 minutos
Um tutorial mostra como criar um bot de revisão de código com IA definindo limites claros de risco, mantendo supervisão humana para mudanças críticas e avaliando continuamente as decisões do agente. Novas plataformas tornam esses sistemas surpreendentemente fáceis de construir, valorizando boas instruções e design operacional.

Docker lança sandboxes para agentes de código executarem com segurança
A Docker apresentou sandboxes que oferecem ambientes isolados para agentes de IA executarem tarefas de forma autônoma sem comprometer o sistema hospedeiro. A novidade responde à crescente adoção de agentes que precisam rodar código e comandos com segurança.

Equipes adotam prototipagem no código com IA em vez de Figma
Equipes de design estão trocando protótipos de alta fidelidade desconectados do produto por experimentos diretamente no codebase usando Git, componentes compartilhados e ferramentas como Cursor. A abordagem reduz o vão entre 'parece pronto' e 'está pronto' e melhora a colaboração com engenharia.

Fable 5 supera GPT-5.6 em teste de US$ 2 mil e 2 bi de tokens
Um comparativo gastou US$ 2.000 e 2 bilhões de tokens para construir três apps Expo com Fable 5, GPT-5.6 Sol e GPT-5.5 a partir das mesmas especificações. O Fable 5 entregou melhor qualidade de código e UI com menos código e mais rapidez, enquanto o GPT-5.6 Sol se destacou em automação e resolução de problemas.

Grindr reformula back-end enquanto se torna nativa de IA
A Grindr acelerou drasticamente sua engenharia com IA, deslocando o gargalo para o julgamento de produto e aproximando as funções de engenharia, design e produto. A empresa chama o processo de 'terraformar' seu futuro como organização AI-native.

Pesquisador compra domínios noreply e vira honeypot de segredos
Cory Solovewicz comprou noreply.us e noreply.net e criou acidentalmente um honeypot que passou a receber segredos e mensagens confidenciais de empresas. O caso expõe falhas graves de configuração e higiene de e-mail corporativo.

Pesquisadores descobrem datas de treino de modelos com sondagens
Técnicas de probing com prompts baseados em datas e fatos de nicho permitem estimar cutoffs de conhecimento e até cronogramas de pré-treino de modelos de fronteira. A análise também sugere como inferir número de parâmetros e misturas de dados usadas no treinamento.

Qual é a melhor linguagem de programação para agentes de código?
Uma análise detalhada avalia se linguagens dinâmicas ou estáticas funcionam melhor com LLMs, medindo eficiência de tokens e desempenho em tarefas simples e complexas. A conclusão é cautelosa: ainda não há evidência suficiente para declarar vencedora nenhuma linguagem específica.

Afirmação de que código nunca foi o problema ofende programadores
Texto argumenta que minimizar a complexidade do código desrespeita décadas de evolução da engenharia de software.

Atproto quer descentralizar sistemas distribuídos de grande escala
Protocolo estabelece modelo de dados compartilhado e APIs públicas NoSQL para backend de alta escala.

Casa de aposta em hardware para agentes se prepara para nova era de workstations
Engenheiros estão reconstruindo estações de trabalho em torno de ferramentas terminais nativas, composáveis e projetadas para fluxos agênticos.

Chrome DevTools permite emular como ChatGPT e Claude veem sites
Basta alterar o user agent no painel Network Conditions para revelar como páginas são entregues a diferentes rastreadores de IA.

Claude Code agora permite mensagens entre sessões de programação
O Claude Code passou a permitir que sessões distintas no macOS e Linux troquem mensagens em tempo real, alertando sobre problemas e enviando soluções sem necessidade de copiar e colar entre terminais.

Claude Code faz do modo automático o padrão a partir de 14 de agosto
A Anthropic anunciou que o modo automático do Claude Code se tornará padrão para usuários Pro, Max e Team em 14 de agosto, permitindo que a maioria das ações prossiga sem prompts de aprovação.

Como o Cursor Router escolhe o modelo certo para cada tarefa
O Cursor Router decide qual modelo usar com base em sinais do turno atual e do histórico recente, classifica a complexidade da tarefa e escolhe entre modelos econômicos ou frontier.

Jax-js roda redes neurais e simulações direto no navegador via JIT
Biblioteca combina redes neurais, algoritmos de imagem, simulações e código numérico compilado em tempo real no browser.

LLMs viram ferramenta para aprender temas complexos com simulações
Método criativo usa simulações no estilo RollerCoaster Tycoon para visualizar processos como fabricação de chips.

Modelo rápido de escrita move trabalho para outro lugar no sistema
Texto mostra como diferentes opções de armazenamento afetam durabilidade e latência, separando gravações locais de cópias duráveis.

Mudança de devtools é barata; ser dono deles não é
O futuro do software depende de blocos bem documentados sobre os quais agentes podem compor artefatos personalizados sem romper a manutenção.

O que aconteceu com o HackerOne segundo a comunidade de hackers
Plataforma de hackers éticos enfrentaria deterioração após mudanças de liderança e foco em vendas, com perda de compromiso com a comunidade.

Qualidade do código agêntico depende das restrições impostas aos agentes
Especialistas defendem que a qualidade do software gerado por agentes depende das restrições que definem o que o sistema pode fazer, criando loops confiáveis de entrega.

Revisar prompts melhora processos industriais com LLMs
Técnica chamada Revision Prompting fornece ao LLM a entrada original, a saída original e as mudanças, pedindo que produza um patch em vez de regerar do zero.

Shopify troca Redis por MySQL em reservas de estoque durante Black Friday
A migração usou SKIP LOCKED do MySQL para gerenciar reservas com melhor conformidade ACID, reduzindo risco de vender acima ou abaixo do estoque em picos de tráfego.

Skill Packs chegam à skills.sh para padronizar capacidades de agentes
Usuários podem agora agrupar várias skills em pacotes compartilháveis com URL exclusivo para padronizar uso entre times.

Snowflake implementa espelhamento de dados do Postgres para análise
Nova extensão do Postgres usa abordagem push para captura de dados, simplificando a replicação de transacional para analítico com baixa latência.

bb: IDE agentic de código aberto que se autoconstrói
bb é um IDE agentic open source que pode ser estendido sob demanda - basta pedir à própria ferramenta que implemente novas funcionalidades.

Channels SDK conecta agentes AG-UI a Slack e Teams
O Channels SDK permite integrar agentes compatíveis com AG-UI a plataformas de comunicação já usadas por equipes, habilitando UIs interativas em fluxos de trabalho.

Engenharia de loops: saber quando a IA deve parar
Loops eficazes de IA exigem estado-alvo claro, estado atual observável, mudanças locais precisas e verificadores fortes, além de condições externas de parada.

Figma Code Connect reduz tokens e melhora código gerado por IA
Recurso Code Connect da Figma conecta componentes do Figma ao código real, reduzindo em ~30% o uso de tokens por agentes e melhorando a qualidade do código gerado.

GitHub Actions sofre um dos piores dias com grande outage
GitHub Actions enfrentou outage severo: webhooks throttled, runners recebendo jobs inexistentes e falhas em ambientes hospedados e self-hosted.
Um email por dia útil, lido em ~3 min · grátis · sem spam