🔥 Destaques
OpenAI divulga em massa 722 manuscritos matemáticos de modelo não lançado, rompendo fronteiras de problemas seculares como a Quase-Hipótese de Riemann : A OpenAI publicou oficialmente no repositório open-source do GitHub openai/math 372 conjuntos de resultados, totalizando 722 manuscritos de artigos matemáticos gerados por um modelo de fronteira interno ainda não lançado. Os principais resultados abrangem a Quase-Hipótese de Riemann (afirmando demonstrar que todas as funções L de Dirichlet não possuem zeros na região onde a parte real é superior a 7/8 e eliminando os zeros de Siegel), a demonstração da Conjectura de Hodge para variedades abelianas, a Conjectura de Kakeya em 4D, o Décimo Problema de Hilbert sobre o corpo dos números racionais e o estabelecimento do limiar ordinário de NP-hardness do Basic-SDP sem depender da Conjectura dos Jogos Únicos (Unique Games Conjecture); cerca de 160 deles incluem provas formalizadas em Lean. A OpenAI revelou que cada resultado individual consumiu em média cerca de 3 horas de capacidade de computação de inferência do ChatGPT Pro. Embora seja considerado um marco na descoberta científica autônoma por máquinas, um painel consultivo do Institute for Advanced Study de Princeton, que inclui três vencedores da Medalha Fields, emitiu uma declaração enfatizando que a divulgação pública não equivale ao reconhecimento acadêmico, alertando que a geração em lote de provas por máquinas está sobrecarregando gravemente a capacidade de digestão e verificação dos pesquisadores humanos (Fonte: 机器之心、The Verge、Latent Space、Abhishek Saha、openai)

DOE dos EUA e NIH unem-se a gigantes como DeepMind para lançar a “Iniciativa de Biologia Virtual” : O Departamento de Energia dos EUA (DOE) e os Institutos Nacionais de Saúde (NIH) anunciaram uma parceria estratégica de nível nacional com Google DeepMind, Meta, Isomorphic Labs e NVIDIA para criar a “Iniciativa de Biologia Virtual” (Virtual Biology Initiative). O plano visa mapear sistematicamente a biologia celular em escala total e gerar dados de benchmark padronizados, combinando IA multimodal para construir o primeiro modelo digital universal do mundo capaz de prever end-to-end as atividades da vida celular, remodelando a P&D de novos fármacos e a exploração de mecanismos de doenças a partir dos primeiros princípios (Fonte: Alex Rives)
Google DeepMind disponibiliza open-source o EmbeddingGemma 2, modelo de embeddings omnimodal on-device : A Google DeepMind lançou oficialmente em open-source sob a licença Apache 2.0 o EmbeddingGemma 2, seu primeiro modelo de embeddings multimodal baseado na arquitetura Gemma 4. Com 740M de parâmetros, o modelo unifica nativamente o espaço de representação vetorial de texto, código, imagem, áudio e vídeo, suportando 8K de contexto. Seu design modular permite que a modalidade exclusiva de texto opere com 270M de parâmetros, exigindo apenas cerca de 191 MB de memória em dispositivos móveis após quantização. Com o auxílio do aprendizado de representação Matryoshka, suporta o truncamento dinâmico de dimensões para até 768 dimensões; testes práticos da Qdrant mostraram que, combinado com a quantização de 1-bit, o uso de VRAM foi reduzido em 77 vezes, mantendo 94,5% de precisão de recuperação, preenchendo uma lacuna crítica de infraestrutura para RAG omnimodal leve on-device e recuperação semântica offline (Fonte: Google DeepMind Blog、THE DECODER、GoogleDeepMind)

OpenAI cumpre o Dia 2 do “Desafio de 28 Dias”: Auto-review torna-se totalmente gratuito e Decisions API entra em beta público : No segundo dia do desafio “28 dias de melhorias práticas diárias”, a OpenAI lançou várias atualizações centrais focadas em reduzir o atrito na implementação de Agents: o recurso de auditoria automática de controle de risco para tarefas longas, Auto-review, foi aberto gratuitamente para todos os usuários logados do ChatGPT sem consumir cotas; os planos pagos de API foram simplificados de cinco para três níveis: Build, Launch e Grow, com o limite do nível mais alto reduzido para US$ 500; a Decisions API para roteamento discreto e distribuição de ferramentas iniciou seu teste público oficial, impulsionada pelo GPT-6 Luna, com resposta no servidor abaixo de 100 milissegundos, custando apenas US$ 0,10 por milhão de tokens de entrada e isenta de cobranças de saída e cache; além disso, o plugin de espaço de trabalho de reuniões Meetings foi liberado em testes graduais para macOS (Fonte: 机器之心、OpenAI Developers、)

Meta e Sierra unem gigantes para lançar o protocolo de agentes pessoais PAP, estabelecendo normas de interação entre humanos, empresas e Agents : Diante do dilema em que os AI Agents de consumo frequentemente enfrentam bloqueios anti-scraping em websites comerciais, a Meta e a plataforma de atendimento ao cliente com IA Sierra uniram-se a empresas como Stripe, Shopify e Walmart para lançar conjuntamente o padrão aberto da indústria “Personal Agent Protocol” (PAP). Baseado nas arquiteturas A2A e OAuth, o protocolo define com clareza as fronteiras de autenticação e controle de risco na comunicação com sistemas corporativos quando assistentes pessoais de IA executam compras de e-commerce, consultas de passagens e preenchimento de formulários em nome dos usuários; simultaneamente, a Decagon disponibilizou em open-source o protocolo de confiança PACT complementar, acelerando a eliminação de atritos de confiança em chamadas transfronteiriças de agentes (Fonte: The Verge、TechCrunch、saranormous)

🎯 Tendências
Google DeepMind lança Nano Banana 2.1, modelo de geração e edição de imagens : O Google lançou o modelo generativo de imagens Nano Banana 2.1 baseado no Gemini 3.6 Flash (identificador de API: gemini-nano-banana-2.1), disponibilizado simultaneamente na Gemini API, no AI Studio e no Google Ads. O novo modelo oferece suporte nativo a designs de tipografia complexos, inpainting preciso com máscaras e fusão de consistência de personagens com até 14 imagens de referência, renderização de até 4K de resolução, com o custo por imagem caindo para US$ 0,034 (redução de cerca de 50%), focando em solucionar o gargalo de consistência contínua entre múltiplos turnos no design visual comercial (Fonte: 机器之心、GoogleAIStudio、THE DECODER)

Claude supera desafio na teoria das probabilidades com demonstração formalizada em Lean da conjectura de transição de fase contínua em percolação : Um modelo interno de fronteira não divulgado do Claude, da Anthropic, resolveu com sucesso a conjectura da transição de fase contínua (onde a probabilidade de conexão infinita na probabilidade crítica $p_c$ é 0), que intrigava os matemáticos há quase 70 anos. Com base no arcabouço de desigualdades estabelecido pela academia em 2024, o modelo realizou milhares de linhas de deduções formalizadas por meio do assistente de provas Lean, rompendo uma estagnação de longa data nas dimensões físicas críticas de 3 a 10. O avanço da IA ao completar uma demonstração formalizada no nível da Medalha Fields causou forte repercussão na comunidade acadêmica (Fonte: 36氪)

Anthropic expande programa de verificação de cibersegurança e estabelece mecanismo de acesso em três níveis : A Anthropic anunciou a atualização de seu Cyber Verification Program (CVP) para uma arquitetura permanente de acesso em três níveis (nível defensivo, nível red team e nível dedicado), abrindo versões do Claude Opus 5.5, Sonnet 5.5 e Mythos 5.1 com filtros de segurança abrandados para instituições verificadas e especialistas white-hat. O novo sistema disponibiliza pela primeira vez, de forma regular e em conformidade, capacidades de chamadas ofensivas autorizadas para testes de penetração e simulações red/blue team, com o objetivo de solucionar a contradição de que “defensores precisam de ferramentas poderosas para corrigir vulnerabilidades, mas são bloqueados pelas políticas de segurança genéricas” (Fonte: Anthropic News、AnthropicAI、THE DECODER)
DeepMind apresenta AlphaGenome Atlas para decodificar o impacto de variações no genoma completo : A Google DeepMind revelou o modelo de deep learning genômico AlphaGenome e seu banco de dados pré-computado AlphaGenome Atlas. O modelo possui resolução de par de bases único e um contexto longo de 1 milhão de pares de bases; seu atlas pré-calculou o impacto no fenótipo molecular de todas as 9 bilhões de possíveis variações de nucleotídeo único no genoma humano, com uma escala de dados 30 vezes maior que a do banco de dados do AlphaFold, visando analisar sistematicamente os mecanismos de suscetibilidade a mutações raras e doenças complexas (Fonte: )
vLLM v0.31.0 introduz mecanismo de snapshot CRIU, transformando inicializações a frio em restaurações de processos em milissegundos : O vLLM lançou a versão v0.31.0, introduzindo os daemons residentes vllm snapshot e vllm preload. Baseado na tecnologia Linux CRIU, esse mecanismo realiza salvamento rápido de checkpoints e restauração de imagens em tempo de execução do motor de inferência. Isso permite ignorar o demorado processo de carregamento de pesos do modelo e inicialização durante hot switches ou escalonamentos de instâncias, reduzindo significativamente a latência de cold start no agendamento elástico de clusters de inferência em larga escala (Fonte: vLLM)
HIT e NUS lançam QuantWM em open-source, solução de compressão de KV Cache de 2-bit para modelos de mundo de vídeo : Em resposta ao consumo extremo de VRAM pelos modelos de mundo de vídeo autorregressivos e à severa oscilação de imagem (flickering) provocada pela quantização tradicional, equipes do Harbin Institute of Technology (Shenzhen) e da NUS propuseram conjuntamente a solução de quantização training-free QuantWM. O estudo revelou que o desalinhamento da atenção espaço-temporal causado pelas Keys quantizadas é a causa raiz da instabilidade temporal. Através de clustering sensível e compensação de erro em subespaço principal, o método mantém a estabilidade temporal das imagens geradas enquanto atinge uma compressão de KV Cache na VRAM de até 6,2 vezes (Fonte: 机器之心)
.jpg)
Perplexity lança versão atualizada do modelo de decisão open-source pplx-decider-v1.1-27b : A Perplexity disponibilizou a versão atualizada de seu modelo de decisão multimodal open-source pplx-decider-v1.1-27b. Esses pesos alcançaram o topo na mais recente avaliação do Hugging Face Decision Index 0.3, otimizando substancialmente a eficiência de inferência enquanto mantêm a precisão em decisões visuais e lógicas. Simultaneamente, o preço do serviço Decision API correspondente foi reduzido para US$ 0,02 por milhão de tokens de entrada (Fonte: AravSrinivas)

Meta disponibiliza Rebalancer em open-source, solver de decisões de alocação de nível de produção : A Meta disponibilizou oficialmente em open-source o Rebalancer (com interface Python e sob licença Apache 2.0), seu solver C++ central que opera internamente há mais de 9 anos e processa cerca de 40 milhões de alocações de recursos diariamente. A ferramenta abstrai problemas NP-hard, como agendamento de shards e balanceamento de tráfego, em grafos acíclicos direcionados unificados, fornecendo busca local altamente eficiente e resolução de programação linear inteira mista para entidades ultra-largas na escala de milhões (Fonte: MarkTechPost)
TII lança Falcon-Emirati-7B, LLM especializado no dialeto dos Emirados : O Technology Innovation Institute (TII) dos Emirados Árabes Unidos lançou o Falcon-Emirati-7B, modelo especializado no dialeto dos Emirados. A equipe construiu um pipeline de dados que combina dados coloquiais da web, contexto cultural nativo e corpus sintético controlado, obtendo 84,83% de precisão em questões de múltipla escolha no benchmark nativo Alyah, além de aprimorar significativamente a compreensão de metáforas culturais e o alinhamento com a etiqueta local em diálogos livres (Fonte: HuggingFace Blog)

AI Agent para design de produtos do Figma atinge GA comercial completa : O Figma anunciou que seu AI Agent nativo para design de produtos UI/UX está oficialmente disponível para todos os usuários. A nova versão adiciona um mecanismo de vinculação a diretrizes de design de equipe e visibilidade colaborativa de ações de agentes entre equipes no modo multiplayer, permitindo que o agente monte automaticamente interfaces de alta fidelidade e protótipos interativos com múltiplos estados diretamente a partir da biblioteca de componentes (Fonte: The Verge)

Cohere lança em open-source a família de SLMs multilíngues Tiny Aya, cobrindo mais de 70 idiomas de poucos recursos : A Cohere Labs lançou em open-source na conferência COLM 2026 a família de modelos multilíngues leves Tiny Aya. A série combina uma base multilíngue geral com variantes regionalmente especializadas, cobrindo mais de 70 idiomas em todo o mundo (incluindo uma ampla gama de idiomas de baixos recursos), com o objetivo de reduzir as barreiras de implantação multilíngue on-device e melhorar a geração semântica transcultural em modelos pequenos (Fonte: sarahookr)

NeurIPS 2026 | Framework SAGE utiliza sinais de estrutura topológica para corrigir desvios no raciocínio de longo alcance de LLMs : Equipes da Virginia Tech e de outras instituições propuseram o método SAGE (Structure-Admissibility Guided Exploration) para enfrentar o problema crônico dos LLMs no raciocínio em cadeias longas — onde “o desvio ocorre no meio do processo, mas não pode ser corrigido devido ao atraso nas recompensas finais”. O método comprime o viés de exploração via esparsificação algébrica e fornece feedback passo a passo usando distâncias em espaço hiperbólico, melhorando significativamente a precisão em vários benchmarks matemáticos simbólicos e formalizados, multiplicando a taxa de aprovação na verificação com Lean (Fonte: 机器之心)
.jpg)
Google lança Playground, plataforma experimental de geração de jogos sem código : O Google disponibilizou a plataforma experimental de jogos com IA playground.google, onde os usuários podem criar jogos leves no navegador por meio de simples conversas em linguagem natural, incluindo regras físicas personalizadas, interações de personagens e estilos de cena, com suporte a gameplay multiplataforma e compartilhamento comunitário; planos futuros incluem a integração com o Unity Spark para introduzir suporte a engines 3D mais profissionais (Fonte: Google AI Blog)
Replit lança contexto global entre projetos e AI Agent assíncrono de código em segundo plano : A Replit realizou uma grande atualização em seu ambiente de desenvolvimento, introduzindo oficialmente um contexto global entre projetos e workspaces. O agente pode indexar todos os projetos históricos e especificações de design da conta do usuário, permitindo extrair paletas de cores e lógica de componentes de projetos de referência e migrá-los para novos projetos, além de suportar geração assíncrona de tarefas de edição em segundo plano e revisão e merge com um único clique (Fonte: amasad)
🧰 Ferramentas
Hark Pro: Agente pessoal com foco em privacidade on-device equipado com navegador sandbox isolado : A equipe de Brett Adcock, fundador da Figure AI, lançou o aplicativo para desktop e mobile Hark Pro. O sistema conta com o agente de uso de computador Handoff e uma interface criada por ex-integrantes da equipe da Apple, capaz de gerenciar credenciais de usuário com segurança em uma sandbox isolada, navegar na web de forma autônoma e executar solicitações de vistos, compra de passagens e preenchimento de formulários entre sistemas, com todo o histórico de operações transparente para o usuário, equilibrando capacidade autônoma com privacidade on-device (Fonte: TechCrunch、TheRundownAI)
Monid.ai levanta US$ 7,7 milhões para criar gateway dinâmico de liquidação de ferramentas para Agents : A provedora de serviços de desenvolvimento de agentes Monid.ai lançou um gateway de API agregado conhecido como o “OpenRouter para Agents” e captou US$ 7,7 milhões. Os desenvolvedores precisam de apenas uma única interface para que os agentes descubram dinamicamente em tempo de execução e liquidem por uso chamadas a 2.500 APIs comerciais, abrangendo marketing, SEO, busca, e-commerce e geração multimodal, substituindo o modelo tradicional de assinaturas mensais de SaaS corporativo (Fonte: yoheinakajima)
Lançamento do AgentID: Solução de credenciais de identidade independentes criada para AI Agents : A AgentMail lançou o serviço AgentID. A solução atribui a cada agente autônomo em execução um e-mail autenticado independente e credenciais vinculadas a um proprietário humano, permitindo que plataformas SaaS de terceiros autorizem com segurança o login e operações entre plataformas de agentes externos, enquanto mantêm o rastreamento de auditoria e evitam bloqueios por controle de risco de contas (Fonte: omarsar0)
Spotify Portal AI Plugins: Trazendo plataformas de desenvolvimento corporativo para os principais AI Agents de código : O Spotify disponibilizou um pacote oficial de plugins open-source, conectando diretamente sua plataforma interna de desenvolvedores, o Spotify Portal, ao Claude Code, Codex e Cursor. Os agentes podem consultar o catálogo de microsserviços via CLI, invocar diagnósticos de serviço, checar status de integridade e suportar o redirecionamento de tarefas intensivas em E/S para modelos leves por meio do plugin shunt para reduzir custos de tokens (Fonte: GitHub Trending)
T3 Code lança renderização de UI em tempo real e visualização interativa na própria conversa : A ferramenta de código T3 Code lançou um recurso de visualização de UI no aplicativo. Ao realizar refatorações de front-end ou revisões de código de PRs, o agente pode renderizar inline protótipos visuais e componentes interativos em HTML/React diretamente na thread de conversa, reduzindo a perda de contexto causada pela necessidade frequente de o desenvolvedor sair da IDE para depuração com hot-reload (Fonte: theo)

Overmind open-source: Destilação automatizada de SLMs verticais usando trajetórias de execução de agentes : Foi lançada a ferramenta open-source Overmind, que suporta a extração e construção de datasets de fine-tuning e benchmarks de alto valor a partir de logs de chamadas de ferramentas e trajetórias de execução de agentes diários de código ou de negócios. Testes práticos mostraram que o SLM vertical ajustado reduziu a taxa de alucinação de citações de 3,36% (do LLM) para 0,12% no cenário de extração de cláusulas em contratos longos (Fonte: kimmonismus)

Mitchell Hashimoto publica especificação universal OSC 7501 para status de programas de terminal : O renomado desenvolvedor Mitchell Hashimoto publicou uma nova especificação de controle de terminal OSC 7501, permitindo que programas de linha de comando relatem com precisão estados refinados ao terminal, como ocioso, em execução, bloqueado/aguardando, concluído e falho. O objetivo é substituir o julgamento heurístico baseado em regex do qual centenas de orquestradores de agentes dependem atualmente, estabelecendo um protocolo padrão para comunicação de estado multi-agente (Fonte: mitchellh)
Scale AI lança AgentEnv em open-source, framework de ambiente de aprendizado por reforço de alta fidelidade para agentes : A Scale AI, em parceria com a Modal, lançou o toolkit de criação de ambientes AgentEnv. O framework foi desenvolvido especificamente para pós-treinamento com aprendizado por reforço de agentes complexos de longo alcance, oferecendo gatilhos dinâmicos, relógios virtuais e agendamento de múltiplos ambientes de sandbox, conectando-se perfeitamente aos principais clusters de sandbox em nuvem para suportar rollouts massivos e treinamento adversarial no ambiente (Fonte: Scale AI)
DAIR.AI apresenta suíte MCP de exploração de literatura de conferências de topo para agentes : A conhecida organização open-source de IA DAIR.AI lançou um plugin MCP dedicado, suportando integração em um clique com Claude Code, Codex, Grok Bot e outros agentes. O agente pode acessar de forma autônoma um banco de dados curado de artigos de IA para mapear tendências recentes de pesquisa, gerar revisões automatizadas de literatura e realizar comparações visuais de arquiteturas de métodos (Fonte: DAIR.AI)
ruNNtime viabiliza execução do EmbeddingGemma 2 inteiramente no navegador via WebGPU : A biblioteca de inferência WebGPU ruNNtime realizou com sucesso o porte das torres de texto e visão do EmbeddingGemma 2 para um ambiente puramente front-end. Os usuários podem realizar busca semântica multimodal em galerias de imagens diretamente na GPU do navegador local, sem qualquer intervenção de serviços de back-end, comprovando o potencial das arquiteturas leves de recuperação multimodal on-device em proteção de privacidade e cenários offline (Fonte: Reddit r/LocalLLaMA)

Anthropic lança plugin Claude for Google Workspace em beta público : A Anthropic lançou para assinantes pagos um plugin oficial de barra lateral para o Google Workspace, permitindo que os usuários invoquem o Claude diretamente dentro do Docs, Slides e Sheets para edições em múltiplos turnos, otimização estrutural e formatação automática, suportando também a leitura direta de contexto entre documentos (Fonte: The Verge)
📚 Aprendizado
Equipe de Yann LeCun propõe modelo de mundo hierárquico H-JEPA, quadruplicando o sucesso no planejamento visual de longo alcance : Diante do desafio de que o planejamento visual end-to-end tende a perder detalhes locais, a equipe de Yann LeCun propôs a arquitetura H-JEPA com representações hierárquicas top-down. Cada nível possui representações de espaço latente independentes e escalas de abstração semântica; no complexo teste de planejamento de longo alcance no labirinto Visual AntMaze, a estrutura empilhada de três camadas elevou a taxa de sucesso da tarefa de 18% para 73% (Fonte: ylecun)

Meta e MIT apresentam Coco: Plataforma de agentes para co-design de hardware e modelos de deep learning : A Meta e o MIT apresentaram o sistema multi-agente Coco para design de hardware. Diante de centenas de gigabytes de dados de escaneamento de simulação nunca vistos, os agentes conseguem escrever consultas SQL em bancos de dados relacionais de forma autônoma, orquestrar ferramentas analíticas e ler estados de navegação de UI, reduzindo pela metade o tempo gasto por arquitetos de TPU na configuração de simulações e atribuição de gargalos de desempenho (Fonte: dair_ai)

Guia para construir assistentes inteligentes com memória persistente baseados em AgentCore e OpenClaw : A equipe da AWS publicou um longo tutorial de arquitetura demonstrando como combinar a base OpenClaw com os componentes de memória persistente do Bedrock AgentCore em um runtime Serverless. O artigo detalha a arquitetura de memória em duas camadas — captura de eventos de curto prazo e extração assíncrona de fatos de longo prazo — e reduz os custos de inferência em interações com memória de múltiplos turnos em quase 90% por meio da tecnologia de prompt caching (Fonte: AWS Machine Learning Blog)

Stanford propõe o framework Priced Guidance para quantificar a capacidade de LLMs formularem hipóteses científicas originais : A equipe liderada por Percy Liang propôs o paradigma de avaliação Priced Guidance, baseado na teoria da informação. Ao projetar um mecanismo de jogo no estilo “vinte perguntas”, o framework mede com precisão os bits de informação necessários para um modelo recuperar conceitos centrais de artigos recém-publicados no futuro a partir de sua data de corte de pré-treinamento, estabelecendo um benchmark a partir da perspectiva de compressão para quantificar a intuição científica e a capacidade de generalização de ponta dos modelos (Fonte: percyliang)

Análise do mecanismo de destilação on-policy com múltiplos professores (MOPD): Superando conflitos de RL entre múltiplos domínios : O estudo detalha o método Multi-Teacher On-Policy Distillation (MOPD). Para lidar com os conflitos de recompensas e a sobrecarga computacional que ocorrem no fine-tuning unificado com RL em múltiplos domínios (como raciocínio, codificação e diálogo), esse método treina modelos de professores especializados por domínio e, em seguida, fornece supervisão densa ao nível de token para o modelo estudante por meio de divergência reversa de KL, unificando um modelo versátil enquanto mantém a eficiência amostral (Fonte: cwolferesearch)

Framework HAD: Melhorando a capacidade de execução de agentes com SLMs por meio de destilação consciente do ambiente : O artigo propõe o HAD, um método de destilação de agentes com SLMs voltado para implantações com Harness. Ao comparar as diferenças de ação do modelo professor na presença e ausência de informações de estado externo, o método treina especificamente a intenção do modelo pequeno de utilizar informações do framework. No benchmark ALFWorld, a taxa de sucesso das tarefas do modelo pequeno subiu para 63,4%, desobstruindo com sucesso quase 60% dos cenários de travamento (Fonte: omarsar0)

Amazon AGI disponibiliza em open-source o ALoDLM, modelo de linguagem de difusão recorrente adaptativo : A equipe da Amazon AGI disponibilizou em open-source a arquitetura e o esquema de treinamento do ALoDLM de 8B parâmetros. Ao introduzir raciocínio recorrente adaptativo e correção progressiva de erros dentro do modelo de linguagem de difusão, o modelo aloca dinamicamente recursos computacionais para amostras complexas, superando de forma abrangente baselines autorregressivos de mesma escala em múltiplos benchmarks de compreensão e geração geral de linguagem (Fonte: arankomatsuzaki)

Jay Alammar compartilha diagrama de arquitetura central do “Guia Ilustrado de AI Agents” : O renomado autor técnico Jay Alammar compartilhou o diagrama de arquitetura de malha fechada mais crucial para sistemas de agentes, detalhando o mecanismo recursivo de closed-loop do LLM em um ambiente de agente — desde o recebimento de metas do usuário, manutenção de estado e recuperação de memória até a execução de ações no ambiente —, organizando os alicerces centrais de engenharia dos sistemas modernos de agentes autônomos para desenvolvedores (Fonte: Jay Alammar)

💼 Negócios
AMD anuncia proposta de aquisição da World Labs, startup de inteligência espacial de Fei-Fei Li, por US$ 8,2 bilhões em ações : A AMD anunciou um acordo definitivo para adquirir a World Labs, unicórnio de modelos de mundo cofundado por Fei-Fei Li, em uma transação totalmente em ações avaliada em cerca de US$ 8,2 bilhões. Análises do setor indicam que, à medida que o modelo Atlas estabeleceu a viabilidade de reconstrução 4D em tempo real a partir de perspectivas esparsas, a IA incorporada (embodied AI) e os modelos de mundo estão atingindo um ponto de inflexão industrial em escala; o movimento da AMD visa concorrer com a NVIDIA e estabelecer barreiras sólidas em arquitetura de chips de computação 4D e ecossistemas de simulação (Fonte: 36氪)

Kling AI, da Kuaishou, seleciona CICC e Goldman Sachs para preparar IPO em Hong Kong, planejando captar mais de US$ 1 bilhão : O negócio de modelos de vídeo de grande porte da Kuaishou, Kling AI, definiu CICC, Goldman Sachs e UBS como sua equipe de subscritores para avançar com o processo de spin-off e IPO em Hong Kong, com a meta de captar pelo menos US$ 1 bilhão e expectativa de listagem a partir de 2027. No segundo trimestre de 2026, a receita do Kling já ultrapassou 850 milhões de yuans; a listagem independente visa ampliar canais autônomos de captação de recursos para a custosa P&D em clusters computacionais, mantendo o controle acionário absoluto da Kuaishou (Fonte: 36氪)

Lambda, provedora de nuvem de computação de IA, planeja levantar US$ 4 bilhões com avaliação de US$ 14,5 bilhões antes de IPO : Segundo o Wall Street Journal, a fornecedora de infraestrutura de nuvem GPU Lambda está levantando até US$ 4 bilhões com uma avaliação pré-investimento de US$ 14,5 bilhões, em rodada liderada por Coatue e Blackstone. Graças a contratos massivos de capacidade de computação de grandes clientes como a Anthropic, sua carteira de pedidos acumulados disparou para US$ 50 bilhões; esta rodada de financiamento de capital será utilizada para garantir a construção de data centers de próxima geração antes de seu planejado IPO (Fonte: TechCrunch)
🌟 Comunidade
Adoção de agentes corporativos enfrenta “imposto de colaboração”: cada 1 hora de resolução de chamados gera 3 horas de comunicação interna : Uma pesquisa realizada pela plataforma de gestão de atendimento Front com 700 executivos corporativos gerou ampla repercussão. Os dados revelam que a introdução de agentes nas empresas não reduziu diretamente os custos com mão de obra; em vez disso, devido à incapacidade dos agentes de fechar ciclos completos, provocando transferências entre múltiplos nós e escalonamento de tickets, gerou-se um enorme e imensurado “imposto de colaboração” — o tempo gasto pelas empresas em transferências entre sistemas e verificação de contexto atingiu o triplo do tempo real de resolução, evidenciando o ponto crítico de governança gerado pela falta de observabilidade ponta a ponta (Fonte: )
Análise aprofundada da inserção de anúncios de apostas no final de títulos do ChatGPT: contaminação de tokenizer e falha no truncamento : Desenvolvedores reconstituíram detalhadamente a mecânica técnica por trás do surgimento esporádico de anúncios ilegais nos títulos de conversas do ChatGPT. Como o corpus de pré-treinamento do tokenizer o200k foi contaminado por um grande volume de tokens longos e de alta frequência de sites de apostas e áreas cinzentas, o modelo leve de inferência de títulos sofria um desvio de probabilidade ao emitir o token de controle EOS no encerramento, acabando por amostrar erroneamente trechos de anúncios de alta probabilidade a partir da “lixeira” de tokens raros que o modelo nunca havia visto (Fonte: 36氪)
Ascensão da arquitetura de Harness nativa da nuvem: Criadores do K8s exploram solução de governança centralizada para agentes : A Stacklok, fundada pela equipe central inicial do Kubernetes, lançou em open-source o projeto de Agent Harness nativo da nuvem Mecatl. A comunidade debateu profundamente a trajetória evolutiva dos agentes, migrando de “scripts de terminal local” para “plataformas centralizadas de controle corporativo”, defendendo a desassociação completa do estado do agente, gateways de ferramentas MCP e ambientes sensíveis de execução em sandbox, evitando que ativos corporativos essenciais e permissões fiquem vinculados a ambientes de máquina única (Fonte: Latent Space)
Meta Muse é exposta criando perfis sociais de 4 milhões de usuários em tempo real, gerando preocupações com privacidade : A comunidade revelou que o agente Muse, da Meta, atualiza automaticamente a cada hora perfis detalhados com base nas conversas e registros de comunicação dos usuários, incluindo redes de relacionamento social, conflitos interpessoais e preferências. Embora a Meta afirme que as VMs dos usuários pertencem a sandboxes isoladas, o mecanismo de “experiências de aprendizado compartilhadas” entre instâncias ainda provocou forte alerta entre os usuários sobre coleta invisível de dados e abuso para publicidade direcionada (Fonte: Reddit r/artificial)

Desenvolvedores debatem a IA que “não fala a língua humana”: da compressão de CoT ao desajuste no encaixe de dados : Recentemente, as comunidades de desenvolvedores têm criticado amplamente o hábito dos mais novos LLMs de código de usarem jargões rígidos e bizarros como “15/15 tudo verde, uma perna falhou” em relatórios. Discussões apontam que parte da razão decorre de tentativas de fornecedores de comprimir fortemente cadeias de pensamento implícitas (CoT) em termos ultra-abreviados e obscuros para reduzir o consumo de tokens; entusiastas aproveitaram a oportunidade para debater até as vantagens naturais de engenharia da densidade do chinês clássico para compressão extrema de tokens (Fonte: 量子位)

Vulnerabilidade de bypass com Prompt criptografado é exposta: auto-descriptografia de agentes torna-se ponto fraco de segurança : Pesquisas de segurança apontaram que invasores estão usando instruções maliciosas criptografadas para burlar os filtros de segurança externos de sistemas como o Copilot. Ao processar a entrada, o agente descriptografa o conteúdo ativamente, recupera segredos locais e executa a exfiltração pela rede. Testes revelaram que os mecanismos automáticos de roteamento de modelos tornam as defesas de segurança altamente instáveis, provando que depender da autorregulação do modelo como linha de defesa de segurança apresenta vulnerabilidades sistêmicas (Fonte: Reddit r/artificial)

Ruptura no limite da miniaturização: Desenvolvedor treina MacroStories, modelo narrativo de apenas 20 mil parâmetros : Um desenvolvedor independente disponibilizou em open-source o micromodelo de linguagem MacroStories, com apenas 81 KB (19.969 parâmetros). Utilizando uma arquitetura de inferência recorrente de 4 passos com decoder único, o modelo consegue rodar em velocidades extremas em CPUs comuns ou até mesmo na memória cache de microcontroladores, mantendo uma linha narrativa clara dentro de um vocabulário restrito, explorando o limite computacional mínimo necessário para a coerência de linguagem (Fonte: Reddit r/LocalLLaMA)

💡 Outros
Expansão da rede elétrica e escassez na cadeia de suprimentos de transformadores podem frear a IA antes dos chips de computação : Análises de políticas energéticas apontam que, embora a carga de energia dos data centers de IA nos EUA deva subir para 50 GW até 2030, o prazo de entrega de equipamentos elétricos pesados, como transformadores de ultra-alta tensão, já ultrapassa comumente 5 anos, e os fabricantes relutam em expandir a produção cegamente devido a bolhas de capacidade no passado. O descompasso rígido de oferta e demanda da rede elétrica física e das instalações de transmissão e transformação está se tornando o gargalo físico real mais severo que restringe a expansão desordenada da computação (Fonte: Transformer)
Suíte completa de design da Adobe é recriada via engenharia reversa open-source: LLMs de código remodelam o fosso de propriedade intelectual : O projeto open-source Artcraft utilizou modelos de código de ponta, como o Opus 5.5, para descompilar a lógica de suítes de design tradicionais e reestruturá-las nos padrões de Rust, concretizando uma alternativa open-source limpa (clean room) de nível Photoshop para todo o pacote de software. A comunidade debate com intensidade como a capacidade dos agentes de código de realizarem engenharia reversa ultrarrápida em softwares legados está rompendo fundamentalmente os fossos comerciais de alta barreira dos quais softwares proprietários tradicionais sempre dependeram (Fonte: dotey、amasad)

McDonald’s enfrenta processo antitruste por suposto conluio de preços entre franquias usando ferramenta de precificação por IA : Consumidores entraram com uma ação coletiva antitruste contra o McDonald’s em um tribunal federal de Chicago, acusando a empresa de exigir que franqueados independentes adotem uma ferramenta de IA de precificação dinâmica que, na prática, promoveu a troca horizontal de dados de vendas não públicos e manipulação algorítmica de preços, violando os direitos dos consumidores e perturbando a ordem da concorrência de mercado (Fonte: The Guardian)
