🔥 Em Foco
Modelo misterioso Ox Alpha surge de surpresa no OpenRouter e OpenCode : O OpenRouter e o OpenCode lançaram de surpresa um modelo em modo stealth com o codinome “Ox Alpha”, oferecendo uma janela de contexto de 1 milhão de Tokens e suporte nativo a entradas de texto, imagem e vídeo. O modelo foi projetado especialmente para programação com Agents de longo ciclo, raciocínio complexo e ambientes de produção reais, disponibilizando uma cota de teste gratuita de 100 trilhões de Tokens por dia. Vários testes práticos de desenvolvedores mostram que sua capacidade de programação e raciocínio supera o Fable 5 e o GPT-5.6 Sol. Há intensas especulações em toda a internet sobre sua verdadeira identidade, com a comunidade apontando principalmente para o Zhipu GLM-5.4/5.5 ou o Xiaomi MiMo V3 (fonte: OpenRouter, 36Kr)
DeepSeek lança oficialmente de surpresa o modelo de visão multimodal V4-Flash-Vision-Exp : A plataforma oficial de API da DeepSeek lançou de surpresa seu primeiro modelo nativo de compreensão visual, o DeepSeek-V4-Flash-Vision-Exp. Mantendo a potente capacidade de texto do V4-Flash, o modelo teve o desempenho do seu Agent multimodal significativamente aprimorado, aproximando-se do Opus 4.8. As imagens são convertidas em Tokens conforme o tamanho (com limite de 384 tokens por imagem), e o preço de cobrança é idêntico ao do V4-Flash (equivalente a cerca de 1 yuan por mil imagens), contando também com a liberação simultânea da API gratuita de Files e adaptação para Harness 0.1.1, reduzindo bastante os custos de desenvolvimento e execução de Agents visuais (fonte: DeepSeek, JiQizhiXin)

Google lança Gemini 3.7 Flash e supera múltiplos benchmarks de Agent : O Google lançou oficialmente o Gemini 3.7 Flash, com preço de API 50% menor em relação ao 3.6 Flash e um salto significativo de inteligência no nível algorítmico. No benchmark de análise de dados reais AA-AnalystAgent da Artificial Analysis, o Gemini 3.7 Flash alcançou o topo do ranking, completando tarefas de 60% a 90% mais rápido do que os concorrentes; ao mesmo tempo, na avaliação de verificação ARC-AGI, atingiu uma pontuação elevada de 84,6% no ARC-AGI-2 com custo extremamente baixo, demonstrando um ótimo custo-benefício e excelente capacidade para Agents visuais (fonte: demishassabis, Google Research Blog)

OpenAI cria fundação e lança o projeto AI Futures : A OpenAI estabeleceu oficialmente a OpenAI Foundation e lançou o projeto AI Futures, com o objetivo de transformar as capacidades de AGI em amplos benefícios públicos para a sociedade. A fundação foca em ciências da vida (como design de proteínas e desenvolvimento de novos medicamentos) e resiliência social de IA (defesa contra ameaças biológicas/cibernéticas), já tendo investido centenas de milhões de dólares nos primeiros cinco meses e com planos de investir bilhões no futuro, incluindo uma doação de US$ 17,2 milhões para a SecureBio para construir um sistema de alerta precoce. Essa iniciativa sinaliza que os principais laboratórios de IA estão acelerando a criação de infraestruturas públicas para prevenir o uso indevido da tecnologia e os riscos sociais (fonte: OpenAI News, woj_zaremba)

🎯 Tendências
NVIDIA lança o Agent AVO e atinge pontuação máxima de 100% no ARC-AGI-3 : A equipe de IA da NVIDIA lançou o AVO, um Agent de programação geral e raciocínio interativo. Sem nenhuma instrução explícita, regra ou objetivo predefinido, o AVO Harness impulsionado pelo Claude Opus 5 concluiu todas as 183 fases nos 25 ambientes do benchmark de raciocínio interativo ARC-AGI-3, obtendo nota máxima de 100%, além de uma eficiência de execução de ações 12% superior a sistemas similares (fonte: ClementDelangue)
Alibaba lança modelo base de Agent Qwen-UI-Agent em código aberto : A Alibaba apresentou o Qwen-UI-Agent (disponível nas versões 27B / 35B-A3B / 4B), um modelo base de Agent de GUI voltado para execução em dispositivos móveis, desktops e web, treinado com base em mais de 100 celulares reais. O modelo unificou o espaço de ações de cliques em GUI e comandos de CLI, superando o GPT-5.6 Sol e o Opus 4.8 em 5 benchmarks de GUI principais (fonte: 36Kr)
Xiaohongshu disponibiliza FireRedTTS3, modelo unificado de geração e edição de voz : A Xiaohongshu lançou o FireRedTTS3, a nova geração de seu modelo de voz. Baseado na representação contínua aprimorada por semântica inédita RedAE, o modelo unifica em uma única estrutura a clonagem zero-shot de 24 idiomas e 21 dialetos chineses, o design de voz por linguagem natural e a edição local precisa de áudio, alcançando o topo em quatro grandes benchmarks públicos, incluindo o Seed-TTS-Eval (fonte: JiQizhiXin)

Replit lança o modo gratuito (Free Mode) impulsionado pelo GPT-5.6 Luna : A Replit, em parceria com a OpenAI, lançou o Free Mode impulsionado pelo GPT-5.6 Luna, permitindo que usuários do mundo todo experimentem gratuitamente a programação interativa com IA e o desenvolvimento de aplicações com Agents, reduzindo consideravelmente as barreiras para criar softwares completos do zero (fonte: amasad)

Meta lança o modelo nativo omnimodal Muse Spark 1.2 : A Meta lançou oficialmente o Muse Spark 1.2, contando com poderosas capacidades de geração de código visual, planejamento para robótica e compreensão de áudio e vídeo. Na avaliação do Design Arena, obteve o primeiro lugar na categoria Video-to-Website e posições de destaque na lista Image-to-HTML, demonstrando um altíssimo valor prático omnimodal (fonte: alexandr_wang)

OpenAI exibe prévia do recurso de geração nativa com fundo transparente no GPT-Image-2 : A OpenAI introduziu a prévia do parâmetro background=transparent na API do GPT-Image-2, permitindo que o modelo gere diretamente camadas PNG transparentes com canal alpha durante a fase de geração, com resultados em texturas complexas, como transparência de vidro e fios finos nas bordas, muito superiores aos recortes tradicionais de pós-processamento (fonte: THE DECODER)
Adobe Firefly integra o Google Gemini Omni Flash e lança ferramentas de áudio com IA : A Adobe anunciou a integração do modelo de vídeo multimodal Google Gemini Omni Flash em sua plataforma de criação Firefly, além de disponibilizar totalmente três ferramentas de geração de áudio com IA seguras para uso comercial: Generate Music, Generate Speech e Generate Sound Effects (fonte: THE DECODER)
Google lança o modelo de linguagem visual com percepção espacial TIPS : O Google disponibilizou em código aberto no Hugging Face o modelo de linguagem visual com percepção espacial TIPS (e TIPSv2), projetado especialmente para tarefas densas de compreensão visual, como segmentação de imagens e estimativa de profundidade (fonte: gabriberton)

Runway lança Ruby, modelo de aprimoramento de vídeo em HDR de 16 bits : A Runway lançou o modelo de vídeo Ruby, que suporta a conversão de vídeos SDR para sequências ProRes/EXR em HDR de 16 bits, aumentando a profundidade de cor e o desempenho da qualidade de imagem dos vídeos gerados e materiais enviados (fonte: c_valenzuelab)
NetEase Xiaomifeng explora comunidade interativa de IA e oferta de UGC de próxima geração : A plataforma Xiaomifeng da NetEase integrou profundamente recursos de IA baseados em modelos próprios e de código aberto em uma comunidade focada nos jovens, lançando o assistente pessoal “Wannao Longxia” e conteúdos de jogos/gráficos interativos com IA, impulsionando a transformação do formato de conteúdo da comunidade em UGCs interativos, jogáveis e recriáveis (fonte: 36Kr)

🧰 Ferramentas
MiniMax lança plataforma de geração e criação de vídeo MiniMax Design : A MiniMax apresentou a plataforma MiniMax Design, voltada para a produção comercial de vídeos. Tendo o Agent como entrada principal, a plataforma integra roteiro, storyboard, geração, dublagem e edição em uma única tela, introduzindo um mecanismo de Skill reutilizável para concorrer diretamente com os fluxos de produção comercial de vídeo da Adobe e da Canva (fonte: 36Kr)

DP Technology lança ambiente colaborativo de pesquisa em IA para desktop “Bohr Science Space” : A DP Technology lançou o aplicativo para desktop “Bohr Science Space”, equipado com especialistas em IA disciplinares como SciMaster, BioMaster e PharmMaster. O aplicativo integra todo o fluxo de pesquisa de literatura, dedução de hipóteses, cálculo de dados e escrita de artigos, ajudando os pesquisadores a assumirem o trabalho manual exaustivo da pesquisa científica (fonte: QbitAI)

Lindy lança extensão do Chrome para gestão inteligente da caixa de entrada : A plataforma de AI Agent Lindy lançou uma extensão para o Chrome integrada diretamente à caixa de entrada do Gmail, capaz de usar a base de memória pessoal para gerar resumos noturnos de e-mails, redigir respostas e realizar a classificação automática por etiquetas (fonte: omarsar0)
ChatGPT / Codex integra plugin de busca ExaAI : A OpenAI integrou o plugin ExaAI no ChatGPT Work e no Codex, permitindo que o AI Agent pesquise diretamente em mais de 100 bilhões de páginas da web, artigos acadêmicos e documentos corporativos em toda a internet (fonte: OpenAIDevs)
OpenHistory lança aplicativo nativo para Mac em código aberto para rastreamento de fluxo de trabalho : Desenvolvedores lançaram o aplicativo OpenHistory em código aberto, usando modelos locais no Mac para registrar automaticamente históricos de trabalho e gerar resumos, além de suportar colaboração com Agents locais por meio do protocolo seguro MCP (fonte: zachtratar)
OpenBot lança alternativa de código aberto ao Grok Bot para múltiplos Harnesses : A equipe da CopilotKit disponibilizou em código aberto o OpenBot, oferecendo uma alternativa ao Grok Bot adaptável a qualquer Agent Harness, com suporte a UI generativa, controle de computador, colaboração Agent-Human e retenção privada de dados (fonte: hwchase17)
📚 Aprendizado
Pesquisadores da Pleias propõem verificador (Verifier) ultra-pequeno de 0,63M de parâmetros : Pesquisadores exploraram o limite inferior de tamanho de modelos verificadores, demonstrando que um modelo ultra-pequeno de 630 mil parâmetros, pré-treinado em apenas 2 minutos em uma única H100, pode alcançar o desempenho de grandes modelos de 7B em tarefas de verificação específicas (fonte: Dorialexander)

Spark-to-Paper: sistema de código aberto ponta a ponta para geração de artigos acadêmicos : Uma equipe de pesquisa apresentou o Spark-to-Paper, um sistema em código aberto para geração de artigos baseado em assistentes de programação. Composto por 13 habilidades combináveis, ele consegue partir de uma ideia de pesquisa para executar experimentos, criar gráficos vetoriais, verificar dados e gerar diretamente artigos em LaTeX prontos para compilação, com uma taxa de detecção de conclusões falsas de 92% (fonte: JiQizhiXin)

Universidade de Zhejiang e Baidu propõem o framework de aprendizado por reforço para Agents de longo alcance BEACON (ICML 2026) : A Universidade de Zhejiang e a Baidu propuseram o BEACON, um framework de aprendizado de política guiado por marcos que divide trajetórias nas fronteiras dos marcos e combina estimativas de vantagem em duas escalas. A solução resolve o problema de atribuição incorreta de crédito em tarefas de Agent de longo alcance, elevando a taxa de sucesso nas tarefas longas do ALFWorld de 53,5% (com GRPO) para 92,9% (fonte: JiQizhiXin)

Relatório de avaliação AutoResearch: falta de “loop metacognitivo” em Agents causa falha em julgamentos científicos : Instituições como Stanford e Prentis AI diagnosticaram 800 trajetórias de pesquisa científica de Agents, descobrindo que 92,1% das falhas decorrem de erros cognitivos e lógicos não relacionados à engenharia, e que 82,5% das trajetórias apresentaram uma lacuna metacognitiva de “perceber o problema, mas não corrigi-lo”, revelando o gargalo da pesquisa científica automatizada ao passar da simples execução de engenharia para decisões mais profundas (fonte: JiQizhiXin)

Patronus AI disponibiliza FigmaTrace, conjunto de dados de uso de computador em design : A Patronus AI lançou em código aberto o FigmaTrace, o primeiro conjunto de dados de Computer-use voltado para o design de UI/UX, reunindo mais de 200 horas e mais de 3.400 trajetórias de operações complexas de longo ciclo de designers reais no Figma (fonte: rebeccatqian)
Fundador do LangChain lança série de tutoriais sobre Managed Deep Agents : Harrison Chase publicou uma série de vídeos e tutoriais sobre Managed Deep Agents, explicando sistematicamente como construir, implantar e gerenciar um Agent Harness profundo e seu ambiente de execução em produção (fonte: hwchase17)

Google propõe a teoria de roteamento inteligente de modelos Pandora’s Router : A equipe do Google DeepMind formalizou o roteamento de múltiplos modelos como um problema de busca da “caixa de Pandora”, calculando de forma abrangente o custo de avaliação e os ganhos dos especialistas. Essa abordagem reduz drasticamente as chamadas a estimadores de alto custo ao mesmo tempo em que mantém a qualidade total da busca (fonte: dair_ai)

💼 Negócios
GPT-5.6 Sol impulsiona aumento de 82% no trimestre dos gastos corporativos da OpenAI no Q3 : De acordo com dados recentes e análises da Ramp, impulsionados pelo forte desempenho do modelo GPT-5.6 Sol, os gastos corporativos com API da OpenAI no Q3 de 2026 cresceram 82% em relação ao trimestre anterior, ultrapassando os 76% da Anthropic e impulsionando um aumento de 35% na receita do terceiro trimestre (fonte: THE DECODER, GavinSBaker)

River AI levanta US$ 110 milhões em rodada de US$ 1,1 bilhão com participação da Cisco Investments : A Cisco Investments anunciou um investimento estratégico na rodada de financiamento de US$ 1,1 bilhão da startup de IA pessoal descentralizada River AI, visando promover conjuntamente infraestruturas de IA controladas autonomamente pelos usuários (fonte: ibab)
Hark lança dispositivo de hardware para consumo nativo de IA em parceria com a AT&T : A startup de hardware de IA Hark anunciou uma parceria estratégica com a gigante de telecomunicações norte-americana AT&T, que realizou um investimento na empresa e fornecerá suporte para certificação de rede e dispositivos. Ambas lançarão conjuntamente a próxima geração de terminais inteligentes pessoais nativos em IA (fonte: adcock_brett)

🌟 Comunidade
Análise da Pangram: barreira de pós-treinamento com RLHF causa “Mode Collapse”, tornando os textos de IA mais fáceis de detectar : A organização de detecção de IA Pangram destacou que modelos base não ajustados originalmente possuem diversidade linguística comparável à dos humanos. Contudo, o RLHF e as regras de comportamento impostas por barreiras de segurança causam o colapso de modo (Mode Collapse), fazendo com que os modelos prefiram estruturas de frases fixas, o que acabou se tornando a principal característica para a detecção de alta precisão de textos gerados por IA (fonte: THE DECODER)

💡 Outros
Lançada a versão estável do runtime JavaScript Bun 1.4 (completamente reescrito em Rust) : Após ser adquirida pela Anthropic, a Bun lançou oficialmente a versão estável do Bun 1.4 inteiramente reescrita em Rust, corrigindo mais de 2.900 Issues e eliminando vazamentos de memória. A versão inclui processamento de imagem integrado, automação de navegador e implantação em HTTP/3, superando 20 milhões de downloads mensais (fonte: 36Kr)

RayNeo lança óculos ultraleves RayNeo iO AI : A RayNeo lançou os óculos RayNeo iO AI, com ópticas e armações reestruturadas, reduzindo o peso para 34g, com autonomia de dois dias de bateria e suporte a lentes de grau. Contando com um motor de memória para o dia todo e bases multimodelo como DeepSeek V4 Pro e Qwen 3.7 Max, os óculos oferecem aprimoramentos proativos de conhecimento, memória e tradução em tempo real (fonte: QbitAI)

Intensificação da corrida de IA EUA-China e alinhamento do bloco Pax Silica : Os Estados Unidos redigiram um documento exigindo que países aliados tomem um lado claro na corrida de IA entre EUA e China. Países que se juntarem à Organização de Cooperação em IA da China (WAICO) serão excluídos da aliança Pax Silica, destacando os riscos políticos de fragmentação da infraestrutura e das cadeias de suprimentos globais de IA (fonte: THE DECODER)