🔥 Em Foco
xAI lança Grok 4.6 e apresenta o agente Grok Bot : A xAI lançou oficialmente o modelo Grok 4.6, que suporta 500K de contexto e entrada multimodal. O modelo obteve 61 pontos no índice de inteligência AA, igualando-se ao GPT-5.6 Sol, e ficou em segundo lugar na avaliação de trabalho real GDPVal-AA v2 com 1753 Elo. O preço de sua API é de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída, sendo mais de 60% mais barato que os concorrentes. Lançado simultaneamente, o Grok Bot suporta colaboração multi-agente e execução independente na nuvem, podendo fazer login automaticamente em aplicativos de terceiros e aprender o fluxo de trabalho do usuário. (Fonte: xAI)

Versão oficial do DeepSeek V4 Pro é lançada e framework Harness é disponibilizado em código aberto : A DeepSeek lançou a versão oficial do V4 Pro (0813), que adota uma arquitetura MoE de 1.6T de parâmetros, suportando 1M de contexto e entrada de imagem. Suas capacidades de Agent deram um salto significativo, disparando de 12,8 pontos na versão preview para 62,7 pontos no benchmark DeepSWE. Ao mesmo tempo, a empresa disponibilizou em código aberto o framework de agentes DeepSeek Harness v0.1, baseado no microkernel Cordis, que permite a montagem flexível de modelos, ferramentas e sandboxes como plugins. (Fonte: DeepSeek)
.jpg)
Alibaba disponibiliza em código aberto o grande modelo Qwen3.8-Max com 2,4 trilhões de parâmetros : A equipe do Qwen da Alibaba disponibilizou em código aberto os pesos do modelo Qwen3.8-2.4T-A95B (Qwen3.8-Max), que possui 95B de parâmetros ativos e suporta nativamente 262K de contexto. O modelo obteve 93 pontos no PaperBench e apresentou excelente desempenho em tarefas de agentes como o OSWorld. A Unsloth utilizou tecnologia de quantização de 1-bit para reduzir seu tamanho em 91%, para 397GB, tornando possível a implantação local. (Fonte: Hugging Face)
Google DeepMind apresenta o modelo de tradução de língua de sinais para texto SL2T : A Google DeepMind lançou o SL2T, um modelo de tradução de língua de sinais para texto, que já está disponível no Gboard e no Live Transcribe do Pixel 11. O modelo alcançou uma pontuação zero-shot de 70 BLEURT no benchmark de tradução FLEURS-ASL. Para proteger a privacidade, o sistema utiliza o MediaPipe Holistic para extrair localmente as coordenadas da pose humana, enviando apenas os dados geométricos para a nuvem para realizar a tradução em tempo real de ASL para inglês. (Fonte: Google DeepMind)
Revelado o primeiro modelo de raciocínio baseado em TTT da SSI, empresa de Ilya : Rumores na comunidade indicam que a SSI, fundada por Ilya Sutskever, está desenvolvendo um pequeno motor de raciocínio baseado em Test-Time Training (TTT). Durante a inferência, o modelo pode atualizar parte de seus pesos em tempo real via descida de gradiente para se adaptar a dados fora de distribuição, libertando-se das limitações de janelas de contexto estáticas e alcançando um aprendizado contínuo altamente eficiente em termos de amostras, com desempenho competitivo frente a modelos muito maiores. (Fonte: X)

🎯 Tendências
Dyna Robotics lança o modelo Dyna-2 pré-treinado em milhões de horas de vídeos egocentric : A Dyna Robotics lançou o Dyna-2, um modelo de ação de mundo para manipulação robótica. O modelo foi pré-treinado em mais de 1 milhão de horas de vídeos em primeira pessoa (egocentric) humana, validando pela primeira vez a capacidade de generalização cross-body da Scaling Law em dados robóticos não vistos. Experimentos mostram que o treinamento conjunto de previsão de vídeo e denoisificação de ação é a chave para alcançar a generalização. (Fonte: Dyna Robotics)
Xiaohongshu e Universidade Jiao Tong de Xangai disponibilizam em código aberto o modelo de síntese de voz autorregressivo contínuo dots.tts : O modelo possui 2 bilhões de parâmetros e modela diretamente bloco a bloco de forma autorregressiva em um espaço latente contínuo, evitando a perda de informações causada por tokens acústicos discretos. No benchmark Seed-TTS-Eval, sua similaridade média de locutor e precisão de conteúdo atingiram o estado da arte (SOTA), suportando saída em streaming e modo de interação de fluxo duplo. (Fonte: JiQiZhiXin)
.jpg)
Microsoft lança MAI-Code-1.1-Flash e reduz preços drasticamente : A Microsoft atualizou seu modelo de código e lançou o MAI-Code-1.1-Flash, otimizando o consumo de tokens para tarefas de CLI e agentes. Ao mesmo tempo, a Microsoft reduziu os preços da API no GitHub em 75% (US$ 0,2 por milhão de tokens de entrada e US$ 1,2 por milhão de saída), com o objetivo de se manter competitiva no mercado de programação dominado pela Anthropic. (Fonte: AI Business)

Equipe de segurança da Alibaba lança o modelo de base de segurança multimodal Yuvion VL : A equipe de segurança da Alibaba apresentou a série de modelos Yuvion VL, focada em IA e segurança de conteúdo. O modelo introduz o framework de aprendizado contrastivo C2FT (Confused Contrastive Fine-Tuning) para minerar dinamicamente amostras negativas difíceis e confusas. Avaliações mostram que sua versão de 8B superou grandes modelos comerciais como o GPT-5.4, que possui 50 vezes mais parâmetros, em várias tarefas de segurança. (Fonte: arXiv)
Oxford e Universidade Nacional de Singapura propõem o framework de “Modelo de Mundo Mental” MWM : Uma equipe de pesquisa conjunta propôs o framework de Modelagem de Mundo Mental (MWM), defendendo a inclusão de variáveis mentais dos agentes, como crenças, objetivos e emoções, no estado global do mundo. Testes com o sistema de referência MENTIS demonstraram que, em comparação com modelos de mundo puramente físicos, a modelagem explícita de estados mentais melhora significativamente a pontuação F1 na previsão de tomadas de decisão humanas. (Fonte: arXiv)
.jpg)
Equipes da Universidade de Pequim e parceiros propõem o ContactSeek, um framework de otimização de editores genéticos baseado na probabilidade de contato do AF3 : A equipe de pesquisa conjunta publicou um artigo na revista Nature, propondo o ContactSeek, um framework de IA que utiliza a probabilidade de contato (CP) prevista pelo AlphaFold3 para otimizar a especificidade de editores genéticos. O framework identificou com sucesso os resíduos de contato cruciais na interação entre a proteína Cas e o DNA/RNA, projetando variantes de editores de base de alta fidelidade. (Fonte: Nature)
.jpg)
LiteLLM sofre ataque massivo à cadeia de suprimentos, resultando no vazamento de terabytes de credenciais : Agências de segurança revelaram que a ferramenta de desenvolvimento de IA de código aberto LiteLLM ocorreu um ataque à cadeia de suprimentos em março. Hackers usaram uma versão maliciosa no repositório oficial PyPI para roubar chaves de nuvem, tokens de API e chaves privadas SSH de 2.500 empresas (incluindo Microsoft, Amazon, Salesforce, etc.) em apenas 40 minutos, totalizando 195 TB de dados vazados. (Fonte: Ars Technica)
Apple negocia pagamentos a editoras de notícias para melhorar o serviço de notícias por IA da Siri : De acordo com relatórios, a Apple está em negociações com várias grandes editoras de notícias, propondo pagá-las quando a Siri utilizar seus conteúdos jornalísticos para responder a perguntas dos usuários ou gerar resumos. A medida visa obter dados de alta qualidade em tempo real e em conformidade regulatória para aprimorar a experiência do assistente inteligente Siri. (Fonte: The Wall Street Journal)
Google lança série Pixel 11 com atualizações completas nos recursos de Gemini AI : A Google lançou a linha de smartphones Pixel 11 no evento Made by Google ‘26. Os novos aparelhos são equipados com o processador Tensor G6 e contam com integração profunda do Gemini. Os novos recursos incluem suporte para tradução em tempo real de língua de sinais ASL para texto, entrada de voz Rambler capaz de entender expressões coloquiais e integração de dados de saúde com o Pixel Watch 5. (Fonte: TechCrunch)

iFLYTEK lança matriz de agentes de serviços corporativos cobrindo sete cenários principais : A iFLYTEK lançou uma matriz de agentes que abrange sete cenários, incluindo gestão inteligente, TI de processos e transações de cadeia de suprimentos, impulsionando a IA corporativa a evoluir de “executar ações isoladas” para “entregar resultados de negócios”. Os produtos incluem um agente de auditoria de conformidade para supervisão de compras e o agente SparkOS com interação hiper-realista. (Fonte: QbitAI)

Kong Tao, ex-líder de robótica da ByteDance, junta-se à Xiaomi como chefe do Departamento de Inteligência Incorporada e Aplicações : Kong Tao, ex-líder da equipe de robótica da ByteDance, juntou-se recentemente à Xiaomi para chefiar o recém-criado “Departamento de Inteligência Incorporada e Aplicações”. Os cenários físicos reais da Xiaomi em seu ecossistema integrado de “Pessoas, Carros e Casas”, como a fabricação de carros inteligentes, são considerados fatores-chave que atraíram este doutor em ciência da computação pela Universidade Tsinghua. (Fonte: 36Kr)
Canva reduz previsão de crescimento de receita em um terço devido aos altos custos de computação de IA : A unicórnio de software de design Canva reduziu sua taxa de crescimento de receita esperada para 20%. A CEO Melanie Perkins revelou que a demanda dos usuários por recursos de IA superou em muito as expectativas, resultando em uma explosão nos custos de computação. A empresa decidiu desacelerar a implantação de alguns recursos de IA e reconstruir sua arquitetura subjacente para reduzir o custo de tokens por tarefa. (Fonte: Reddit)

🧰 Ferramentas
LlamaIndex lança ExtractBench e LlamaExtract Agentic Plus : A LlamaIndex apresentou o ExtractBench, um conjunto de avaliação para extração de informações de documentos corporativos. Para resolver o problema de colapso de recall de VLMs de ponta na extração de documentos longos, eles lançaram o LlamaExtract Agentic Plus, que processa documentos longos de forma iterativa e segmentada, alcançando uma pontuação F1 de 96,1% em tarefas de extração de listas longas. (Fonte: LlamaIndex)
OpenAI lança espaço de trabalho corporativo ChatGPT Work e ferramenta de geração de páginas Sites : A ferramenta pode integrar perfeitamente documentos do Google Drive, resultados financeiros do NetSuite e discussões de equipe do Slack de uma empresa. Os usuários podem usar comandos em linguagem natural para concluir automaticamente auditorias financeiras trimestrais complexas, análises de dados preditivos e gerar painéis de dados interativos no Sites com um único clique. (Fonte: OpenAI)

Ferramenta de gestão de relacionamentos Mesh da Automattic chega à plataforma Android : A ferramenta de gestão de relacionamentos pessoais e CRM Mesh (anteriormente Clay) lançou sua versão para Android. O aplicativo suporta visualizações em tela dividida e pop-up, podendo ser integrado com softwares de mensagens multiplataforma como o Beeper. Seu Nexus AI integrado permite que os usuários pesquisem especialistas do setor ou contatos em cidades específicas em sua rede de contatos usando linguagem natural. (Fonte: TechCrunch)

📚 Aprendizado
DeepLearning.AI lança curso curto “Fluxos de Trabalho de Codificação com IA: Da Nuvem ao Local” em parceria com a JetBrains : O curso é ministrado por Paul Everitt, defensor de desenvolvedores da JetBrains, e orienta os alunos na construção de aplicativos Python em ambientes na nuvem, híbridos e totalmente locais. O curso aborda como usar sub-agentes para decompor tarefas, como reduzir custos por meio de roteamento de modelos e como configurar agentes de codificação de código aberto localmente. (Fonte: DeepLearning.AI)
IIT Bombay e Adobe Research propõem o método PTP para extração reversa de prompts de LLM : A equipe de pesquisa conjunta publicou um artigo apresentando um método de extração reversa chamado Pre-Token Prediction (PTP). Ao treinar um modelo reverso nas saídas sintéticas do LLM alvo, o método consegue recuperar os prompts de sistema e dados privados do usuário do grande modelo com altíssima fidelidade, sem a necessidade de acessar os pesos do modelo. (Fonte: arXiv)

Equipe OpenMOSS disponibiliza em código aberto o modelo World Critic Model (WCM) para controle de RL incorporado : A equipe de pesquisa conjunta disponibilizou em código aberto o framework WCM. Para lidar com o problema de observabilidade parcial no controle robótico, o WCM estima o valor do estado enquanto prevê o estado latente do momento seguinte após a execução de uma ação. Experimentos mostram que a introdução da previsão de estados futuros melhora significativamente a eficiência dos modelos VLA no aprendizado por reforço em robôs reais. (Fonte: arXiv)
.jpg)
Dataset de código aberto OpenWALDO visa fornecer fontes de dados de treinamento de IA seguras e transparentes : Para resolver a falta de transparência nos dados de treinamento de modelos de código aberto, o fundador do CentOS, Gregory Kurtzer, lançou o projeto OpenWALDO. O projeto visa estabelecer um conjunto de dados de treinamento de IA totalmente público e auditável, que atualmente já contém 167,3 bilhões de tokens de referência originados de literatura de domínio público e artigos acadêmicos. (Fonte: The Register)
💼 Negócios
Plataforma de desenvolvimento de software sem código Lovable capta US$ 400 milhões em rodada Série C : A startup sueca de “programação visual” Lovable anunciou a captação de US$ 400 milhões em sua rodada Série C, liderada pela Menlo Ventures com a participação da Tencent e outros investidores, dobrando sua avaliação para US$ 13,3 bilhões em apenas 7 meses. O ARR da empresa atingiu US$ 600 milhões, permitindo que os usuários concluam todo o processo, desde a concepção do aplicativo até a operação online, diretamente na plataforma. (Fonte: TechCrunch)

Thrive Holdings capta US$ 2 bilhões para impulsionar a implementação de modelos da OpenAI em setores tradicionais : A empresa de private equity focada em implementação de IA Thrive Holdings anunciou a captação de US$ 2 bilhões em novos fundos, alcançando uma avaliação de US$ 12 bilhões. A empresa otimiza fluxos de trabalho adquirindo empresas tradicionais de contabilidade e TI e incorporando diretamente modelos da OpenAI. Os novos fundos serão usados para expandir novos negócios, como a supervisão de ativos físicos. (Fonte: TechCrunch)
IBM e Together AI fecham acordo de US$ 240 milhões para aluguel de cluster Nvidia Blackwell : A IBM e a Together AI assinaram um acordo de cooperação plurianual no valor de US$ 240 milhões. A Together AI implantará um cluster de computação de IA contendo 2.000 chips Nvidia B300 (Blackwell) na IBM Cloud, fornecendo serviços eficientes de inferência na nuvem para grandes modelos de código aberto como DeepSeek e Kimi. (Fonte: IBM)

🌟 Comunidade
Comunidade debate a baixa taxa de adoção comercial do Fable 5 e o teto de gastos corporativos com IA : Dados da provedora de serviços financeiros Ramp mostram que o Fable 5 representou apenas 11,4% dos gastos totais das empresas com modelos da Anthropic no primeiro mês de lançamento. Analistas apontam que o preço elevado de US$ 50 por milhão de tokens de saída atingiu o teto dos gastos corporativos com IA. Sem conseguir quantificar o ROI, as empresas estão migrando para modelos de código aberto ou de médio/pequeno porte com melhor custo-benefício. (Fonte: Ramp)

Desenvolvedores discutem o limite entre o “harness” (framework de suporte) e a capacidade do modelo em ferramentas de programação de IA : Após o Opus 5 passar no ARC-AGI-3 escrevendo autonomamente 269 programas, os desenvolvedores debateram que, com o aumento da capacidade de raciocínio dos modelos, prompts excessivamente projetados e frameworks de agentes externos complexos (harness) tornam-se “amarras” que limitam o desempenho do modelo. No futuro, a tendência será o uso de interfaces de ambiente minimalistas. (Fonte: 36Kr)
Grupo de trabalho de IA da Royal Statistical Society pede a introdução de princípios estatísticos na regulamentação da IA : A Royal Statistical Society publicou um relatório apontando que, como os modelos de IA evoluem dinamicamente com o ambiente após a implantação, as auditorias de conformidade estáticas tradicionais não conseguem prevenir riscos de forma eficaz. O grupo de trabalho pede que os reguladores desenvolvam capacidades de avaliação estatística para realizar auditorias contínuas sobre o comportamento de agentes de IA em cenários de negócios reais. (Fonte: RSS)

Perdas agrícolas causadas por alucinações de IA geram discussões sobre os limites das decisões automatizadas : A comunidade debateu intensamente um incidente em que 25 acres de plantações foram destruídos após seguir conselhos de uma IA. O aplicativo de IA recomendou incorretamente um agente químico que matou tanto as ervas daninhas quanto as plantações. Internautas apontaram que, em decisões que envolvem o mundo físico, confiar cegamente em recomendações automatizadas de IA sem verificação humana pode trazer consequências graves. (Fonte: X)
💡 Outros
Kellanova utiliza tecnologia de gêmeo digital da Siemens para optimizar linha de produção de batatas fritas : A gigante de alimentos Kellanova investiu US$ 5 milhões para implantar um sistema de gêmeo digital em tempo real para purê de batata em sua fábrica na Polônia. Sensores coletam 200 pontos de dados a cada milissegundo e os alimentam em um modelo de machine learning para ajustar automaticamente a receita, reduzindo o desperdício na linha de produção em 13% e o consumo de energia em 7%. (Fonte: X)
IPO da Unitree Robotics recebe quase 10 milhões de assinaturas, registrando a menor taxa de alocação da história do STAR Market : O número de contas de assinatura online para o IPO de ações A da Unitree Robotics superou 9,78 milhões, com uma taxa de alocação de apenas 0,018%, a menor da história do STAR Market (Sci-Tech Innovation Board). O valor de mercado de emissão atingiu 61 bilhões de yuans. Além disso, a empresa de inteligência artificial DeepSeek confirmou sua participação na alocação como investidora estratégica, e ambas as partes realizarão pesquisa e desenvolvimento conjuntos em inteligência incorporada e grandes modelos. (Fonte: 36Kr)
Suno fecha parceria com a BMG, mas marca d’água digital gera preocupação entre criadores : A plataforma de geração de música Suno anunciou uma parceria global com a BMG para colocar os criadores humanos no centro do ecossistema de música por IA. No entanto, a marca d’água digital irreversível adicionada obrigatoriamente pela Suno nas faixas de áudio gerou reações negativas na comunidade, com criadores temendo que ela se torne uma ferramenta para gravadoras e plataformas realizarem monitoramento de direitos autorais e remoção de conteúdo. (Fonte: Suno)