🔥 Destaques
GPT-5.6 inicia modo de auto-otimização, reduzindo custos de serviço de inferência em 20%: O GPT-5.6 Sol foi aplicado com sucesso no ambiente de produção da OpenAI, reescrevendo e otimizando de forma autônoma os núcleos de GPU, o que reduziu os custos de serviço de ponta a ponta em 20% e aumentou a eficiência de geração de tokens em mais de 15% por meio da otimização do modelo de decodificação especulativa. Este avanço demonstra a implementação prática do auto-aprimoramento recursivo (RSI) no nível da infraestrutura do sistema, com a AI começando a participar ativamente na transformação do seu próprio ambiente de execução. (Fonte: OpenAI News)
Meta divulga resultados do Q2: despesas de capital disparam e Zuckerberg prevê a era dos agentes inteligentes pessoais: A Meta divulgou seus resultados financeiros do Q2 de 2026, com receita de US$ 60,8 bilhões. No entanto, devido aos investimentos em infraestrutura de AI e ao aumento das despesas com litígios, o fluxo de caixa livre despencou 91%, caindo para US$ 784 milhões, o que provocou uma forte queda nas ações no pós-mercado. O CEO Mark Zuckerberg previu que, nos próximos cinco anos, bilhões de pessoas terão agentes de AI pessoais funcionando 24 horas por dia, e afirmou que continuará a aumentar as despesas de capital em AI para impulsionar a integração entre agentes e o ecossistema de hardware. (Fonte: TechCrunch)
Guerra de rotas entre “código aberto e código fechado” explode no Vale do Silício: Com a assinatura conjunta de mais de 70 gigantes como NVIDIA, Microsoft e OpenAI na carta aberta “Open Weights and US AI Leadership”, o campo do código aberto no Vale do Silício ganhou grande força. Por outro lado, a Anthropic, como a única gigante de código fechado que não assinou, teve seu CEO publicando uma carta aberta argumentando que não defende a proibição de pesos abertos, mas enfatizando suas preocupações com a segurança nacional e a destilação maliciosa. A iniciativa gerou reações negativas no Vale do Silício, levando algumas startups a migrarem para modelos de código aberto por medo de serem “engolidas” pelo ecossistema fechado. (Fonte: ZDNet)
OpenAI lança “Programa para Pesquisadores Acadêmicos”, abrindo modelos emblemáticos gratuitamente para 100 mil cientistas: A OpenAI anunciou que disponibilizará gratuitamente seus modelos emblemáticos (incluindo a série GPT-5.6) para 100 mil pesquisadores universitários em todo o mundo, oferecendo proteção de privacidade de nível empresarial, uma versão estendida do Deep Research e 75 habilidades especializadas em ciências da vida. A iniciativa visa vincular profundamente o fluxo de trabalho de pesquisa científica ao ecossistema do ChatGPT, fidelizando os hábitos de uso de AI de longo prazo da comunidade acadêmica por meio do acesso gratuito. (Fonte: OpenAI News)
🎯 Movimentações
Lilian Weng retorna à OpenAI em tempo recorde para liderar pesquisas de auto-evolução: A cofundadora Lilian Weng, que havia anunciado recentemente sua saída do Thinking Machines Lab por motivos de saúde, confirmou seu retorno à OpenAI. Ela liderará a equipe de pesquisa de alto nível em “auto-evolução” (RSI), focada no uso de modelos de AI para desenvolver e aprimorar modelos de próxima geração. Isso indica que a OpenAI está acelerando a transição do auto-aprimoramento de AI da fase experimental para a engenharia sistemática. (Fonte: QbitAI)
Google lança modelo de geração de música Lyria 3.5, introduzindo função de pintura seletiva: O Google DeepMind lançou o Lyria 3.5 no Flow Music, melhorando a naturalidade e a expressividade de melodias, letras e vocais. A nova versão introduz a função “Selective Section Painting” (pintura de seção seletiva), permitindo que os usuários façam ajustes finos em partes específicas de uma faixa ou expandam uma melodia curta em uma música completa, sem a necessidade de refazer a faixa inteira. (Fonte: Google DeepMind Blog)
Modelo de mundo LJM da Moke Robot alcança o segundo lugar global no ranking WorldArena: A startup chinesa Moke Robot lançou o modelo de mundo LJM (Latent Joint-conditional Model), conquistando o segundo lugar global na avaliação de modelos de mundo incorporados WorldArena. O modelo adota uma arquitetura de “colaboração de dois cérebros”, separando o raciocínio de interação física da renderização de vídeo, permitindo que o robô primeiro compreenda a semântica física da interação no espaço latente antes de gerar as imagens previstas. (Fonte: JiQizhixin)
Google DeepMind lança Gemini Robotics 2, desbloqueando controle de corpo inteiro e capacidade de colaboração: O Google lançou a nova geração de cérebro para inteligência incorporada, o Gemini Robotics 2, fechando o ciclo entre o treinamento em simulação e a execução no mundo real. O modelo desbloqueia controle inteligente de corpo inteiro, manipulação destreza avançada e capacidades de colaboração multi-robô, permitindo que robôs de diferentes formatos alcancem operação autônoma de longa duração por meio de treinamento em ambientes simulados, sem depender de dados reais. (Fonte: )
Tencent WorkBuddy atualiza para edição colaborativa de “co-escrita humano-máquina”: A ferramenta de agente de produtividade da Tencent, WorkBuddy, lançou a versão V5.3.5, introduzindo a função de “co-escrita humano-máquina” em parceria com o Tencent Docs. Os usuários podem colaborar e editar em tempo real com a AI diretamente em documentos como Word, Excel e PPT, alcançando pela primeira vez a sincronização multi-terminal “humano-humano, humano-máquina, máquina-máquina”, impulsionando os softwares de escritório para a era da colaboração nativa em AI. (Fonte: QbitAI)
Tencent Video realiza testes internos da plataforma leve de criação de AI “WorkSolo”: O Departamento de Plataforma de Criação Inteligente da Tencent Video está realizando testes internos do WorkSolo, uma plataforma de criação que integra “minisséries de AI, jogos interativos de vídeo e tela livre”. Diferente do WorkRally, que foca na produção industrializada de dramas de animação de alta qualidade, o WorkSolo foca na produção rápida de minisséries leves e conteúdo interativo, adotando um modelo de computação por pontos com teste gratuito e assinatura de membros. (Fonte: 36Kr)
Google Earth introduz Nano Banana para reconstrução geográfica com AI: O Google integrou o modelo de geração de imagens Nano Banana 2 ao Google Earth, permitindo que os usuários gerem imagens de AI com base em imagens de satélite e 3D. Os usuários podem transformar edifícios reais ou gerar gráficos de informações geográficas por meio de comandos de texto, embora testes práticos mostrem que ele ainda apresenta limitações ao lidar com lógica geográfica precisa e geração de texto. (Fonte: The Verge)
Roteiro de hardware da OpenAI é revelado: primeiro alto-falante, depois smartphone: Fontes indicam que, um ano após adquirir a empresa de Jony Ive, a OpenAI estabeleceu um roteiro de hardware claro. O primeiro produto será um alto-falante inteligente sem tela, previsto para o início de 2027, equipado com câmera e estrutura mecânica. Além disso, a OpenAI está desenvolvendo um “smartphone com AI Agent” equipado com um chip MediaTek personalizado, com produção em massa planejada para o primeiro semestre de 2027. (Fonte: 36Kr)
Elon Musk lança Grok Voice Think Fast 2.0, alcançando o topo do ranking de testes de agentes: A SpaceXAI lançou a nova geração de seu modelo de voz, o Grok Voice Think Fast 2.0, que conquistou o primeiro lugar no teste de agentes Tau Voice. O modelo apresenta um tempo médio de resposta do primeiro áudio de apenas 0,70 segundos, suporta computação em fluxo de “raciocínio enquanto fala”, reduz o consumo de tokens em 60% em comparação com a geração anterior e tem preço fixado em US$ 0,08 por minuto. (Fonte: 36Kr)
🧰 Ferramentas
Replit lança ferramenta de design de AI Replit Design, focando na interação pós-prompt: A Replit lançou a ferramenta de design de AI Replit Design, com foco na interação “pós-prompt” (post-prompting). A ferramenta dispensa a necessidade de os usuários inserirem prompts complexos ou linguagem de design; em vez disso, utiliza inteligência ambiental (Ambient Intelligence) para recomendar ativamente o próximo passo do design a cada etapa, com suporte para aceitação em um clique, reduzindo significativamente a barreira de design de aplicativos para não desenvolvedores. (Fonte: amasad)
Cisco lança navegador gratuito de procedência da cadeia de suprimentos de AI para prevenir vulnerabilidades de conformidade em modelos de código aberto: A Cisco lançou um “navegador de procedência da cadeia de suprimentos de AI” gratuito, que cataloga as características de impressão digital de quase 900 modelos de código aberto. Ao comparar metadados de arquitetura com sinais de nível de peso, a ferramenta pode contornar as etiquetas preenchidas pelos próprios usuários para identificar com precisão a verdadeira linhagem e as relações de derivação dos modelos de código aberto, ajudando as empresas a prevenir vulnerabilidades de conformidade e segurança. (Fonte: VentureBeat)
Token Saver: plugin MCP de código aberto que reduz drasticamente os custos de tokens na análise de PDFs: Desenvolvedores disponibilizaram em código aberto o Token Saver, uma extensão MCP para o Claude Desktop. A ferramenta executa localmente um sistema RAG híbrido leve (combinando BM25 e busca semântica), eliminando a necessidade de enviar o PDF inteiro para a nuvem. Ao enviar apenas os parágrafos mais relevantes para o modelo, ela pode reduzir os custos de tokens na análise de documentos longos em 90% a 99%. (Fonte: MarkTechPost)
Hint: aplicativo de assistente doméstico de AI cofundado por Martha Stewart é lançado: Foi lançado o Hint, um aplicativo de assistente doméstico de AI cofundado por Kyle Rush, ex-líder de engenharia da Casper, e pela especialista em estilo de vida Martha Stewart. Após o usuário inserir o endereço e enviar contratos e faturas da casa, o aplicativo combina dados geográficos, de solo e meteorológicos públicos para gerar automaticamente um plano de manutenção residencial, além de responder a dúvidas sobre sinistros de seguros, otimização de energia e outras questões de gestão doméstica por meio de um chat de AI. (Fonte: TechCrunch)
📚 Aprendizado
DeepLearning.AI lança curso gratuito de “Revisão de Código com AI” em parceria com a Qodo: A DeepLearning.AI, de Andrew Ng, lançou um novo curso curto que ensina como construir e otimizar agentes de revisão de código com AI. O curso aborda a realização de revisões de código antes do PR, o fornecimento de contexto completo do repositório, o uso de busca vetorial para construir um mecanismo de contexto e a colaboração com agentes especialistas em segurança e conformidade para reduzir a taxa de falsos positivos. (Fonte: )
Artigo sobre CtrlBench-Rec: uma estrutura de avaliação de controlabilidade externa para sistemas de recomendação de caixa preta: Uma equipe do Instituto de Engenharia de Informação da Academia Chinesa de Ciências e outras instituições publicou um artigo propondo a estrutura de avaliação CtrlBench-Rec. Sem acessar os parâmetros internos do modelo, a estrutura utiliza múltiplos agentes colaborativos como sondas para medir a capacidade de resposta do sistema de recomendação de caixa preta em dimensões como descoberta de conteúdo, modelagem de perfil de interesse e mitigação de viés de cauda longa, por meio da simulação de interações externas como buscas e cliques. (Fonte: HuggingFace Daily Papers)
Tencent disponibiliza em código aberto o AngelSpec, estrutura de treinamento de decodificação especulativa que acelera a decodificação em 2x: A Tencent disponibilizou em código aberto a estrutura de treinamento de decodificação especulativa AngelSpec, que suporta previsão de múltiplos tokens (MTP) e arquitetura DFlash paralela em blocos. A estrutura adota um design de parâmetros compartilhados e profundidade múltipla, alcançando um aumento de quase 2x na velocidade de decodificação de ponta a ponta nos modelos Qwen3 e Hy3 por meio de Rollout do modelo alvo e mecanismo de atenção adaptativa de prefixo. (Fonte: MarkTechPost)
YC Paper Club discute múltiplos núcleos de GPU e motores de jogos acelerados por GPU: O YC Paper Club compartilhou vários artigos de sistemas de ponta, incluindo a estrutura Parallel Kittens para simplificar núcleos de AI em multi-GPU, a métrica de “inteligência por watt” para medir a eficiência energética de AI local e na nuvem, e o Madrona, um motor de jogo de alto rendimento executado inteiramente na GPU para acelerar o treinamento de aprendizado por reforço. (Fonte: )
💼 Negócios
Tokens Infinity AI conclui nova rodada de financiamento de centenas de milhões de yuans: A Tokens Infinity AI, empresa de infraestrutura de AI Agent voltada para engenharia de software corporativo, anunciou a conclusão de uma nova rodada de financiamento, liderada pela Linxin Investment com a participação do acionista anterior Huakong Fund, acumulando centenas de milhões de yuans em captação no período de um ano. A empresa foi fundada por Yang Ping, ex-responsável pelo MarsCode da ByteDance, e foca em uma base de agentes corporativos totalmente autônoma, altamente segura e auto-evolutiva. (Fonte: QbitAI)
Dili capta US$ 21,7 milhões para resolver desafios de conformidade em infraestrutura com AI: A startup de conformidade com AI Dili anunciou a conclusão de uma rodada Série A de US$ 15 milhões, elevando o financiamento total acumulado para US$ 21,7 milhões, liderada pela Khosla Ventures com a participação da Y Combinator e outros investidores. A Dili utiliza AI para analisar contratos, folhas de pagamento e dados de ERP de grandes projetos de infraestrutura, como edifícios e data centers, validando automaticamente a conformidade com leis federais como a Davis-Bacon por meio de regras determinísticas. (Fonte: TechCrunch)
Atlassian introduz mecanismo de “carteira de AI” para limitar o consumo de AI dos funcionários: A gigante de software Atlassian introduziu um mecanismo de “carteira de AI” para suas equipes de P&D, definindo um limite mensal de uso de AI entre US$ 500 e US$ 2.000 por funcionário para lidar com a pressão dos custos de TI decorrentes da “explosão de tokens”. A medida contrasta com a tendência anterior do Vale do Silício de incentivar o uso ilimitado de AI pelos funcionários, conhecida como “tokenmaxxing”. (Fonte: The Guardian)
🌟 Comunidade
GCC anuncia proibição de contribuições de código geradas por AI com relevância jurídica: O comitê gestor do GNU Compiler Collection (GCC) anunciou uma nova política que, por motivos de autoria de direitos autorais, conformidade de licenças e responsabilidade jurídica, rejeitará a partir deste ano qualquer contribuição de código “com relevância jurídica” gerada por agentes de grandes modelos de linguagem. Isso gerou uma ampla discussão na comunidade de código aberto sobre a “atribuição de responsabilidade por código gerado por AI”. (Fonte: Hacker News)
Óculos inteligentes da Meta são apelidados de “óculos de espiar”, gerando preocupações com a privacidade: Com a disseminação nas redes sociais de vídeos mostrando pegadinhas e gravações secretas em locais públicos usando os óculos inteligentes Meta Ray-Ban, o hardware foi apelidado na comunidade de “óculos de espiar”. O chefe do Instagram afirmou que contas e vídeos que violarem a privacidade dos usuários ou que forem suspeitos de assédio serão banidos e removidos. (Fonte: Reddit r/ArtificialInteligence)
💡 Outros
36Kr e PureblueAI lançam a segunda edição da “Lista de Recomendação de AI para Marcas de Consumo 2026”: A 36Kr, em parceria com a PureblueAI, lançou uma nova edição da lista, avaliando o desempenho de recomendação de cinco grandes categorias, incluindo smartphones, automóveis e eletrodomésticos, nas principais plataformas de AI. Os dados mostram que a Xiaomi manteve a liderança na recomendação de sedãs elétricos de nova energia, enquanto a iQOO conquistou o topo na categoria de smartphones de alto desempenho. O mecanismo de recomendação de AI está se tornando gradualmente o novo campo de batalha para as marcas em cenários de consumo específicos. (Fonte: 36Kr)