OpenAI, Anthropic e Google planejam criar a SAFA, agência… | Diário de IA 2026-09-26

🔥 Destaques

OpenAI, Anthropic e Google planejam criar a SAFA, agência de segurança para AI de fronteira : De acordo com o The Information, a OpenAI, a Anthropic e o Google estão se preparando para fundar a organização de segurança de AI “Standards Authority for Frontier AI” (SAFA), com lançamento oficial previsto para o início de 2027. O órgão planeja coordenar testes independentes de terceiros antes do deployment de modelos, além de estabelecer mecanismos de notificação de incidentes e benchmarks para o setor, sendo visto como uma medida de autorregulação e defesa de padrões das big techs diante do risco de perda de controle de modelos de fronteira e do aperto regulatório em vários países (Fonte: The Verge)

Casa Branca exige que OpenAI e Anthropic priorizem revisão de modelos de fronteira pelas autoridades dos EUA : O Escritório do Diretor Cibernético Nacional da Casa Branca exigiu que a OpenAI e a Anthropic submetam seus modelos de fronteira mais recentes à revisão de órgãos oficiais dos EUA antes de fornecê-los ao AI Safety Institute (AISI) do Reino Unido. A Anthropic já implementou ajustes, restringindo certas versões de fronteira exclusivamente a agências norte-americanas. O movimento destaca a disputa direta entre potências pela liderança em segurança nacional e avaliação técnica de AI de fronteira, gerando atritos institucionais na cooperação transatlântica de avaliação de segurança (Fonte: THE DECODER)

Anthropic planeja estrutura de supervotação: 7 cofundadores com apenas 2% de participação controlarão 50,1% dos votos : Às vésperas de um IPO trilionário, a Anthropic busca a aprovação dos acionistas para um novo modelo de governança. Mesmo que os 7 cofundadores, incluindo o CEO Dario Amodei, detenham apenas cerca de 2% de ações individualmente, desde que pelo menos 3 atinjam certos critérios, eles poderão controlar coletivamente 50,1% do poder de voto por meio de um trust de votação de fundadores semelhante ao da Palantir. A estrutura visa desacoplar interesses econômicos do controle decisório, blindando a pesquisa de longo prazo em AI alignment e safety contra as pressões de lucro de curto prazo de Wall Street (Fonte: 机器之心, 36氪, kimmonismus)

Anthropic planeja estrutura de supervotação

Google inicia piloto do centro de computação de AI solar espacial Suncatcher : O Google anunciou que o primeiro satélite experimental MVP do seu data center orbital de AI, o “Project Suncatcher”, está programado para ser lançado em 1º de outubro a bordo do foguete Falcon 9 da SpaceX (missão Transporter-18). Equipado com 4 aceleradores Trillium TPU personalizados e alimentado por energia solar, o satélite visa verificar a viabilidade de executar inferência de AI em ambientes espaciais extremos utilizando 8 vezes a energia solar disponível na Terra. Os testes centrais focarão na dissipação de calor no vácuo e na computação orbital de alta eficiência energética, com testes de interconexão a laser de alta velocidade entre satélites previstos para 2027 (Fonte: Ars Technica, Google, dotey)

OpenAI estaria preparando plano ChatGPT Pro Max de US$ 500 por mês : Desenvolvedores descobriram no código front-end do ChatGPT um novo plano de assinatura “Pro Max” com valor mensal de US$ 500, com foco na “velocidade de execução mais rápida para Work e Codex” e potencial acesso a capacidade computacional dedicada de baixa latência. Após o GPT-6 Astra consumir massivamente recursos de inferência, levando a restrições em momentos de alta carga, a OpenAI está adotando uma precificação premium para segmentar a capacidade computacional voltada a cenários pesados de produtividade, indicando que o poder computacional de ponta está se concentrando cada vez mais em empresas de alto valor e instituições profissionais (Fonte: 36氪, nicdunz)

ChatGPT planeja vender plano Pro Max por US$ 500

🎯 Tendências

Google lança Gemini 3.8 Live e modelo de avatar virtual em tempo real : O Google lançou oficialmente o Gemini 3.8 Live e a funcionalidade Live Avatar, integrando profundamente conversação em streaming em tempo real com geração dinâmica de vídeo de avatares com baixa latência. O modelo suporta sincronização labial nativa de áudio e vídeo em 97 idiomas e chamadas assíncronas de ferramentas em segundo plano, oferecendo geração de avatares personalizáveis para cenários de interação corporativa, com marcas d’água SynthID totalmente integradas (Fonte: Google DeepMind Blog)

Meta lança modelo incorporado em tempo real Muse Realtime Avatar : A Meta anunciou a arquitetura de streaming Muse Realtime Avatar, que compartilha o fluxo de tokens de voz com o Realtime Voice, reduzindo a latência de resposta de conversas em vídeo ponta a ponta para cerca de 870 ms. O sistema mantém um custo computacional delimitado por meio de um contexto histórico de comprimento fixo, suportando sincronização de movimentos labiais e microexpressões em conversas de qualquer duração (Fonte: alex_conneau, jack_w_rae)

Muse Realtime Avatar

Meta Muse se envolve em polêmica de privacidade por usar atendentes humanos sem autorização para realizar chamadas : A Reuters revelou que, durante os testes da funcionalidade de chamadas telefônicas autônomas para seu novo agente pessoal Muse, a Meta repassava secretamente as tarefas para equipes terceirizadas de atendentes humanos a fim de manter uma alta taxa de sucesso, gerando graves preocupações de privacidade entre usuários e questionamentos de reguladores. Executivos da Meta pediram desculpas publicamente e desativaram o teste, prometendo não reabrir o canal até que os mecanismos de divulgação de privacidade e segurança sejam aprimorados (Fonte: 量子位)

Pioneiro da AI moderna Jürgen Schmidhuber assume como Conselheiro Científico Chefe da Sakana AI : Jürgen Schmidhuber, pioneiro em Recursive Self-Improvement (RSI) e meta-learning, assumiu oficialmente como Conselheiro Científico Chefe da startup japonesa de AI Sakana AI. Ele liderará o recém-criado RSI Lab em Tóquio, combinando algoritmos evolutivos, world models e arquiteturas auto-organizáveis para explorar inteligência adaptativa sob restrições computacionais e loops fechados de RSI no mundo físico (Fonte: SakanaAILabs, hardmaru)

Jürgen Schmidhuber assume como Conselheiro Científico Chefe da Sakana AI

LangChain lança LangSmith Engine v2 e Managed Deep Agents 0.8 : O LangSmith Engine v2 introduz Red Teaming proativo e mecanismos de verificação e correção automática, capazes de identificar e corrigir lógicas anômalas antes que os agentes entrem em produção. Já o Managed Deep Agents 0.8 adiciona políticas de permissão de memória persistente para usuários corporativos, APIs de arquivos em sandbox e recursos nativos de busca na web (Fonte: LangChain, hwchase17)

LangChain lança novos produtos na conferência Interrupt

Perplexity lança Photon, motor de busca próprio em Rust, e Fast Search API : A Perplexity lançou o Photon, um serviço de busca e reranking desenvolvido em Rust que alcança buscas ultrarrápidas com latência p95 abaixo de 230 ms e p50 de apenas 160 ms, reduzindo o custo de chamada da API para US$ 1 por 1.000 requisições, com integração perfeita ao Hermes Agent e ao ecossistema local de AI (Fonte: AravSrinivas, MParakhin)

Perplexity lança Fast Search

Lançado motor de consulta conjunta AI-SQL open source Quail: processamento de mais de 1 bilhão de tokens por minuto em uma única GPU : Equipes de Stanford e Modal disponibilizaram em código aberto o Quail, um motor SQL para operações de dados de AI. Ao reestruturar o escalonador do vLLM e fundir o plano de consulta com a fase de Prefill do LLM, além de personalizar o KV cache e os núcleos de atenção, o sistema alcançou um throughput de mais de 1 bilhão de tokens de entrada por minuto por consulta em uma única H100 (Fonte: charles_irl, HamelHusain)

Google testa recurso “Call for Me” do Gemini em dispositivos Pixel : O Google está testando a funcionalidade “Call for Me” no Pixel 11 nos EUA, permitindo que o Gemini realize chamadas telefônicas autônomas para estabelecimentos comerciais usando o número real do usuário para verificar estoque, fazer reservas e reagendamentos em restaurantes, navegando automaticamente por menus de voz e esperas, com transcrição em tempo real e controle manual instantâneo (Fonte: TechCrunch)

T-Head da Alibaba abre totalmente o código da stack de software para chips de AI Zhenwu, o T-Head SAIL : Durante a Apsara Conference, a T-Head da Alibaba revelou os avanços mais recentes no código aberto da sua stack de software semelhante ao CUDA, a T-Head SAIL. Foram disponibilizadas a camada de adaptação do PyTorch, a ferramenta de migração sailify e bibliotecas de aceleração como DeepGEMM e FlashAttention, capacitando desenvolvedores a realizar ajustes finos em nível de operadores e migrações sem atrito para a arquitetura Zhenwu (Fonte: 量子位)

Equipe de Shaoqing Ren na NIO propõe MM-Future, modelo multimodal de mundo e ação para direção autônoma : A equipe da NIO apresentou a arquitetura MM-Future, que realiza a evolução conjunta de múltiplos pares de hipóteses de “cenário-ação” para o planejamento de direção autônoma. Por meio da representação espaço-temporal compacta MM-Tokens e de um avaliador conjunto de histórico e futuro, alcançou 94,0 PDMS no benchmark NAVSIM-v1, impulsionando os world models da predição passiva unidirecional para o planejamento ativo em malha fechada (Fonte: 量子位)

Kuaishou lança KwaiMind, modelo base de edição de imagem para e-commerce : A Kuaishou lançou o KwaiMind, um modelo base de edição de imagem voltado para a geração de materiais reais de e-commerce. Integrando detalhes de vestuário, consistência de produtos e renderização de texto por meio de um motor de dados multiagente e destilação online, o modelo conquistou o primeiro lugar entre os modelos de código aberto em 11 tarefas de e-commerce, trazendo um aumento relativo de cerca de 2,44% no CTR em testes A/B online (Fonte: 机器之心)

Liquid AI lança modelo de decodificação especulativa open source LFM2.5-VL-DSpark : A Liquid AI lançou a solução de decodificação especulativa DSpark para modelos de visão e linguagem de 3B. Com um acréscimo de apenas 280M parâmetros e mantendo resultados estritamente equivalentes, alcançou uma aceleração de decodificação de até 3,13x em dispositivos com M5 Max, com suporte simultâneo para llama.cpp e SGLang (Fonte: HuggingFace Blog)

Qwengram-0.8B é disponibilizado em código aberto: migração sem perdas de 51B de memória explícita de N-Gram para modelos miniaturizados on-device : Desenvolvedores disponibilizaram a arquitetura Qwengram, que, mantendo congelada a rede backbone Qwen3.5-0.8B, acopla com sucesso uma memória externa de 51B de N-gram via PLE por meio do treinamento de um Reader leve e de um mecanismo de gating dinâmico, alcançando uma redução de 5,05% na perplexidade (PPL) no conjunto de validação (Fonte: Reddit r/LocalLLaMA)

PrismML leva LLM ultraleve de 1-bit para smart glasses com Qualcomm Snapdragon : Especializada em compressão e fine-tuning de modelos, a PrismML demonstrou o modelo Bonsai de 2B parâmetros e 1-bit rodando no chip Snapdragon AR1 Gen 1, viabilizando perguntas e respostas visuais em tempo real e interação natural localmente no dispositivo, comprovando a viabilidade de engenharia para executar modelos multimodais on-device com consumo de energia extremamente baixo (Fonte: TechCrunch)

🧰 Ferramentas

Extensão de navegador do Kimi é lançada com suporte para transformar ações na web em Skills : O Kimi atualizou oficialmente o WebBridge para uma extensão nativa de navegador, adicionando interação via barra lateral e suporte para gravar ações sequenciais do usuário (como cliques, paginação e web scraping) em instruções reutilizáveis de Skill, criando um fluxo de trabalho automatizado integrado ao Kimi Code Desktop (Fonte: 量子位)

GLiNER2.5-Decide é lançado em open source: modelo de decisão ultrarrápido compatível com relações de entidades e restrições lógicas : A Fastino disponibilizou em código aberto o modelo leve de decisão estruturada GLiNER2.5-Decide (340M), que suporta não apenas roteamento e classificação rápidos, mas também extração de spans em nível de caractere e relações de entidades, realizando validação lógica em tempo real para restrições de exclusividade, cardinalidade e ordinais. A latência de inferência é de apenas 167 ms em CPU e 38-47 ms em GPU, substituindo o custo de decisão de geração de texto longo de LLMs tradicionais (Fonte: MarkTechPost, ClementDelangue)

GLiNER2.5-Decide é lançado em open source

LangSmith lança ferramenta de fine-tuning open source smithtune e plataforma Custom Apps : A LangChain, em parceria com a Baseten e a Fireworks, lançou a ferramenta de linha de comando smithtune, que converte diretamente traces de sessões do LangSmith em produção em datasets de fine-tuning SFT e faz o deployment automático de modelos; a função Custom Apps lançada simultaneamente permite que desenvolvedores utilizem prompts para transformar logs de execução de agentes em filas de anotação ou dashboards de comparação de métricas (Fonte: LangChain, baseten)

LangSmith lança Custom Apps e smithtune

CoreWeave lança servidor MCP Mission Control para integrar ambientes de programação de AI : A provedora de nuvem de computação CoreWeave lançou o serviço Mission Control baseado no protocolo MCP, permitindo que ferramentas de programação como Cursor e Claude Code leiam diretamente o status operacional de clusters de GPU, redes e nós subjacentes, possibilitando que agentes realizem troubleshooting e otimização de recursos diretamente no editor de código (Fonte: AI Business)

Pruna-Qwen-Image-2.1 é lançado em open source: LoRA de 5 a 8 passos atinge aceleração de 6,3x na geração de imagens : A Pruna AI disponibilizou em código aberto um adaptador LoRA ultrarrápido para o Qwen-Image-2.1 que, por meio de um escalonamento sigma otimizado de forma independente e operação sem CFG, reduz a geração e edição de imagens de 40 passos para 5 a 8 passos, acelerando o processo em até 6,3x enquanto preserva a qualidade 1K e a consistência de referência em múltiplas imagens (Fonte: _akhaliq, huggingface)

flow-transform 1.0 é lançado: modelo de anonimização de PII corporativo de alta fidelidade para proteger fluxos de trabalho : A micro1 lançou o flow-transform 1.0, um modelo de anonimização de privacidade projetado especificamente para treinamento de modelos de fronteira, alcançando uma pontuação F1 de 96,0% no PrivacyBench. Seu diferencial é a substituição por identidades sintéticas em vez de simples mascaramento, preservando integralmente relações de decisão em múltiplos turnos e cadeias de chamadas de ferramentas em fluxos de trabalho empresariais (Fonte: omarsar0)

flow-transform 1.0 é lançado

Whiteboard: IDE open source para design de arquitetura de software colaborativo entre humanos e AI : O Whiteboard, uma IDE desktop open source construída com base no CodeOSS, foi lançado oficialmente para fornecer SDKs de diagramação e visualizadores de Diff semântico para agentes de programação como o Claude Code, aliviando o “débito cognitivo” causado pela codificação totalmente automatizada por meio de diagramas de sequência, diagramas ER e logs de decisão visualizáveis (Fonte: Hacker News)

StarNet: bancada de trabalho multiagente desktop local-first em estilo pixel art : O projeto desktop open source StarNet projeta o runtime de agentes de AI como uma estação espacial em pixel art, onde cada sala representa um escopo de permissão e os corredores representam o fluxo de dados, suportando a integração com os principais LLMs via BYOK e gerenciando de forma persistente e local a colaboração multiagente e o registro de tarefas (Fonte: GitHub Trending)

Google Gemini integra oficialmente plugins do Adobe Photoshop e Lightroom : Após a integração com o ChatGPT e o Claude, os plugins da Adobe Creative Suite chegam oficialmente ao Google Gemini, permitindo que os usuários chamem diretamente ferramentas profissionais de retoque de imagem e layout criativo usando “@Adobe”, expandindo a produtividade gráfica do assistente conversacional (Fonte: The Verge)

📚 Aprendizado

Universidade de Stanford disponibiliza novo curso de outono CS329Z “Building AI Agents Engineering” : A equipe de NLP de Stanford, em colaboração com os autores do DSPy e do SWE-bench, lançou o curso sistemático CS329Z, abrangendo o design de engenharia full-stack desde pipelines simples de LLM e sistemas compostos de AI até agentes autônomos, focando em engenharia de prompts, avaliação de estado, segurança em sandbox e orquestração de ferramentas. Os slides e o código da primeira aula já estão disponíveis publicamente (Fonte: stanfordnlp)

Stanford lança CS329Z

Google revela arquitetura multiagente de geração de vídeo longo AI Video Co-Director : A equipe de pesquisa do Google publicou um conjunto de ferramentas para geração narrativa de vídeo que combina otimização de política global MAB, memória visual explícita CANVAS e feedback em malha fechada via prompts VQQA, resolvendo com eficácia o desvio de sujeitos e erros em cascata na geração de vídeos longos multicâmera, entregando narrativas consistentes de vários minutos (Fonte: Google Research Blog)

Perplexity detalha método de autodestilação guiada por dicas baseada em erros reais : A Perplexity divulgou seu mecanismo de pós-treinamento para agentes de operação de computadores, convertendo falhas de trajetórias em dicas estruturadas e usando on-policy self-distillation (OPSD) para que o modelo professor oriente a correção do modelo estudante, reduzindo a taxa de falhas em chamadas de ferramentas em produção em 21,2% (Fonte: MarkTechPost)

BJTU, Tsinghua e parceiros propõem ARGUS: framework de detecção de falsificação em vídeo impulsionado por cadeia de evidências e colaboração multiagente : Visando o problema de baixa generalização de decisões caixa-preta na detecção de deepfakes em vídeo, a equipe de pesquisa propôs o ARGUS, que desacopla agentes observadores independentes (focados em textura, iluminação, movimento temporal e bom senso físico) de um agente juiz, disponibilizando também o dataset FaceVid-Forensics-100K com 33 fontes de geração, elevando o F1 fora do domínio para 53,28% (Fonte: 36氪)

Framework de detecção de falsificação em vídeo ARGUS

Zhejiang University e parceiros propõem MemGUI-Bench: primeiro benchmark de avaliação para memória de longo prazo e aprendizado entre sessões em agentes de GUI : A Zhejiang University, em conjunto com Nankai, CUHK e outras instituições, lançou o MemGUI-Bench, contendo 128 tarefas reais de longo prazo, acompanhado da ferramenta de auditoria progressiva em três etapas MemGUI-Eval. Experimentos revelaram que os modelos líderes atuais apresentam até 58,9% de alucinações de memória em tarefas de longo prazo entre aplicativos e sessões, expondo pontos cegos de memória não identificáveis em benchmarks convencionais (Fonte: 36氪)

Benchmark de avaliação de memória MemGUI-Bench

Hugging Face lança SmolDataEnvs em open source: mais de 5.000 ambientes verificáveis de aprendizado por reforço : Respondendo à carência de ambientes de treinamento em ciência de dados e código para modelos pequenos com menos de 10B de parâmetros, a comunidade open source disponibilizou o SmolDataEnvs, contendo mais de 5.000 ambientes verificáveis de RL para tarefas reais de ciência de dados, com suporte a aprendizado por reforço assíncrono em uma única GPU (Fonte: _lewtun, huggingface)

Microsoft e parceiros propõem CASD: otimização de prompts por análise de logs completos de agentes de código : Pesquisadores da Microsoft propuseram o método CASD, demonstrando que permitir que agentes de código calculem estatísticas sobre trajetórias completas e elaborem regras de otimização supera em 16,6 pontos a execução de loops de busca em pequenos lotes de trajetórias, enquanto reduz o custo de uma única otimização de prompt para US$ 1,60 (Fonte: dair_ai)

Método de otimização de prompts CASD

ULTRA, artigo candidato ao IROS 2026: controle coordenado de corpo inteiro orientado a objetivos para robôs humanoides : A equipe de pesquisa da UIUC propôs o ULTRA, um framework unificado de controle multimodal que, por meio de retargeting neural baseado em física e ajuste fino por aprendizado por reforço, permite que o robô Unitree G1 gere autonomamente ações contínuas de preensão e translação de corpo inteiro recebendo apenas metas esparsas ou nuvens de pontos em primeira pessoa (Fonte: 机器之心)

AdaRoboVLG: framework de preensão de visão e linguagem entre manipuladores com desacoplamento de tarefas : Equipes da HUST, Peking University e parceiros apresentaram o AdaRoboVLG, que desacopla os priors semânticos/temporais de alto nível da geração física de preensão de baixo nível, oferecendo uma interface unificada adaptável a mãos destras multifuncionais e garras paralelas, mantendo alta robustez em esteiras dinâmicas e cenários desordenados (Fonte: 机器之心)

Agent ou Workflow? Guia prático de avaliação para seleção de arquitetura em sistemas corporativos : Um artigo detalhado do setor analisa as fronteiras entre workflows de processo fixo e agentes autônomos, propondo como critério central de teste a pergunta: “é possível desenhar uma máquina de estados completa antes da execução?”. O guia recomenda priorizar workflows aprimorados por decisão de LLM para cenários de alto throughput e sensíveis a conformidade regulatória (Fonte: Machine Learning Mastery)

💼 Negócios

Anthropic e Akamai assinam contrato de longo prazo de computação em nuvem de US$ 11,6 bilhões : A Anthropic firmou um acordo de infraestrutura de computação em nuvem de 7 anos e US$ 11,6 bilhões com a Akamai, concedendo a esta última warrants de subscrição de até 5% em ações, elevando seus compromissos de compra de capacidade computacional para mais de US$ 500 bilhões nos últimos 11 meses (Fonte: THE DECODER)

TypeSafe estaria buscando nova rodada de US$ 1 bilhão com valuation superior a US$ 10 bilhões : Segundo o The Information, após o modelo de decisão Jev viralizar na comunidade de desenvolvedores e ultrapassar 1 trilhão de tokens em chamadas diárias, a TypeSafe AI está em negociações com investidores de primeira linha para uma nova rodada de mais de US$ 1 bilhão, com valuation pós-aporte projetado para superar US$ 10 bilhões — um salto exponencial em relação às avaliações anteriores (Fonte: steph_palazzolo)

Databricks anuncia aquisição da plataforma de planilhas em nuvem em tempo real Row Zero : A Databricks anunciou um acordo para a aquisição da Row Zero. Conhecida por suas planilhas de alto desempenho em nuvem capazes de processar centenas de milhões de linhas, a Row Zero será profundamente integrada ao motor de análise inteligente Genie da Databricks, oferecendo a analistas e equipes financeiras um espaço de trabalho de dados interativo em tempo real, impulsionado por governança e AI (Fonte: jefrankle, matei_zaharia)

🌟 Comunidade

Teste de desenvolvedor com Claude Code exclui por engano 48 mil arquivos essenciais e gera reflexão sobre segurança de código : A comunidade repercutiu o caso de um desenvolvedor que, ao reconstruir uma imagem com o Claude Code, sofreu a exclusão total de 48.000 arquivos de projeto e do índice Git em apenas 103 segundos devido a falhas no isolamento de permissões do script, soando novamente o alarme sobre os riscos de engenharia de execuções sem sandbox e da concessão direta de permissões a agentes em ambientes de produção (Fonte: TechRadar)

Jev desencadeia onda de pesquisas acadêmicas e intenso debate sobre arquitetura System 1 : Em uma semana após o lançamento do Jev, surgiram no arXiv vários artigos focados em seu agendamento de borda e avaliações em cascata. A comunidade destaca que, embora o modelo ofereça extrema velocidade e custos centenas de vezes menores em decisões binárias/múltiplas, ele é sensível à nomeação de opções em raciocínios de cadeia longa, acelerando a transição dos desenvolvedores para o paradigma de orquestração híbrida de “triagem ultrarrápida com System 1 + fallback em modelos de fronteira com System 2” (Fonte: 36氪, Latent Space, dair_ai)

Explosão de artigos de pesquisa sobre o Jev

Jantar na Casa Branca reúne gigantes da tecnologia: intenso confronto entre regulação de segurança e discursos de aceleração : Autoridades dos EUA e da China, juntamente com líderes do setor de tecnologia como Jensen Huang, Elon Musk e Tim Cook, reuniram-se em um jantar de estado onde o avanço e a segurança da AI foram temas centrais. O setor debateu calorosamente se laboratórios de fronteira estariam usando o pânico de segurança para construir uma “captura regulatória”. Mark Zuckerberg e Jensen Huang manifestaram-se publicamente contra a desaceleração coordenada da indústria, defendendo a responsabilização com base em casos de uso e cenários de aplicação específicos (Fonte: Transformer, teortaxesTex, Reddit r/ArtificialInteligence)

Jantar na Casa Branca e gigantes da tecnologia

Claude Opus 5.5 é elogiado por estética refinada, mas modo “Max” apresentaria loops de autorreflexão : A comunidade teceu fortes elogios à capacidade de geração de código e design estético do Claude Opus 5.5, mas desenvolvedores experientes apontaram que, com o nível de raciocínio no modo “Max”, o modelo tende a entrar em loops infinitos durante múltiplos passos de autoinspeção, consumindo cotas desnecessariamente; a recomendação é optar pelos níveis Medium ou High para tarefas comuns e leves (Fonte: Reddit r/ClaudeAI, theo, arena)

Comunidade médica alerta contra a deterioração das funções cognitivas causada pelo excesso de dependência da AI : Um artigo de opinião do The Guardian ressalta que, com a profunda penetração da AI generativa em universidades e ambientes de trabalho, a terceirização excessiva de tarefas cognitivas profundas — como análise e redação — está enfraquecendo a conectividade cerebral e o pensamento crítico independente, pedindo que os impactos do uso de AI na saúde cognitiva de longo prazo sejam incluídos nas discussões de saúde pública e educação (Fonte: The Guardian)

💡 Outros

GPT-6 Astra zera com sucesso o complexo e desafiador jogo roguelike NetHack : Experimentos demonstraram que o GPT-6 Astra alcançou com sucesso a Ascensão (Ascension) em sua terceira tentativa no clássico e extremamente desafiador jogo roguelike NetHack, marcando um grande avanço dos LLMs ao lidar com espaços de estados massivos, informação incompleta e exploração contínua de estratégias de longo prazo (Fonte: Plinz, _rockt)

GPT-6 Astra vence o NetHack

Big techs consolidam portfólio de produtos de AI: Tencent anuncia oficialmente o encerramento do “Xiaolongxia” QClaw : A Tencent anunciou que o QClaw será descontinuado em 24 de dezembro de 2026, orientando os usuários a migrarem para o WorkBuddy. Sob a pressão de custos computacionais e metas de ROI, as grandes empresas de tecnologia chinesas estão encerrando suas estratégias de concorrência interna paralela, unificando iniciativas fragmentadas de agentes em plataformas corporativas integradas de produtividade (Fonte: 36氪)

Tencent encerra o QClaw

Maior supercomputador de AI do Reino Unido pode ser adiado para a década de 2030 devido a atrasos na rede elétrica : O supercomputador soberano de AI de 90 MW em Essex, no Reino Unido, previsto originalmente para entrar em operação em 2027, enfrenta gargalos de expansão na rede elétrica regional. A concessionária local estima que o fornecimento necessário só poderá ser atendido em meados da década de 2030, evidenciando o descompasso estrutural entre a expansão da infraestrutura de computação e a capacidade de fornecimento elétrico tradicional (Fonte: The Guardian)

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *