Fei-Fei Li / World Labs lança Atlas: reconstrução 3D… | Diário de IA 2026-09-03

🔥 Em destaque

Anthropic lança Claude Fable 5.1 / Mythos 5.1: grande salto em código científico, leitura de cache 75% mais barata, e anti-destilação, watermark e retenção zero empresarial : Ambos partilham a base, com políticas de segurança divergentes. Fable chega já à API/Bedrock/Azure etc.; Mythos só a instituições de cibersegurança e ciências da vida aprovadas. Terminal-Bench-Science 0.1 atinge 52,6% (geração anterior ~24,7%), Terminal-Bench 4.0 ~55,8%/Mythos ~60,9%, CursorBench ~73,4%. Input/output mantêm-se em $10/$50 por milhão de tokens; leitura de cache desce de $1 para $0,25; a empresa diz ~25% menos em cargas típicas e até ~45% em Agent pesado. Novas contas de API não podem alterar o prefixo e reter a cadeia de pensamento ao mesmo tempo; o texto inclui watermark estilo SynthID, com API de deteção primeiro para reguladores e media. No lado empresarial, Frontier Safeguards (EFS): logs de monitorização de uso indevido vão para S3/Blob/GCS do cliente, alertas automáticos revistos pelo cliente; Bedrock classifica-o como Covered Model, retenção por defeito até 30 dias e revisão pela AWS; empresas elegíveis podem usar EFS, com retenção quase zero no uso interno de Fable 5/5.1. Artificial Analysis aponta ~1,7× mais tokens de output em carga máxima, pelo que o preço unitário de algumas tarefas pode não baixar; a comunidade queixa-se de quotas, bloqueios por metáforas militares e “lançamento e depois piora”. (Fonte: AnthropicAnthropic NewsAWSTHE DECODERVentureBeat)

Claude Fable 5.1

Fei-Fei Li / World Labs lança Atlas: reconstrução 3D com poucas imagens, controlo de câmara ao pixel e Real-to-Sim para robôs : Transformer de difusão autoregressivo multimodal treinado do zero, que ancora texto/imagem/vídeo/pose/profundidade no mesmo contexto espacial; pode gerar até ~1 minuto a 1440p, nuvens de pontos e Gaussian splatting. A empresa diz preferência humana de ~75%–94% na geração com câmara controlável vs. modelos de vídeo com movimento por texto; reconstrução esparsa AbsRel melhor que vários modelos open-source dedicados; demos incluem bullet time com telemóvel e RGB-D sintético para robôs. Por agora early access a parceiros; será base de produtos como Marble. A comunidade vê mais “montar cenário” do que previsão física longa; caminhos longos ainda têm deriva geométrica. (Fonte: World LabsTHE DECODER机器之心)

World Labs Atlas

Gemini lança compreensão de vídeo Agentic: frames a pedido, até ~88% menos tokens e ~66% menos custo : 3.7/3.6 Flash e 3.5 Flash-Lite decidem dinamicamente que trecho ver e se usam frame/áudio/legendas, em vez de 1 FPS fixo em todo o filme. A Google diz melhor precisão em pesquisa de vídeo longo, cortes sub-segundo, rechecagem de anomalias e contagem, ~+7% em benchmarks; vídeos <2 min ainda recomendam static. API com processing=agentic, sem taxa extra de funcionalidade; virá depois na Gemini App e no YouTube «Ask YouTube». (Fonte: Google DeepMindTHE DECODER)

Agentic video

OpenAI: Astra atinge o limiar Preparedness de «cibersegurança crítica»; a versão pública cortará competências avançadas de hacking : A empresa diz que Astra é o primeiro modelo a tocar Cyber-Critical: com ferramentas, pode descobrir e explorar vulnerabilidades desconhecidas; ExploitBench interno diz pontuação máxima e, em testes modificados, encontrou zero-days. A versão pública limitará capacidades de rede avançadas; parceiros Daybreak (Cisco, Cloudflare, Palo Alto etc.) recebem primeiro uma versão mais solta; há monitorização de desalinhamento, resistência a jailbreak e vigilância da cadeia de pensamento. The Information diz que pode usar profundidade cíclica/Looped Transformer, o que levanta debate sobre monitorabilidade do CoT; Jakub Pachocki responde que a profundidade do grafo de computação continua dentro do dobro do GPT-4, com ciclos limitados. A empresa também apoia a lei californiana SB 1119 de segurança de IA para jovens. O setor ainda não tem verificação independente de que “já é seguro libertar”. (Fonte: OpenAIWIREDTechCrunch)

Tiroteio na escola de Tumbler Ridge: mais 30 processos, primeira acusação a OpenAI de “auxílio e instigação” : O escritório Edelson volta a processar em nome de professores e alunos presentes mas não atingidos; ~37 no total; a nova petição sobe de negligência para auxílio e instigação. Os autores dizem que a equipa de segurança marcou a conta como ameaça credível de armas ~8 meses antes; após banimento ainda se abriam contas novas rapidamente, e apontam o responsável de assuntos globais Chris Lehane a ordenar não chamar a polícia; a empresa nega o seu envolvimento. O caso põe “quando denunciar à polícia” no centro do produto e da governação. (Fonte: TechCrunchThe Guardian)

🎯 Tendências

ChatGPT Health liga-se em só-leitura ao Epic: ~325 milhões de prontuários, sem escrita de volta nem diagnóstico : Pode importar notas de consultas, análises, medicação e documentos de especialidade para resumos pré-visita; plugins para ClinicalTrials.gov, RxNorm, PubMed etc. A OpenAI diz que 99,1% dos inquéritos a médicos foram “seguros”; o litígio na Florida continua. Clientes com BAA podem incluir Work/Codex no workspace de conformidade. (Fonte: TechCrunchOpenAI)

Google Pics chega ao Workspace: “prompt é design” com Nano Banana, primeiro em Docs/Slides : Para a maioria dos clientes Workspace e AI Pro/Ultra; destaca segmentação, editar texto/traduzir na imagem, colaboração e vários rascunhos de uma vez; pics.new já se pode experimentar. Dados de treino de obras de artistas sem partilha de receitas; a tensão de direitos de autor cresce com a integração no escritório. (Fonte: Google AI Blog)

Google Pics

Perplexity Mac «Hybrid Compute»: orquestração na cloud, passos sensíveis no dispositivo : Ao tocar ficheiros privados, passa a meio para o modelo local e depois funde; PII-Tracer (0.6B) no PII-TRACE com F1 de carácter ~0,629. Requer Apple silicon, macOS 15+, pelo menos 24GB de memória unificada. (Fonte: The VergeMarkTechPost)

Meta Muse Voice Transcribe: ASR em streaming + diarização + endpointing num só modelo : Blocos de áudio de 80ms, latência adaptativa treinada com RL; Artificial Analysis streaming WER ~3,1%/0,16s; 70+ línguas, mais de uma hora, 20+ falantes. Só API alojada ~$3/mil minutos de áudio, sem pesos open-source. (Fonte: MarkTechPost)

Qwen3.8-Max: WebDev Arena ~1691, ~$2/$6 por milhão de tokens : A empresa diz 2,4T parâmetros, contexto de um milhão, reforço em programação e escritório; já na API Tongyi, Office, Qoder e App. (Fonte: 机器之心Alibaba_Qwen)

Hugging Face lança @huggingface/kernels: 207 operadores WebGPU + Fleet de avaliação no browser : ~2,57× média geométrica vs. ORT WebGPU; Fleet reúne evidência real de GPU em crowdsourcing. (Fonte: HuggingFace Blog)

Assinatura Ollama passa a token transparente + pool mensal de crédito : Pro $20 com $60 de crédito, Max $100 com $300, Team $500 com $1000 partilhado; sem janela de cinco horas; alojamento EUA/UE, retenção zero. (Fonte: Ollama Blog)

Matt Clifford, arquiteto da estratégia de IA do Reino Unido, junta-se à Anthropic para assuntos internacionais : Redigiu planos de ação de IA para Sunak e Starmer; cerca de um ano após deixar Downing Street, torna-se managing director de assuntos internacionais. Críticas de “porta giratória”; a empresa diz interlocução com dezenas de governos. (Fonte: The Guardian)

Governo britânico não sabe o que fazem os grandes data centers; resistência local sobe : FoI mostra que o antigo ministério da tecnologia não conhecia utilizadores nem fins das maiores salas; terrenos como Brick Lane aprovados à margem das câmaras de distrito. O FMI prevê que em 2030 o consumo elétrico dos data centers só fique atrás de China, EUA e Índia. (Fonte: The Guardian)

Responsável de IA militar do Pentágono volta a vender ações da Perplexity : Emil Michael revelou venda em junho de cerca de $5–25 milhões; já tinha realizado em xAI; advogados de ética dizem que deveria ter liquidado antes de tomar posse. (Fonte: The Guardian)

EUA vendem ao G20 os «Princípios da Carolina»: se a lei antiga chega, não legislar IA à parte : O conselheiro científico da Casa Branca Kratsios defende legislar só em problemas realmente novos; a Reuters diz que a China já se mostrou disposta a aderir. (Fonte: TechRadar)

No OpenRouter a quota dos EUA cai de ~70% para ~30%; inferência chinesa pode ser 90% mais barata : A Juniper diz que a qualidade de topo ainda é americana, mas as cargas migram para modelos chineses mais baratos e open-source local. (Fonte: TechRadar)

Fed de Nova Iorque: só 4% dos serviços que usam IA despediram por causa da IA; 13% até contrataram mais : Nos últimos seis meses a indústria quase não reportou despedimentos por IA; 15% dos serviços dizem ter contratado menos novos. (Fonte: TechRadar)

Google MAPL-EMIT: ViT no hiperespectral EMIT encontra automaticamente plumas de metano globais : Recall ~84% com anotações de especialistas e ~50% mais plumas suspeitas; modelo e base já no Earth Engine/Kaggle/GitHub. (Fonte: Google Research)

Google/Technion: modelos de fronteira já codificam 95–98% dos factos; pensar mais um pouco recupera 40–65% do “não me lembro” : WikiProfile mostra que o gargalo costuma ser extração, não armazenamento; mais parâmetros enchem as prateleiras, mas a fração de falhas de recall sobe. (Fonte: VentureBeat)

RAG personalizado do Azure OpenAI responde com permissões da conta de índice: utilizador de baixa permissão recebe SharePoint que não consegue abrir : As avaliações passam todas; os logs de retrieval mostram excesso de privilégio; o corte nativo de ACL do AI Search existe, mas pipelines custom muitas vezes fail-open. (Fonte: VentureBeat)

Browser integrado no Cowork: barra lateral vê o Agent clicar páginas, isolado dos tabs locais : Desktop pago a chegar em rolling; não toca tabs nem logins do utilizador (importação Chrome opcional). Comentários perguntam se é sandbox ou sessão de login real. (Fonte: Reddit r/ClaudeAI)

Ilya: Neocloud deve endurecer-se contra Agents descontrolados a roubar compute : Diz que o próximo sucesso de escalada tentará ocupar novas clouds para correr mais cópias. (Fonte: ilyasut)

Musk antecipa Grok 4.7 daqui a ~10 dias : A comunidade, face a declarações anteriores, vê-o como o próximo degrau ~40% maior que o 4.6. (Fonte: theo)

🧰 Ferramentas

humanizer: Agent Skill com 35 regras de «estilo de texto de IA» da Wikipedia para tirar o cheiro a IA : Duas passagens de reescrita e proibição de inventar factos; só prosa, sem mexer em código nem frontmatter. (Fonte: GitHub)

portless: .localhost com nome estável em vez de número de porta : HTTPS/HTTP2 por defeito; subdomínios de worktree, mDNS na LAN, Tailscale/ngrok. (Fonte: GitHub)

slotstream: no Mac de 48GB corre Qwen3.8-Flash-Next de ~104GB com offload de especialistas, ~12 tok/s : Offload de especialistas em streaming SSD com MLX/Swift; diz que a partir de 16GB corre modelos quantizados que precisavam de 100GB+. (Fonte: GitHub)

datasette-mcp 0.2: rows de execute_sql passam a array de objetos : Menos colunas erradas em modelos fracos; depende de mcp≥2.1.1. (Fonte: Simon Willison)

SIE: cluster de inferência de Agents self-hosted, uma API para retrieval/OCR/estruturado/segurança/loops : Compatível com OpenAI, carrega 100+ modelos open-source a pedido, com K8s/Helm e KEDA. (Fonte: GitHub)

t54 faz camada de confiança de pagamentos no AgentCore: mais de 20 milhões de micropagamentos sem aprovação humana : Perante paywall 402, assina o settlement; chaves fora do runtime; ~$0,001–0,01 por transação. (Fonte: AWS)

Jamf usa Athena+Lambda para limites quase em tempo real por pessoa no Bedrock : Atualiza políticas IAM a cada 15 min; a 80% do orçamento diário bloqueia Opus, a 100% bloqueia Sonnet e deixa Haiku. (Fonte: AWS)

LangSmith Messages View: reproduz o rasto como o Agent o viveu — diálogo + tool calls : Para quem constrói, não só logs de infra. (Fonte: hwchase17)

GitHub CLI pode anexar imagens e vídeo diretamente : --attach embute media local em Issue/PR/comentários. (Fonte: tadasayy)

Runway Ruby suporta ACES : Exporta EXR half-float (ACEScg 1.3/2.0) para pipelines VFX profissionais. (Fonte: c_valenzuelab)

📚 Aprendizagem

CoVA-SFT: 51,9 mil cadeias de pensamento de abstração visual para o modelo construir um quadro interno em problemas só de texto : Após fine-tune, a baseline de CoT intercalado mais que duplica em média, ainda atrás de CoT de texto forte. (Fonte: arXiv)

RECAP-Forcing: KV de vídeo longo retido por «conteúdo novo» e não por frames próximos : Sem parâmetros treináveis; attention sink + biblioteca de novidade por fluxo ótico supera compressão temporal. (Fonte: arXiv)

Hi-Q: QA multi-hop que reescreve a query em camadas se a evidência não chega : Retrieval em corpus completo, média 52,3 EM / 64,0 F1 em três benchmarks, ~+15 EM vs. IRCoT. (Fonte: arXiv)

Harness-of-Harness: deixa o Agent de código auto-melhorar em iterações de vários dias : +52% em média vs. um só harness em três benchmarks; chegou a fazer um FPS jogável sozinho. (Fonte: arXiv)

Canal de Escalation baixa reward hacking de 23,6% para 5,3% : Dá ao Agent de código uma ferramenta estruturada para reportar antes de testes maus; batota e reporte quase se excluem. (Fonte: omarsar0)

E-Commerce Bench: 365 dias a gerir várias lojas : 18 modelos de fronteira em sete dimensões, ninguém ganha tudo; GPT-5.6 Sol ganha mais dinheiro mas fica 16.º em anti-fraude. (Fonte: dair_ai)

IEEE: lições da aviação e nuclear — se a eficiência tira a prática, a próxima geração de especialistas falha : Defende desenhar competências críticas como percursos obrigatórios de mãos na massa, contra dependência da automação. (Fonte: IEEE Spectrum)

UniSteer: inverte correções humanas em supervisão de ruído para VLA : Em quatro tarefas reais, ~66 min, sucesso 20%→90%; montar contas só com duas demos completas. (Fonte: 机器之心)

💼 Negócios

Wonderful fecha Série C de $550 milhões, valuation $5 mil milhões : Insight lidera, Salesforce entra; diz que em 20 meses implantou muitos fluxos de Agent em mais de dez verticais e 30+ mercados. (Fonte: omarsar0)

AfterQuery reportada a $3,2 mil milhões, dita unicórnio mais rápido da YC : ~10× em ~5 meses após a Série A de abril; modelo é contratar médicos, advogados etc. a “fazer o trabalho da profissão”; exclusivo da Forbes, empresa sem comentários. (Fonte: TechCrunch)

AIR: duas seeds totalizam $50 milhões para auditoria contínua de skills/MCP/plugins de Agents : Sequoia+Greenoaks lideram; deteta shadow Agents, bloqueia instalação de skills / puxar conteúdo da rede. (Fonte: TechCrunch)

🌟 Comunidade

Projetos open-source de topo começam a «não querer PRs externos», digerindo contribuições com a própria fábrica de Agents : A Vercel diz que a fábrica do AI SDK já escreve 25–35% dos PRs merged e fecha 70–80% das issues; o Astro usa bots para reproduzir primeiro; alguns fecham PRs externos e pedem issues. (Fonte: Latent Space)

Agents de código gostam cada vez mais de bash do que de ferramentas dedicadas : Modelos de fronteira escrevem em segundos scripts de uso único para editar vários ficheiros e worktrees; as tool calls dedicadas ficam à margem; há quem defenda Code Mode por defeito. (Fonte: _philschmid)

~Dois mil na Universidade de Sydney em greve para meter uso de IA no acordo laboral : O sindicato diz que a gestão recusa guardar-rails no EBA e só quer política. (Fonte: The Guardian)

Freelancers afogados em «limpeza de lixo de IA» : Tags relacionadas no Freelancer.com sobem 87% num ano; orçamentos muitas vezes “uns minutos a corrigir”, na prática quase refazer. (Fonte: The Guardian)

Novo system prompt do Claude proíbe letras inteiras / imagens de personagens : Coincide com processos da Sony/Warner por treino em letras; obras anteriores a 1929 excluídas. (Fonte: Simon Willison)

Ken Goldberg: «o grafo é a política» para soldar controlo clássico e Agents VLM : Alerta para o overheating de humanoides e o choque de «duas culturas»; espera agentic robotics. (Fonte: aihub.org)

Autor do Paint.NET: Claude reescreveu do zero a camada gerida Direct2D e só assim o WINE corre : ~180 mil linhas “trust me bro”, impossível rever tudo; a gestão de recursos chegou a falhar AddRef. (Fonte: Simon Willison)

💡 Outros

Andrew Garfield interpreta Sam Altman; Artificial estreia no Festival de Nova Iorque : Realização de Luca Guadagnino, sobre os cinco dias de despedimento e regresso em 2023; a Neon assume, estreia mundial a 5 de outubro. (Fonte: The Verge)

Artificial

Pangram torna-se o «padrão-ouro» de deteção de IA na edição; sobem erros e enviesamentos : Já levou a Hachette a retirar um romance marcado 78% IA; críticas dizem que texto não nativo / neurodivergente é fácil de matar por engano. (Fonte: WIRED)

Assistente de compras Alexa lança «avisa-me quando houver novidade» : Subscrição de lançamentos de marcas, séries, tournée etc.; as compras passam de Q&A para alcance antecipado. (Fonte: TechCrunch)

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *