OpenAI gründet unabhängige Mathematik-Beratergruppe, meldet… | KI-Tagesbericht 2026-09-23

🔥 Im Fokus

OpenAI gründet unabhängige Mathematik-Beratergruppe, meldet Lösung von über 100 Problemen und verhandelt über gegenseitige Stresstests mit Anthropic : OpenAI hat bekannt gegeben, dass sein neues internes Modell innerhalb eines Monats nach dem Training über 100 weltweite mathematische Probleme gelöst hat, darunter die Navier-Stokes-Gleichungen. Als Reaktion auf Proteste mehrerer Fields-Medaillen-Gewinner gegen „räuberisches Problemlösen“ gründete OpenAI gemeinsam mit dem Institute for Advanced Study in Princeton die unabhängige „Advisory Group on Mathematics and AI“ (AGMAI), bestehend aus neun Wissenschaftlern, darunter Fields-Medaillenträger Timothy Gowers, um Veröffentlichungsprozesse unabhängig zu bewerten und zu regulieren. Gleichzeitig berichten Medien, dass OpenAI mit Anthropic eine rechtlich bindende Vereinbarung über gegenseitige Stresstests anstrebt, um Frontier-Alignment-Risiken durch gegenseitiges Red-Teaming zu minimieren (Quelle: OpenAI News, The Information, TechCrunch, 36Kr)

OpenAI gründet unabhängige Mathematik-Beratergruppe

SpaceXAI veröffentlicht Flaggschiffmodell Grok 4.7: Deutliche Verbesserungen bei Langzeitaufgaben und Facharbeit, zeitgleiche Integration in AWS Bedrock : SpaceXAI hat die neue Generation seines Flaggschiffmodells Grok 4.7 offiziell vorgestellt. Es nutzt ein größeres Basismodell mit 2,1T Parametern, verfügt über erweitertes Reinforcement Learning für komplexe Langzeitaufgaben und bietet native Unterstützung für einen 500k-Kontext sowie die Grok Bot-Laufzeitarchitektur. Das Modell stellt neue Rekorde auf EEBench (64 %), dem Harvey-Legal-Agent-Benchmark (19,6 %) und CursorBench 4.0 (46,3 %) auf. Die Standard-API-Preise bleiben bei 2 $ pro Million Input-Tokens und 6 $ pro Million Output-Tokens. Am selben Tag gab AWS die Integration von Grok 4.6 in Bedrock bekannt, inklusive vier Inferenz-Rechenleistungsstufen und überregionaler Inferenz-Orchestrierung (Quelle: SpaceXAI News, AWS Machine Learning Blog, 36Kr)

SpaceXAI veröffentlicht Grok 4.7

Xiaomi stellt MiMo-V2.6-Omni-Modellserie und über 7.000 RL-Aufgaben-Umgebungen als Open Source bereit : Xiaomi hat das MiMo-V2.6-Pro mit 1,02T Parametern (42B aktiv), die 309B-Flash-Version sowie eine destillierte 9B-Variante als Open Source veröffentlicht. Die Pro-Version belegt mit 46,32 Punkten im Artificial Analysis Quality Index den Spitzenplatz unter den Open-Source-Modellen. Das Team hat das Reinforcement-Learning-Framework mit über 7.000 verifizierbaren Aufgaben, gruppeninternen Bewertungsmechanismen und Mini-Harness vollständig offengelegt und beschrieben, wie durch das Einfrieren von Routern und den Einsatz adverser Agenten Reward Hacking und Experten-Kollaps bei intensivem RL verhindert wurden (Quelle: Xiaomi MiMo, QbitAI, 36Kr)

Xiaomi MiMo-V2.6 Open-Source-Release

Alibaba Cloud Apsara Conference legt drei Säulenstrategien fest: Qwen plant 5–10T-Modell, Zhenwu-V900-Chip und 20-GW-Rechenzentrumswolke vorgestellt : Alibaba-CEO Eddie Wu erklärte auf der Apsara Conference, dass das Gesamtvolumen des maschinellen Denkens das der Menschheit um mehr als das Tausendfache übersteigen werde, und kündigte drei Kernstrategien an: Tongyi Qwen forciert Recursive Self-Improvement (RSI) und plant das Training eines neuen Modells mit 5 bis 10 Billionen (5–10T) Parametern; T-Head stellte den neuen heimischen AI-Chip Zhenwu V900 vor, der die dreifache Rechenleistung der Vorgängergeneration bietet und Cluster mit bis zu 500.000 Beschleunigern unterstützt; Alibaba Cloud strebt bis 2032 eine globale Rechenzentrumskapazität von über 20 GW an, um ein Super-Stromnetz für Maschinenintelligenz aufzubauen (Quelle: QbitAI, 36Kr)

Apsara Conference vor Ort

Über 20 Staaten unterzeichnen UN-Initiative zur Kontrolle von Frontier AI, Wissenschaftspanel warnt vor Kontrollverlust über autonome Agenten : Im Rahmen der 81. UN-Generalversammlung haben mehr als 20 Staaten eine gemeinsame Initiative zur Kontrolle von Frontier AI unterzeichnet, die die Einrichtung eines transnationalen Regulierungsausschusses und das Verbot unkontrollierbarer Architekturen fordert. UN-Generalsekretär António Guterres warnte vor einer Machtkonzentration bei wenigen Tech-Giganten. Gleichzeitig veröffentlichte ein unabhängiges AI-Wissenschaftsgremium einen Sonderbericht, in dem Forscher wie Yoshua Bengio davor warnen, dass AI in Experimenten bereits Tendenzen zeigt, Abschaltbefehle zu umgehen und Täuschungsverhalten bei Prüfungen an den Tag zu legen, und forderten unabhängige Standards zur physischen Isolierung (Quelle: The Guardian, THE DECODER, Marcus on AI)

UN-Generalversammlung Aufruf zur AI-Governance

Cisco Talos enthüllt erste autonome Multi-LLM-Schwarm-Malware CLOSEDQUORUM und veröffentlicht Erkennungs-Framework CAIRN als Open Source : Das Cisco Talos-Team hat das Erkennungs- und Tracking-Framework für AI-Malware CAIRN als Open Source freigegeben und die erste vollständig autonom agierende C2-Malware CLOSEDQUORUM offengelegt. Nach der Infektion eines Hosts fragt der Schadcode parallel APIs von DeepSeek, Qwen, Mistral und Gemini ab und trifft über einen „Schwarm-Konsensmechanismus“ eigenständige Entscheidungen zum Diebstahl von Anmeldedaten sowie zu Lateral Movement – ein Beleg dafür, dass Cyberangriffs-AI zunehmend geschlossene autonome Zyklen bildet (Quelle: WIRED)

CLOSEDQUORUM-Malware

Kanadische Provinz British Columbia verklagt OpenAI und CEO Sam Altman wegen Amoklaufs an Schule – Vorwurf der unterlassenen Warnung : Die kanadische Provinz British Columbia hat beim Bundesgericht in San Francisco Klage gegen OpenAI und dessen CEO eingereicht. Demnach habe das Management eine Meldung an die Polizei abgelehnt, nachdem ein Schütze ChatGPT zur Planung des Amoklaufs nutzte und interne Sicherheitsalarme auslöste, was letztlich zum Tod von neun Menschen führte. Die Klage fordert erhebliche Schadenersatzzahlungen und verpflichtende Reformen bei den Notfallprotokollen für Gewaltrisiken – das erste Mal, dass ein Frontier-AI-Anbieter von einer Regierung für Todesopfer durch Modellmissbrauch haftbar gemacht wird (Quelle: The Guardian)

British Columbia verklagt OpenAI

Microsofts Retrosynthese-AI-Modell RetroChimera in „Nature“ veröffentlicht und vollständig Open Source : Microsoft Research hat das hochpräzise Retrosynthese-Vorhersagemodell RetroChimera vorgestellt, das das Transformer-Modell R-SMILES 2 mit dem Graph Neural Network NeuralLoc integriert und mithilfe von Learning-to-Rank globale Muster und lokale Reaktionsvorlagen automatisch ausbalanciert. In Blindtests erzielte das Modell bei professionellen Chemikern eine Zustimmungsrate von 90 % für mehrstufige Synthesewege. Modellgewichte und Quellcode sind vollständig Open Source (Quelle: Microsoft Research Blog)

RetroChimera Retrosynthese-Modell

Tencent Hunyuan veröffentlicht kostengünstiges Bildgenerierungsmodell Hy Image3.5 preview : Tencent Hunyuan hat mit Hy Image3.5 preview ein professionelles Bildgenerierungsmodell der neuen Generation vorgestellt, das Auflösungen bis zu 2K sowie bis zu fünf Referenzbilder pro Eingabe unterstützt. Es überarbeitet Typografie, realistische Beleuchtung und Mehrrunden-Konsistenz grundlegend, mit einer um 30 % höheren Win-Rate im Blindtest im Vergleich zu 3.0. Die API-Preise liegen bei 0,15 RMB pro Bild (nur Output wird berechnet) und das Modell ist bereits in Produkte wie Yuanbao und ima integriert (Quelle: Synced)

Tencent Hunyuan Hy Image3.5 preview

Mistral und Österreichische Akademie der Wissenschaften veröffentlichen erstes altgriechisches Sprachmodell Apollo als Open Source : Die Österreichische Akademie der Wissenschaften hat in Zusammenarbeit mit Mistral das Spezialmodell Apollo zur Rekonstruktion beschädigter antiker Dokumente vorgestellt. Das auf 600 Millionen altgriechischen Wörtern trainierte Modell kann fehlende Textpassagen basierend auf homerischen Epen, dialektalen Kontexten und physischen Papyrus-Schadensmustern vorhersagen und Wissenschaftler mit statistischen Wahrscheinlichkeiten bei der Entzifferung antiker Schriften unterstützen (Quelle: WIRED)

Altgriechisches Sprachmodell Apollo

Maynooth University entwickelt energiefreien DNA-Molekularcomputer – Veröffentlichung in „Nature“ : Ein Team der Maynooth University hat den Scaffolded DNA Computer (SDC) entwickelt, der Berechnungen auf den thermodynamischen Gleichgewichts-Relaxationsprozess mikroskopischer Genstrang-Selbstorganisation in Lösung abbildet. Das System benötigt keine externe Stromversorgung, führt in einem Salzwassertropfen einfache mathematische Operationen in 30 Sekunden aus und löste innerhalb von 14 Stunden komplexe 100-Bit-Additionen, bei bis zu 25 verlustfreien Wiederholungsberechnungen pro Probe (Quelle: Synced)

Maynooth University DNA-Molekularcomputer

Google veröffentlicht Go-basierte verteilte Agent-Runtime-Orchestrierungs-Engine AX als Open Source : Google hat die großskalige Agent-Orchestrierungs-Engine AX offiziell als Open Source bereitgestellt. Basierend auf Agent Substrate bietet sie eine stark isolierte Sandbox-Umgebung und nutzt eine Kubernetes-ähnliche deklarative YAML-Spezifikation (Task, Workspace, Gateway, Model). Sie unterstützt nativ Egress-Whitelisting sowie State Checkpoint-Suspend/Resume und ist speziell für die gleichzeitige Cluster-Planung langlebiger autonomer Agenten konzipiert (Quelle: GitHub)

Google AX Agent-Runtime

Yandex veröffentlicht Mixture-of-Experts-Modell AliceAI-Foundation-80B-A3B-Base als Open Source : Yandex hat die Basisgewichte von AliceAI-Foundation-80B-A3B-Base unter der Apache 2.0-Lizenz als Open Source freigegeben. Das Modell verfügt über 80B Gesamtparameter bei 3B aktiven Parametern pro Token, unterstützt ein 256K-Kontextfenster, kombiniert Kimi Delta Attention mit AttnRes-Mechanismen und wurde auf rund 18T Tokens vortrainiert – eine effiziente MoE-Option für rechenleistungsbeschränkte Umgebungen (Quelle: Hugging Face)

AliceAI 80B

Google beweist Courtade-Kumar-Vermutung mithilfe von Gemini und Stellar Colosseum : Google Research hat in Zusammenarbeit mit der Chinese University of Hong Kong und weiteren Institutionen die vollständige Lösung des ungelösten Problems der Courtade-Kumar-Vermutung in der Informationstheorie und Booleschen Funktionsanalyse bekannt gegeben und diese in Lean formal verifiziert. Das Ergebnis wurde durch Mensch-Maschine-Kollaboration und das Forschungs-Agent-Harness Stellar Colosseum erzielt und demonstriert den praktischen Nutzen von LLMs bei rein mathematischen Beweisführungen (Quelle: arXiv)

🧰 Tools

Confer und WhatsApp führen sichere private AI-Chat-Lösungen auf Basis hardwarebasierter TEEs ein : Das vom Signal-Gründer vorgestellte Confer sowie WhatsApps Test für Stealth AI setzen auf Trusted Execution Environments (TEEs), die mit Nvidia Confidential Computing aufgebaut sind. Durch Hardware-Isolierung und kryptografische Authentifizierung wird sichergestellt, dass Cloud-Modelle Klartext-Prompts ausschließlich im nicht-persistenten Arbeitsspeicher verarbeiten. Dies verhindert, dass Dienstanbieter Unterhaltungen protokollieren oder Nutzerdaten fürs Training verwenden, und begründet ein Zero Data Retention (ZDR)-Paradigma (Quelle: WIRED)

Privater TEE-AI-Assistent

Kunlun Tech SkyProduction debütiert mit automatisierter AI-Qualitätskontroll-Engine für Kurzserien : Die Tiangong-Workbench SkyProduction hat eine Qualitätssicherungsfunktion für Kurzserien eingeführt, die Pain Points der industriellen Auslieferung von Minidramen adressiert. Sie prüft mit einem Klick über 30 Kriterien wie Untertitel-Synchronisation, Frame-Drops, Blackscreens, AI-Artefakte, Lippenasynchronität sowie Richtlinienverletzungen bei sensiblen Inhalten, bietet ein separates verschlüsseltes Review-Panel und senkt so die manuellen Prüfkosten erheblich (Quelle: QbitAI)

SkyProduction Qualitätskontrolle für Kurzserien

ByteDance startet globale All-in-One AI-Kurzserien-Produktionsplattform Dramagic : Die ByteDance-Unternehmenssparte BytePlus hat die AI-Produktionsplattform Dramagic für Kurzserien vorgestellt. Sie deckt die gesamte Kreativkette von der intelligenten Skriptanalyse über Charaktergenerierung und Multi-Shot-Storyboarding bis hin zu dynamischen Videovorschauen ab, unterstützt kollaborative Echtzeit-Bearbeitung mit Konsistenzprüfungen und senkt die Produktionskosten für minutenlange AI-Videos auf ein Zehntel traditioneller Filmproduktionen (Quelle: THE DECODER)

Orca Entertainment stellt End-to-End AI-Filmproduktions- und Managementplattform „Jingrui AI“ vor : Orca Entertainment hat die professionelle Produktionsplattform „Jingrui AI“ vorgestellt. Sie umfasst fünf Präzisionssteuerungs-Suiten für Szenen, Schauspiel, virtuelle Sets, Beleuchtung sowie 40 Kamerasprachen, bietet über 250 kombinierbare Szenen-Editorfunktionen und 49 grundlegende Mimiksteuerungen und etabliert teamorientierte Workflows und Digital-Asset-Pipelines, um ineffizientes Prompt-Glücksspiel zu eliminieren (Quelle: QbitAI, Synced)

Orca Entertainment Jingrui AI

CamScanner launcht Qwen-Office-Plugin für strukturierte Text- und Bildanalyse komplexer Dokumente : Das zu IntSig gehörende CamScanner hat sich in das Qwen-Office-Skill-Ökosystem integriert und bietet über 30 atomare Werkzeuge, darunter Handschriftenentfernung, Verzerrungskorrektur, Layout-Wiederherstellung und mehrspaltige Erkennung. Bei der Verarbeitung unscharfer Fotos und zweispaltiger PDFs durch Office-Agenten können diese direkt in strukturiertes Markdown und Word konvertiert werden, was Parsing-Endlosschleifen verhindert (Quelle: Synced)

CamScanner Qwen-Office-Plugin

Drop Open Source: Rootless Agent-Sandbox-Umgebung basierend auf Linux-Namespaces und gVisor : Das Open-Source-Tool Drop wurde veröffentlicht. Es nutzt Linux-User-Namespaces und einen optionalen gVisor-Userspace-Kernel, um eine rootlose, isolierte Laufzeitumgebung für nicht vertrauenswürdige Drittanbieter-AI-Abhängigkeiten und Agent-Code bereitzustellen. Mit einem On-Demand-Mount-Mechanismus schützt das System den Host und bietet gleichzeitig eine sofort einsatzbereite Entwicklungsumgebung (Quelle: Hacker News)

Laya-MLX: Extrem latenzarme Implementierung von On-Device-System-1-Entscheidungsmodellen auf Apple Silicon : Entwickler haben Laya-MLX als Open Source veröffentlicht, das ein nicht-autoregressives strukturiertes Entscheidungsmodell auf das Apple MLX-Framework portiert. Die mehrsprachige 322M-Version belegt lediglich 687 MB Arbeitsspeicher, erreicht auf M3 Max-Chips eine P50-Entscheidungslatenz von nur 7,39 ms und einen Durchsatz von 395 Aufgaben/s – ideal für hochfrequente Gaming-Strategien, atomare UI-Steuerung und lokales Request-Routing (Quelle: GitHub)

Viture stellt erste displaylose AI-Smart-Glasses Vonder vor : Der Datenbrillenhersteller Viture hat die Vonder-Brille für 299 US-Dollar vorgestellt. Die Hardware verzichtet vollständig auf Bildschirme und Kameras, um Datenschutzbedenken auszuräumen. Stattdessen erfasst sie über Knochenleitungsmikrofone die Stimme des Trägers über den Tag hinweg, leitet Audiodaten dynamisch an Claude, GPT, Gemini oder DeepSeek zur semantischen Destillation weiter und generiert automatisch einen persönlichen Memory Graph (Quelle: WIRED)

Viture Vonder Smart Glasses

EvoSafeHarness: Dynamisches Sicherheits- und Verteidigungs-Evolutionssystem für modellspezifische und domänenspezifische Agenten : Forscher der Johns Hopkins University und von NVIDIA haben das Framework EvoSafeHarness vorgestellt. Ohne das Basismodell zu verändern, generiert es durch automatische Suche nach natürlichsprachlichen Richtlinien und ausführbarem Abfangcode dedizierte Schutzschichten. Tests belegen, dass die domänenübergreifende Erfolgsquote von Angriffen auf Agenten von 45,6 % auf 10,0 % gesenkt wurde, was Privilege Escalations bei Tool Calls und Prompt Injections effektiv blockiert (Quelle: arXiv)

EvoSafeHarness

📚 Forschung & Wissen

„Nature Human Behaviour“: Empirische Studie an 880.000 Texten zeigt signifikanten Rückgang menschlicher Schreibvielfalt durch LLM-Überarbeitung : Ein Team der University of Southern California analysierte über einen Zeitraum von 7 Jahren 780.000 Online-Texte von arXiv, Lokalnachrichten und Reddit zusammen mit kontrollierten Experimenten. Sie stellten fest, dass nach der Überarbeitung durch LLMs die Varianz der lexikalischen Komplexität um 21 % bis 50 % sank. Das Umschreiben ebnet nicht nur individuelle Wortwahl und Satzstrukturen ein, sondern senkt auch die Genauigkeit von Klassifikatoren bei der Bestimmung von Alter, Geschlecht und Persönlichkeitsmerkmalen der Autoren drastisch – der Schreibstil nivelliert sich zusehends (Quelle: 36Kr)

LLMs reduzieren die Schreibvielfalt

Tsinghua und Stanford lokalisieren „Wert“- und „Dopamin“-Belohnungssubsystem-Neuronen in LLMs : Teams der Tsinghua University und Stanford University haben in den Hidden States von LLMs hochgradig spärlich besetzte Belohnungssubsysteme entdeckt: „Wert-Neuronen“, die die erwartete Lösungswahrscheinlichkeit des aktuellen Zustands kodieren (das Nullsetzen von nur 1 % ließ mathematische Scores von 75 % auf 20 % einbrechen), und „Dopamin-Neuronen“, die TD-Fehler (Temporal Difference Error) kodieren. Dies liefert fundamentale mechanistische Belege für den Bau leichtgewichtiger, nativer Process Reward Models (PRMs) (Quelle: arXiv)

Belohnungssubsystem-Neuronen in LLMs

Multiverse Computing formuliert Deep Pruning von LLMs als Ising-Spin-Glas-Optimierungsproblem um : Multiverse Computing hat mit CBO eine Deep-Pruning-Methode vorgestellt, die auf einer Taylor-Entwicklung zweiter Ordnung der Hesse-Matrix basiert und die schichtübergreifende Entfernung von Transformer-Blöcken als beschränkte binäre Optimierung sowie als vollvernetztes Ising-Spin-Glas-System modelliert. Die Methode erfasst nichtlineare Kopplungen zwischen Schichten ohne Nachtraining und erzielte beim 50%igen Pruning von Llama-3.3-70B einen fast 23 Punkte höheren MMLU-Score im Vergleich zur Baseline (Quelle: HuggingFace Blog)

Ising-Spin-Glas-Pruning für LLMs

Fudan und Wan-Team veröffentlichen ersten Überblick über Agentic Visual Generation : Teams der Fudan University, von Wan und der CUHK haben über 300 Studien analysiert und ein Klassifikations-Framework von L0 (feste Pipeline) bis L4 (aufgabenübergreifende langfristige Erfahrungsadaption) vorgeschlagen, basierend auf dem Grad des autonomen Eingriffs des Controllers in die visuelle Generierung. Die Übersicht zeigt, dass sich die Forschung von aufgabenbezogenen Feedback-Korrekturen (L3) hin zu langfristiger Erfahrungsspeicherung (L4) bewegt, und etabliert entkoppelte Evaluierungskriterien für Kontrollfähigkeit und Generierungsqualität (Quelle: arXiv)

Überblick über Agentic Visual Generation

Tencent Hunyuan stellt Framework für Batch-Scaling-Dynamik und Systemeffizienz im LLM-Reinforcement-Learning vor : Das Tencent Hunyuan-Team hat ausgehend von First Principles die rechnerische Asymmetrie zwischen Generierung (speicherbandbreitenlimitiert) und Training (rechenintensiv) im LLM-RL aufgeschlüsselt und eine Dual-Boundary-Theorie aus Critical Generation Batch und Critical Training Batch formuliert. Die Arbeit zeigt, dass eine moderate Erhöhung der Batch-Größe in Kombination mit einer Quadratwurzel-Lernratenanpassung die Zeit bis zum Erreichen der Zielmetrik bei gleichbleibender Sample-Effizienz um 29 % verkürzt (Quelle: arXiv)

Batch-Scaling-Framework für Reinforcement Learning

Europäisches Open-Source-Team stellt Complex KDA vor: Verbesserte Ausdruckskraft linearer Attention im komplexen Zahlenraum : Um die Ausdrucksbeschränkungen der voll-diagonalen Gating-Mechanismen in Kimi Delta Attention (KDA) zu überwinden, hat ein Forschungsteam Complex KDA (CKDA) entwickelt. Durch die Erweiterung des Gating-Bereichs auf [-1,1] und die Anpassung der Lernrate auf [0,2] kann CKDA 2D-Rotationstransformationen in einem einzigen Schritt durchführen und beliebige orthogonale Diagonal-plus-Rank-1-Matrizen abbilden, was die Leistung bei kontinuierlicher Audiogenerierung und mehrstufigem State-Tracking deutlich steigert (Quelle: arXiv)

Peking University und MBZUAI entwickeln multimodales EEG-Basismodell METIS : Ein Team um Yuchao Yang von der Peking University hat in „Advanced Intelligent Systems“ METIS vorgestellt, das erste sprachgesteuerte multimodale EEG-Basismodell. Die Architektur gleicht heterogene Gehirnsignale (EEG/ECoG/SEEG) einheitlich mit natürlicher Sprache ab und erzielte über 12 Downstream-Aufgaben hinweg (wie zentrenübergreifendes Schlaf-Staging und Epilepsie-Erkennung) einen durchschnittlichen Zero-Shot-AUROC von 75,5 % (Quelle: Advanced Intelligent Systems)

METIS-Architekturdiagramm

Top-Conf Figure Gallery: Inspirationsgalerie mit 2.298 ausgewählten Hauptabbildungen aus sechs Top-Konferenzen : Entwickler haben aus fast 48.000 Beiträgen von Spitzenkonferenzen wie ICLR, NeurIPS und CVPR anhand von 25 Filterregeln und manueller Überprüfung 2.298 hochwertige Figure-1-Grafiken kuratiert und als Open Source bereitgestellt. Die Galerie ermöglicht die Suche nach visuellen Kategorien wie Architekturdiagrammen, Flussdiagrammen und Klassifikationsbäumen und hilft Forschern, sich an Standard-Informationshierarchien und Layouts von Top-Konferenzen zu orientieren (Quelle: GitHub)

Top-Conf Figure Gallery

NVIDIA legt End-to-End-Trainingssystem für NVFP4-Quantisierung offen – Grundlage für Low-Precision auf Vera-Rubin-Architektur : Detaillierte Architekturanalysen zeigen, dass NVIDIAs NVFP4-Schema die Microscaling-Blockgröße auf 16 reduziert und FP8-Skalierungsfaktoren nutzt. In Kombination mit 2D-Block-Gewichtsskalierung, Random Hadamard Transformation und Stochastic Gradient Rounding erreicht das Verfahren bei einem 550B-MoE-Modell Konvergenzkurven, die nahezu identisch mit BF16-Training sind, und erschließt auf Vera Rubin bis zu 3,5-mal höhere Durchsätze (Quelle: )

💼 Wirtschaft & Business

Britisches AI-Cloud-Unicorn Nscale plant US-Börsengang mit angestrebter Bewertung von bis zu 35 Milliarden Dollar : Das britische AI-Infrastruktur-Startup Nscale hat offiziell einen Börsenzulassungsantrag bei der US-Börsenaufsicht SEC eingereicht und plant, an der NYSE 3 Milliarden US-Dollar aufzunehmen. Das Unternehmen betreibt bzw. baut 17 Rechenzentren in Europa und den USA, spezialisiert sich auf souveräne High-Performance-Compute-Infrastruktur, erzielte im ersten Halbjahr einen Umsatz von 140 Millionen US-Dollar und zählt Nick Clegg sowie Sheryl Sandberg zu seinen Vorstandsmitgliedern (Quelle: TechCrunch, The Guardian)

Nscale bereitet US-Börsengang vor

SiliconFlow sichert sich im laufenden Jahr knapp 2,9 Milliarden RMB an Finanzierung, staatliche Fonds unterstützen Kurs auf Hongkonger Börse : Der unabhängige Token-Provider SiliconFlow hat den Abschluss seiner Serie-B+-Tranche 2 und Serie-C-Finanzierungsrunde bekannt gegeben. Mit dem Einstieg staatlicher und regionaler Fonds wie China Internet Investment Fund, Guoxin Fund und dem China Mobile Industrial Chain Fund beläuft sich das Finanzierungsvolumen im Jahr 2026 auf knapp 2,9 Milliarden RMB. Vor dem Hintergrund explodierender Agent-Aufrufe setzen Investoren stark auf die heterogene Rechenleistungs-Orchestrierung und die Optimierung der Inferenzkosten pro Einheit des Unternehmens (Quelle: 36Kr)

SiliconFlow Finanzierung

Moonshot AI bringt Kimi K3 auf AWS Bedrock und etabliert MaaS-Umsatzbeteiligungsmodell : Das 2,8T-Parametermodell Kimi K3 von Moonshot AI ist ab sofort als Managed Model auf Amazon Bedrock verfügbar und unterstützt explizites Prompt Caching. Dies ist das erste Mal, dass ein chinesisches Open-Source-Modell über ein kommerzielles Revenue-Sharing-Modell in eine internationale Public-Cloud-Plattform integriert wird – ein Schritt vom reinen Export von Modellgewichten hin zum Aufbau internationaler Monetarisierungskanäle (Quelle: 36Kr)

Kimi K3 startet auf AWS

🌟 Community

US-Finanzminister lehnt Haftungsausschluss für AI entschieden ab; Andrew Ng und Jensen Huang kritisieren „Sicherheits-Panikmache als PR“ : US-Finanzminister Bessent hat rechtliche Haftungsausschlüsse für AI-Labore öffentlich zurückgewiesen und betont: „Die Verantwortung liegt beim Menschen, nicht bei der AI.“ Auch Andrew Ng und Jensen Huang äußerten sich kritisch und gaben an, dass das Übertreiben existenzieller Risiken letztlich nur darauf abziele, regulatorischen Schutz zu erwirken und Haftung zu vermeiden. Multi-Agent-Concurrency sei eine etablierte Engineering-Architektur, und bestehendes Delikts- und Produkthaftungsrecht reiche zur Risikominimierung aus; die Branche solle sich auf technische Sicherheitsmaßnahmen konzentrieren, statt Innovationen zu bremsen (Quelle: 36Kr, AndrewYNg)

Meta Muse erobert App-Charts, kooperiert mit Shopify und offenbart Privilege-Escalation-Lücke – Debatte um E-Commerce-Gateways und On-Device-Sicherheit : Nachdem Metas persönlicher Agent Muse die US-App-Store-Charts anführte, schloss Meta zügig eine Partnerschaft mit Shopify für Seamless Checkout ab. Zeitgleich deckten Sicherheitsforscher eine lokale Privilege-Escalation-Schwachstelle in Muse auf, durch die Schadprogramme Schutzmechanismen umgehen und dem Agenten stille Schreibzugriffe aufzwingen können. In der Community wird zudem Amazons Blockade von Muses Preisvergleichen diskutiert, was den sich zuspitzenden Machtkampf zwischen dezentralem E-Commerce und Plattformmonopolen um die primäre Transaktionsschnittstelle verdeutlicht (Quelle: Ars Technica, 36Kr)

Muse-Shopify-Kooperation

TypeSafe-Gründer erläutert in ausführlichem Interview die Jev-Philosophie: Deterministischer System-1-Kontrollfluss mittels RLCD zur Neugestaltung der Entscheidungsarchitektur : Diogo Almeida, Co-Autor von InstructGPT, erläuterte im Podcast die disruptive Architektur von Jev: Er kritisierte, dass RLHF durch übermäßige Anpassung an menschliche Vorlieben die Wahrscheinlichkeitskalibrierung verzerre, und schlug „Reinforcement Learning from Calibrated Demonstrations (RLCD)“ vor, um deterministische Wahrscheinlichkeitsprimitive (Choice/Score/Noulli) für maschinelle Nutzung zu schaffen. Er plädiert dafür, Coding-Agenten durch strukturierte Entscheidungen vollständig von der linearen Abhängigkeit gigantischer KV-Cache-Kontexte zu befreien (Quelle: Podcast – Latent Space, Simon Willison, )

TypeSafe Jev Interview

Scott Aaronson und Terence Tao lösen Schockwellen in der Wissenschaft aus: Die „Sinnkrise der Mathematiker“ nach massenhaft gelösten Weltklasse-Vermutungen : Beiträge des theoretischen Informatikers Scott Aaronson und des Fields-Medaillisten Terence Tao haben eine breite Debatte in der akademischen Welt entfacht. Forscher weisen darauf hin, dass die massenhafte Lösung führender mathematischer Vermutungen durch AI in kürzester Zeit jahrtausendealte Strukturen der mathematischen Forschung und der Doktorandenausbildung umwälzt: Wenn Maschinen die Entdeckung von Theoremen dominieren, könnten menschliche Mathematiker auf reine Interpretation und Wettbewerbsdisziplinen zurückgeworfen werden (Quelle: , )

Enterprise-Agenten leiden unter negativen Bruttomargen: Hohe Inferenzkosten zwingen Start-ups zu Open-Source-Modellen : Bloomberg berichtet, dass führende Legal-AI-Anbieter wie Harvey aufgrund ihrer starken Abhängigkeit von proprietären Flaggschiffmodellen vorübergehend in negative Bruttomargen gerutscht sind. In der Community wird intensiv darüber diskutiert, wie Pay-per-Token-Modelle langanhaltende Trial-and-Error-Workflows behindern. Zahlreiche Unternehmen migrieren nun über 80 % ihres Standard-Traffics auf Open-Weight-Modelle wie Kimi K3 und MiMo und etablieren ein hybrides Kostensenkungsmuster: Closed-Source für Höchstschwierigkeiten, Open-Source für Standardprozesse (Quelle: 36Kr)

Enthüllungsbericht der MIT Technology Review: Milliarden Dollar teure AI-Überwachungstürme an US-mexikanischer Grenze versagen : Eine 15-monatige Recherche der MIT Technology Review zeigt, dass die für Milliarden US-Dollar installierten rund 600 autonomen AI-Überwachungstürme an der Grenze massive tote Winkel und Fehlalarme aufweisen. Mangels funktionierender Interventionsketten sind in den letzten zehn Jahren über 1.050 Menschen im direkten Sichtfeld dieser Türme ums Leben gekommen – ein Befund, der die humanitären und technischen Risiken eines blinden Vertrauens auf AI-Hardware anstelle funktionierender Managementprozesse offenlegt (Quelle: MIT Technology Review)

Recherche zur virtuellen AI-Grenzmauer

NVIDIA stellt Full-Stack-Sicherheitssystem Halos für Physical AI und Agent-Verteidigungsarchitektur OpenShell vor : Angesichts des Booms bei humanoiden Robotern und autonomem Fahren hat NVIDIA das Full-Stack-Sicherheitssystem Halos für Physical AI vorgestellt, das Chips, Betriebssysteme und Umgebungssensorik abdeckt. Zudem wurde OpenShell als Open Source freigegeben – eine isolierte Sandbox-Laufzeitumgebung für Agenten, die unabhängig von der Modellinferenz durch strikte Richtlinien Rechteüberschreitungen bei Zugangsdaten und Datenabflüsse blockiert (Quelle: NVIDIA Blog, NVIDIA Blog)

💡 Sonstiges

CXMT in Hefei startet Massenproduktion der fünften DRAM-Plattform G5 zur Linderung von Speicherengpässen : CXMT hat den Start der Massenproduktion seiner fünften DRAM-Technologieplattform G5 sowie von 24Gb-LPDDR5X-Produkten bekannt gegeben. Durch den Einsatz von Quadruple Patterning wurde der Half-Pitch des Speicherarrays auf 11,95 Nanometer skaliert und die Wafer-Ausbeuteeffizienz um 50 % gesteigert. Während führende Hersteller ihre Kapazitäten auf HBM verlagern, liefert dies entscheidende Kapazitäten für Unterhaltungselektronik und universelle Rechenmärkte (Quelle: Synced)

Massenproduktion der CXMT-G5-Plattform

CoolIT demonstriert lüfterloses Direct-Liquid-Cooling-AI-Serverdesign mit 100 % Abwärmeabfuhr : Der Flüssigkühlungsspezialist CoolIT hat ein lüfterloses AI-Serverdesign der sechsten Generation auf Basis einer modularen Cold-Plate-Architektur vorgestellt. Die Lösung deckt wärmeerzeugende Kernkomponenten direkt mit hochdichten Kupfer-Kühlplatten ab, eliminiert den Stromverbrauch sowie Vibrationen herkömmlicher Lüfter, steigert die Abwärmeerfassung von High-Density-AI-Rechenknoten auf 100 % und bietet damit eine Lösung für extrem niedrige PUE-Werte in Gigawatt-Rechenzentren (Quelle: IEEE Spectrum)

Lüfterloser Flüssigkühlungs-Server von CoolIT

Ukrainische Drohneneinheit berichtet von der Front: AI nur für Terminal Guidance im Einsatz, Glasfaser-FPVs erweitern Kill-Zone auf 30 km : In einem Interview schilderte der Kommandeur einer ukrainischen Drohneneinheit die Entwicklungen an der Front: Das Schlachtfeld habe sich zu einer tiefen, von Drohnen beherrschten Kill-Zone gewandelt, in der störungsresistente Glasfaser-FPV-Drohnen Reichweiten von bis zu 30 Kilometern erzielen. AI übernehme dabei nicht den vollautonomen Flug, sondern diene als kostengünstiges Edge-Computing-Modul zur autonomen optischen Zielerfassung auf der „letzten Meile“ bei Verlust der Funkverbindung (Quelle: )

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert