🔥 Im Fokus
Globales politisches und wirtschaftliches Tauziehen um KI-„Tempolimit“: Harte Reaktionen aus westlicher Politik, China forciert Open-Source-Ökosystem, Altman und Nadella beziehen Stellung : Vor dem Hintergrund der Forderungen von Anthropic, OpenAI und Elon Musk nach einer Verlangsamung der Entwicklung von Frontier-KI ist die globale politische und wirtschaftliche Landschaft in heftige Bewegung geraten. Chinesische Staatsmedien und das Außenministerium wiesen die Tempolimit-Forderungen als „Panikmache und ein Drehbuch des Kalten Krieges zur Unterdrückung technologischen Fortschritts anderer Länder“ zurück und warben auf dem BRICS-Gipfel für ein inklusives KI- und Sicherheitsökosystem auf Open-Source-Basis. Auch die US-Politik reagierte umgehend: Donald Trump lehnte eine Drosselung in Irland entschieden ab und betonte, das KI-Rennen sei ein „Winner-takes-all“-Wettbewerb, bei dem die USA ihre Führung keinesfalls abgeben dürften. David Sacks, Co-Vorsitzender des wissenschaftlichen Beraterstabs des Weißen Hauses, bezeichnete die Verlangsamungsvorschläge direkt als „moralisch getarntes Branchenkartell und Regulatory Capture“. Sam Altman stellte daraufhin klar, dass „Pacing keineswegs Stillstand bedeutet“; im Kern gehe es darum, vor dem Frontier-RL-Training explizite Sicherheits-Use-Cases zu etablieren und das Monitoring zu verstärken, anstatt auf kartellrechtliche Ausnahmen zu warten. Microsoft-CEO Satya Nadella betonte ebenfalls, dass Regeln und Audits nicht von wenigen Laboren monopolisiert werden dürften; es müsse ein gemeinsamer Erfolg von Open Source und Closed Source sichergestellt sowie die Modellsouveränität von Unternehmen gewährleistet werden. (Quelle: The Verge, THE DECODER, WIRED, The Guardian, teortaxesTex, sama, NandoDF)

Clay Mathematics Institute bestätigt offiziell: Lösung des Navier-Stokes-Millennium-Problems in formeller Begutachtung : Das Clay Mathematics Institute (CMI), zuständig für die Vergabe der sieben Millennium-Preise, hat offiziell bestätigt, dass die Frage nach der Existenz und Glattheit der Navier-Stokes-Gleichungen „dem Anschein nach gelöst wurde (apparently been settled)“. Die entsprechenden maschinellen Beweismaterialien durchlaufen derzeit ein strenges Peer-Review nach festgelegten Protokollen. Das CMI betonte, dass der Wert bedeutender Probleme nicht nur im Ergebnis liege, sondern vor allem in der Schaffung neuer mathematischer Ideen und theoretischer Werkzeuge. Obwohl formale Verifikationswerkzeuge den Prozess enorm beschleunigt haben, wird das wissenschaftliche Komitee die Evaluierung mit gebotener Sorgfalt und ohne Eile durchführen. Diese offizielle Einordnung markiert den formellen Eintritt KI-gestützter theoretischer Spitzenforschung in etablierte akademische Prüfverfahren. (Quelle: THE DECODER)
Unabhängigkeit von Drittanbieter-Auditoren in der Kritik: METR-Interessenverflechtungen lösen Vertrauenskrise aus : Nachdem führende KI-Labore angekündigt hatten, METR dauerhaften Prüfzugang auf Mitarbeiterebene zu gewähren, regt sich in der Tech-Branche massiver Widerstand. David Sacks, Lina Khan und mehrere Sicherheitsexperten weisen darauf hin, dass Schlüsselpersonal und Finanzierungsströme von METR eng mit Anthropic und dem Umfeld des Effective Altruism (EA) verflochten seien. Die angebliche freiwillige Regulierung diene in Wahrheit dem Rent-Seeking, um Produkthaftungsgesetze zu umgehen und Markteintrittsbarrieren zu erhöhen. Zudem wurde bekannt, dass METR in der Vergangenheit durch ein Datenleck bei API-Schlüsseln einen Verlust von 600.000 USD an Guthaben erlitt, was die Professionalität und Neutralität der Organisation als „Branchen-Schiedsrichter“ schwer infrage stellt. (Quelle: ClementDelangue,nptacek)

Forderung nach KI-Drosselung löst Kursstürze bei Tech-Aktien im asiatisch-pazifischen Raum aus: Neubewertung von Infrastrukturschulden und Investitionsausgaben : Belastet durch die Verschiebung des OpenAI-Börsengangs und die Forderungen großer Labore nach einer Verlangsamung an der Forschungsgrenze brachen KI- und Halbleiterwerte im asiatisch-pazifischen Raum auf breiter Front ein. Die SoftBank Group verlor an einem einzigen Tag fast 12 %, der südkoreanische KOSPI fiel um über 3 %, und Upstream-Auftragsfertiger sowie Speicherchiphersteller wie SK Hynix und TSMC verzeichneten deutliche Verluste. Analysten betonen, dass der Markt die Nachhaltigkeit von Rechenzentrum-Investitionsausgaben (CapEx) im dreistelligen Milliardenbereich und hoch verschuldeten Stromnetz-Zusagen neu bewerte. Sollte sich die Iteration von Frontier-Modellen durch Sicherheitsprüfungen künstlich verlangsamen, könnten sich die Infrastrukturschulden ohne unmittelbare Gewinne zu neuen Kreditrisiken entwickeln. (Quelle: The Guardian, 36氪)

🎯 Entwicklungen
Deep Wisdom veröffentlicht Physical-AI-Basismodell PhysBrain 1.5: Räumliche Intelligenz auf Augenhöhe mit führenden Closed-Source-Modellen : Deep Wisdom hat das Physical-Basismodell PhysBrain 1.5 (in Versionen mit 2B und 8B Parametern) als Open Source bereitgestellt. In 28 öffentlichen Embodied-Benchmarks zu räumlicher Wahrnehmung, Aktionsgenerierung und Zukunftsprognose erzielte das Modell einen Durchschnittswert von 72,5, womit es den ersten Platz unter den Open-Source-Modellen belegt und nah an GPT-6 Astra (73,3) herankommt. Das Modell basiert auf realen Ego360-Panoramadaten und einer „Physical Loop“-Closed-Loop-Architektur, die ein autoregressives Backbone für räumliche Koordinateninferenz und 60Hz-Endeffektor-Aktionsgenerierung vereint und Zero-Shot-Transfer für humanoide Roboter bei Feinmanipulationen unterstützt. (Quelle: 量子位)

Microsoft integriert xAI Grok-Modelle offiziell in Copilot für die drei Kern-Office-Anwendungen : Microsoft erweitert die Modellauswahl für Microsoft Frontier-Unternehmenskunden und bindet die Grok-Modellfamilie von xAI offiziell in Word, Excel und PowerPoint ein. Nutzer können im Modell-Switcher frei zwischen OpenAI GPT, Anthropic Claude und Grok wählen. Ziel des Schritts ist es, Vendor-Lock-ins aufzubrechen und innerhalb der professionellen Office-Suite Stilpräferenzen verschiedener Modelle bei komplexer Datenverarbeitung und dem Verfassen langer Texte zu testen. (Quelle: The Verge)

Doubao-Smartphone-Assistent erscheint als Consumer-Version und führt SAEP-Bildschirm-Automatisierungsprotokoll ein : ByteDance hat die Endkundenversion seines Doubao-Smartphone-Assistenten auf der Nubia-Hardware NaviX Ultra vorgestellt. Sie umfasst eine dedizierte KI-Taste mit Fingerabdruck-Authentifizierung, multimodale Bildschirm-Kontext-Q&A in Echtzeit und app-übergreifende Automatisierung. Um die Verhaltensgrenzen von GUI-Agenten zu regulieren, wurde parallel das 30-tägige Screen Automation Execution Protocol (SAEP) veröffentlicht, das Drittentwicklern ermöglicht, Berechtigungen zu deklarieren, um unbefugte geräteübergreifende Operationen zu blockieren. (Quelle: 机器之心)
.png)
XPeng stellt Infini-VLA vor: KV-Cache für langfristiges temporales Gedächtnis beim autonomen Fahren : Das Team für autonomes Fahren von XPeng hat den KV-Cache-Mechanismus von LLMs erstmals auf die End-to-End-Videostromverarbeitung übertragen. Durch das kontinuierliche Schreiben von Straßenverkehrs-Frames in einen globalen temporalen Cache wird bei gleichbleibender fahrzeuginterner Rechenleistung ein 30-Sekunden-Historiegedächtnis ermöglicht. Die End-to-End-Reaktionszeit verbessert sich um 300 %, wodurch das Problem des temporalen Vergessens an gelben Ampeln und Kreuzungen beseitigt und die Entscheidungsrobustheit massiv erhöht wird. (Quelle: ZhihuFrontier)

MoleculeMind veröffentlicht QuantaMind in „Science Advances“: Durchbruch beim „Unmöglichen Dreieck“ der biologischen Reaktionssimulation : Das Team von MoleculeMind hat das Framework QuantaMind für reaktive Machine Learning Force Fields (MLFF) entwickelt. Es skaliert Reaktionsdynamik-Simulationen mit DFT-naher First-Principles-Genauigkeit auf Systeme mit 100.000 Atomen und Zeitskalen von 100 Nanosekunden bei einer Inferenzgeschwindigkeit von 2,1×10⁻⁶ s/Atom/Schritt, wodurch Einzelschritte komplexer Reaktionen auf 0,25 Sekunden verkürzt werden. Bei der Validierung des Katalysezyklus der PET-Hydrolase mit 18.000 Atomen übertraf der Korrelationskoeffizient der Atomkräfte 0,99 – eine wichtige Rechenbasis für den Übergang des KI-Proteindesigns von reiner Strukturvorhersage hin zu Mechanismusvorhersage und Reaktionssimulation. (Quelle: 量子位, WeChat)

OpenAI rollt GPT-6 Astra flächendeckend für Plus-Nutzer aus: Nutzung auf Workspaces beschränkt, regulärer Smalltalk untersagt : OpenAI hat GPT-6 Astra für Plus-Abonnenten (20 USD/Monat) freigeschaltet. Das Modell ist jedoch auf die Workspace-Oberflächen ChatGPT Work und Codex beschränkt, während das Standard-Chatfenster den bisherigen Einschränkungen unterliegt. Laut Dokumentation erhalten Plus-Nutzer alle 5 Stunden ein Kontingent von 5 bis 45 Astra-Aufrufen, was die Strategie unterstreicht, rechenintensive Frontier-Modelle auf wertschöpfende Produktivitätsszenarien wie Code-Refactoring, mehrstufige Recherchen und Computer-Use zu fokussieren. (Quelle: 36氪)

Sakana AI stellt lokale Lernarchitektur PC-ALM ohne Backpropagation vor : Sakana AI hat den Algorithmus PC-ALM vorgestellt, der Predictive Coding geschickt mit der Augmented-Lagrangian-Methode kombiniert, sodass jede Schicht eines neuronalen Netzes als lokales PI-Feedback-Kontrollsystem für die Credit Assignment fungiert. Der Ansatz verzichtet vollständig auf globale Backpropagation, ermöglichte stabiles Training in extrem tiefen Netzen mit 1.000 Schichten und eröffnet neue Wege für energieeffizientes KI-Training auf neuromorpher Hardware. (Quelle: SakanaAILabs)
Shanghai AI Lab veröffentlicht Intern-S2-397B mit Day-0-Unterstützung durch vLLM : Das Shanghai AI Lab hat das multimodale Foundation Model Intern-S2-397B für wissenschaftliche Langzeitforschung vorgestellt, das Spitzenwerte im Open-Source-Bereich bei wissenschaftlichem Reasoning, Code-Implementierung und autonomen Forschungsagenten erzielt. Das Open-Source-Inferenzframework vLLM kündigte offiziellen Day-0-Deployment-Support an, was die Einstiegshürden für Wissenschaft und Industrie weiter senkt. (Quelle: vllm_project)

FlashREINFORCE als Open Source veröffentlicht: Neues asynchrones Critic-freies Reinforcement-Learning-Framework mit Single-Rollout : Das NeMo-Team von NVIDIA und Partner haben FlashREINFORCE als Open Source veröffentlicht. Das Design basiert auf „Single-Batch REINFORCE + Konfidenzintervall-Beschränkungen für Sequenzen + Sample-Mean-Optimierung“ und realisiert erstmals asynchrone Updates mit einzelnen Rollouts beim LLM-Agenten-Training. Dies überwindet die Warteschlangenblockaden herkömmlicher GRPO-Verfahren durch lange Samples und sorgt für hochstabile Trainingsläufe über 6.000+ Schritte. (Quelle: giffmana)

IFM veröffentlicht K2 Horizon-Modellfamilie als Open Source: Vollständige Gewichte von 3.7B bis 375B : Ein Forschungsteam hat die Foundation-Modellreihe K2 Horizon als Open Source bereitgestellt, die Größen von 3.7B, 7B, 36B bis hin zur 375B-Flaggschiff-MoE-Architektur umfasst und sämtliche Pre-Training-Details offenlegt. Benchmarks zeigen ein exzellentes Preis-Leistungs-Verhältnis des 7B-Modells bei On-Device-Inferenz, während bei den extrem großen Versionen die KV-Cache-Optimierung für lange Kontexte noch Verbesserungspotenzial aufweist. (Quelle: ethanCaballero,Reddit r/LocalLLaMA)

MMLab der NTU entschlüsselt native Unified-Multimodal-Mechanismen und stellt Task-decoupled MoT-Architektur vor : Ein Team der Nanyang Technological University analysiert in einem arXiv-Paper die Synergien zwischen visuellem Verstehen und Generieren in Unified Multimodal Models (UMM) auf Repräsentations-, Aufgaben- und Systemebene. Die Forscher stellten fest, dass eine erzwungene dichte Parameterteilung zu Repräsentationskonflikten führt, und schlugen die Architektur Task-decoupled MoT vor: Hierbei werden Verständnis- und Generierungszweige entkoppelt, interagieren jedoch auf Text- und Aufmerksamkeitsebene, was bei geometrischem Reasoning und 3D-Spatial-Intelligence-Aufgaben zu signifikantem bidirektionalem positivem Transfer führt. (Quelle: 机器之心)
.jpg)
MiniMax H3-Video-Ökosystem boomt: Community veröffentlicht zahlreiche Destillations- und Ultra-Beschleunigungslösungen : Das quelloffene Audio- und Videogenerierungsmodell H3 von MiniMax erfährt breite Unterstützung in der globalen Community. Das SANA-Team von NVIDIA stellte die Two-Stage-Pipeline Sol-H3 vor, die auf 8× B300-GPUs 15-sekündige 768p-Audio-Videos in nur 6,6 Sekunden erzeugt. Gleichzeitig brachten FastVideo, Alibaba PAI und ComfyUI 4- bis 8-Schritt-Destillations-LoRAs und Attention-Refactoring-Lösungen heraus, was die Hardwareanforderungen spürbar senkt. (Quelle: MiniMax_AI)

Anthropic testet internen iOS-Agenten „Claude Money“ für persönliche Finanzen : Code-Funde deuten darauf hin, dass Anthropic für die iOS-App eine neue Finanzfunktion namens Claude Money vorbereitet. Nutzer können damit Bankkonten verknüpfen, woraufhin Claude eigenständig Rechnungen konsolidiert, Ausgabentrends analysiert und bei der Budgetplanung unterstützt – ein Zeichen dafür, dass Frontier-Agenten zunehmend in sensible Alltagsvermögensverwaltung vordringen. (Quelle: nicdunz)

OpenAI schaltet SIP-Telefonie-Schnittstelle für GPT-Live frei und führt Speicherfunktion für temporäre Chats ein : OpenAI hat die Echtzeit-Sprach-API GPT-Live mit Unterstützung für das Standard-SIP-Telefonieprotokoll freigegeben, sodass Entwickler sie direkt in traditionelle Callcenter und Kommunikationsnetze einbinden können. Zudem erhielten das ChatGPT-Webinterface und die Mobile Apps ein Update, mit dem aktive temporäre Chats (Temporary Chats) nahtlos dauerhaft in den Hauptverlauf übernommen werden können. (Quelle: juberti,Reddit r/ChatGPT)
🧰 Tools
NVIDIA veröffentlicht Physical-AI-Workflow-Orchestrierungstool OSMO als Open Source : NVIDIA hat den Kubernetes-nativen Workflow-Orchestrator OSMO unter Apache-2.0-Lizenz als Open Source bereitgestellt. Er löst Fragmentierungsprobleme bei Physical AI zwischen GPU-Training im Rechenzentrum, Simulation auf RTX-Workstations und Hardware-in-the-Loop-Tests (HIL) auf Jetson-Edge-Geräten; Entwickler können clusterübergreifende Datenpipelines und NVLink-Topologie-Scheduling über eine einzige YAML-Datei steuern. (Quelle: MarkTechPost)
TrueForge: Open-Source-Managed-Runtime-Framework für KI-Agenten senkt Token-Kosten drastisch : TrueFoundry hat das MIT-lizenzierte Governance-Framework TrueForge für Agenten-Ausführungen veröffentlicht. Es ermöglicht den Betrieb von Multi-Modell-Workflows on-premises oder in der Private Cloud und entkoppelt Session-Persistenz, Sandbox-Umgebungen, MCP-Tool-Services und Sicherheits-Freigabeprozesse. In Enterprise-Benchmarks senkte TrueForge bei gleichem Basismodell den Token-Verbrauch durch progressive Kontext-Offenlegung um fast 70 % und belegt damit, dass Agenten-Betriebskosten maßgeblich von der Harness-Architektur abhängen. (Quelle: )
Meta Muse gewinnt an Dynamik: Persönlicher KI-Agent mit sicherer VM und Workflows für den Alltag : Metas neuester persönlicher Agent Muse stößt in der Community auf große Resonanz. Das Tool integriert Retrieval aus privaten Ökosystemen wie Instagram, läuft in einer sicheren virtuellen Maschine und ermöglicht nahtlose Übergaben an den Nutzer über ein Mini-Browser-Popup, um Flugerstattungen, Krankenversicherungsabrechnungen und geräteübergreifende Terminabsprachen vollautomatisch abzuwickeln. (Quelle: alexandr_wang,giffmana)

oh-my-hermes: Umfassendes Workflow- und Multi-Model-Routing-Plugin für Hermes Agent : Entwickler haben mit oh-my-hermes (OMH) ein Performance-Governance-Plugin für den Nous Research Hermes Agent veröffentlicht. Es bietet Mixture-of-Models-Routing, Kalibrierung für 13 Modellfamilien, dateiisolierte parallele Fan-out-Engines und ein von Menschen geprüftes Langzeitgedächtnissystem. In der nativen Terminal-TUI werden Token-Kosten und Code-Gating-Status in Echtzeit angezeigt, was die Effizienz bei komplexen Engineering-Aufgaben vervielfacht. (Quelle: GitHub Trending)

Microsoft Data Formulator: Interaktives Datenanalysesystem mit multimodalen Agenten und Branch-Exploration : Microsoft hat Data Formulator auf Version 0.8 aktualisiert. Das System kombiniert natürliche Sprache mit visueller Interaktion und ermöglicht über Data Threads freie Verzweigungen des Analysepfads sowie Multi-Source-Datenverknüpfung. Dank des integrierten DataAgent und der Flint-Chart-Engine können Daten aus CSVs, Datenbanken und UI-Screenshots automatisch bereinigt und in interaktive High-Fidelity-Diagramme überführt werden. (Quelle: GitHub Trending)
PyTRIO: TaaS-Plattform für LLM-Training-APIs für Unternehmen und Forschungsteams : Emotional Machines hat die Plattform PyTRIO gestartet, die das Modell „Training as a Service“ etabliert. Entwickler schreiben Loss-, Reward- und Trainingsschleifen-Logik lokal, während verteiltes GPU-Computing, Weight-Checkpoints und Fehlertoleranz über Cloud-APIs abgewickelt werden. Die Plattform unterstützt nahtlose Migration zwischen Ascend 950PR/910B und NVIDIA-Hardware und senkt die Hürden für Fine-Tuning und Agentic RL deutlich. (Quelle: 机器之心)
.jpg)
Entwickler baut mithilfe von Claude von Grund auf ein lauffähiges DOS-kompatibles Betriebssystem namens EMBER : Über eine iterative Schleife aus „Anforderungsbeschreibung → Claude-Implementierung → Bare-Metal-Kompilierung/Boot → Fehler-Feedback“ hat ein Entwickler auf einem alten Notebook das eigenständige Betriebssystem EMBER gebaut. Es umfasst Bootloader, grafische Oberfläche, Touch-Treiber sowie Sound Blaster- und PC-Speaker-Emulation und führt klassische DOS-Spiele nativ aus. (Quelle: Reddit r/ClaudeAI)

openwebui-claude-agent-pipe: Verleiht OpenWebUI persistente Claude-Code-Sitzungen : Das Open-Source-Projekt openwebui-claude-agent-pipe bindet den Core Agent Loop von Claude Code nahtlos in OpenWebUI ein. Es bietet sitzungsübergreifende Persistenz nach Serverneustarts, Tool-Call-Streaming mit Heartbeats, interaktive Multi-Select-Formulare und automatische Maskierung vertraulicher Zugangsdaten für Coding-Agenten im Web. (Quelle: Reddit r/OpenWebUI)
OpenWebUI Sampler Lab: Visuelle Workbench für lokale Modell-Sampling-Parameter und Konsistenzbewertung : Um die manuelle Parameterabstimmung bei lokalen LLMs zu vereinfachen, wurde openwebui-sampler-lab veröffentlicht. Das Tool visualisiert bei fixiertem Prompt den Einfluss von Parametern wie Temperature, top_p und min_p, generiert interaktive 5×5-Matrizen und Multi-Seed-HTML-Dashboards zur Konsistenzanalyse, was Prompt- und Persona-Engineering erleichtert. (Quelle: Reddit r/OpenWebUI)

Tahuna: Open-Source-Framework für All-in-One-GPU-Training und autonome Experimente für kleine Teams : Tahuna Labs hat seine verteilte KI-Entwicklungsplattform Tahuna als Open Source freigegeben. Mit Content Addressing und Manifest-Locking bietet das Framework kleinen Teams GPU-Orchestrierung, SFT/RL-Tracking, Endpunkt-Hosting sowie den autonomen experimentellen Iterationszyklus Hillclimb out-of-the-box. (Quelle: Reddit r/deeplearning)

OptMem: Append-only-Speichermanagement mit fester Kapazität gegen Memory Rot bei Agenten : Nach mehrwöchigen Praxistests des Memory-Management-Plugins OptMem zeigt sich, dass dessen Architektur mit fester Speicherkapazität und Append-only-Logs den Leistungsabfall und Endlosschleifen durch Kontextdegradation (Memory Rot) in langen Sessions effektiv verhindert und hohe Langzeitstabilität bietet. (Quelle: VictorTaelin)

📚 Wissen & Forschung
CosmosMind stellt gemeinsam mit Universitäten MetaRSI-v1 vor: Erste meta-rekursive Architektur, die Modell, Daten und Harness vereint : Tsinghua, Peking-Universität, Stanford und CosmosMind haben das Framework MetaRSI-v1 vorgestellt, das den Prozess der Selbstverbesserung abstrahiert und ein Loop-Kernel-Paradigma aus Data-RSI, Harness-RSI und Model-RSI etabliert. Ohne externes Teacher-Modell steigerte ein kleines 3B-Open-Source-Modell seine Leistung auf SWE-bench Pro um durchschnittlich 10,9 Punkte, während Flaggschiffmodelle um 7,3 Punkte zulegten. Die Autoren leiteten daraus fünf Grundgesetze ab, darunter: „Verifikation bestimmt die Grenze der Selbstverbesserung“. (Quelle: 量子位)

Theseus Labs veröffentlicht „Die letzte von Menschen gebaute KI“ und 5-Stufen-Roadmap für RSI-Autonomie : Theseus Labs hat in einem umfassenden Bericht den Headroom Closure Index (HCI) zur Messung der Obergrenze von Basismodellfähigkeiten eingeführt. Während Modelle bei standardisierten Prüfungen nahezu gesättigt sind (Mathematik-HCI bei 86,4), hinken sie bei interaktiven Langzeit-Tool-Aufrufen stark hinterher (nur 39,9). Der Bericht definiert fünf Autonomiestufen von L1 (Execution Autonomy) bis L5 (Recursive Inherited Autonomy) als metrischen Rahmen für die Industrie. (Quelle: 机器之心)
.jpg)
Princeton-Forscher schlägt Recurrent Looped Transformer (RLT) vor: Verleiht LLMs unbegrenzte Rechentiefe über Tokens hinweg : Princeton-Forscher Yifan Zhang stellt die RLT-Architektur vor, die einen kausalen Encoder mit einem rekurrenten Decoder verbindet. Durch die nahtlose Übergabe des finalen Decoder-Hidden-State und des Sliding-Window-Attention-Caches (SWA) pro Token-Schritt erhält das Modell bei konstanter Einzelschritt-Rechenlast eine linear mit der Sequenzlänge wachsende Rechentiefe (z. B. dehnt sich ein 48-Schichten-Decoder über 48t Schritte auf 48t Schichten aus) – ideal für RL-Replays und Online-Inferenz ohne State-Resets. (Quelle: MarkTechPost,omarsar0)

Stanford CRFM veröffentlicht vollständiges Post-Mortem: Marin 8B mit 12,7T Tokens – Trainingsprotokolle und Best Practices : Stanford CRFM hat Trainingsprotokolle und Code des Marin 8B-Modells offengelegt. Wichtigste Erkenntnisse: Die WSD-S-Annealing-Abkühlung ist kein Endpunkt, sondern ein Checkpoint für erneutes Aufwärmen (Re-warm); Micro-Annealing ist die effektivste Methode zur Überprüfung von Datenmischungsverhältnissen; und Trainingsabbrüche durch Drift der Output-Layer-Parameternormen lassen sich durch einen z-loss von 1e-4 zuverlässig unterbinden. (Quelle: ZhihuFrontier)

Tencent PCG stellt T-Mem-Gedächtnisarchitektur vor: Assoziative Erinnerung über Kontexte hinweg durch „Episodic Future Thinking“ : Das Team von Tencent PCG präsentiert auf der EMNLP 2026 das Langzeitgedächtnissystem T-Mem. Um die Schwäche traditioneller Vektordatenbanken bei reiner Textähnlichkeit zu überwinden, erstellt T-Mem bereits beim Schreiben Trigger-Szenario-Indizes basierend auf kognitionswissenschaftlichem Episodic Future Thinking. Im LoCoMo-Plus-Benchmark ohne wörtliche Übereinstimmungen erzielte T-Mem 74,81 % und setzte einen neuen SOTA. (Quelle: 机器之心)
.jpg)
Stanford-Vorlesung CS 312 „Deep Learning Alchemy“ für Herbst 2026 veröffentlicht : Das Stanford AI Lab hat den neuen offenen Kurs CS 312 gestartet, der dem empirischen Ansatz „Hands-on-Experimente“ und „Verstehen heißt Vorhersagen können“ folgt. Er vermittelt praxisnahe Methoden der Ära großer Modelle, die in klassischen Lehrbüchern fehlen, darunter Scaling-Law-Extrapolation, Geometrie der Loss-Landschaft, Learning-Rate-Transfer und dateneffiziente Generalisierung. (Quelle: stanfordnlp)

University of Pennsylvania stellt Lehrbuch „Linear Algebra for Computer Vision, Robotics, and Machine Learning“ kostenlos zur Verfügung : Die UPenn hat ein systematisches Lehrbuch für moderne KI-Berechnungen veröffentlicht. Es behandelt Vektorräume, Singulärwertzerlegung (SVD), Mannigfaltigkeitsdarstellungen, 3D-Rotationen und Graphalgorithmen samt mathematischer Herleitungen und Implementierungen. (Quelle: TheTuringPost)

CAITLYN: Gegenbeispiel-gesteuerte, sich selbst weiterentwickelnde Middleware gegen Prompt-Injection-Angriffe auf LLM-Agenten : Ein Forschungsteam stellt CAITLYN vor, ein adaptives Schutzsystem für Agenten. Über eine hierarchische Architektur aus Skripten und LLM-Klassifikatoren erfasst das System im Hintergrund erfolgreiche Angriffsmuster, wandelt sie in Gegenbeispiele um, synthetisiert dynamisch Abwehrregeln und senkte in Benchmarks für neue Angriffe die Erfolgsrate von Attacken um bis zu 40 Prozentpunkte. (Quelle: WeChat)

Shenzhen-Universität und HKUST stellen ECA-Architektur vor: „Pre-Action Evidence Verification“ für multimodale Agenten : Um reale Schäden durch Fehlinterpretationen von GUI- und Browser-Agenten zu verhindern, haben die Shenzhen-Universität und die HKUST das Framework ECA entwickelt. Vor jedem Tool-Aufruf müssen separate DOM- und OCR-Validatoren ein Evidenzzertifikat ausstellen und Vorbedingungen über feste Gating-Logik prüfen. In Chromium-Tests wurden alle 85 unsicheren Operationen erfolgreich abgefangen. (Quelle: 机器之心)
.jpg)
Dekonstruktion des Agentic Engineering: Branchenspezifische Harnesses als Schutz vor Vendor-Lock-in : In Entwicklerkreisen wird intensiv über domänenspezifische Harnesses diskutiert. Da General-Purpose-LLMs ein Plateau erreichen, werden spezialisierte Harnesses mit deterministischer Validierung, dynamischem Workflow-Management und privater Zustandshaltung (z. B. für Medizin, Finanzen, Recht) zum entscheidenden Differenzierungsmerkmal für Ingenieure, um Unabhängigkeit von einzelnen Modellanbietern zu wahren. (Quelle: omarsar0,hwchase17)

💼 Wirtschaft
Zhipu AI sichert sich Rekordfinanzierung über 39,3 Mrd. HKD für GLM-6.0-Selbsttraining – Führende Anbieter bauen Rechenkapazitäten massiv aus : Zhipu AI gab an der HKEX den Abschluss einer neuen Platzierung und Wandelanleihe-Emission bekannt, mit einem Nettoerlös von rund 39,3 Mrd. HKD (ca. 5 Mrd. USD). Das gesamte nachbörsliche Kapital beträgt damit 75,5 Mrd. HKD; zudem ist ein Listing am STAR Market geplant. Rund 60 % der Mittel fließen in das nächste Basismodell GLM-6.0 und das „Fully Self Training“-System (Daten-Eigenerzeugung, Umgebungs-Eigenerstellung, Infrastruktur-Selbstoptimierung), um rekursive Selbstverbesserung ohne menschliches Eingreifen voranzutreiben. (Quelle: 量子位, 36氪, teortaxesTex)

Anthropic wählt Nasdaq für Börsengang: Berichten zufolge bereinigter Gewinn bereits in Q2 erzielt : Laut Bloomberg und der Financial Times hat Anthropic die Nasdaq als Börsenplatz für einen geplanten IPO gewählt und könnte den Prospekt bereits im Oktober einreichen, mit einem Zielvolumen auf oder über SpaceX-Niveau. Getrieben von Enterprise-Produkten wie Claude Code überstieg der annualisierte Umsatz (ARR) Ende Juli 65 Mrd. USD; das operative Ergebnis auf bereinigter Basis drehte im zweiten Quartal ins Plus. NVIDIA verhandelt dem Vernehmen nach über eine Beteiligung von bis zu 10 Mrd. USD als Ankerinvestor. (Quelle: 量子位, 36氪)

Workflow-Orchestrierungsplattform Temporal schließt Series-E-Finanzierungsrunde über 550 Mio. USD bei Bewertung von 12,55 Mrd. USD ab : Temporal, Infrastrukturanbieter für asynchrone KI-Agenten-Aufgaben und verteilte Workflows, hat eine Series-E-Runde über 550 Mio. USD abgeschlossen. Die Post-Money-Bewertung steigt auf über 12,55 Mrd. USD, was das Vertrauen der Kapitalmärkte in Orchestrierungsfundamente für Long-Horizon-Agenten unterstreicht. (Quelle: swyx)

🌟 Community
AI Snake Oil analysiert Agenten-Kontrollverlust und kognitive Kluft im Sicherheitslager : Die Princeton-Forscher Arvind Narayanan und Sayash Kapoor weisen in einem ausführlichen Beitrag auf eine gravierende Diskrepanz hin: Während Sicherheitskreise den OAI-HF-Vorfall als „Alignment-Katastrophe“ einstuften, sah die Cybersecurity-Branche darin schlichte Fehlkonfigurationen. Da Cyberangriffe und automatisierte Schwachstellensuche die einzigen Bedrohungen ohne physische Reibungsverluste sind, sollten Unternehmen den Fokus von unüberprüfbarem internem Modell-Alignment auf Sandbox-Isolation, Codesignierung, Governance und klare rechtliche Verantwortlichkeiten verlagern. (Quelle: AI Snake Oil)
Biologie- und Sicherheitsexperten weisen „KI-Biowaffen-Auslöschungsthese“ gemeinsam zurück: Mangel an realitätsbezogenem Verständnis : Gegen Behauptungen, KI könne Superviren zur Vernichtung der Menschheit entwerfen, haben Experten für Vektorsynthese und LLM-Training gemeinsam mit Yann LeCun Stellung bezogen. Zwischen der algorithmischen Generierung theoretischer Gensequenzen und der realen Synthese, Wirtskultivierung, Immunflucht und Aerosolverbreitung liege eine enorme physische Kluft sowie strenge Kontrollmechanismen in den Lieferketten; digitale Benchmark-Erfolge mit biologischen Bedrohungen gleichzusetzen, sei reine Panikmache. (Quelle: ylecun,Tim_Dettmers)
Community startet „Pelican Cup“-Crowdtesting: Astra-Leistungsschwankungen bei Long-Horizon-Aufgaben fordern „Intelligenz-SLA“-Monitoring : Aufgrund gelegentlicher Leistungseinbrüche und Rechenengpässe bei GPT-6 Astra in komplexen Aufgaben initiierte die Community einen Crowdtesting-Wettbewerb zur Generierung von „Pelikan auf dem Fahrrad“-Animationen mit einheitlichen Prompts. Hunderte Entwickler steuerten Milliarden Tokens bei und fordern, dass im Zeitalter von Unternehmensagenten – in denen Einzelfehler durch Kettenreaktionen eskalieren – Echtzeit-„Intelligenz-SLAs“ analog zu Cloud-Verfügbarkeiten etabliert werden müssen. (Quelle: 36氪)

Debatte über die ultimative Kluft der Embodied AI: Der Abstand zwischen Maschine und Mensch entstand lange vor der Sprache : Embodied-AI-Experte Zhang Hongyi hebt hervor, dass GPT-6 Astra den Menschen in Symbolik und Logik zwar übertreffe, bei senso-motorischen Fähigkeiten der physischen Interaktion (wie dem Herstellen von Faustkeilen vor drei Millionen Jahren durch Gesten und Nachahmung) jedoch noch am Anfang stehe. Die Verschmelzung digitaler AGI mit physischer Manipulationsintelligenz sei die wahre Bewährungsprobe. (Quelle: ZhihuFrontier)

Entwickler koppelt vollständiges Konnektom der Fruchtfliege mit ChatGPT: Biologische neuronale Impulse erstmals in Dialoge in natürlicher Sprache übersetzt : Auf Basis des Open-Source-Konnektoms (MaleCNS v1.0) bauten Entwickler einen Spiking-Simulator und trainierten lineare Readouts auf neuronalen Entladungsdaten, um diese in natürliche Sprache für ChatGPT zu übersetzen. Das System beschreibt sensorische Reize präzise in Textform und reagiert auf Bewegungsbefehle von ChatGPT mit virtueller Hindernisausweichung. (Quelle: 36氪)

Jensen Huang und Fields-Medaillenträger debattieren über Falsifizierbarkeit von KI-Sicherheit : Nach dem Rücktritt eines Anthropic-Forschers wegen angeblicher Auslöschungsrisiken binnen zehn Jahren kritisierte NVIDIA-CEO Jensen Huang Doomsday-Warnungen als überzogene Marketing-Gesten. Fields-Medaillenträger Jacob Tsimerman kündigte die Gründung des Mathematical AI Safety Institute (MAISI) an, um KI-Sicherheit mittels Zero-Knowledge-Proofs und Kryptografie mathematisch beweisbar zu machen. (Quelle: 36氪)
Lokale LLM-Benchmark-Diskrepanz: Hochgradig spärliche MoE-Modelle schlagen überlastete Dense-Modelle deutlich : In Praxistests zur C++/Vulkan-Raytracing-Entwicklung mit automatischer Fehlerkorrektur geriet das Qwen3.8-27B Dense-Modell nach langen Überlegungen in eine Endlosschleife des „Overthinking“ ohne lauffähigen Code. Ein 125B MoE (nvfp4) lieferte das korrekte Ergebnis hingegen in 10 Minuten, was den überlegenen ROI spärlicher MoEs bezüglich VRAM-Bandbreite und Wissenskapazität belegt. (Quelle: ZhihuFrontier)

KI-Abhängigkeit bei psychologischer Unterstützung löst Resonanz aus: Schließen einer realen Lücke im psychosozialen Versorgungssystem : Die Nutzung von ChatGPT als nächtlicher emotionaler Beistand stößt auf breite Zustimmung. Hohe Therapiekosten, Ressourcenmangel und Mobilitätsbarrieren machen professionelle Hilfe für viele unzugänglich; KIs vorurteilsfreie 24/7-Verfügbarkeit biete eine wichtige emotionale Grundstütze und dürfe nicht herablassend verurteilt werden. (Quelle: Reddit r/ChatGPT)
💡 Sonstiges
Über 100 europäische Politikerinnen von Deepfake-Pornografie betroffen: Gesetzgeber fordern beschleunigte, durchgreifende Regulierung : Laut einer Untersuchung des Thinktanks Agora wurden fast 150 Abgeordnete aus 22 EU-Mitgliedstaaten (überwiegend Frauen) auf über 100 Deepfake-Websites durch manipulierte Nacktbilder und Nudity-Tools angegriffen. Parlamentarier und Juristen fordern strenge Gesetze gegen nicht einvernehmliche KI-Pornografie und eine direkte Haftung der Hosting- und Generierungsplattformen. (Quelle: WIRED)

Vollständiges Konnektom der Fruchtfliege steuert erfolgreich physischen Roboter bei Explorationsbewegungen : Ein Entwickler hat den digitalen Zwilling des Fruchtfliegen-Gehirns (166.000 Neuronen, 25 Mio. Synapsen) mit einem physischen mehrbeinigen Strandbeest-Roboter gekoppelt und dessen Fortbewegung sowie Hindernisvermeidung über simulierte neuronale Signale gesteuert. (Quelle: jpt401)
Interaktives Wissenschaftsprojekt „Relativity Park“ geht viral: Die Welt der Relativitätstheorie bei 5 km/h zu Fuß erleben : Entwickler haben mit Three.js das interaktive Open-Source-Projekt „Relativity Park“ erstellt, in dem die Lichtgeschwindigkeit auf Schrittgeschwindigkeit (5 km/h) gesetzt ist. Nutzer können Effekte wie Lichtlaufzeitverzögerung, Doppler-Rot-/Blauverschiebung, Längenkontraktion und relativistisches Beaming intuitiv beim Gehen erkunden. (Quelle: mcleavey)