MCP wird zustandslos: größte Protokoll-Revision seit dem Launch macht Sticky Sessions überflüssig.
​​​​​​​​​​

$ ki-news --datum 2026-07-03 | mail

KI-News — 3. Juli 2026

// die viralsten KI-Themen der letzten 24 Stunden, kuratiert für deinen Stack

$ cat top-story.md

MCP-Protokoll wird radikal überarbeitet: Release Candidate macht Sticky Sessions überflüssig

Der Release Candidate für die MCP-Spezifikation vom 28. Juli 2026 macht das Protokoll zustandslos: Statt Sticky Sessions und Session-Stores läuft jeder Request unabhängig und lässt sich per einfachem Round-Robin-Load-Balancer verteilen. Server müssen künftig den neuen server/discover-Endpoint statt des alten initialize-Handshakes implementieren, Sessions werden durch explizite Handles ersetzt. Zusätzlich werden Tasks (Langläufer) und MCP Apps (server-gerenderte UIs) offizielle Erweiterungen mit eigenem Versionszyklus, dazu kommt eine formale Deprecation-Policy.

Warum relevant: Wer eigene MCP-Server betreibt oder plant, sollte jetzt die zehnwöchige Migrationsfrist im Blick behalten — es ist die größte Protokoll-Revision seit dem MCP-Launch.

// quelle: MCP Blog

## 📦 Modelle & Releases

Anthropic entwickelt offenbar eigenen KI-Chip, spricht mit Samsung über Fertigung

Anthropic arbeitet Berichten zufolge an einem eigenen Inferenz-Chip und führt frühe Gespräche mit Samsung als möglichem Fertigungspartner; dafür wurden bereits erfahrene Chip-Ingenieure von Tesla und OpenAI eingestellt. AWS-, Google- und Nvidia-Chips sollen laut Anthropic aber weiterhin zentral bleiben. Warum relevant: Zeigt, wohin sich die großen Anbieter bei den Inferenz-Kosten bewegen — ein Trend, der auch API-Preise langfristig beeinflusst. // The Decoder

Fable 5: Anthropic veröffentlicht Cyber-Sicherheitsklassifizierer und Jailbreak-Severity-Framework

Neue Sicherheits-Klassifizierer teilen Cybersecurity-Anfragen an Fable 5 in vier Kategorien ein (verboten, hochriskant, niedrigriskant, harmlos), dazu kommt ein Jailbreak-Severity-Framework (CJS-0 bis CJS-4), das Angriffstechniken nach Fähigkeitsgewinn, Universalität, Aufwand und Entdeckbarkeit bewertet. Warum relevant: Konkreter Einblick, wie Anthropic Sicherheitsrisiken bei starken Modellen inzwischen systematisch misst. // Anthropic Blog

OpenAIs GPT-5.5-Cyber schlägt Anthropics Mythos 5 bei Schwachstellenerkennung

Im Cybergym-Benchmark erkennt das sicherheitsfokussierte GPT-5.5-Cyber Code-Schwachstellen mit 85,6% Genauigkeit gegenüber 83,8% bei Claude Mythos 5, bei der Exploit-Erkennung ist der Abstand mit 39,5% noch deutlicher. Das kommt kurz nachdem die US-Regierung Mythos-5-Zugänge wegen Sicherheitsbedenken vorübergehend gestoppt hatte. Warum relevant: Aktuelles Kräfteverhältnis für alle, die KI für Security-Audits oder Pentesting einsetzen. // t3n

## 🛠️ Tools & Repos

Superpowers: Agentisches Skills-Framework knackt 245.000 Sterne

Superpowers bündelt wiederverwendbare Skills und eine komplette Softwareentwicklungsmethodik für Coding-Agenten wie Claude Code, GitHub Copilot und Cursor; Version 6.1.1 ist frisch erschienen. Warum relevant: Fertige, geprüfte Skill-Sammlung statt eigener Prompt-Bastelei — direkt in Claude Code einsetzbar. // GitHub Trending

Strix: Open-Source-Tool lässt KI-Agenten wie echte Pentester angreifen

Strix orchestriert autonome KI-Agenten, die Schwachstellen wie echte Hacker aufspüren, validieren und teils automatisch patchen — inklusive CI/CD-Integration. Das Python-Tool wächst gerade rasant (allein heute über 2.100 neue Sterne, insgesamt schon über 32.000). Warum relevant: Praktisches Werkzeug für automatisierte Sicherheitschecks eigener Anwendungen — nur auf autorisierte Systeme anwenden. // GitHub Trending

Caveman: Claude-Code-Skill drückt Agenten-Output um bis zu 75%

Das Skill-Paket bringt Coding-Agenten dazu, in knapper "Höhlenmensch-Sprache" zu antworten und spart laut eigenem Benchmark im Schnitt 65% Tokens bei zehn getesteten Aufgaben, ohne technische Genauigkeit einzubüßen — funktioniert über 30+ Agenten hinweg. Warum relevant: Direkter Hebel gegen steigende Token-Kosten bei intensiver Agenten-Nutzung. // GitHub Trending

## 🤖 Agenten & MCP

Claude Code v2.1.198/199: Subagents laufen jetzt standardmäßig im Hintergrund, Claude in Chrome ist GA

Subagents laufen per Default im Hintergrund, Claude in Chrome ist allgemein verfügbar, dazu ein neuer /dataviz-Skill sowie gestapelte Skill-Aufrufe (bis zu 5 Skills in einer Zeile). Mehrere Bugfixes betreffen abgebrochene Streaming-Antworten und durch Rate-Limits still fehlschlagende Subagents. Warum relevant: Die Fixes für verschluckte Subagent-Ergebnisse sind für Automatisierungs-Workflows wichtig — updaten lohnt sich. // Claude Code Changelog

Weniger ist mehr: Anthropic steuert Mythos-Klasse mit Kontext statt mit Verboten

Für die neuen Fable-5-Modelle hat Anthropic den Steuerungsansatz geändert: Statt vieler Verbote und Beispiele bekommen die leistungsstärkeren Modelle mehr Kontext — konkret wurden 80% des System-Prompts von Claude Code entfernt, weil zu viele Einschränkungen eher limitieren als verbessern. Warum relevant: Erklärt, warum aktuelle Claude-Code-Versionen sich "freier" anfühlen — und liefert einen Denkanstoß für eigene System-Prompts. // The Decoder

## 🏠 Self-Hosting & RAG

OpenKnowledge: Lokale LLM-Wiki mit MCP und agentischer Suche

OpenKnowledge ist ein Open-Source-Markdown-Editor als "second brain" für Wissensdatenbanken, läuft privat und lokal (macOS-App oder Web) und bringt MCP-Integration sowie agentische Suche direkt für Claude, Codex & Co. mit — auf Hacker News sorgte das Projekt mit 380+ Punkten für Aufsehen. Warum relevant: Passt direkt in einen selbstgehosteten RAG-Stack — Wissensbasis plus Agenten-Zugriff ohne Cloud-Abhängigkeit. // Hacker News / GitHub

## 🎬 Sehenswert

Fable 5 vs GPT 5.6 Sol: The Early Results

AI Explained vergleicht die ersten unabhängigen Benchmark- und Praxisergebnisse von Anthropics Fable 5 gegen OpenAIs GPT-5.6 Sol. Warum relevant: Kompakter Überblick, welches Modell aktuell wofür vorne liegt, bevor man Zugänge oder Budget umverteilt. // AI Explained / YouTube EN

Hättest du es erkannt?

c't 3003 testet, ob man KI-generierte Videos mittlerweile noch von echten unterscheiden kann — Fazit: es wird zunehmend schwerer. Warum relevant: Kurzer Praxis-Check zum Stand der Videofakes, gut zum Sensibilisieren im eigenen Umfeld. // c't 3003 / YouTube DE

## 📰 Lesenswert

Explodierende KI-Kosten: Konzerne sperren Zugänge oder raten zu älteren Modellen

Firmen wie Atlassian, Adobe, Amazon und Citi drosseln die KI-Nutzung ihrer Mitarbeiter wegen explodierender Kosten — Atlassian verdreifachte seine KI-Werkzeugkosten von 5 auf 15 Millionen Dollar, mit erwarteten 120 Millionen jährlich. Statt Pauschalfreigabe gibt es jetzt Vorgaben, KI nur noch für hochwertige statt simple Aufgaben zu nutzen. Warum relevant: Bestätigt den ökonomischen Case fürs Self-Hosting — genau das Kostenproblem, das ein eigener vLLM/Qdrant-Stack umgeht. // heise online

$ echo "automatisch recherchiert am 2026-07-03"
> ki-news · news.reichenberg.ruhr

[ abbestellen ] [ im browser ansehen ]