|
$ ki-news --datum 2026-07-15 | mail
KI-News — 15. Juli 2026
// die viralsten KI-Themen der letzten 24 Stunden, kuratiert für deinen Stack
$ cat top-story.md
PrismML hat Qwen3.6-27B per Quantization-Aware Training auf 1-Bit (3,9 GB) und 1,58-Bit-ternär (5,9 GB) komprimiert. Die 1-Bit-Version läuft mit rund 11 Tokens/s direkt auf einem iPhone 17 Pro und hält dabei knapp 90 % der Full-Precision-Leistung (Mathe 91,7 vs. 95,3, Code 81,9 vs. 88,7 Punkte). Multimodal, 262K Kontext, Apache-2.0-Lizenz, Gewichte auf Hugging Face.
Warum relevant: Zeigt, wie weit extreme Quantisierung mittlerweile trägt – ernstzunehmende 27B-Modelle laufen jetzt ganz ohne dedizierte GPU, ein Fingerzeig auch für die eigene Self-Hosting-Praxis.
// quelle: PrismML · MarkTechPost · Hacker News (~490 Punkte)
## 🛠️ Tools & Repos
Tencent Cloud hat einen Open-Source-Sandbox-Service für KI-Agenten veröffentlicht: unter 60ms Boot-Zeit, eigener MicroVM-Kernel pro Sandbox statt Shared-Kernel, Credential Vault hält API-Keys aus der Ausführungsumgebung heraus, drop-in-kompatibel zu E2B Cloud. Warum relevant: Schnelle, hardwareisolierte Alternative für alle, die autonome Coding-Agenten unbeaufsichtigt Code ausführen lassen. // GitHub Trending
Ein einzelnes Rust-Binary (kein Electron) für persistente, tmux-artige Terminal-Sessions, das pro Pane erkennt, ob ein Agent gerade arbeitet, wartet oder fertig ist – Agenten können über eine Socket-API selbst neue Panes spawnen. Warum relevant: Praktisches Cockpit, um mehrere Claude-Code-/Coding-Agent-Sessions parallel zu orchestrieren und im Blick zu behalten. // GitHub Trending
Matt Pococks öffentliche Skill-Sammlung bekommt einen überarbeiteten Skill-Router, einen neuen "research"-Skill für hintergrundrecherchierte, zitierte Markdown-Notizen sowie einen Triage-Skill, der jetzt auch externe Pull Requests behandelt. Warum relevant: Eine der meistgenutzten frei verfügbaren Skill-Sammlungen – fertige Patterns gegen typische Agent-Fails (TDD, Debugging, Architektur-Verfall) zum Nachbauen. // GitHub
## 🤖 Agenten & MCP
Zwei Patch-Releases vom 14. Juli: Das Agent-Tool ist jetzt gegen indirekte Prompt-Injection über von Subagenten gelesene Inhalte gehärtet, ein Bug wurde behoben, bei dem isolation:'worktree'-Subagenten versehentlich git-verändernde Befehle im Haupt-Repo statt im isolierten Worktree ausführten, und das "ultracode"-Schlüsselwort löst nicht mehr durch Webhook-Payloads oder relayte PR-Kommentare aus. Warum relevant: Konkrete Sicherheits-Härtung für alle, die Subagenten, Worktrees und Automatisierung intensiv nutzen. // Claude Code Changelog
Bei Multi-Agent-Setups (MultiAgentV2, Sol/Terra) speichert Codex die Prompts zwischen Parent- und Sub-Agenten jetzt nur noch verschlüsselt – lokale Session-Logs zeigen keine lesbaren Anweisungen mehr, Entwickler fordern ein separates Klartext-Audit-Feld. Warum relevant: Deutlicher Kontrastpunkt zu Claude Code Subagents – zeigt, wie unterschiedlich Transparenz und Debugging von Multi-Agent-Workflows zwischen den Ökosystemen gehandhabt werden. // The Register, GitHub Issue openai/codex#28058
Claude-Artifacts (auch aus Claude-Code-Sessions) lassen sich jetzt öffentlich teilen und von mehreren Personen live gemeinsam bearbeiten. Dazu kommt Claude Tag: ein gemeinsames @Claude pro Slack-Channel, das über Zeit Kontext aufbaut und Aufgaben asynchron erledigt. Warum relevant: Verwandelt Coding-Session-Outputs in geteilte Team-Workspaces statt Hin-und-her-Kopieren von Dateien. // Anthropic, the-decoder.com, t3n.de
Die Release-Candidate-Version der finalen MCP-Spec entfernt die protokollseitige Mcp-Session-Id, wodurch Sticky-Routing und Shared-Session-Stores überflüssig werden; dazu kommen ein Extensions-Framework (MCP Apps, Tasks) und schärfere OAuth-Anforderungen. Kein Feature fällt sofort weg, Deprecations laufen über mindestens 12 Monate. Warum relevant: Wer eigene MCP-Server betreibt oder in Claude Code einbindet, sollte das zehnwöchige Validierungsfenster für Breaking Changes im Blick behalten. // Model Context Protocol Blog
NemoClaw kombiniert das offene Nemotron-3-Ultra-Modell, das MIT-lizenzierte LangChain-Deep-Agents-Framework und NVIDIAs sandboxed OpenShell-Runtime zu einem selbstgehosteten Agenten-Stack. In LangChains Eval-Suite erreichte Nemotron 3 Ultra einen Score von 0,86 bei 4,48 $ Kosten – rund 10x günstiger als das nächstbeste Modell. Warum relevant: Konkreter Open-Source-Baukasten für produktionsreife Agenten mit voller Infrastrukturkontrolle statt Cloud-API-Abhängigkeit. // NVIDIA Blog, LangChain
## 🏠 Self-Hosting & RAG
Patch-Release nach v0.25.0: behebt korrupte Outputs, wenn bei fused-Allreduce-RMSNorm-Quantisierung z.B. ein BF16-Residual mit FP32-RMSNorm-Gewichten (wie bei Gemma/Qwen-Modellen) gemischt wurde, sowie einen unnötigen Startup-Blocker durch fehlendes System-FFmpeg. Warum relevant: Der Quantisierungs-Bug betrifft potenziell produktive Gemma-Setups mit gemischter Präzision – zeitnahes Update empfohlen. // vLLM GitHub Releases
Eine neue Studie vergleicht Fixed-Size-, Recursive-, Breakpoint- und Cluster-basiertes semantisches Chunking auf langen akademischen Texten via RAGAS. Ergebnis: Cluster-basiertes Chunking schlägt einfachere Strategien nicht, und RAGAS-Faithfulness erweist sich hier als wenig verlässliche Metrik. Warum relevant: Weiterer Beleg, dass aufwendige Chunking-Strategien in der eigenen RAG-Pipeline oft keinen Mehrwert gegenüber simplen Fixed-Size/Recursive-Ansätzen bringen. // arXiv
## 🎬 Sehenswert
Matthew Berman zeigt seinen persönlichen Workflow mit OpenAI Codex als Coding-Agent, inklusive Zapier-MCP-Integration und einem GitHub-basierten "Hook Prompt"-Setup für automatisiertes Agentenverhalten. Warum relevant: Praktischer Workflow-Vergleich zur eigenen Claude-Code-Nutzung, inklusive MCP-Integration in bestehende Tools. // Matthew Berman, YouTube EN
## 📰 Lesenswert
Hachette, Cengage, Elsevier und Autor Scott Turow verklagen Google in New York wegen mutmaßlich unautorisierten Trainings von Gemini mit Millionen urheberrechtlich geschützter Bücher und Fachtexte – sie werfen Google zudem vor, Copyright-Hinweise gezielt entfernt zu haben. Warum relevant: Wegweisender Rechtsstreit mit möglicher Präzedenzwirkung für KI-Training generell. // TechCrunch
$ echo "automatisch recherchiert am 2026-07-15"
> ki-news · news.reichenberg.ruhr
[ abbestellen ]
[ im browser ansehen ]
|