|
$ ki-news --datum 2026-07-01 | mail
KI-News — 1. Juli 2026
// die viralsten KI-Themen der letzten 24 Stunden, kuratiert für deinen Stack
$ cat top-story.md
Anthropic hat Claude Sonnet 5 als neues Standard-Modell für Free- und Pro-Nutzer gestartet. Es bringt einen nativen 1-Million-Token-Kontext, übertrifft Sonnet 4.6 auf allen Agentic-Benchmarks (BrowseComp, OSWorld) und nähert sich Opus 4.8 — auf dem GDPval-AA-v2-Knowledge-Benchmark sogar knapp darüber. Einführungspreis bis 31. August: $2/$10 pro Mio. Token (input/output), danach $3/$15.
Warum relevant: Wer Claude Code nutzt, bekommt ab Version 2.1.197 automatisch Sonnet 5 als Default — mehr Kontext für komplexe Codebasen, bessere Werkzeugnutzung und niedrigere Kosten durch den Einführungspreis.
// quelle: Anthropic Blog · The Decoder
## 📦 Modelle & Releases
Nano Banana 2 Lite erzeugt hochauflösende Bilder in 4 Sekunden für $0,034/Bild; Gemini Omni Flash erstellt und bearbeitet Videos bis 10 Sekunden per Textbefehl für $0,10/Sekunde Output — beide ab sofort über Google AI Studio und Gemini API. Warum relevant: Gute Basis für Bild-/Video-Automatisierungspipelines; Google empfiehlt das Chaining: Bild mit Nano Banana erzeugen, dann mit Omni Flash animieren. // The Decoder
## 🔨 Tools & Repos
232 spezialisierte KI-Agenten in 16 Fachbereichen — von Frontend-Dev über Security bis GIS-Analyse — mit je eigenem Kommunikationsstil, Deliverables und Installations-Skripten für Claude Code, Copilot, Cursor und 12 weitere Coding-Plattformen. Warum relevant: Wer Claude Code täglich nutzt, kann fertige Expert-Rollen (z.B. RAG-Spezialist, DevOps Engineer) aktivieren statt Prompts von Grund auf zu schreiben. // GitHub Trending (121.000+ ★, +1.791 heute)
Von den Machern von browser-use: video-use bearbeitet Videos per Textbefehl — Füllwörter entfernen, Farbkorrektur, Untertitel, Animationsoverlay. Selbst-Evaluationsschleifen sichern die Qualität ohne feste Vorlagen. Warum relevant: Solides Fundament für Medienproduktions-Workflows in Agenten-Pipelines — das browser-use-Team liefert erfahrungsgemäß durchdachte Implementierungen. // GitHub Trending (12.700+ ★, +721 heute)
Googles offizielles CLI ermöglicht es, von Coding-Assistenten erstellte Agenten auf Google Cloud zu deployen — als fertiger Brücken-Layer zwischen KI-Tool und Cloud-Infrastruktur, Python-basiert. Warum relevant: Wer Agenten-Prototypen aus Claude Code oder Cursor in Produktion bringen will, bekommt damit einen direkten GCloud-Deployment-Pfad ohne Boilerplate. // GitHub Trending (4.300+ ★, +445 heute)
## 🤖 Agenten & MCP
Claude Science bündelt über 60 vorkonfigurierte Skills für Genomik, Proteomik und Cheminformatik — inklusive automatisierter Verifikationsagenten für Zitate und Berechnungen, BioNeMo-Integration (Evo 2, Boltz-2) und lokalem Betrieb via SSH/HPC für sensible Daten. Beta-Zugang für Pro-, Max-, Team- und Enterprise-Nutzer. Warum relevant: Die Skill-Pipeline-Architektur ist als Blaupause für eigene RAG-Pipelines interessant; Anthropic vergibt bis zu 50 Grants à $30.000 Credits (Bewerbung bis 15. Juli). // The Decoder
v2.1.197 setzt Claude Sonnet 5 als Standardmodell (1M Kontext, Aktionspreise bis 31. August). v2.1.196 brachte Org-Admin-Modellkonfiguration, lesbare Session-Namen, klickbare Dateinhänge und einen MCP-Sicherheitspatch: MCP-Server können sich nicht mehr über .claude/settings.json selbst genehmigen. Warum relevant: Update sofort einspielen — besonders wenn MCP-Server in eigenen CI/CD-Pipelines oder automatisierten Workflows laufen. // Claude Code Changelog
## 🏠 Self-Hosting & RAG
OmniRoute ist ein Open-Source-API-Gateway, das 231 LLM-Anbieter hinter einer einheitlichen Schnittstelle vereint, Prompts automatisch komprimiert und Anfragen intelligent auf mehrere Modelle aufteilt — selbst-hostbar, TypeScript. Warum relevant: Als Drop-in-Layer vor vLLM oder anderen Inference-Backends: Failover, Cost-Routing und Kontext-Kompression in einem — besonders nützlich, wenn der RAG-Stack mehrere Backends bedient. // GitHub Trending (8.700+ ★, +387 heute)
## 📰 Lesenswert
Meituan trainierte LongCat-2.0 mit 1,6 Bio. Parametern und 35 Bio. Trainings-Token auf über 50.000 heimischen ASICs — ohne ein einziges Nvidia-Chip. Auf SWE-bench Pro (59,5 Punkte) übertrifft es Gemini 3.1 Pro und GPT-5.5, bleibt aber hinter Claude Opus. Unabhängige Verifikation steht noch aus; das Modell ist bisher nicht auf HuggingFace verfügbar. Warum relevant: Belegt, dass US-Exportkontrollen Chinas KI-Entwicklung nicht stoppen — was den Wettbewerbsdruck und Preisdruck auf westliche Anbieter erhöht. // The Decoder
Die Bank für Internationalen Zahlungsausgleich (63 Zentralbanken, darunter EZB und Bundesbank) warnt: Die fünf größten Hyperscaler planen 2025–2026 über eine Billion Dollar in KI-Infrastruktur — mehr als ihre kombinierten Gewinne und freien Cashflows. Intransparente Finanzierungsstrukturen und Doppelverpfändung von Assets könnten einen Kreditmarktschock wie in der Dotcom-Ära auslösen. Warum relevant: Korrigiert sich die Blase, könnten API-Preise steigen und Dienste eingeschränkt werden — ein weiteres Argument für eigene Inference-Infrastruktur. // heise online
$ echo "automatisch recherchiert am 2026-07-01"
> ki-news · news.reichenberg.ruhr
[ abbestellen ]
[ im browser ansehen ]
|