KI-Modell-Ökonomie im Wandel: Günstigere Inferenz, neue Optionen
Dieser wöchentliche Newsletter behandelt Entwicklungen in der KI-Modellbereitstellung und -ökonomie vom 4. bis 10. Oktober 2026. Anthropic veröffentlichte Claude Haiku 5.5, ein kosteneffizientes kleines Modell mit einstellbaren Aufwandsstufen, das die Preise für hochvolumige Aufgaben senkt. Mistral startete den öffentlichen API-Vorschau von Mistral Large 4 ("Le Chonk"), einem multimodalen Modell mit 1,05 Billionen Parametern und einem Kontextfenster von einer Million Token; Gewichte wurden für später im Monat angekündigt. Liquid AI veröffentlichte Open-Weight-Entscheidungsmodelle (d1-3B und d1-omni-600M), die in einem einzigen Vorwärtspass Wahrscheinlichkeiten ausgeben, ohne Text zu generieren. Google veröffentlichte ML Drift als Open Source, die GPU-Beschleunigungs-Engine für LiteRT, die mehrere Grafik-APIs unterstützt und die Edge-Inferenz verbessert. Zusätzlich deckte JFrog eine kritische Remote-Code-Execution-Schwachstelle (CVE-2026-105192) in LMCache auf, was Sicherheitsrisiken in gemeinsamer Inferenzinfrastruktur hervorhebt.
- •Anthropic veröffentlichte Claude Haiku 5.5 am 7. Oktober 2026 mit einem Preis von 0,10 $ pro Million Input-Token und 0,50 $ pro Million Output-Token für Prompts bis 100.000 Token.
- •Mistral startete die öffentliche API-Vorschau von Mistral Large 4 am 6. Oktober 2026 mit insgesamt 1,05 Billionen Parametern und einem Kontextfenster von einer Million Token.
- •Liquid AI veröffentlichte die Open-Weight-Entscheidungsmodelle d1-3B und d1-omni-600M am 7. Oktober 2026.
