Beobachtetes Signal · 17. Juni 2026 · Technical Release · Quelle: DEV Community · Relevanz: 2/5 · Sentiment: Positiv
ccglass: Lokaler LLM Reverse Proxy für Coding-CLIs
ccglass ist ein Open-Source-Reverse-Proxy unter MIT-Lizenz mit rund 5.000 Zeilen Node.js-Code, der LLM-API-Traffic von Coding-Agent-CLIs wie Claude Code, Codex, DeepSeek oder Kimi abfängt. Das Tool funktioniert, indem es Provider-Basis-URLs auf einen lokalen HTTP-Endpunkt (127.0.0.1:8123) umleitet. Dadurch lassen sich Anfragen protokollieren, ein Echtzeit-Web-Dashboard mit Prompts, Kosten und Cache-Hit-Raten anzeigen sowie Traffic an Upstream-HTTPS-APIs weiterleiten. ccglass proxyt SSE-Streaming-Responses ungebuffert, teilt Stream-Chunks für Logs auf, um inkrementelle Kosten zu berechnen, und pflegt eine JSON-Preistabelle je Provider-Modell. Zudem enthält das Projekt einen MCP-Server, sodass Modelle aktuelle Anfragen direkt aus dem Chat heraus abfragen können. Das Tool ist auf GitHub verfügbar und lässt sich via npm installieren.
Ein nützliches Open-Source-Entwicklertools zur Verbesserung von Observability, Kostenattribuierung und Streaming bei der Nutzung von LLM-CLIs, besonders wertvoll für Teams beim Debugging von Agenten-Workflows.
Marktsignale zu Anthropic in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- ccglass ist ein Open-Source-Reverse-Proxy in Node.js (~5.000 Zeilen) unter MIT-Lizenz.
- Das Tool fängt LLM-API-Traffic von Coding-Agent-CLIs ab, indem es Provider-URLs auf 127.0.0.1:8123 umleitet.
- SSE-Streaming-Responses werden ungebuffert proxyt, Chunks für Logs aufgeteilt und Kosten inkrementell anhand einer JSON-Preistabelle berechnet.
- Ein integrierter MCP-Server ermöglicht Modellen den Zugriff auf den Verlauf jüngster Anfragen direkt im Chat.
- Das Repository ist auf GitHub verfügbar (jianshuo/ccglass) und über npm installierbar.
Verknüpfte Unternehmen
3 verknüpfte UnternehmenOntologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
CliGate: Lokales Gateway zur zentralen Steuerung mehrerer KI-Coding-Tools
Ein Entwickler beschreibt den Einsatz von CliGate, einem Open-Source-Local-Gateway (localhost:8081) zur Vereinheitlichung von Konfiguration und Routing für verschiedene AI Coding CLIs wie Claude Code, Codex CLI, Gemini CLI und OpenClaw. CliGate nimmt Anfragen entgegen, identifiziert den Absender, übersetzt Protokolle zwischen Anthropic-, OpenAI- und Gemini-Formaten und leitet den Traffic an den entsprechenden Provider oder einen Fallback-Pool weiter. Zu den Funktionen gehören Account-Rotation, Key-Load-Balancing, OAuth-Token-Refresh, Nutzungs-Tracking sowie ein Dashboard mit One-Click-Konfiguration. Zudem lassen sich ressourcenarme Anfragen zur Kostenreduktion an kostenfreie Modelle routen. Das Projekt steht auf GitHub unter der AGPL-3.0-Lizenz zur Verfügung.
LLM Gateway Proxy für zentrale Security, Compliance und Observability
Ein Open-Source-Entwickler hat einen LLM Gateway Proxy vorgestellt, der zwischen Client-Applikationen und der OpenAI-API geschaltet wird, um Sicherheits-, Compliance- und Observability-Funktionen zentral zu bündeln. Die Architektur implementiert mehrstufige Guardrails: Regex-basierte PII-Sanitization, heuristische Erkennung von Prompt Injections sowie Response-Validierungen, bevor Anfragen weitergeleitet werden. Zudem erfasst das System granulare Metriken auf Request-Ebene – darunter Latenz, Token-Verbrauch und kalkulierte API-Kosten –, die in einem CSV-Ledger protokolliert und über ein interaktives Streamlit-Dashboard visualisiert werden. Die Lösung ist via Docker containerisiert und verfügt über eine GitHub-Actions-CI-Pipeline für statische Code-Analysen. Als künftige Erweiterungen nennt der Entwickler NER-gestützte PII-Filterung, semantische Embedding-Guardrails, Caching, persistente Datenbanken und Distributed Tracing für den produktiven Produktiveinsatz.
llama-dash: Local LLM Ops Dashboard Released
A Dev.to post by Nico Domino (published 2026-06-19) introduces llama-dash, an open-source single-pane dashboard and logging proxy for self-hosted local large language model (LLM) inference stacks. llama-dash proxies OpenAI/Anthropic-compatible /v1/* endpoints (streaming SSE passthrough), logs requests with token counts and estimated costs, and adds hashed API keys, per-key rate limits, model allow-lists, routing rules, and UI controls to load/unload models. It is distributed as a Docker Compose stack and the code is available on GitHub. The proxy can be used as an ANTHROPIC_BASE_URL to route Claude usage through the dashboard.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
