Beobachtetes Signal · 9. Aug. 2026 · Technical Release · Quelle: DEV Community · Relevanz: 2/5 · Sentiment: Positiv
Architektur für produktionsreife WhatsApp-KI-Agenten vorgestellt
Der Artikel beschreibt SARA, einen Open-Source WhatsApp-KI-Agenten, der produktiv in 20 Branchen eingesetzt wird. Er erläutert eine resiliente Architektur, die eine Anbieter-Fallback-Kette für Inferenz (Groq, Cerebras, SambaNova, Mistral), einen Tool-Dispatcher mit Autonomiegrenze für Aktionsausführungen, Regeln zur PII-Anonymisierung und -De-Anonymisierung sowie ein Session-Management über Sliding Windows und konversationsübergreifendes Gedächtnis umfasst. Das System läuft auf einem einzelnen VPS mit 4 vCPU und 8GB RAM, während die Inferenz an Cloud-Anbieter ausgelagert wird. Das Projekt ist unter der AGPL-3.0 auf GitHub verfügbar und enthält 20 branchenspezifische Agenten-Definitionen unter der Apache-2.0-Lizenz.
Liefert eine praxisbewährte Architektur und Open-Source-Code für Conversational Agents und bietet wertvolle technische Orientierung für Unternehmen, die WhatsApp-Agenten einsetzen möchten.
Marktsignale zu WhatsApp in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- SARA ist ein Open-Source WhatsApp-KI-Agent für Unternehmen aus 20 verschiedenen Branchen.
- Das System nutzt eine Inferenz-Fallback-Kette aus vier Anbietern: Groq (primär), Cerebras, SambaNova und Mistral.
- Durch die Anbieterkette und automatische Wiederholungsversuche wurde eine Verfügbarkeit von 99,7 % über sechs Monate bei keinen Inferenzkosten erzielt.
- SARA ist auf GitHub unter AGPL-3.0 lizenziert, die 20 branchenspezifischen Agenten-Definitionen unter Apache-2.0.
- Die Lösung läuft auf einem einzelnen VPS mit 4 vCPU und 8GB RAM bei einer Auslastung von rund 3GB RAM.
Verknüpfte Unternehmen
6 verknüpfte Unternehmen“Everyone demos a WhatsApp chatbot....”
“Primary: Groq (fastest, free tier)...”
“Fallback 1: Cerebras...”
“Fallback 3: Mistral (paid, always works)...”
“SARA is AGPL-3.0 on GitHub: [github.com/Alessandro114/sara]...”
“This track will guide you through Google AI Studio's new "Build apps with Gemini" feature, where you can turn a simple text prompt into a fu...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
WhatsApp-KI-Assistent für mexikanische KMU mit Claude und n8n
Eine Entwickler-Fallstudie beschreibt einen produktionsreifen WhatsApp-KI-Assistenten für mexikanische Kleine und mittlere Unternehmen. Das System nutzt n8n als Orchestrierungsschicht, Claude (Haiku) als LLM, Postgres für Konversationsspeicher und eine schlanke Wissensbasis bzw. ein CRM, die WhatsApp Cloud API für Messaging sowie Gemini zur Transkription von Sprachnachrichten. Der Autor erläutert Designmuster, die die Zuverlässigkeit und Vorhersehbarkeit erhöhten – insbesondere „Meta-Blocks“ (strukturierte Aktionstokens von Claude, die von Workflow-Knoten verarbeitet werden) – sowie technische Entscheidungen wie die Speicherung von Embeddings in Postgres und die Berechnung der Kosinus-Ähnlichkeit im Code ohne Vektor-Datenbank. Der Beitrag plädiert für eine direkte Integration mit der WhatsApp Cloud API ohne BSP, um Zwischenhändlerkosten zu vermeiden und die Kontrolle über Daten und Rufnummern zu behalten.
WhatsApp-Bots mit einer Memory-API um Konversationsgedächtnis erweitern
Ein technischer Leitfaden erläutert, wie sich die standardmäßige Statuslosigkeit von WhatsApp überwinden lässt, ohne komplexe Infrastruktur für Conversational AI-Bots selbst zu bauen. Da Nachrichten isolierte Ereignisse darstellen, erfordert dies klassisch eine Datenbank für den Chat-Verlauf pro Rufnummer, Kontextaufbereitung, Token-Window-Management und modellspezifische Formatierung. Der Autor zeigt, wie diese Basisarbeit an eine REST Memory-API delegiert werden kann. Diese verarbeitet POST-Nachrichten, liefert vorformatierten Kontext für LLMs wie OpenAI oder Anthropic, kürzt oder zusammenfasst lange Konversationen automatisch und speichert Sitzungsmetadaten. Der Beitrag enthält Python-Code mit httpx und OpenAI sowie den Verweis auf eine Live-API mit interaktiver Dokumentation.
WhatsApp testet native Integration von externen KI-Agenten
WhatsApp testet eine neue Funktion, mit der Nutzer bis zu fünf externe KI-Agenten oder Bots direkt in ihren Account einbinden können, jeweils über einen dedizierten Chat. Das Feature wurde von WABetaInfo in der WhatsApp-Betaversion für Android (2.26.35.3) entdeckt und steht derzeit einem ausgewählten Nutzerkreis in spezifischen Regionen zur Verfügung. Die Konfiguration erfolgt über einen in den WhatsApp-Einstellungen generierten API-Key, der mit dem Hosting-Service des jeweiligen Agenten verknüpft wird. Der Zugriff der KI beschränkt sich strikt auf die im entsprechenden Chat geteilten Nachrichten und Dateien. Da Meta die Chats im Auftrag der Bot-Entwickler verwaltet, entfällt für diese Dialoge die Ende-zu-Ende-Verschlüsselung. Die native Schnittstelle vereinfacht die Nutzung externer KI-Assistenten in WhatsApp deutlich und eliminiert frühere Risiken von Accountsperren.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
