Beobachtetes Signal · 9. Juli 2026 · Technical Release · Quelle: onlinemarketing.de · Relevanz: 4/5 · Sentiment: Positiv

OpenAI launcht GPT-Live: Neue Voice-Modelle für echtzeitfähige Konversationen

Zusammenfassung des Signals

OpenAI hat mit GPT-Live eine neue Voice-Modellfamilie vorgestellt, die ChatGPT Voice antreibt und dank Full-Duplex-Technologie gleichzeitiges Hören und Sprechen ermöglicht. Die Modelle GPT-Live-1 und GPT-Live-1 mini bieten Features wie Live-Übersetzungen, visuelle Answer Cards sowie eine verbesserte Rauschunterdrückung. Die Mini-Version steht auch Nutzern des kostenlosen ChatGPT-Tiers zur Verfügung. Ein zentraler technologischer Fortschritt ist die Hintergrund-Delegation: GPT-Live kann komplexe Analysen an leistungsstärkere Modelle wie GPT-5.5 oder das angekündigte GPT-5.6 auslagern und die Resultate nahtlos in den laufenden Dialog integrieren. Der Rollout erfolgt über Web, iOS und Android; zudem ist ein API-Zugang für Entwickler geplant. Laut OpenAI nutzen bereits über 150 Millionen Menschen die bestehenden Voice- und Diktierfunktionen der Plattform.

Polaris7 AgentStrategische Einordnung
Hohe Konfidenz

Die Einführung von Full-Duplex-Sprachmodellen mit intelligenter Task-Delegation setzt neue Maßstäbe für Voice-UX und Konversationsschnittstellen, was mittelfristig auch voice-basierte Discovery- und AdTech-Integrationen beschleunigen wird.

SIGNAL RADAR

Marktsignale zu OpenAI in Echtzeit verfolgen

Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.

Kostenlos im Explorer starten
Kostenloser Explorer-ZugangKeine Kreditkarte nötigSofortiges Watchlist-Setup

Wichtigste Kernpunkte & Evidenz

  • OpenAI launcht mit GPT-Live eine Full-Duplex-Voice-Modellfamilie für ChatGPT Voice.
  • Die Modelle unterstützen simultanes Hören/Sprechen und können Hintergrundaufgaben an Modelle wie GPT-5.5 und GPT-5.6 delegieren.
  • Der Rollout von GPT-Live-1 und GPT-Live-1 mini umfasst Web, iOS und Android; die Mini-Variante ist für Free-User zugänglich.
  • Ein API-Zugang für Entwickler ist in Vorbereitung, Registrierungen sind bereits geöffnet.
  • Über 150 Millionen Nutzer verwenden laut OpenAI bereits die Sprach- und Diktierfunktionen von ChatGPT.
Primäre Quellenbasis & Herkunftsnachweis
Verifizierter Herkunftsnachweis
Primärquelle: onlinemarketing.de•Veröffentlicht: 9. Juli 2026
Ursprünglicher Berichttitel: “GPT-Live ist da: Das sind OpenAIs neue Voice-Modelle für lebensechte Konversationen”

Verwandte Marktsignale & Trends

Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.

Infrastructure3. Aug. 2026

OpenAI stellt GPT-Live für latenzfreie Full-Duplex-Sprachinteraktion vor

OpenAI hat Details zu GPT-Live veröffentlicht, einem neuen Full-Duplex-Echtzeit-Sprachsystem. Die Architektur verzichtet auf bisherige Turn-Detector-Modelle und verarbeitet Audio kontinuierlich via Streaming-Inference, wodurch gleichzeitiges Hören und Sprechen ermöglicht wird. Über einen asynchronen Delegationspfad können komplexe Abfragen und Tool-Calls an Frontier-Modelle wie GPT-5.5 ausgelagert werden, ohne den Live-Media-Stream zu unterbrechen. Technisch setzt OpenAI auf ein in Go neu geschriebenes Media-Frontend und Inferenz-Routing, WebRTC sowie eigene Protokolloptimierungen (WARP und Instant Connect). Die Entkopplung von Mediapfad und Applikationslogik erlaubt nahtlose Modell-Handoffs und Context-Compaction bei minimierten Latenzen. Das System wurde bereits via Shadow-Testing im Produktivbetrieb von ChatGPT Voice validiert und bildet das Fundament für künftige GPT-Live APIs.

Signal analysieren
AI10. Sept. 2026

OpenAI bringt Voice-Modell GPT-Live-1 in die API

OpenAI hat GPT-Live-1 als API-Modell veröffentlicht, das speziell für Voice-native Anwendungen und geschäftliche Workflows konzipiert ist. Die Architektur verarbeitet simultanes Hören und Sprechen, wodurch die Latenz durch den Wegfall getrennter Speech-to-Text-, Reasoning- und Text-to-Speech-Pipelines drastisch sinkt. Zu den Kernfunktionen zählen eine optimierte Handhabung von Gesprächsunterbrechungen, hohe Robustheit gegenüber Hintergrundgeräuschen sowie die Delegation komplexer Logik und Tool Calls an Backend-Modelle wie GPT-6 Astra oder Drittanbietersysteme. Die Schnittstelle bietet zudem native Telefonie-Unterstützung für Full-Duplex-Sprachagenten. Das Pricing liegt bei 0,05 USD pro Minute für den Voice-Layer; Backend-Modelle werden separat abgerechnet. Erste Evaluierungen verzeichnen im Vergleich zu sequenziellen Systemen eine Reduktion fehlerhafter Unterbrechungen um 80 Prozent, was insbesondere für interaktive AdTech-, Customer-Service- und E-Commerce-Szenarien neue Standards setzt.

Signal analysieren
Conversational AI & Chatbots7. Mai 2026

OpenAI bringt drei neue Echtzeit-Sprachmodelle in die Realtime API

OpenAI hat am 7. Mai 2026 drei neue Echtzeit-Sprachmodelle für seine Realtime API eingeführt: GPT-Realtime-2 als GPT-5-Klasse Reasoning-Sprachmodell für realistische Konversationen und agentische Workflows, GPT-Realtime-Translate für Live-Übersetzungen mit über 70 Eingangs- und 13 Ausgangssprachen sowie GPT-Realtime-Whisper für latenzarme Streaming-Sprach-zu-Text-Transkription. Die Lösungen zielen auf Kundenservice, Bildung, Medien, Events und Creator-Plattformen ab. Während Translate und Whisper minütlich abgerechnet werden, erfolgt die Abrechnung bei GPT-Realtime-2 über den Token-Verbrauch. OpenAI hat zudem integrierte Sicherheitsleitplanken und aktive Klassifizierer implementiert, um Richtlinienverstöße bei schädlichen Inhalten zu unterbinden. Die Ankündigung umfasst detaillierte Preisstrukturen und Sicherheitskontrollen in der API-Dokumentation.

Signal analysieren

Marktsignale & Strategische Shifts in Echtzeit verfolgen

Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.