Beobachtetes Signal · 28. Sept. 2026 · Product Launch · Quelle: https://martechseries.com/feed/ · Relevanz: 2/5 · Sentiment: Positiv
Omneky führt TASTE BENCH zur Bewertung von KI-Kreativqualität ein
Omneky, die autonome KI-Wachstumsplattform, hat die Einführung von TASTE BENCH angekündigt, einer Bewertungssuite, die testet, wie gut Bild- und Videogenerierungsmodelle kreative Briefings und Markenassets in einsatzbereite Werbeanzeigen umsetzen. Die erste Ausgabe umfasst acht Bildmodelle, 59 Anzeigen-Briefings, vier Marken und fünf Sprachen, mit 469 generierten Anzeigen und 1.371 gültigen Blind-Bewertungen. GPT Image 2.5 Sunburst erreichte mit 54,2 % (32 von 59) die höchste Ready-to-Run-Quote, die durchschnittlichen Qualitätswerte variieren modelübergreifend. Ein Blindpanel aus KI-Juroren von OpenAI, Anthropic und Google bewertet die Ergebnisse auf acht Qualitätsdimensionen, darunter Markenpassung, Typografie und Anzeigeneffektivität. Elf Pass/Fail-Prüfungen decken exakte Textwiedergabe, Sprachkorrektheit, Markentreue, Safe-Zone-Platzierung und erfundene Behauptungen ab. Die Ergebnisse sind automatisierte kreative Urteile, keine Kampagnenleistungskennzahlen.
Die Einführung von TASTE BENCH bietet einen neuen Benchmark zur Bewertung KI-generierter Werbekreative, der für die AdTech- und MarTech-Branche relevant ist, da er die Qualitätsbewertung über Modelle hinweg systematisiert. Da es sich jedoch um eine spezifische Tool-Einführung eines einzelnen Anbieters handelt, ist die branchenweite Wirkung moderat.
Marktsignale zu Omneky in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Omneky hat TASTE BENCH eingeführt, eine Bewertungssuite für KI-generierte Werbekreative.
- GPT Image 2.5 Sunburst erreichte mit 54,2 % (32 von 59) die höchste Ready-to-Run-Quote.
- Der Benchmark umfasst acht Bildmodelle, 59 Anzeigen-Briefings, vier Marken und fünf Sprachen.
- KI-Juroren von OpenAI, Anthropic und Google bewerteten die Ergebnisse auf acht Qualitätsdimensionen.
- Die Suite umfasst elf Pass/Fail-Prüfungen für Markentreue und inhaltliche Genauigkeit.
Verknüpfte Unternehmen
1 verknüpfte Unternehmen“Omneky, the autonomous AI growth platform, introduced TASTE BENCH, an evaluation suite that tests how well image and video models turn creat...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Optimizely stellt spezialisierte Marketing-KI-Modelle und Mark-Bench vor
Auf der Konferenz Opticon hat Optimizely eine Reihe speziell entwickelter, post-trainierter KI-Modelle für Marketing-Anwendungen präsentiert. Laut Angaben des Unternehmens bieten diese Modelle eine zehnmal höhere Kosteneffizienz im Vergleich zu führenden Large Language Models. Zudem wurde Mark-Bench eingeführt, ein Open-Source-Benchmark zur Evaluierung der KI-Leistung über 285 Aufgaben und 15 Marketing-Funktionen hinweg. Die Agent Platform erreichte dabei eine Erfolgsquote von 67 % in Standardkonfigurationen, verglichen mit 60 % bei Claude Code bei halben Kosten. Die Modelle integrieren sich nahtlos in Mark-IQ, die Datenebene der Plattform, um organisatorischen Kontext automatisch einzubinden. Diese Ankündigung, die auf die Einführung von Virtual Teammates folgt, unterstreicht Optimizelys Ambitionen, den Einsatz von agentenbasiertem Marketing über Testphasen hinaus zu skalieren. Eine globale Studie unter 2.000 B2B-Marketingentscheidern ergab jedoch, dass 53 % der Befragten der Ansicht sind, dass aktuelle KI-Tools Schwierigkeiten mit emotionaler Markenresonanz haben.
KI erkennt keine KI-Ads, kann aber menschliche Kreativität bewerten
Andrew Tindall von System1 untersucht, ob Künstliche Intelligenz menschliche Werbung effektiv bewerten kann, während Verbraucher KI-Ads kaum identifizieren. Er stützt sich auf vier Studien, darunter die NYU-Stern-Untersuchung zum „AI Advertising Paradox“, wonach undisclosed KI-Ads menschliche Werbung um bis zu 19 Prozent übertrafen, bei Offenlegung jedoch um 31,5 Prozent einbrachen. Eine Taboola-Studie mit über 500 Millionen Impressions bestätigte dies für kurzfristige Metriken wie die CTR. In einem eigenen Test ließ Tindall zehn bekannte menschliche Werbespots von System1 analysieren. Die KI prognostizierte das Fluency Rating zehnmal und das Star Rating neunmal korrekt. Sie brillierte bei Extremwerten, zeigte Schwächen im Mittelfeld und betonte die Notwendigkeit von Unsicherheitsanalysen. Tindall folgert, dass KI als probabilistische Vorhersagemaschine menschliches Urteilsvermögen im Creative Testing ergänzen, aber nicht ersetzen sollte.
System1 führt KI-gestütztes Kreativ-Screening für Videowerbung ein
System1 hat „Test Your Ad Screen“ vorgestellt, ein auf künstlicher Intelligenz basierendes Tool zum Screening von Werbemitteln, das auf einem Datensatz von 18 Millionen menschlichen emotionalen Reaktionen trainiert wurde. Die Lösung wurde konzipiert, um bis zu 100 langformatige Kreativ-Assets gleichzeitig zu bewerten und innerhalb von Minuten kommerzielle Wirksamkeitsprognosen in Form von niedrigen, mittleren oder hohen Diagnosebändern zu liefern. Laut System1 stimmen die Ergebnisse des Modells in neun von zehn Fällen mit menschlichen Tests überein; bei unzureichender Konfidenz werden keine Vorhersagen ausgegeben. Das Tool ist zunächst über die Online-Plattform von System1 in den USA und im Vereinigten Königreich für Langform-Assets verfügbar, wobei weitere Märkte und Medienkanäle in Planung sind. Das Unternehmen positioniert das Produkt als Vorscreening für seine bestehende Consumer-Testing-Lösung „Test Your Ad“.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
