Beobachtetes Signal · 4. Apr. 2025 · Opinion / Interview · Quelle: CMSWire · Relevanz: 2/5 · Sentiment: Positiv
Scale AI CTO: Mensch-KI-Kollaboration übertrifft reine Automatisierung im CX-Bereich
Vijay Karunamurthy, Field CTO von Scale AI, betont im Interview mit CMSWire, dass künstliche Intelligenz menschliche Experten im professionellen Umfeld noch nicht vollständig ersetzen kann. Interne Benchmarks zeigen weiterhin erhebliche Leistungsunterschiede zwischen KI und Menschen in Bereichen wie Finanzen, Medizin und Recht. Für das Training der Modelle greift Scale AI auf ein Expertennetzwerk zurück, das zu zwölf Prozent aus Promovierten und zu über 40 Prozent aus Akademikern mit Master- oder Berufsabschluss besteht. Gemeinsam mit dem Center for AI Safety entwickelte das Unternehmen den Benchmark „Humanity's Last Exam“, bei dem führende Modelle aktuell rund 20 Prozent der 2,700 Fragen korrekt beantworten. Während komplexe Beratungsleistungen von einer engen Zusammenarbeit zwischen Mensch und KI profitieren, räumt Karunamurthy ein, dass KI-Agenten im Kundenservice-Callcenter durchschnittliche Mitarbeiter mit sofortigen Antworten ablösen könnten.
Das redaktionelle Interview liefert wertvolle Benchmark-Daten zur Leistungsfähigkeit von KI im Vergleich zu Menschen im CX-Kontext und stützt das Narrativ der Mensch-KI-Kollaboration, enthält jedoch keine Produkt- oder Finanzierungsankündigungen.
Marktsignale zu Scale AI in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Scale-AI-Field-CTO Vijay Karunamurthy betont, dass modernen KI-Modellen die Kreativität, emotionale Intelligenz und differenzierte Entscheidungsfindung menschlicher Experten fehlen.
- Das Contributor-Netzwerk von Scale AI besteht zu 12 % aus PhDs und zu über 40 % aus Personen mit Master- oder Fachabschlüssen.
- Scale AI und das Center for AI Safety entwarfen den Benchmark „Humanity's Last Exam“ mit rund 2.700 Fragen; Top-KI-Modelle erreichen etwa 20 % richtige Antworten.
- Die Kundenzufriedenheit steigt nachweislich, wenn KI Investmentberater vor Kundengesprächen gezielt vorbereitet.
- Karunamurthy räumt ein, dass KI-Agenten durchschnittliche Mitarbeiter in Kundensupport-Callcentern ersetzen könnten.
Verknüpfte Unternehmen
2 verknüpfte Unternehmen“Scale AI is working to bring artificial intelligence up to human-level proficiency by having deeply skilled humans teach it what they know....”
“But lawyers working with legal bots like Harvey can sort through documents more efficiently, leading to better performance....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Zustand der Tech-Branche 2026: KI-Codierungsagenten verändern Softwareentwicklung
Der Artikel, basierend auf einer Keynote von Gergely Orosz auf der LDX3-Konferenz, bietet eine umfassende Analyse der Tech-Branche Ende 2026. Zu den wichtigsten Trends gehören die weit verbreitete Verlagerung auf KI-Codierungsagenten, wobei die meisten Ingenieure nicht mehr von Hand codieren und 5-10 Agenten parallel ausführen. Von Agenten erstellte PRs auf GitHub übersteigen inzwischen die von Menschen erstellten, und KI-generierter Code führt zu einem 'goldenen Zeitalter' der Migrationen. Die IDE verschwindet, ersetzt durch CLI-First- und agentenbasierte Umgebungen. Code-Reviews sind aufgrund der überwältigenden Menge 'theatralisch' geworden, und reine KI-Reviews nehmen zu. Teams sind kleiner, Spezialisierungen verschwimmen, und es gibt einen Trend, dass CTOs kündigen, um zu bauen. Zu den Herausforderungen gehören Qualitätsverlust, erhöhter Kontextwechsel und Infrastrukturengpässe (GPU, Speicher, CPU). Der Artikel behandelt auch den Aufstieg von 'agentic software factories' und benutzerdefinierten Agenten-Harness bei großen Unternehmen sowie den Trend zu offenen KI-Modellen zur Kostensenkung.
Building Trust at the Frontier
New blog post added: 'Building Trust at the Frontier' under the Policy category, discussing AI testing and evaluation lifecycle.
MIT-Doktorand Alex Zhang über Rekursive Sprachmodelle und KI-Harnesses
In dieser Folge des Latent-Space-Podcasts interviewen Swyx und Vibhu Alex Zhang, einen PhD-Studenten am MIT, der für seine Arbeiten zu Rekursiven Sprachmodellen (RLMs), GPU-Kerneln und KI-Agenten-Harnesses bekannt ist. Zhang spricht über seine Beteiligung an GPU Mode und KernelBench, das Konzept von RLMs als Harness-Design, bei dem Code das primäre Werkzeug ist, und die Idee von Harnesses als kompositionelle Generalisierer, die die Generalisierungsfähigkeit von Modellen über Aufgaben hinweg verbessern können. Er erzählt von Prime Agent, einem RLM-Harness basierend auf Pi Mono, und seinen Ansichten zu Agenten-Schwärmen, wobei er sich auf OpenAIs 10.000-Agenten-Experiment mit Kosten von rund 40 Millionen Dollar bezieht. Zhang plädiert dafür, dass Akademiker große Forschungsrisiken eingehen, erkundet alternative Modellarchitekturen wie Jev und spricht über offene Forschung bei Sakana AI, Capability Overhang und die Zukunft von Sprachmodellen, die möglicherweise unsichtbare Schwärme von Agenten sein werden.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
