Beobachtetes Signal · 20. Mai 2024 · Technical Release · Quelle: Tech.eu · Relevanz: 2/5 · Sentiment: Neutral
Großbritannien: AI Safety Institute veröffentlicht erste LLM-Testergebnisse
Das britische Institute for AI Safety (AISI) hat seine ersten Evaluierungsergebnisse vorgelegt und fünf führende Large Language Models hinsichtlich Cyber-, Chemie- und Biologierisiken sowie der Wirksamkeit von Sicherheitsvorkehrungen untersucht. Die Modelle wurden anonymisiert getestet. Die Ergebnisse zeigen, dass mehrere LLMs über promoviertes Fachwissen in Chemie und Biologie verfügen, jedoch bei komplexeren Cyber-Herausforderungen versagten. Kritisch ist, dass alle getesteten Modelle extrem anfällig für einfache Jailbreaks bleiben. Der Fokus lag auf nationalen Sicherheitsrisiken statt auf kurzfristigen Themen wie Bias. Das Ministerium kündigte an, dass die Testergebnisse künftige Gesetzesvorhaben beeinflussen werden. Zudem plant das AISI einen Standort in San Francisco und eine Kooperation mit Kanada. Die Ergebnisse sollen auf dem bevorstehenden Seoul Summit diskutiert werden.
Die Testergebnisse prägen die zukünftige KI-Regulierung und verdeutlichen die Risikoprofile führender LLMs, was auch für das breitere KI-Technologie-Ökosystem im Bereich AdTech und MarTech relevant ist, wenngleich es kein direktes Branchenereignis darstellt.
Marktsignale zu BBC in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Das UK Institute for AI Safety (AISI) veröffentlichte am 20. Mai 2024 erste LLM-Sicherheitsbewertungen.
- Fünf führende LLMs wurden anonym unter Farbpseudonymen auf Cyber-, Bio- und Chemierisiken getestet.
- Mehrere LLMs zeigten PhD-Niveau in Chemie und Biologie und beantworteten über 600 Expertenfragen.
- Alle getesteten LLMs sind stark anfällig für einfache Jailbreaks und können schädliche Outputs generieren.
- Das AISI plant einen Standort in San Francisco und die Zusammenarbeit mit der kanadischen Partnerbehörde.
Verknüpfte Unternehmen
1 verknüpfte Unternehmen“BBC Technology editor Zoe Kleinman tweeted: 'I don't think they safety tested either GPT-4o or Google's Project Astra.'...”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
BBC-Chef kündigt Silicon-Valley-Umbau an
BBC-Intendant Matt Brittin, ehemals bei Google, hat einen umfassenden kulturellen und strategischen Umbau der britischen Rundfunkanstalt angekündigt. In einer Town-Hall-Rede forderte er die Mitarbeiter auf, schnellere Entscheidungen zu treffen, digitale Dienste als Flaggschiffprodukte zu behandeln und kontrollierte Experimente zu wagen. In der Rede, die keine Bestätigung von TV-Sender-Schließungen enthielt, stellte Brittin einen Prototyp für den Streamingdienst iPlayer vor, darunter einen KI-Agenten für Empfehlungen und mehrsprachige Unterstützung, personalisierte Startseiten und eine Zufallsauswahl-Funktion. Die Publikumstests sollen in Kürze beginnen. Während einige Mitarbeiter die neue Richtung begrüßten, äußerten andere Skepsis angesichts der Risiken für einen öffentlich-rechtlichen Sender. Brittin betonte die Notwendigkeit greifbarer Ergebnisse und deutete einen künftigen Übergang weg von der analogen Verbreitung an.
Asos bestätigt Datenleck nach manipulierter App-Benachrichtigung
Der britische Modehändler Asos hat eine Datenpanne mit personenbezogenen Daten von Kunden bestätigt. Hacker brachen in eine Drittanbieter-Plattform ein, die für die Kundenkommunikation genutzt wird, und erbeuteten Namen, Kontaktdaten, Wohnadressen, Telefonnummern, E-Mail-Adressen sowie Notizen zu Kundenprofilen, einschließlich Suchanfragen. Die Hacker, die sich Xuanye Group nennen, sendeten über die Asos-App eine unbefugte Push-Benachrichtigung und verwiesen auf kompromittierte Daten, die bei Snowflake gehostet wurden. Sie forderten das Unternehmen zur Kontaktaufnahme auf, andernfalls drohten sie mit der Veröffentlichung der Daten. Die Angreifer sollen sich durch Identitätstäuschung Zugangsdaten verschafft haben. Snowflake betonte, dass die eigenen Systeme nicht betroffen seien. Asos hat 17 Millionen Kunden. Der Vorfall ähnelt einem früheren Angriff auf das Fintech-Unternehmen Betterment.
Streaming-Divide: USA monetarisieren, UK balanciert
In einem Interview mit State of Streaming diskutierten die Cloud- und Media-Experten Rahul Bhatia und Hemant Soni strukturelle Unterschiede zwischen den US-amerikanischen und britischen Streaming-Märkten. Die USA sind privatwirtschaftlich geprägt und fokussieren auf Monetarisierung, Abo-plus-Werbe-Modelle, während UK stärker öffentlich-rechtlich ausgerichtet ist, mit BBC und ITV, und kommerzielle Interessen mit dem öffentlichen Auftrag balanciert. Architektur-Entscheidungen im Streaming sollten für Spitzenlasten und nicht für Durchschnittswerte ausgelegt sein, wobei Public Cloud und Serverless für Skalierbarkeit sorgen. KI wird als Umsatztreiber gesehen, vor allem bei Personalisierung und Werbeoperationen; Netflix' Werbe-Tier erreicht fast 250 Millionen monatliche Werbezuschauer. Agentic AI beginnt, Media Buying und Kampagnenoptimierung zu automatisieren. Zudem werden Trends wie KI-generierte Filme (z.B. 'Cully Hill Boys') hervorgehoben, und es wird erwartet, dass Streaming-Dienste künftig Speicherkosten an Nutzer weitergeben.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
