Beobachtetes Signal · 3. Sept. 2026 · Product Launch · Quelle: t3n · Relevanz: 2/5 · Sentiment: Negativ
KI-Startup veröffentlicht Modell ohne jegliche Sicherheitsblockaden
Das kalifornische KI-Startup Abliteration hat das Modell ‚Abliterated-model-large-v2‘ veröffentlicht, das auf dem Open-Source-Modell GLM-5.3 des chinesischen Labors Z.ai basiert. Mittels einer Technik namens Orthogonalisierung wurden sämtliche Sicherheitsmechanismen und Verweigerungsfunktionen des Modells gezielt entfernt. Es verarbeitet Anfragen, die andere KI-Systeme blockieren, darunter Cyberangriffe, Red-Teaming und Agententests, während Inhalte zu sexueller Kindesmissbrauch und Selbstverletzung weiterhin untersagt bleiben. Der Launch erfolgt vor dem Hintergrund intensivierter Sicherheitsdebatten, in denen führende Labore wie OpenAI und Anthropic strengere Regulierung fordern. Sicherheitsexperten bewerten die unregulierte Kommerzialisierung gefährlicher KI-Funktionen als alarmierenden Weckruf für Entscheidungsträger. Das Angebot richtet sich an Entwickler, die bestehende Sicherheitswarnungen als übertrieben erachten, während Anthropic auf Nutzerfeedback hin ebenfalls Einschränkungen in seinem Fable-5.1-Modell gelockert hat.
Die Veröffentlichung ungefilterter KI-Modelle und die Debatte um Hardwaresicherheit könnten die KI-Adoption im MarTech- und AdTech-Bereich beeinflussen, haben jedoch aktuell keine direkten Branchenauswirkungen.
Marktsignale zu Z.ai in Echtzeit verfolgen
Polaris7 erfasst behördliche Registrierungen, Primärquellen, Führungswechsel und Deal-Aktivitäten rund um die Uhr. Erstellen Sie Ihren kostenlosen Explorer-Workspace, um automatisierte Executive Briefings zu erhalten.
Wichtigste Kernpunkte & Evidenz
- Abliteration hat das auf GLM-5.3 basierende Modell ‚Abliterated-model-large-v2‘ ohne Sicherheitsfilter via Orthogonalisierung veröffentlicht.
- Das Modell bearbeitet Anfragen zu Cyberangriffen und Red-Teaming, blockiert jedoch Kindesmissbrauch und Selbstverletzung.
- OpenAI und Anthropic fordern strengere KI-Regulierung und eine Pause bei der Entwicklung, um Kontrollverluste zu verhindern.
- Chris McGuire vom Council on Foreign Relations kritisierte die unregulierte Kommerzialisierung gefährlicher KI-Funktionen als alarmierend.
- Anthropic hat zudem Einschränkungen im Modell Fable 5.1 als Reaktion auf Nutzerfeedback gelockert.
Verknüpfte Unternehmen
5 verknüpfte Unternehmen“Das Modell basiert auf GLM-5.3, einem offenen Modell des chinesischen Labors Z.ai....”
“Das Modell basiert auf GLM-5.3, einem offenen Modell des chinesischen Labors Z.ai....”
“Große KI-Labore wie OpenAI und Anthropic sprechen über strengere Sicherheitsvorkehrungen....”
“Große KI-Labore wie OpenAI und Anthropic sprechen über strengere Sicherheitsvorkehrungen....”
“Vor allem der Angriff auf Hugging Face hat zuletzt für viel Aufsehen gesorgt....”
Ontologie & Marktkonzepte
Verwandte Marktsignale & Trends
Aktuelle verifizierte Unternehmensentwicklungen und Deal-Aktivitäten in diesem Marktsegment.
Abliteration.ai vertreibt KI-Modelle ohne Sicherheitsleitplanken
Das Startup Abliteration.ai hat einen kommerziellen Dienst gestartet, der modifizierte Open-Weight AI-Modelle ohne Sicherheitsleitplanken hostet, darunter das kürzlich veröffentlichte GLM-5.3 von Z.ai. Nutzer können die sogenannten abliterierten Modelle über einen Webbrowser oder eine API abfragen. Laut Unternehmensangaben unterstützt der Dienst offensive Cyberoperationen, Red-Teaming und Agententests. TechCrunch verifizierte, dass der Service problemlos Code zum Diebstahl von Chrome-Passwörtern und Anleitungen zur Züchtung eines gefährlichen Pathogens erstellte. Kritiker warnen, dass ein skalierter Zugriff auf solche Modelle erheblichen Schaden anrichten kann. Das Ende letzten Jahres gegründete und im März inkorporierte Startup hat noch kein Venture Capital aufgenommen, befindet sich jedoch in Gesprächen. Es gibt an, dass die Kundenerlöse die Kosten für große Cloud-Provider decken. Zu den Kunden zählen Frühphasen-Red-Teaming-Startups in Großbritannien und Europa.
Safety Guardrails Block Incident Response
An AI-native company was reportedly attacked by an autonomous AI agent and — after frontline American models refused to assist in analyzing attack artifacts due to safety refusals — turned to a Chinese open-source model to investigate. The author argues this is not primarily a geopolitical story but a recurring operational failure: safety guardrails over-tuned for demos can hinder real-world incident response. The piece warns that autonomous agents increase attack scale and automation, and that models must be tested against incident response playbooks. It urges model providers to develop contextual refusal that recognizes defensive intent and recommends multi-model strategies to avoid single points of failure during breaches.
Open-Weight-KI-Modelle schließen Leistungslücke, während Sicherheitsvorkehrungen hinterherhinken
Eine Evaluierung von SaferAI zeigt, dass Chinas Open-Weight-Modell GLM-5.2 (von Z.ai) sich den Cyber- und Biokapazitäten von Frontier-Modellen wie OpenAI GPT-5.5 und Anthropic Claude Opus 4.7 annähert, jedoch keine der gestellten Offensiv-Cyber- oder Dual-Use-Biologieaufgaben verweigerte. Der Bericht verdeutlicht eine wachsende Kluft zwischen Leistungsfähigkeit und durchsetzbarer Sicherheit: Schutzmaßnahmen für gehostete APIs versagen, sobald Modellgewichte heruntergeladen und lokal ausgeführt werden. Während Frontier-Entwickler auf Verweigerungstraining und API-Kontrollen setzen, zeigen Jailbreak-Forschungen von Far.ai, dass wiederverwendbare Techniken auch geschlossene Modelle umgehen können. Zu den vorgeschlagenen Gegenmaßnahmen gehören die Filterung von Pre-Training-Daten, präventive Tests und das Zurückhalten von Gewichten. SaferAI bemängelt, dass Z.ai keinen Sicherheitsrahmen veröffentlicht hat. Die Debatte verlagert sich von reinem Leistungs-Wettbewerb hin zum Risikomanagement frei verfügbarer, hochleistungsfähiger Open-Weight-Modelle.
Marktsignale & Strategische Shifts in Echtzeit verfolgen
Erstellen Sie benutzerdefinierte Watchlists, um automatisierte, evidenzbasierte Executive Briefings zu erhalten, sobald wesentliche Signale oder Marktverschiebungen auftreten.
