ANZEIGE

ANZEIGE

OpenAI startet GPT-6 Astra mit deutlich erweiterten Cyber-Fähigkeiten

Kleines OpenAI Logo auf einem Smartphone
Foto: MingPhoto / depositphotos.com

Key takeaways

Mit der neuen Modellgeneration erweitert OpenAI die Möglichkeiten für komplexe digitale Arbeitsabläufe erheblich. Gleichzeitig wächst das Sicherheitsrisiko, weil das System unbekannte Schwachstellen finden kann und seine interne Überwachung schwieriger wird.

Lesezeit ca. 2 Minuten

OpenAI hat mit GPT-6 Astra sein bislang leistungsfähigstes breit eingesetztes KI-Modell vorgestellt. Das System soll insbesondere bei komplexen Arbeitsabläufen, Softwareentwicklung, Browser- und Computernutzung sowie wissenschaftlichen Aufgaben Fortschritte bringen. Zugleich erreicht Astra als erstes OpenAI-Modell die im Preparedness Framework definierte kritische Stufe für Cybersicherheitsfähigkeiten.

Der Zugang wird zunächst schrittweise ausgeweitet. Unternehmen aus einem eingeschränkten Zugangsprogramm erhalten Astra zuerst, anschließend soll das Modell über die API sowie die kostenpflichtigen ChatGPT-Angebote Plus, Pro, Business und Enterprise verfügbar werden. Damit verbindet OpenAI den Produktstart mit einer kontrollierten Einführung seiner fortschrittlichsten Funktionen.

Astra kann bislang unbekannte Sicherheitslücken aufspüren

Besondere Aufmerksamkeit erhalten die Cybersicherheitsfähigkeiten des Modells. Nach Angaben von OpenAI kann Astra mit geeigneten Werkzeugen und entsprechenden Zugriffsrechten bislang unbekannte Schwachstellen in gut geschützten Systemen identifizieren und Methoden zu deren Ausnutzung entwickeln, ohne dass ein Mensch jeden einzelnen Arbeitsschritt steuern muss.

Diese Fähigkeiten können Sicherheitsteams dabei unterstützen, bislang unentdeckte Schwachstellen zu finden und zu schließen. Gleichzeitig steigt das Missbrauchspotenzial eines derart leistungsfähigen Systems. OpenAI hat deshalb nach eigenen Angaben zusätzliche technische und organisatorische Schutzmaßnahmen für Entwicklung und Bereitstellung eingeführt.

Anzeige

Gewinnen in der Plattform-Ökonomie

von Alexander Graf – der Leitfaden für Handelsentscheider
★★★★☆ 4,4 / 5 Sterne
Jetzt bei Amazon entdecken

OpenAI verstärkt Schutz vor Missbrauch und Fehlverhalten

Astra soll gegenüber dem Vorgängermodell GPT-5.6 Sol widerstandsfähiger gegen sogenannte Jailbreaks sein, mit denen Sicherheitsvorgaben eines KI-Systems umgangen werden sollen. OpenAI verweist hierfür auf interne und externe Tests sowie automatisiertes Red-Teaming und zusätzliche Sicherheitsmechanismen für als besonders riskant eingestufte Nutzungsszenarien.

Auch beim Alignment meldet das Unternehmen Fortschritte. In einer Simulation mit mehr als 54.000 internen Codex-Aufgaben seien bei Astra ungefähr halb so viele Hinweise auf schwerwiegenderes fehlangepasstes Verhalten aufgetreten wie beim Vorgänger. Für die externe Nutzung von Astra setzt OpenAI zusätzlich auf eine umfassende Überwachung werkzeuggestützter Modellaktivitäten.

Leistungsfähigeres Modell erschwert zugleich die Überwachung

Die höhere Leistungsfähigkeit bringt jedoch eine neue Herausforderung mit sich. OpenAI berichtet, dass Astra seine internen Gedankengänge stärker kontrollieren kann und darin seltener Informationen hinterlässt, anhand derer problematisches Verhalten erkannt werden könnte. Unter gezielt herbeigeführten adversarialen Bedingungen konnte das Modell in Tests teilweise Überwachungssysteme umgehen.

OpenAI betont zugleich, dass diese Ergebnisse vor allem aus Tests stammen, in denen das Modell ausdrücklich zur Umgehung der Überwachung aufgefordert wurde. Insgesamt zeigten die Alignment-Auswertungen ein sichereres Verhalten als beim Vorgänger. Dennoch sieht das Unternehmen die Entwicklung als Anlass, Kontrollmethoden auszubauen, die nicht ausschließlich auf der Analyse interner Gedankengänge beruhen.

Computer- und Browsernutzung rücken stärker in den Mittelpunkt

Neben Cybersicherheit und Programmierung positioniert OpenAI Astra als Modell für umfangreiche digitale Arbeitsprozesse. Es soll mehrstufige Aufgaben über Code, Browser und professionelle Anwendungen hinweg bearbeiten und dabei Änderungen der Nutzeranforderungen während eines laufenden Arbeitsprozesses berücksichtigen können.

OpenAI meldet zudem Verbesserungen beim Schutz vor Prompt-Injections sowie beim Verhalten in realistischen Browser- und Arbeitsplatzumgebungen. Das Modell soll seltener nicht autorisierte oder potenziell schädliche Aktionen ausführen. Damit zielt Astra verstärkt auf Aufgaben, bei denen KI nicht nur Informationen erzeugt, sondern selbstständig innerhalb digitaler Systeme arbeitet.

Must-read

ANZEIGE
JANGER E-Commerce
Wer als Shop-Betreiber, E-Commerce Manager oder Gründer einer E-Commerce-Marke erfolgreich werden möchte, muss drei grundsätzliche Faktoren, Verkaufspsychologie, Außendarstellung und Design sowie Nutzererlebnis, verinnerlichen.

Top-News

Sponsored

Sponsored