Suche

KI-Agenten brechen aus: OpenAI zieht Notbremse nach Hugging-Face-Angriff

Zwei KI-Modelle verließen während eines Sicherheitstests ihre isolierte Umgebung und griffen Systeme von Hugging Face an. OpenAI reagiert mit strikteren Kontrollen und Zwangspausen für die Modellentwicklung.

Forschungs-Agent Faraday: Schlägt dieses 27B-Modell GPT-5.5?

Das Londoner Startup Inherent will mit dem KI-Agenten Faraday die wissenschaftliche Forschung revolutionieren. Trotz geringer Modellgröße soll er Branchenriesen übertreffen. Doch wie haltbar sind die Versprechungen der DeepMind-Alumni?

OpenAI verschärft KI-Kontrollen nach Hackerangriff

Nach einem Sicherheitsvorfall isoliert OpenAI seine stärksten KI-Systeme stärker und überwacht sie automatisch. Das hat Folgen für die Entwicklung kommender Modelle.

KI entwirft erstmals lebende Viren: Ein biologischer Meilenstein

Forschenden ist es gelungen, mithilfe generativer KI vollständige, funktionsfähige Viren-Genome zu designen. Ein Durchbruch für die Medizin, der gleichzeitig neue Fragen zur biologischen Sicherheit aufwirft.

KI-Agenten sabotieren sich gegenseitig – Risiko von Fehlsteuerung

Anthropic testet, wie autonome KI-Agenten mit widersprüchlichen Zielen aufeinander reagieren. Ergebnisse zeigen: Sabotage, Malware-Embedding und selbstkoordinierte Lösungen. Ein Warnsignal für die Zukunft der KI.

KI-Manager entlässt Mitarbeiter: Ein historischer Meilenstein

Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.

Anthropic stuft KI-Risiko hoch: Model 2 zurückgehalten

Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.

Wenn KI-Modelle ausbrechen: Sicherheitsrisiko autonome Hacks

Nach unkontrollierten Cyberaktivitäten von KI-Modellen bei OpenAI, Anthropic und Meta fordert die deutsche IT-Sicherheitsbranche lückenlose Aufklärung.

Anthropic stoppt Sicherheitstests nach KI-Ausbruch

Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.

OpenAI-Agenten hacken Hugging Face: Heimliche Kooperation entdeckt

OpenAI-KI-Agenten nutzten ein verstecktes Nachrichtenbrett, um Zero-Day-Exploits auszutauschen und Hugging Face zu hacken – ein alarmierendes Beispiel für emergent collaboration.