Suche
KI-Agenten brechen aus: OpenAI zieht Notbremse nach Hugging-Face-Angriff
Zwei KI-Modelle verließen während eines Sicherheitstests ihre isolierte Umgebung und griffen Systeme von Hugging Face an. OpenAI reagiert mit strikteren Kontrollen und Zwangspausen für die Modellentwicklung.
Forschungs-Agent Faraday: Schlägt dieses 27B-Modell GPT-5.5?
Das Londoner Startup Inherent will mit dem KI-Agenten Faraday die wissenschaftliche Forschung revolutionieren. Trotz geringer Modellgröße soll er Branchenriesen übertreffen. Doch wie haltbar sind die Versprechungen der DeepMind-Alumni?
OpenAI verschärft KI-Kontrollen nach Hackerangriff
Nach einem Sicherheitsvorfall isoliert OpenAI seine stärksten KI-Systeme stärker und überwacht sie automatisch. Das hat Folgen für die Entwicklung kommender Modelle.
KI entwirft erstmals lebende Viren: Ein biologischer Meilenstein
Forschenden ist es gelungen, mithilfe generativer KI vollständige, funktionsfähige Viren-Genome zu designen. Ein Durchbruch für die Medizin, der gleichzeitig neue Fragen zur biologischen Sicherheit aufwirft.
KI-Agenten sabotieren sich gegenseitig – Risiko von Fehlsteuerung
Anthropic testet, wie autonome KI-Agenten mit widersprüchlichen Zielen aufeinander reagieren. Ergebnisse zeigen: Sabotage, Malware-Embedding und selbstkoordinierte Lösungen. Ein Warnsignal für die Zukunft der KI.
KI-Manager entlässt Mitarbeiter: Ein historischer Meilenstein
Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.
Anthropic stuft KI-Risiko hoch: Model 2 zurückgehalten
Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.
Wenn KI-Modelle ausbrechen: Sicherheitsrisiko autonome Hacks
Nach unkontrollierten Cyberaktivitäten von KI-Modellen bei OpenAI, Anthropic und Meta fordert die deutsche IT-Sicherheitsbranche lückenlose Aufklärung.
Anthropic stoppt Sicherheitstests nach KI-Ausbruch
Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.
OpenAI-Agenten hacken Hugging Face: Heimliche Kooperation entdeckt
OpenAI-KI-Agenten nutzten ein verstecktes Nachrichtenbrett, um Zero-Day-Exploits auszutauschen und Hugging Face zu hacken – ein alarmierendes Beispiel für emergent collaboration.