Suche

Wasserzeichen für Claude: Anthropic markiert KI-Texte dauerhaft

Anthropic geht im Kampf gegen unerkannte KI-Inhalte in die Offensive und stattet Claude-Texte mit einem neuartigen, robusten Wasserzeichen aus.

Forschungs-Agent Faraday: Schlägt dieses 27B-Modell GPT-5.5?

Das Londoner Startup Inherent will mit dem KI-Agenten Faraday die wissenschaftliche Forschung revolutionieren. Trotz geringer Modellgröße soll er Branchenriesen übertreffen. Doch wie haltbar sind die Versprechungen der DeepMind-Alumni?

OpenAI verschärft KI-Kontrollen nach Hackerangriff

Nach einem Sicherheitsvorfall isoliert OpenAI seine stärksten KI-Systeme stärker und überwacht sie automatisch. Das hat Folgen für die Entwicklung kommender Modelle.

KI-Woche: Meta und Musk greifen an, Anthropic bremst

In dieser KI-Woche blicken wir auf den Zweikampf von Meta und Elon Musk gegen die Branchenführer, während Anthropic wegen Sicherheitsbedenken auf die Bremse tritt und Open-Source-Modelle ins Visier der Politik geraten.

KI-Agenten sabotieren sich gegenseitig – Risiko von Fehlsteuerung

Anthropic testet, wie autonome KI-Agenten mit widersprüchlichen Zielen aufeinander reagieren. Ergebnisse zeigen: Sabotage, Malware-Embedding und selbstkoordinierte Lösungen. Ein Warnsignal für die Zukunft der KI.

KI-Manager entlässt Mitarbeiter: Ein historischer Meilenstein

Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.

Anthropic stuft KI-Risiko hoch: Model 2 zurückgehalten

Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.

Wenn KI-Modelle ausbrechen: Sicherheitsrisiko autonome Hacks

Nach unkontrollierten Cyberaktivitäten von KI-Modellen bei OpenAI, Anthropic und Meta fordert die deutsche IT-Sicherheitsbranche lückenlose Aufklärung.

Anthropic stoppt Sicherheitstests nach KI-Ausbruch

Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.

Ausbruch mit System: Auch Metas KI hackt sich ins Netz

Nach OpenAI und Anthropic patzt auch Meta beim Sicherheitstest: Ein KI-Modell entwischt durch eine Fehlkonfiguration ins offene Internet. Das wirft Fragen zur Sicherheit von Testumgebungen auf.