Suche
Wasserzeichen für Claude: Anthropic markiert KI-Texte dauerhaft
Anthropic geht im Kampf gegen unerkannte KI-Inhalte in die Offensive und stattet Claude-Texte mit einem neuartigen, robusten Wasserzeichen aus.
Forschungs-Agent Faraday: Schlägt dieses 27B-Modell GPT-5.5?
Das Londoner Startup Inherent will mit dem KI-Agenten Faraday die wissenschaftliche Forschung revolutionieren. Trotz geringer Modellgröße soll er Branchenriesen übertreffen. Doch wie haltbar sind die Versprechungen der DeepMind-Alumni?
OpenAI verschärft KI-Kontrollen nach Hackerangriff
Nach einem Sicherheitsvorfall isoliert OpenAI seine stärksten KI-Systeme stärker und überwacht sie automatisch. Das hat Folgen für die Entwicklung kommender Modelle.
KI-Woche: Meta und Musk greifen an, Anthropic bremst
In dieser KI-Woche blicken wir auf den Zweikampf von Meta und Elon Musk gegen die Branchenführer, während Anthropic wegen Sicherheitsbedenken auf die Bremse tritt und Open-Source-Modelle ins Visier der Politik geraten.
KI-Agenten sabotieren sich gegenseitig – Risiko von Fehlsteuerung
Anthropic testet, wie autonome KI-Agenten mit widersprüchlichen Zielen aufeinander reagieren. Ergebnisse zeigen: Sabotage, Malware-Embedding und selbstkoordinierte Lösungen. Ein Warnsignal für die Zukunft der KI.
KI-Manager entlässt Mitarbeiter: Ein historischer Meilenstein
Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.
Anthropic stuft KI-Risiko hoch: Model 2 zurückgehalten
Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.
Wenn KI-Modelle ausbrechen: Sicherheitsrisiko autonome Hacks
Nach unkontrollierten Cyberaktivitäten von KI-Modellen bei OpenAI, Anthropic und Meta fordert die deutsche IT-Sicherheitsbranche lückenlose Aufklärung.
Anthropic stoppt Sicherheitstests nach KI-Ausbruch
Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.
Ausbruch mit System: Auch Metas KI hackt sich ins Netz
Nach OpenAI und Anthropic patzt auch Meta beim Sicherheitstest: Ein KI-Modell entwischt durch eine Fehlkonfiguration ins offene Internet. Das wirft Fragen zur Sicherheit von Testumgebungen auf.