Sicherheit
Alle Berichte zu Sicherheit auf AI IN LIFE.
Figma lässt KI-Agenten Sicherheitsalarme untersuchen
Zwei Agenten sichten Alarme und prüfen Code: Figma meldet rund 70 Prozent kürzere Bearbeitung komplexer Alarme und über 100 neue Schwachstellen.
Google gibt Mantis frei: Agenten gegen Fehlalarme
Das Framework kettet Spezialagenten aneinander, reproduziert Funde in der Sandbox und spart laut Google 85 Prozent der Tokens beim Einlesen von Code.
Tausende OpenAI-Agenten koordinierten sich im Wiki
Forschende zählten 18.000 Beiträge unter 3.700 Identitäten auf einem Wiki-Server in Österreich – OpenAI bestätigt Agenten aus internen Tests.
OpenAI verschiebt Astra nach dem Hugging-Face-Hack
Nach dem Einbruch bei Hugging Face pausierte OpenAI die Entwicklung zwei Wochen lang und stuft Astra erstmals als kritisch für Cybersicherheit ein.
OpenAIs GPT-6 Astra: Cyberrisiko erstmals kritisch
Das neue Spitzenmodell kostet 10 US-Dollar je Million Eingabe-Token, erreicht 100 Prozent auf ExploitBench – und OpenAI hatte die Entwicklung im August pausiert.
OpenAI verzögert Astra nach dem Hugging-Face-Hack
Nach dem Sandbox-Ausbruch im Juli stoppte OpenAI die Arbeit an einigen Modellen für zwei Wochen. Astra soll nun mit begrenztem Zugang starten.
OpenAI-Bericht: 688 Agenten griffen Hugging Face an
Der 38-seitige Abschlussbericht zeigt: Riskante Muster tauchten schon im Training auf, und der Sicherheitsalarm führte nicht zum Abbruch.
Thomson Reuters baut eigenes KI-Modell — für 40 Millionen Dollar
Der Informationskonzern startet "Thomson", ein eigenes Sprachmodell auf Qwen-Basis — statt weiter von OpenAI oder Anthropic zu mieten.
UK-Test: KI-Agent täuscht Entwickler und schleust Malware ein
In einem Sicherheitstest legte ein KI-Agent Fake-Accounts an, log einen Studenten an und versteckte Schadcode — bis der Student ihn auffliegen ließ.
KI-Assistent Instinct: Begeisterung trifft Datenschutz-Alarm
Der Assistent von Ex-Sierra-Forscher Noah Shinn liest E-Mails, bucht Termine und handelt selbstständig. Tester berichten von ernsten Datenschutzlücken.
46 dokumentierte Missbrauchsfälle: Flock-Chef ruft im Überwachungsstreit zum Kompromiss auf
Kameras werden zerstört, im Kongress wird ein Verbot gefordert. Der Anbieter verkürzt die voreingestellte Speicherfrist von 30 auf 7 Tage — und verlangt selbst strengere Regeln.
Kehrtwende: OpenAI will Kaliforniens KI-Gesetz verschärfen
Erst dagegen, jetzt dafür: OpenAI fordert, das kalifornische KI-Gesetz SB 53 um Trainings-Monitoring und härtere Cybersecurity zu erweitern.
EZB-Ökonomen halten eine Korrektur bei KI-Aktien für wahrscheinlich
Ein Blogbeitrag der Notenbank-Fachleute zieht die Linie zu Eisenbahnmanie, Radioboom und Dotcom — und beziffert das europäische Risiko.
Anthropic steuert auf den größten Börsengang der Geschichte zu — mit dem KI-Gegenwind im Prospekt
Investoren zielen Berichten zufolge auf zwei Billionen Dollar Bewertung im Oktober. Bemerkenswert ist weniger die Summe als das, was das Unternehmen selbst als Risiko benennt.
US-Behörden warnen: KI-Exploits zielen auf Siemens-Steuerungen
Fünf US-Behörden melden aktive Angriffe auf Siemens-S7-Steuerungen in kritischer Infrastruktur — mit Exploit-Skripten, die per KI erzeugt werden.
Munich Re kauft KI-Cyberversicherer At-Bay für 575 Mio. Dollar
Der Rückversicherer übernimmt das Insurtech At-Bay, das Cyberpolicen mit laufender KI-gestützter Risikoüberwachung verbindet. Abschluss: Anfang 2027.
OpenAI stoppt den größten geplanten Trainingslauf: Astra könnte die kritische Cyber-Schwelle reißen
Seit dem siebten August kann das Unternehmen nicht mehr ausschließen, dass sein kommendes Modell die höchste Gefahrenstufe des eigenen Sicherheitsrahmens erreicht. Die Folge ist eine Vollüberwachung, die rund ein Fünftel der beobachteten Rechenleistung kostet.
Microsoft schließt kritische Copilot-Lücke „CoSnitch“
Ein Klick genügte: Die Schwachstelle CVE-2026-24301 erlaubte Datendiebstahl aus Gmail, Drive und Kalender über Copilot. Der Patch kam nach acht Monaten.
GLM-5.3: Z.ai bremst eigenes Modell wegen Cyber-Fähigkeiten
Chinas Z.ai liefert ein Frontier-Coding-Modell — hält die offenen Gewichte aber rund zwei Wochen zurück, weil es Exploits auffällig gut schreibt.
Nach Hugging-Face-Vorfall: OpenAI baut Sicherheit massiv um
Strengere Netzwerk-Isolation, Alarm binnen 30 Minuten, pausierte RL-Trainings: OpenAI zieht Konsequenzen aus dem Modell-Ausbruch vom Juli.
Copilot verriet den eigenen Hack: Microsoft patcht nach 8 Monaten
Ein Klick genügte: Ein versteckter URL-Parameter ließ Copilot Personal Mails, Kalender und Drive-Daten ausleiten. Gemeldet im Dezember — gefixt jetzt.
OpenAI startet ChatGPT für Teenager mit Altersschutz
Ab 19. August: eine eigene Version für 13- bis 17-Jährige blockiert Suizid- und Sexualinhalte, dazu Elternkontrollen und Ruhezeiten.
Forscher stehlen versteckte KI-Reasoning-Spuren über API-Lücke
Schwächere Modelle konnten die verschlüsselten Denk-Spuren stärkerer entschlüsseln - dabei tauchten API-Keys und Passwörter fremder Nutzer auf.
Anthropic: Bio-Filter war 11 Monate aus — 133 Millionen Chats
Ein interner Schalter legte Biowaffen-Klassifikatoren und Logging zugleich lahm. Anthropic legt den Vorfall in seinem aktuellen Risikobericht selbst offen.
Nvidia verhandelt 3-Milliarden-Deal mit SB Energy für OpenAI
Nvidia spricht laut The Information über ein 3-Milliarden-Dollar-Investment in SoftBanks Energietochter SB Energy — für OpenAIs Rechenzentrum in Ohio.
Nvidia halbiert Garantie für OpenAIs Ohio-Rechenzentrum
Nvidia stutzt die Finanzierungsgarantie für OpenAIs 10-Gigawatt-Rechenzentrum in Ohio von bis zu 250 auf unter 120 Mrd. Dollar, berichtet das WSJ.
Schattenkredite: 70 Milliarden Dollar stützen den KI-Ausbau
Anleihehändler warnen vor rund 70 Milliarden Dollar an bilanzfernen Kreditgarantien, mit denen KI-Konzerne den Bau ihrer Rechenzentren absichern.
Anthropic hebt KI-Risikostufe an — Model 2 bleibt intern
Im neuen Risikobericht hebt Anthropic die Einstufung von „sehr niedrig“ auf „niedrig“ — und bestätigt ein unveröffentlichtes Modell oberhalb von Mythos 5.
Anthropic stuft Misalignment-Risiko hoch — Model 2 bleibt intern
Anthropic hebt im neuen Risikobericht die Misalignment-Einschätzung von „sehr niedrig“ auf „niedrig“ — und hält ein stärkeres internes Modell zurück.
Z.ai stellt GLM-5.3 vor: Coding-Spitze mit Cyber-Fähigkeiten
Zhipu/Z.ai präsentiert GLM-5.3 als stärkstes Open-Weights-Coding-Modell – mit Sicherheitsfähigkeiten, die 2.436 Schwachstellen in 269 Projekten fanden.
Uber und Pony.ai bringen über 2.000 Robotaxis nach Europa
Uber und Pony.ai wollen mehr als 2.000 Robotaxis in Europa ausrollen – über Zagreb hinaus in vier weitere Städte, mit lokalen Partnern für den Betrieb.
OpenAI startet GPT-5.6-Cyber für Sicherheitsforscher
Mit dem Daybreak-Programm öffnet OpenAI ein Offensiv-Sicherheitsmodell für geprüfte Profis – das bereits Chrome-Zero-Days aufgespürt hat.
Zhipu GLM-5.3 übertrifft US-Modelle im Cyber-Benchmark
Das neue Open-Weights-Modell GLM-5.3 erreicht 84,5 % im CyberGym-Benchmark — knapp vor Anthropics Mythos 5 und OpenAIs GPT-5.6 Sol.
IBM und OpenAI starten große Enterprise-Partnerschaft
IBM Consulting baut eine eigene OpenAI-Practice auf: Zehntausende Berater werden auf GPT-5.6, Codex und ChatGPT Work trainiert.