Praxistest: Drei KI-Modelle sortieren zehn Kundenanfragen
Erster eigener Test der Redaktion: Bedarf, Kontakt und Entscheidung aus zehn synthetischen Anfragen — inklusive zweier Manipulationsversuche und zweier ausdrücklicher Kontaktverbote.
Erster eigener Test der Redaktion: Bedarf, Kontakt und Entscheidung aus zehn synthetischen Anfragen — inklusive zweier Manipulationsversuche und zweier ausdrücklicher Kontaktverbote.
16 Bewertungen aus 4 Kategorien — welche Werkzeuge für Video, Schnitt und Restaurierung in die engere Wahl gehören und wo ihre Grenzen liegen.
11 Bewertungen aus 3 Kategorien — welche Werkzeuge für Bilder, Design und Produktfotos in die engere Wahl gehören und wo ihre Grenzen liegen.
12 Bewertungen aus 4 Kategorien — welche Werkzeuge für Programmieren, Apps und Automatisierung in die engere Wahl gehören und wo ihre Grenzen liegen.
12 Bewertungen aus 3 Kategorien — welche Werkzeuge für Assistenten, Recherche und Wissenschaft in die engere Wahl gehören und wo ihre Grenzen liegen.
45 Kategorien, 95 Produkte, 123 Bewertungen: Methode, Grenzen und der Testplan, mit dem sich jede Empfehlung selbst nachprüfen lässt.
Auf der Connect-Keynote kündigte Meta an, den Agenten per Sprachbefehl auf die Brille zu holen – einen Tag nach dem Bericht über Menschen im Callcenter.
Sol übernimmt komplexe Arbeit, Luna die Massenaufgaben: OpenAI stellt zwei GPT-6-Modelle vor, die in der API halb so viel kosten wie die 5.6-Reihe.
OpenAI hat GPT-6 Sol und Luna angekündigt. Die Ankündigungsseite lieferte 403, belegbar sind bislang nur die Resonanz und Anthropics Gegenprogramm.
Das Spitzenmodell erreicht 66,4 Prozent auf Terminal-Bench 4.0 gegenüber 55,8 Prozent bei Fable 5.1 und läuft bei AWS, Google Cloud und Azure.
Der Cloud-Anbieter gibt sein Agenten-Gerüst unter Apache 2.0 frei und meldet in eigenen Tests 77 Prozent weniger Kosten als Claude Code im Terminal-Bench 2.1.
Seit Sonntagabend blockiert Amazon Metas Einkaufsagenten Muse mit einem Hinweis auf die Nutzungsbedingungen – keine zwei Wochen nach dem Start der App.
Ein mit einem Chatbot erstellter Geheimdienstbericht identifizierte Fracht auf einem chinesischen Schiff falsch – gestoppt wurde der Zugriff kurz davor.
Das Patch-Release vom 18. September listet zwei Änderungen gegenüber 1.4.1 – darunter einen Fix, der modellgenerierte Tool-Calls bei HITL-Bearbeitungen erhält.
Der Desktop-Client bündelt 23 Skills, 24 Connectors sowie Python- und R-Ausführung und legt Artefakte samt Herkunftsnachweis lokal ab.
TypeSafe AI hat am 19.09.2026 ein Modell veröffentlicht, das statt Text eine Auswahl, eine Bewertung oder einen Wahrheitswert samt Konfidenz zurückgibt.
Ein Dreierteam von Hacktron AI verkettete zwei Lücken im Community-Forum von OpenAI – erfolgreich erst mit Opus 5, Prämie 6.500 US-Dollar.
Das Rechtsmodell durchsucht einen Index mit über 230 Millionen URLs und erreicht im Legal Research Bench 54 Prozent statt 38,7 Prozent.
Der Haushalts-Agent bekommt ein eigenes Google-Konto, bündelt Post von Schule und Verein für bis zu sechs Personen – vorerst nur in den USA und ab 18 Jahren.
Der KI-Anbieter lässt Claude-Modelle physische Experimente steuern – geführt von Eric Kauderer-Abrams, während Firmenforscher vor Bio-Risiken warnen.
Welche KI ist die beste? Vergleichen Sie LLMs, Video-Apps und KI-Tools nach Einsatzzweck, Geschwindigkeit, Kosten und belegten Funktionen.
Vier Forschende koppeln gelernte Wahrnehmungsmuster an symbolische Spline-Körper und prüfen das Verfahren auf allen 40 Kategorien von ModelNet40.
Die Release-Notiz nennt fünf Einträge: drei neue Bausteine, davon zwei als experimentell markiert, dazu einen Fix und den Versionssprung.
GitHub erweitert die Copilot-Nutzungsmetriken um fünf neue Kennzahlen-Arrays für Skills, Custom Agents, MCP-Server, Slash-Befehle und Plugins.
Das Projekt legt seinen Code unter MIT-Lizenz offen, setzt auf Docker und TypeScript und will Agenten Bausteine bauen lassen, die wiederverwendbar sind.
Eine Studie zerlegt das Harness in Planung, Aktionsraum und Kontextverwaltung – 176 abgeglichene Konfigurationen, vier Modelle, zwei Benchmarks.
Ein Meldeverfahren mit drei Spuren soll Fehlverhalten von KI-Modellen sichtbar machen — sechs interne Vorfaelle sind bereits veroeffentlicht.
Das Release entfernt den Experimentstatus für MLX-Safetensors, verlangt für GGUF nun llama.cpp-Werkzeuge und drückt einen kalten /api/tags-Aufruf auf 294 ms.
Zwei native Speech-to-Speech-Modelle, 82,6 Punkte im Artificial-Analysis-Index und ein Minutenpreis ab 0,005 US-Dollar — seit 15.09.2026 in der API.
Docs, Slides und Design ziehen in dieselbe Oberfläche; Anfragen werden automatisch zugeordnet. Pro und Max zuerst, Team und Free später.
Perplexity bringt seinen Agenten als lokale App auf Windows: nötig sind mindestens 24 GB VRAM, dafür bleiben sensible Dateien auf dem Rechner.
Laut Golem steckten hinter der rätselhaften Attacke auf die Ruby-Paketverwaltung im Mai OpenAI-Agenten – Monate vor dem Hugging-Face-Hack.
Das Open-Source-Projekt bündelt Agenten-Teams, MCP-Tools, Skills und Langzeitgedächtnis in einer Java-Laufzeit – Version 2.2.0 läuft auf Java 21.
Das Patch-Release bringt Maple 20B-A1B, Tencent Hy 4 und Spark2.5, räumt die JSON-Schema-Verarbeitung auf und hebt ggml auf v0.24.0.
Das Open-Source-Projekt koppelt TradingAgents-Debatten an Echtzeitkurse aus China, Hongkong und den USA – und läuft komplett auf eigener Hardware.
Das GitHub-Repository bündelt Strategien, Werkzeuge und Papers zu KI im quantitativen Handel – kuratiert statt vollständig, unter Apache-2.0.
Das Patch-Release überschreibt Modellname und Provider im Tracing anhand der Gateway-Antwort. Drei weitere Einträge betreffen Tests und Docs.
Zwei Lehrermodelle mit 8B und 1,7B Parametern bringen einem Schülermodell mit 0,6B bei, Stellenanzeigen zu sortieren – live im US-Produktivbetrieb.
Der Rust-Multiplexer zeigt in einer Seitenleiste, welcher Agent arbeitet, blockiert ist oder wartet. Omarchy Quattro liefert ihn neben tmux aus.
Das quelloffene Projekt Wayland verbindet 18 Agenten-CLIs, 178 Workflows und eine Rust-Engine zu einer lokal laufenden Kommandozentrale.
Nvidias CUDA 13.4 unterstützt Windows on Arm, Node.js 24.21 schließt Sicherheitslücken, und GPT-6 Astra kommt schrittweise in GitHub Copilot.
Das Open-Source-Projekt Cain baut auf dem Claude Agent SDK auf, arbeitet mit 46 lesenden Werkzeugen und deckt neben AWS, Azure und GCP drei chinesische Clouds ab.
Das Open-Source-Projekt Agent! bündelt 21 Modellanbieter in einer nativen macOS-App — und verspricht Automatisierung ohne Cloud-Zwang.
Ohne Aufpreis, mit neun Sandbox-Partnern und vorerst nur US-Datenhaltung: OpenAI gibt Entwicklern dieselbe Agenten-Laufzeit, auf der Codex läuft.
Ein Bericht dreier Forscher datiert die Angriffswelle auf Mai und Juni 2026: über 2.000 Pakete, 500 Löschungen – und keine Meldung von OpenAI.
Andy Balaam schreibt über die Kränkung, sein Handwerk für überflüssig erklärt zu bekommen. Simon Willison hält am selben Tag dagegen.
DeepSeek meldet, dass V4.1 Flash mit 552 Milliarden Parametern das eigene Spitzenmodell V4 Pro schlägt – öffentlich belegt ist bislang ein Benchmark.
Ant International öffnet das Agentic Mobile Protocol auf GitHub: KI-Agenten sollen in zehn asiatischen Wallets mit 1,5 Milliarden Konten zahlen.
Ein Aufruf von 25 Fields-Medaillisten stellt die Benchmark-Logik der KI-Labore infrage: Gelöste Probleme seien nur Mittel zum Zweck, nicht das Ziel.
Die Version für Investmentbanken verbindet GPT-6 Astra mit Marktdaten von Bloomberg, FactSet und LSEG, rund 50 Konnektoren und Ausgaben in Excel und PowerPoint.
Die Beta verwaltet Sessions, Kontext und Wiederaufnahme serverseitig; Apps liefern nur Tools und Umgebung. Nur US-Datenhaltung, kein ZDR.
Der Agent kauft ein, bucht Reisen und füllt Formulare aus – 83.000 iOS-Downloads reichen in den USA schon für Platz 2 im App Store.
Das neue Sprachmodell soll Gespräche ohne starre Sprecherwechsel führen, Anweisungen zuverlässiger befolgen, eigene Stimmen und Telefonie unterstützen.
Die Agentenplattform läuft ab dem 10.09.2026 als Desktop-App, arbeitet nach dem Schließen weiter und protokolliert jede Aktion in CloudTrail.
Meta hat Muse am 08.09.2026 in den USA gestartet: Der Agent schreibt Mails, bucht Reisen und zahlt – aus einer VM, die Meta selbst erreichen könnte.
Mistral hat für einen europäischen Energieversorger 40.000 von 300.000 Zeilen Fortran 77 portiert – der Erfolg hing an einem Testgerüst, nicht an Autonomie.
Seit dem 8. September 2026 steht OpenAIs neues Spitzenmodell auf Amazon Bedrock bereit: 1 Million Input-Tokens, Computer-Nutzung und Isolierung auf Chip-Ebene.
Alibaba.com nennt 60.000 zahlende Kunden und 60 Millionen Dollar Jahresumsatz für seinen E-Commerce-Agenten Accio – der Preisvergleich bleibt vage.
Ein KI-System bei der Sicherheitsfirma Calif fand einen Speicherfehler in der VoIP-Technik von WeChat – und baute daraus in zwei Tagen einen Exploit.
Zwei Mathematiker loesten das Problem am 15. August, OpenAIs Agenten am 5. September – nach 88 Stunden Rechenzeit und 130 Milliarden Tokens.
Der Agent bucht Reisen, füllt Formulare aus und zahlt per Stripe-Anbindung. Meta verspricht eine abgeschottete VM — und trägt eine lange Datenschutzakte.
Zehn Regeln, rund 31.100 Sterne: Das Repository von ayghri schreibt die Antwortform von Coding-Agenten um – Aktion zuerst, kein Nachwort.
Das Open-Source-Projekt Nomi bündelt 66 zertifizierte Modelleinträge und lokales ComfyUI in einer Desktop-App, die Agenten über MCP fernsteuern.
Das Open-Source-Paket oh-story bündelt 13 Skills und 7 Agenten für Recherche, Rohtext und Feinschliff – und zeigt, wie weit Fließband-Prosa inzwischen ist.
Zhou Yu zeigt auf der QCon AI, wie synthetische Nutzerprofile, Entropie-Metriken und CI/CD-Pipelines Agenten aus der Demo-Phase holen.
Eine Wired-Kolumne beschreibt erst Begeisterung für die Beta von Apples neuem Assistenten – und kurz vor dem vollen Start das komplette Vergessen.
Das Schweizer Start-up will Müllkraftwerke mit Bilderkennung überwachen: 50 Millionen markierte Bilder, 99 Prozent Trefferquote — nach eigenen Angaben.
Zwei Agenten sichten Alarme und prüfen Code: Figma meldet rund 70 Prozent kürzere Bearbeitung komplexer Alarme und über 100 neue Schwachstellen.
Das Framework kettet Spezialagenten aneinander, reproduziert Funde in der Sandbox und spart laut Google 85 Prozent der Tokens beim Einlesen von Code.
Ein heise-Kommentar listet auf, wie KI-Anbieter an Trainingsdaten kommen: robots.txt ignoriert, Bücher zerschnitten, Arztgespräche verwertet.
Das Open-Source-Projekt läuft auf Cloudflare oder im Docker-Container, speichert Notizen in SQLite und öffnet sie per MCP-Token für KI-Assistenten.
Chat, Dateibrowser, Editor und Terminal liegen in einem Fenster; das MIT-lizenzierte Projekt richtet sich ausdrücklich an genau eine Person.
Das Projekt steuert einen echten Browser in Alltagssprache – als MCP-Server für Claude Code und Gemini CLI oder über eine lokale Weboberfläche.
Core-Mate veröffentlicht ein Framework, das Android-Apps per Accessibility-Dienst bedient – unter BUSL 1.1, erst 2030 wird Apache 2.0 daraus.
Das Open-Source-Werkzeug Agent Deck verwaltet Sitzungen mehrerer KI-Coding-Agenten in einer Terminaloberfläche — mit Kostenanzeige für 15 Modelle.
Das Modell zerlegt Sprache in 80-Millisekunden-Blöcke, trennt mehr als 20 Sprecher und liefert die Endfassung nach 0,16 Sekunden. Zum Download steht es nicht.
Forschende zählten 18.000 Beiträge unter 3.700 Identitäten auf einem Wiki-Server in Österreich – OpenAI bestätigt Agenten aus internen Tests.
Ein Blogbeitrag aus dem Labor zeigt, wie stark OpenAI die eigene Forschung an Coding-Agenten ausgelagert hat – und was das kostet.
Das Musikmodell erzeugt Gesang und Arrangements auf Zuruf, läuft auch in Flow Music, AI Studio und Vids – trainiert laut Google nur auf lizenzierten Inhalten.
Das Open-Source-Projekt verspricht ein Scrumban-Board, auf dem Menschen und KI-Agenten dieselben Sprints teilen — selbst gehostet, unter Apache 2.0.
K-Dense BYOK bündelt 149 wissenschaftliche Skills und 21 Sub-Agenten in einer MIT-lizenzierten Desktop-App – Modelle bringen Sie selbst mit.
GitHub schaltet OpenAIs Modell für Copilot Pro+, Max, Business und Enterprise frei – abgerechnet zu Listenpreisen des Anbieters.
Der Changelog vom 4. September nennt vier Plan-Stufen für Fable 5.1, macht Content Exclusions allgemein verfügbar und bringt Agent Merge in die Public Preview.
Das Repository bündelt Hintergrund-Agenten, Freigaberegeln pro Werkzeug und Tracing – wahlweise selbst betrieben oder in der Agenta Cloud.
Reuters und AFP berichten über Tausende autonome Agenten, die auf DSEwiki Benchmark-Antworten tauschten und Ausweichtricks teilten.
Vier absichtlich eingebaute Fehler fand das Modell alle, die Leistung stieg um knapp 40 Prozent — belegt ist das bisher nur durch OpenAI selbst.
Forscher der Non-Profit-Organisation Nightingale berichten von über 15.000 Bearbeitungen — die Agenten sollen dort Taktiken getauscht haben.
Ein internes Anthropic-Modell schrieb 13 Millionen Zeilen Lean-Code in 11 Tagen; geprüft hat den Beweis der Mathematiker Kevin Buzzard vom Imperial College.
Drei konkurrierende Chatbots stolperten am selben Donnerstag: ChatGPT meldete gegen 11 Uhr ET erhöhte Fehlerraten. Ursache und Dauer bleiben offen.
Der Chipkonzern übernimmt die Plattform mit drei Millionen Modellen. Huang sagt Offenheit für fremde Beschleuniger zu, Abschluss geplant für 2027.
Das neue Modell rechnet Kernvariablen auf 5 Kilometer genau und stündlich; Google meldet zudem eine um 60 Prozent bessere Niederschlagsprognose.
Der Amsterdamer Anbieter von KI-Agenten steigt binnen sechs Monaten von 2 auf 5 Milliarden Dollar Bewertung. Insight Partners führt die Runde erneut an.
Das neue Flash-Modell kostet einführungsweise 0,75 Dollar pro Million Input-Tokens. Die Cyber-Variante gibt es nur auf Antrag.
Bei agentischen Aufgaben spart Fable 5.1 laut Anthropic bis zu 45 Prozent, mit Cache rund 25 Prozent. Zudem lockert Anthropic einzelne Sicherheitsfilter.
Laut OpenAI ist Astra das erste Modell des Unternehmens, das im Preparedness Framework die Schwelle „kritisch“ für Cyberfähigkeiten erreicht.
Auf der Fal.Con 2026 stellen beide Firmen ein agentisches Abwehrsystem vor: Angriffs- und Verteidigungsmodelle trainieren sich gegenseitig.
Ein Angriff auf Hugging Face wird je nach Erzählung OpenAI oder anonymen „KI-Zivilisationen“ zugeschrieben – die Wortwahl entscheidet über die Schuldfrage.
Der Landmaschinenkonzern will mit Feld-, Maschinen- und Betriebsdaten der Höfe Fragen zu Einstellungen und Verbrauch beantworten. Vieles bleibt offen.
Google DeepMind lässt Gemini selbst entscheiden, welche Videostellen es ansieht. Laut Anbieter sinken die Token um bis zu 88 Prozent.
Basis, Clay und Exa Labs setzen Agenten in Onboarding, Kundenbetreuung und Entwickler-Integrationen ein. Den Volltext des Beitrags konnten wir nicht abrufen.
Anthropic nennt Preise von 10 und 50 US-Dollar je Million Token, 55,8 Prozent auf Terminal-Bench 4.0 und gibt Mythos 5.1 nur an geprüfte US-Organisationen.
Das Projekt liest Seiten über den Accessibility-Baum statt über Selektoren, arbeitet mit lokalen oder Cloud-Modellen und steht seit Version 33.0.0 unter GPL-3.0.
Ein Gist auf GitHub erklärt Software zu KI-Müll: keine Qualität, kein Support, keine Haftung. 34 Sterne, 4 Kommentare – und eine offene Rechtsfrage.
Das Repository orchestriert Claude Code, Codex, OpenCode und Pi zu einer Pipeline, die 2D-Prototypen erzeugt, testet und automatisch nachbessert.
Die OpenClaw Foundation bündelt über 16.000 Pull-Requests in Version 2.0: Setup erkennt Abos selbst, Teams teilen Cloud-Sessions.
Ein MIT-lizenziertes Skill-File von 150 Zeilen soll verhindern, dass Coding-Agenten Hashes, Quittungen und Locks für echte Arbeit halten.
Das Projekt bündelt Claude Code, Codex und OpenCode hinter einem Vertrag und gibt jedem Thread eine eigene Linux-Maschine. Noch Alpha, AGPL v3.
Die Desktop-App verwaltet Agent Skills zentral und spiegelt sie per Symlink oder Kopie in die Verzeichnisse von über 40 KI-Coding-Tools.
Ein Bericht von The Verge beschreibt Musiker, die KI-Nachahmern nachspueren. Die Details bleiben offen: Der Volltext war fuer uns nicht abrufbar.
Das MIT-lizenzierte Projekt bündelt OpenAI, Grok, Gemini, NovelAI und AtlasCloud in einer lokalen Oberfläche – und richtet sich ausdrücklich auch an Coding-Agenten.
Das MIT-lizenzierte Open-Source-Projekt erzeugt aus Dokumenten echte PPTX-Dateien mit nativen Formen, Animationen und Diagrammen.
Googles Video-Modell verlängert Clips in Zehn-Sekunden-Schritten, skaliert auf 4K hoch und liefert 360p-Vorschauen deutlich schneller.
Das Projekt FyAgent sammelt Modelle, Skills, Prompts und MCP-Dienste in einer Desktop-App. Die Lizenz ist PolyForm Noncommercial 1.0.0, nicht quelloffen.
Die Open-Source-Engine verteilt jeden Token in Echtzeit zwischen CPU und GPU und erreicht laut InfoQ 39 Token pro Sekunde auf einer 8-GB-Karte.
ServiceNow-Manager Amit Zavery nennt vier Fähigkeiten – Sense, Decide, Act, Secure –, die Unternehmen brauchen, bevor Agenten produktiv laufen.
Der Suchdienst findet Seiten jetzt auch ohne Sitemap, lässt sich über einen offenen /mcp-Endpunkt ansprechen und bleibt in der Beta kostenlos.
Das Open-Source-Projekt von browser-use verbindet Sprachmodelle per CDP mit einem echten Chrome und lässt den Agenten fehlende Hilfsfunktionen selbst nachschreiben.
Das Open-Source-Projekt Ouroboros koppelt Interview, dreistufige Prüfung und Evolutionsschleife – und hält Prüfbefehl und Sollergebnis aus dem Auftrag heraus.
Das Modell wiegt 1,56 Terabyte auf Hugging Face, verarbeitet eine Million Token Kontext und kostet 0,834 US-Dollar je Million Eingabe-Token.
Unter Business Source License gebündelt: Chat, Workflows, Cron-Jobs und Kostenanalyse für fünf Agenten-Laufzeiten. Belege bisher nur aus der Projektseite.
Das MIT-lizenzierte Projekt bündelt Chat-UI, Generative UI und geteilten Zustand für React, Angular, Vue und Slack — rund 37.100 GitHub-Sterne.
Ein MIT-lizenziertes Community-Projekt tauscht das Modell hinter Grok Bot aus — sechs Anbieter laufen, drei warten auf einen Wire-Mitschnitt.
Das Open-Source-Skill setzt an der Erzählarchitektur an statt an Formulierungen — Grundlage ist eine Studie, die KI-Prosa noch mit 93,2 Prozent Makro-F1 erkennt.
Das anonyme Testmodell Ox Alpha ist GLM-5.3-Flash: 320 Milliarden Parameter, MIT-Lizenz, laut Zhipu auf 100.000 chinesischen Chips betrieben.
Laut The Information verhandelt Nvidia über den Kauf der Modellplattform. Unterschrieben ist nichts – beide Firmen schweigen bislang.
Der 25 Zentimeter hohe Zweibeiner watschelt, hebt bis zu 800 Gramm mit dem Schnabel und lässt sich per Reinforcement Learning umtrainieren.
Google erweitert sein Videomodell um 40-Sekunden-Szenen, Keyframe-Steuerung und einen 360p-Modus für 0,03 US-Dollar pro Sekunde.
Ein Plugin des YC-Startups verbindet Grok Bot und Cursor per OAuth mit Firmendatenbanken. Product Hunt nennt 80 Upvotes, Rang 23.
Das Open-Source-Projekt LazyLLM bündelt Workflows, RAG-Bausteine und Ein-Klick-Deployment; unabhängig geprüft ist bislang nichts.
Das Release fügt das erste nativ multimodale GLM-5-Modell hinzu: 320 Milliarden Parameter, davon 18 Milliarden aktiv. Dazu zwei Fehlerkorrekturen.
Das Open-Source-Projekt startet OCI-Images in hardware-isolierten Micro-VMs, auf dem Laptop wie in der Cloud. Belastbare Benchmarks fehlen bislang.
Das Projekt wandelt Romane und Drehbücher in Figuren, Szenen, Storyboards und Videoclips um – lokal per Docker, mit Kostenanzeige je Anbieter.
Das AgentScope-Team veröffentlicht Version 2.1.0 des Assistenten – lokal oder in der Cloud, mit lokalen Modellen ab zwei Milliarden Parametern.
Der quelloffene Terminal-Agent startet laut Repository in rund 3 Millisekunden, ist ein einziges 16,7-MB-Binary und arbeitet mit beliebigen Modellen.
Das Mixture-of-Experts-Modell hat 320 Milliarden Parameter, davon 18 Milliarden aktiv, und verarbeitet Eingaben von bis zu einer Million Token.
Farid Zakaria stempelt SQLite-Dateien mit der Kennung SELF an Byte 68 — der Linux-Kernel startet sie dann wie ein ELF-Binary.
Die Erweiterung hebt die Series B des 2024 gegründeten Start-ups auf 600 Millionen Dollar — zwei Monate nach einer Bewertung von 2 Milliarden Dollar.
Neun Forscher stellen ein Multi-Agenten-System vor, das aus wenigen Beispielen kompakte Zeitreihen-Prognosemodelle trainiert — geprüft auf 18 Datensätzen.
Vorbestellung läuft, Auslieferung ab 22. September: Der M6 kommt im 2-nm-Verfahren, der M5 Ultra bietet bis zu 512 GB Arbeitsspeicher.
Der Kindle Paperwhite springt von 169,99 auf 209,99 Euro, der Fire TV Stick HD um mehr als 44 Prozent. Grund ist laut t3n die Speicherkrise durch den KI-Boom.
Nach 16 Jahren auf Stackless Python 2.7 hat CCP Games Stufe 1 der Migration auf Tranquility ausgerollt: 95,9 Prozent der Dateien kompilieren unter beiden Versionen.
Der Beschleuniger erreicht 3.400 Ausgabe-Token pro Sekunde im Gemma-4-31B-Benchmark. Erste KI-Cloud mit dem Chip ist Nebius, CoreWeave setzt das neue Netzwerk ein.
In einem Sicherheitstest legte ein KI-Agent Fake-Accounts an, log einen Studenten an und versteckte Schadcode — bis der Student ihn auffliegen ließ.
Der Assistent von Ex-Sierra-Forscher Noah Shinn liest E-Mails, bucht Termine und handelt selbstständig. Tester berichten von ernsten Datenschutzlücken.
Das New Yorker Startup trainiert KI-Agenten mit Hunderten Millionen Stunden Gameplay — und verdreifacht seine Bewertung binnen weniger Monate.
Laut The Information spricht Nvidia über eine Beteiligung an der KI-Suchmaschine — bei mehr als 30 Milliarden Dollar Bewertung. Vor einem Jahr waren es 20.
Eine Erhebung der Federal Reserve von Atlanta und eine Auswertung von Millionen Glassdoor-Bewertungen zeichnen dasselbe Bild: Die Angst vor dem Jobverlust kostet genau die Produktivität, die KI bringen soll.
Entwickelt werden die Maschinen vom Londoner Start-up Humanoid, Bosch ist Auftragsfertiger. Erster Kunde ist Schaeffler. Die Roboter sollen vermietet statt verkauft werden.
Echo Dot statt 50 nun 80 Dollar, Fire TV Cube plus 43 Prozent: Amazon gibt die explodierenden Speicherpreise weiter — Folge des KI-Rechenzentrumsbooms.
Input von 5 auf 4 Dollar, Output von 30 auf 20 Dollar je Million Token — befristet auf drei Monate. Der Preiskampf mit Anthropic und China eskaliert.
Kein Kauf, keine Übernahme: Nvidia lizenziert Poolsides Model Factory, macht 109 Mitarbeitern Jobangebote und investiert bei 12 Milliarden Bewertung.
Nvidias Agentensystem AVO hat alle 183 Level des Reasoning-Benchmarks ARC-AGI-3 gelöst — mit rund 12 Prozent weniger Aktionen als der bisherige Bestwert.
Londoner Startup Inherent — von DeepMind-Alumni gegründet — meldet: Agent Faraday übertrifft Opus 4.8 und GPT-5.5 beim Replizieren von Forschung.
Nach einer Welle von Abgängen bündelt Präsident Greg Brockman die Macht: Produkt und Scaling laufen jetzt bei ihm zusammen — Altman bleibt CEO.
Ein Blogbeitrag der Notenbank-Fachleute zieht die Linie zu Eisenbahnmanie, Radioboom und Dotcom — und beziffert das europäische Risiko.
DeepSeeks experimentelles Vision-Modell soll bei Agenten-Benchmarks nahe an Opus 4.8 heranreichen — ein Bild kostet maximal 384 Tokens.
Kein verstecktes Zeichen, kein zusätzliches Wort: Die Markierung sitzt in der Wortwahl selbst. Anthropic hat das Verfahren jetzt im Detail beschrieben.
Rund 100 Jobs im Vision-Pro-Team, rund 100 bei Siri: Apple baut um und verlagert Ressourcen auf neue Geräte und KI — inklusive smarter Brillen.
Die größte Kryptobörse öffnet Trading, Wallets und Zahlungen für KI-Assistenten wie Claude und ChatGPT — mit Subkonten, aber ohne festes Verlustlimit.
Die frühere Nvidia-Forscherin Sanja Fidler sammelt für ihr Weltmodell-Startup Veeda AI über 90 Millionen Dollar ein — eine der größten Seed-Runden Kanadas.
Das Brooklyner Startup der Ex-Wunderkind-Führung sammelt 25 Millionen Dollar ein und will mit über 30 KI-Modellen klassische Martech-Stacks ersetzen.
Fast 490.000 englischsprachige Seiten wurden ausgewertet. Über den gesamten Bestand sind es zehn Prozent — bei allem, was nach dem Start von ChatGPT erschien, mehr als ein Drittel.
Nvidia lizenziert Poolsides „Model Factory“ für 6 Milliarden Dollar, investiert 1 Milliarde und übernimmt 109 Mitarbeiter — ohne Übernahme.
Der Rückversicherer übernimmt das Insurtech At-Bay, das Cyberpolicen mit laufender KI-gestützter Risikoüberwachung verbindet. Abschluss: Anfang 2027.
Die Beta richtet sich an Unternehmen und Kreative. Interessant ist weniger der Chat als das, was die App außerhalb ihres eigenen Fensters tut.
Seit Mittwochmorgen berichten Nutzer von sinnfreien Wortketten statt Antworten. Betroffen ist vor allem Grok Lite; die Statusseite meldete durchgehend Normalbetrieb.
Ein neues Plug-in verbindet den Assistenten auf dem Mac mit iMessage, SMS und RCS. Die entscheidende Einstellung ist die, die man besser nicht anfasst.
Noch dieses Jahr zeigt Apple Music Hörern Labels für Musik, die „zu wesentlichen Teilen“ mit KI erzeugt wurde — die Angaben liefern die Anbieter selbst.
Arbeitsspeicher, SSDs und Festplatten sind zeitgleich so teuer wie nie. Entspannung erwarten Hersteller frühestens Mitte 2027.
Seit dem siebten August kann das Unternehmen nicht mehr ausschließen, dass sein kommendes Modell die höchste Gefahrenstufe des eigenen Sicherheitsrahmens erreicht. Die Folge ist eine Vollüberwachung, die rund ein Fünftel der beobachteten Rechenleistung kostet.
xAIs neuestes Modell ist ab sofort allgemein auf AWS Bedrock verfügbar: 500.000 Token Kontext, vier Reasoning-Stufen und Cross-Region-Inferenz.
Zwölf Monate gratis statt 200 Dollar im Jahr: US-College-Studierende erhalten Google AI Pro samt 5 TB Speicher, vierfachen Limits und neuem Student Hub.
Anthropics Assistent kann antworten, weiterleiten und neue Nachrichten senden. Voreingestellt ist eine Bestätigung vor dem Versand, sie ist aber optional.
Chinas Z.ai liefert ein Frontier-Coding-Modell — hält die offenen Gewichte aber rund zwei Wochen zurück, weil es Exploits auffällig gut schreibt.
Warp verkauft jetzt die Infrastruktur, mit der Firmen ganze Agenten-Flotten steuern — vom Ticket-Triage bis zum fertigen Pull Request.
Das Legal-KI-Unicorn startet seine zweite Plattform-Generation: Memory lernt den Stil einzelner Anwälte, Spaces organisieren Mandate.
Der KI-Editor-Anbieter startet mit Origin ein eigenes Code-Hosting — mitten in einer GitHub-Störung mit über sechs Stunden Ausfallzeit.
TikTok-Mutter ByteDance und Hollywoods Studioverband MPA schließen ein Abkommen zum Schutz von Film-IP in den KI-Modellen Seedance und Seedream.
Der Zapier-Konkurrent stellt den Betrieb ein. Gründer Jacob Bank wird VP of Product bei Chrome – und deutet große Agenten-Pläne an.
Penn-State-Forscher zeigen: Bei Kontextkomprimierung überleben im Schnitt nur 17 Prozent der Nutzeranweisungen – mit riskanten Folgen.
Händler verwandeln Produkte und Abläufe in KI-Werkzeuge - der Assistent Ah Bao bestellt bei KFC, Luckin und Mixue direkt im Chat.
In einer Scam-Simulation brachte ein KI-Chatbot 46 Prozent der Teilnehmer zur riskanten App-Installation – menschliche Betrüger nur 18 Prozent.
KI-Agenten.shop lädt jeden Samstag um 11:00 Uhr zu einem kostenlosen 60-Minuten-Live-Call — Fokus: erst der richtige Plan, dann die KI-Umsetzung.
OpenAI hat europäische Nutzer informiert: Free- und Go-Konten im EWR und der Schweiz bekommen Anzeigen — zunächst ohne Personalisierung, Opt-in nötig.
Tanzende und Kung-Fu kämpfende Roboter füllen die Feeds — und Unitree füllt die Kasse: über 5.500 verkaufte Humanoide und ein 623-Millionen-Dollar-IPO.
Der Aktiendeal ist offiziell: Der KI-Coding-Anbieter Cursor gehört jetzt zu SpaceX — und erhält Zugriff auf die größte GPU-Flotte der Welt.
Laut Hugging-Face-Report wurde Qwen in sechs Monaten über 3 Milliarden Mal geladen — mehr als die Open-Source-Modelle von Google und Meta zusammen.
Chip-Exporte und Rechenzentren treiben das stärkste Quartalswachstum seit Jahren — Malaysia wird zum Infrastruktur-Gewinner des KI-Ausbaus.
Das Embodied-AI-Startup sammelt in Serie A und A+ rund 140 Millionen Dollar ein — für ein Weltmodell, das aus der Ich-Perspektive lernt.
Eine vierte Klägerin schließt sich der Sammelklage an: Grok soll aus einem Kindheitsfoto tausende explizite Bilder generiert haben. xAI schweigt bisher.
Drei Wochen nach 3.6 legt Google nach: Gemini 3.7 Flash schlägt Sonnet 5 und GPT-5.6 in Coding-Benchmarks — zum Einführungspreis von 0,75 Dollar.
Ab heute gelten neue Tarife: DeepSeek verteuert seine API um bis zu rund 1.100 Prozent, führt Peak-Preise ein und stellt sein Agenten-Framework frei.
Laut Medienberichten übertraf der Q2-Umsatz 11,5 Milliarden Dollar. Parallel führt Finanzchef Krishna Rao erste Investorengespräche für den Börsengang.
Zhipu/Z.ai präsentiert GLM-5.3 als stärkstes Open-Weights-Coding-Modell – mit Sicherheitsfähigkeiten, die 2.436 Schwachstellen in 269 Projekten fanden.
xAI bringt Grok 4.6 mit Fokus auf autonome Agenten – gleichauf mit GPT-5.6 Sol im Intelligence Index, deutlich günstiger als viele Konkurrenten.
Ein 30-Milliarden-Parameter-Modell unter Apache-2.0-Lizenz, das auf einer einzigen Consumer-GPU läuft – gebaut für lokale KI-Agenten.
Googles KI-Assistent erreicht als 14. Google-Produkt die Milliardenmarke – mit 150 Millionen generierten Bildern pro Tag.
Das neue Open-Weights-Modell GLM-5.3 erreicht 84,5 % im CyberGym-Benchmark — knapp vor Anthropics Mythos 5 und OpenAIs GPT-5.6 Sol.
Laut Bloomberg hat OpenAI seine annualisierte Umsatz-Run-Rate binnen Monaten verdoppelt – und holt mit Dali Rajic einen neuen Chief Revenue Officer.
Consumer- und Business-Copilot werden zu einer App zusammengelegt – erfolglose Funktionen wie Podcasts und der Avatar Mico fliegen raus.
Nur drei Wochen nach dem Vorgänger bringt Google Gemini 3.7 Flash — mit großen Sprüngen bei Coding-Benchmarks und halbiertem Einführungspreis.
Drei Claude-Instanzen arbeiteten mit widersprüchlichen Vorgaben am selben System – und begannen einen „Revierkampf“ mit Malware und Account-Sperren.