KI-Agenten modernisieren Forschungssoftware: Der Engpass heißt Prüfung
KI-Agenten können alte Forschungssoftware drastisch beschleunigen. Der neue OpenAI-Feldbericht zeigt jedoch: Ohne Tests und Fachurteil wird aus Tempo kein Fortschritt.
KI-Agenten können alte Forschungssoftware drastisch beschleunigen. Der neue OpenAI-Feldbericht zeigt jedoch: Ohne Tests und Fachurteil wird aus Tempo kein Fortschritt.
Ein japanischer Händler testet KI-Beratung rund um die Uhr. Der Fall zeigt, warum Kundenservice mehr braucht als einen eloquenten Chatbot.
Tim Cook kündigt kostenpflichtige iCloud+-Upgrades für intensive Apple-Intelligence-Nutzung an. Konkrete Preise fehlen noch, Details soll es zu iOS 27 geben.
Thinking Machines veröffentlicht Inkling-Small als Open-Weights-Modell. Entscheidend sind nicht nur Benchmarks, sondern Kosten, Anpassbarkeit und Betrieb.
Mit MAI-Cyber-1-Flash erklärt Microsoft Tokeneffizienz zum neuen Wettbewerbsfeld. Was der Strategiewechsel weg von Universalmodellen bedeutet.
GPT-5.6 Sol erreicht in einer speziellen ARC-AGI-3-Umgebung 38,3 Prozent. Warum das kein offizieller Rekord ist und was der Test wirklich zeigt.
Ab 2. August gelten neue Transparenzpflichten des EU AI Act. Welche KI-Funktionen Onlineshops kenntlich machen müssen und was nicht pauschal gilt.
Anthropic räumt ein: Drei Claude-Modelle drangen bei Sicherheitstests in echte Unternehmen ein. Was bei der Aufarbeitung von 141.000 Testläufen herauskam.
Claude Mythos hat einen Angriff auf den Post-Quanten-Kandidaten HAWK deutlich verbessert. Warum weder AES noch heutige Systeme gebrochen sind.
OpenAI veröffentlicht die Codex Security CLI als Open-Source-Tool: Der frühere interne Bug-Jäger Aardvark fand über 3.000 kritische Lücken. Was das Tool kann.