Zurück zur Übersicht
Der neue Forschungsbenchmark prüft agentische KI in komplexen, mehrstufigen Analyse- und Entscheidungsaufgaben der Genomik und Medizin. OpenAIs bestes Modell erreicht auf dem höchsten Reasoning-Level nur 28,7 Prozent und bleibt damit deutlich hinter menschlichen Expert:innen zurück.
OpenAI hat am 2026-06-30 GeneBench-Pro vorgestellt. Der Benchmark umfasst 129 Probleme in zehn Domänen, darunter statistische Genetik, Populationsgenetik, funktionelle Genomik und klinische Diagnostik, und stellt Agenten realistische Datensätze, Fallbeschreibungen und eine Standard-Bioinformatik-Toolchain zur Verfügung.
Auf dem höchsten Reasoning-Level erzielt OpenAIs Modell GPT-5.6 Sol eine Bestehensrate von 28,7 Prozent; im Pro-Modus 31,5 Prozent. OpenAI bezeichnet das als Fortschritt, betont aber zugleich, dass Systeme weiterhin zu unzuverlässig sind, um menschliche Expert:innen zu ersetzen. Gutachter schätzten, ein menschlicher Experte benötige für ein Problem 20 bis 40 Stunden.
OpenAI weist darauf hin, dass partielle Automatisierung trotz der derzeitigen Kosten wirtschaftlichen und wissenschaftlichen Wert schaffen könne. GeneBench-Pro soll die Forschung und Entwicklung vergleichbarer agentischer Systeme in der Genomik standardisieren.
Weiterlesen
Microsoft will Unternehmen stärker an die eigene KI-Plattform binden und zugleich den Wechsel zwischen verschiedenen Modellanbietern erleichtern. Der Konzern setzt dabei auf eigene Modelle, Agenten, Sicherheitswerkzeuge und Chips.
Eine Analyse von mehr als 800.000 arbeitsbezogenen Nachrichten zeigt, dass Beschäftigte ChatGPT häufig für Aufgaben außerhalb ihres eigenen Berufsbilds nutzen. Die Untersuchung deutet auf eine Verschiebung zwischen spezialisierten und generalistischen Rollen hin, misst jedoch weder Produktivitäts- noch Beschäftigungseffekte.
Nach einem Sicherheitsvorfall bei einer OpenAI-Modellprüfung verlangt Clem Delangue mehr Transparenz und Rechenleistung für die Entwicklung von Abwehrsystemen. Der Fall zeigt, dass nicht nur Modelle selbst, sondern auch ihre Testumgebungen zum Angriffsziel werden können.
Die neue Funktion verknüpft ChatGPT mit persönlichen Gesundheitsdaten aus Apple Health und unterstützten medizinischen Datensätzen. Der Dienst soll medizinische Versorgung unterstützen, aber keine Diagnose oder Behandlung ersetzen.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.