Aktuelle Nachrichten
BVerwG 2 C 12.25 - Urteil
BVerwG 2 WD 14.26 - Beschluss
BVerwG 2 WDB 11.25 - Beschluss - Unzureichende Begründung eines Durchsuchungsbeschlusses
BVerwG 2 WDB 12.25 - Beschluss - Beschlagnahme von Zufallsfunden bei rechtswidriger Durchsuchung
BVerwG 3 B 15.26 - Beschluss
BVerwG 9 A 15.26 - Gerichtsbescheid
Kein Schmerzensgeld für Wiesn-Besucher
Schulungszentren innerhalb der AfD
Regierung verteidigt Ganztagsanspruch an Grundschulen
"Partnerschaften für Demokratie" in Rheinland-Pfalz
AfD thematisiert Effekte der neuen E-Auto-Förderung
AfD fragt nach Umgang mit Problemimmobilien
Unerlaubte Einreisen im ersten Halbjahr 2026
Deutschland weist Genozid-Vorwurf zurück
OLG Rostock zu Kreuzfahrt-Reisebedingungen: Umbuchen und Stornogebühr verlangen können geht zu weit
Stornogebühr, Umbuchung und Quarantänekosten: Mehrere Klauseln in den Bedingungen eines Kreuzfahrt-Reiseveranstalters halten der rechtlichen Prüfung durch das OLG Rostock nicht stand.
- Bundespräsident Steinmeier kondoliert zum Tod von Michael Mendl
Deutsche Bank einigt sich mit Ex-Banker auf Vergleich
Anwalt erhält zweite Chance
15 Millionen Euro für ein fehlendes KI-Label?
Neues KI Modell GPT 6 Astra zeigt Fortschritte bei komplexen Aufgaben in Recht und Finanzen
OpenAIs neues KI Modell GPT 6 Astra soll komplexe professionelle Aufgaben zuverlässiger von Anfang bis Ende bearbeiten können. Erste Tests der Legal AI Anbieter Harvey und Legora zeigen Fortschritte insbesondere bei der Verarbeitung umfangreicher Dokumentenmengen und bei Aufgaben, die mehrere aufeinanderfolgende Arbeitsschritte erfordern. Vollständig ohne menschliche Kontrolle kommt die Technologie jedoch weiterhin nicht aus.
Fortschritte bei komplexen juristischen Aufgaben
GPT 6 Astra wird seit dem 3. September zunächst eingeschränkt bereitgestellt. OpenAI positioniert das Modell insbesondere für komplexe Arbeitsabläufe in professionellen Umgebungen. Erste Ergebnisse zeigen Verbesserungen gegenüber dem Vorgängermodell GPT 5.6 Sol. Beim Benchmark „Agents’ Last Exam“, der untersucht, ob KI Agenten wirtschaftlich relevante professionelle Aufgaben vollständig bearbeiten können, erreicht GPT 6 Astra 59,3 Prozent. GPT 5.6 Sol kam auf 53,6 Prozent. Der Benchmark umfasst 55 professionelle Teilbereiche und berücksichtigt unter anderem juristische Aufgaben.
Auch der Legal AI Anbieter Harvey berichtet von Fortschritten. Niko Grupen, Head of Applied Research bei Harvey, bezeichnet Astra als deutliche Qualitätsverbesserung bei komplexen juristischen Aufgaben. In ersten Tests habe das Modell unter anderem besser zwischen vorhandenen Dokumenten und tatsächlich belegten Informationen unterschieden. Zudem erkenne es nicht belegte Annahmen und könne Informationslücken in konkrete Vorschläge für die weitere Ausarbeitung überführen.
41 Dokumente innerhalb weniger Minuten geprüft
Besonders deutlich werden die neuen Fähigkeiten in einem Test des Legal AI Anbieters Legora. Das Unternehmen setzte GPT 6 Astra für die Abstimmung von Jahresabschlüssen ein. Bei dieser Aufgabe müssen Zahlen aus Abschlussentwürfen mit Summen und Saldenlisten, Konsolidierungsübersichten und Vorjahresabschlüssen abgeglichen werden. Nach Angaben von Legora kann eine solche Prüfung normalerweise einen ganzen Abend oder sogar mehrere Tage in Anspruch nehmen. Der Agent von Legora verarbeitete mit GPT 6 Astra insgesamt 41 Dokumente in einem einzigen Durchlauf und schloss die Prüfung innerhalb weniger Minuten ab. Dabei wurden die einzelnen Salden mit den zugehörigen Unterlagen abgeglichen, Abweichungen identifiziert und sämtliche Prüfungen protokolliert. „Der Unterschied zwischen vorher und nachher liegt meiner Ansicht nach in der Verarbeitungskapazität: der Fähigkeit, so viele Dokumente aufzunehmen, wirklich komplexe Informationen zu verarbeiten und all die verschiedenen Positionen und Zahlenwerte zu erfassen“, erklärt Percevale Perks, Legal Engineer bei Legora.
Alle absichtlich eingebauten Fehler erkannt
Für den Test hatte Legora vier Fehler in den Unterlagen platziert. GPT 6 Astra erkannte alle vier, darunter eine Differenz von 500.000 britischen Pfund in einer Umsatzangabe. Gleichzeitig führte das Modell alle Prüfungen weiterhin korrekt durch, die bereits das vorherige Modell bewältigt hatte, und erledigte zusätzlich rund 50 weitere Prüfungen. Im Legora Benchmark for Agentic Reasoning, kurz BAR, verbesserte GPT 6 Astra die Leistung bei diesem speziellen Arbeitsablauf gegenüber dem vorherigen Modell um fast 40 Prozent. Betrachtet man sämtliche Aufgaben des Benchmarks, fällt der Fortschritt mit durchschnittlich etwa 3 Prozent deutlich geringer aus.
Menschen behalten die Verantwortung
Die Ergebnisse zeigen vor allem, wie KI zunehmend umfangreiche Arbeitsabläufe übernehmen kann, die bislang viel manuelle Prüfung erfordern. Statt lediglich einzelne Fragen zu beantworten oder Texte zu erstellen, können KI Agenten große Mengen an Informationen verarbeiten, mehrere Arbeitsschritte miteinander verbinden und ihre Ergebnisse für eine anschließende Kontrolle dokumentieren. Die endgültige fachliche Entscheidung bleibt jedoch beim Menschen. Legora sieht diesen Ansatz als zentral für den Einsatz der Technologie und erweitert seine Plattform neben juristischen Aufgaben auch auf Wirtschaftsprüfung, Steuern, Compliance und Risikomanagement.
Auch die Ergebnisse von „Agents’ Last Exam“ zeigen, dass vollständig autonome Arbeitsabläufe noch nicht erreicht sind. Gleichzeitig deuten die Tests darauf hin, dass KI Agenten bei komplexen professionellen Aufgaben zunehmend leistungsfähiger werden.
Der Beitrag Neues KI Modell GPT 6 Astra zeigt Fortschritte bei komplexen Aufgaben in Recht und Finanzen erschien zuerst auf .
