🤖 KI-Agenten vs. Steuerrechner, der aktuelle Praxistest

Ich wollte wieder einmal prüfen, ob die KI-Agenten sich in den letzten Monaten verbessert haben.

Dafür habe ich wieder einen für uns im Rechnungswesen realistischen Testcase genommen: Steuerrückstellung über einen kantonalen Steuerrechner berechnen, direkt im Web-Interface.

Die Aufgabe:
Berechnung der Steuerrückstellung für ein Unternehmen (Sitz Zürich, Steuerjahr 2025) mit 1,5 Mio. CHF Gewinn und 10 Mio. CHF Kapital

Das Teilnehmerfeld:
➡️ ChatGPT 5.2 (Agenten-Modus)
➡️ Claude Opus 4.6 (Chrome Extension)
➡️ Manus AI
➡️ Mein „eingesperrter“ OpenClaw Agent

Das Ergebnis? Ich bin ehrlich beeindruckt. 🤯

Früher war automatisiertes Ausfüllen von Web-Formularen oft eine Zitterpartie für die Agenten. Heute sieht das deutlich anders aus:

✅ ChatGPT, Claude und Manus AI haben die Aufgabe alle im ersten Anlauf sauber gelöst. Auch wenn sie hier und da beim Formular-Handling manchmal „geübt“ haben, war das Ergebnis präzise und zuverlässig. Die Agenten haben sich in den letzten Monaten stark verbessert. Für das Ergebnis benötigten sie jedoch schon einige Minuten.

👉 Und dann kam mein „eingesperrter“ OpenClaw-Agent ⚡

Besonders gespannt war ich auf meinen OpenClaw-Agenten.
Dem musste ich temporär erweiterte Berechtigungen einräumen; die Browser-Funktionalität mit Whitelist-Einschränkung kurz aktivieren und Zugriff auf die Webseite des Steuerrechners erteilen, damit er die Aufgabe überhaupt lösen konnte. Aber danach:

🔝 Was soll ich sagen: Der OpenClaw-Agent mit dem Modell Claude Opus 4.6 ist im Sekundentakt durch die Eingaben gerauscht, kein Zögern, kein Suchen, schnell die Felder ausgefüllt, hat sauber dokumentiert, was er gerade macht und hat mit Abstand als Schnellster innerhalb derselben Minute das korrekte Ergebnis geliefert. Ich war ehrlich gesagt wirklich baff….

🙂 Und ja: Danach habe ich ihm die Berechtigungen sofort wieder entzogen.

Picture of Roman Kalberer

Roman Kalberer

20. Februar 2026

Diesen Beitrag teilen

Nach oben scrollen