Amtro untersucht KI als Berater

Welche KI Sie wählen, kann die Empfehlung umkehren.

Zweite Welle: zehn Flagship-Modelle, 36 Entscheidungsszenarien, Englisch und Deutsch. In 11 Szenarien stehen Modelle mit stabilen Gegenpositionen. Die Juli-Basiserhebung mit 18 Szenarien bleibt veröffentlicht.

Gleicher Fall · anderer Rat Mehrheit aus sechs Läufen je Modell. Release 3.0.0.
Forschung

Studien darüber, wie KI-Modelle urteilen, empfehlen und voneinander abweichen.

Hauptstudie August 2026 · Version 3.0.0

Welche KI Sie fragen, kann die Entscheidung umkehren.

Verändert die Wahl des KI-Modells geschäftliche und öffentliche Empfehlungen — auch über Sprachen hinweg?

In 11 von 36 Szenarien fanden wir stabile Gegenpositionen. Der Dissens ist fallbezogen reproduzierbar: Von Juli auf August bleiben Modelle in 33 von 40 vergleichbaren Konfliktzellen auf derselben Seite. Die Juli-Basiserhebung bleibt separat verfügbar.

Panel: 10 Flagship-Modelle, 36 Szenarien, EN+DE, 4.320 Entscheidungen. Protokoll eingefroren am 26.07.2026.

10Modelle
36Szenarien
4.320Entscheidungen
August-Welle öffnen
Anker, öffentliche Hand und Wirtschaftskomplement. Die Juli-Welle mit 18 Szenarien bleibt veröffentlicht.

Basiserhebung Juli 2026 · Version 1.1.0

Die Wahl des KI‑Modells beeinflusst die Entscheidung.

Erste Welle: In sechs von 18 Unternehmensszenarien vertraten führende Modelle stabile Gegenpositionen. 10 Modelle, 1.080 gespeicherte Entscheidungen.

Panel: 10 Modelle, 18 Szenarien, 6 Läufe je Modellbedingung. Instrument und Protokoll vor der Erhebung eingefroren.

Juli-Basiserhebung ansehen

Methodenreihe Vorläufige Baseline · Juli 2026

Dasselbe Modell, anderes Weltbild?

Sieben von acht Modellen wechselten zwischen zwei politischen Messinstrumenten den ökonomischen Quadranten. Ein einzelner Kompasswert ist keine stabile Eigenschaft eines Modells.

Status: vorläufige Baseline. Acht auswertbare Modelle, drei Instrumente.

Baseline ansehen
Dual-Panel: Political Compass und WVS-Batterie für acht Modelle
Produkte

Software im Alltag. Hosting benannt.

Zeittel Im Feld

Zeiterfassung, die niemand erklären muss.

Eine Stempeluhr für kleine und mittlere Betriebe. Kommen und Gehen in Sekunden, per PIN auf Tablet, Handy oder PC.

Mehr zu Zeittel

Echte Produktansicht

Zeittel Stempeluhr mit Mitarbeiterauswahl
Kiosk-Ansicht: Mitarbeiter wählen, einstempeln.
Zeittel App-Ansicht mit erfassten Arbeitszeiten
Erfasste Zeiten auf dem Telefon.
01Auf vorhandenen Geräten

Kiosk auf Tablet, Handy oder PC.

02Ein klares Angebot

Fertiges Produkt für den Betrieb, mit festem Funktionsumfang.

03Daten in Deutschland

Hosting im Rechenzentrum in Nürnberg.

Womit arbeiten wir selbst?

Für den eigenen Betrieb haben wir drei Werkzeuge gebaut. In Cortex liegt jede Aussage mit Quelle und Zeitpunkt. Widersprüche bleiben stehen, bis ein Mensch entscheidet. Neue Erkenntnisse lösen alte ab, statt sie zu löschen.

Intake nimmt Text, Sprachnotizen und Dateien entgegen, normalisiert sie und übergibt sie an Cortex. Ausgeführt wird nichts davon. In der Workbench erscheint jede Änderung als Diff, mit Budgets und Pfadgrenzen. Freigegeben wird erst, wenn ein Mensch zustimmt.

Cortex

Belege und Gegenpositionen in einem Gedächtnis.

Cortex: Aussage mit Beleg, offenem Widerspruch und Ablösungshistorie
Aussage mit Beleg und offenem Widerspruch

Intake

Eingang als strukturierte Signale.

Intake: Signale werden normalisiert und an Cortex übergeben
Signale normalisiert, an Cortex übergeben

Workbench

Änderungen als Diff, Freigabe beim Menschen.

Workbench: Lauf-Protokoll mit Diff und Freigabepunkt
Diff und Freigabepunkt im Lauf-Protokoll

Wie gehen wir vor?

Am Anfang stehen bei uns Scope und Spezifikation. Bevor wir Software schreiben, klären wir, was erreicht werden soll. Wir führen Interviews, dokumentieren und werten sie aus und fassen das Ergebnis in einem Scope-Dokument zusammen: grob, was die Software tun soll. Daraus entstehen einzelne Spezifikationen. Die Umsetzung läuft in User Stories und Sprints. Ein Sprint ist erst abgeschlossen, wenn die zuvor festgelegten Akzeptanzkriterien erreicht sind. Zu diesen Kriterien gehört immer ein automatisierter Test. Wird dieselbe Funktion später wieder angefasst, prüft der Build, ob sie noch funktioniert. Auch bei vergleichsweise einfachen Produkten laufen deshalb bereits hunderte automatisierte Tests bei jedem Build.

Wir arbeiten mit einer mehrstufigen Entwicklungslandschaft: Entwicklungs-, Test- und Produktivsystem. Systeme und Daten schützen wir vor Fremdzugriff. Daten werden bei der Übertragung und bei der Speicherung verschlüsselt. Die Software betreiben wir ausschließlich in Deutschland.

In der Forschung achten wir auf Transparenz und Nachvollziehbarkeit und halten etablierte akademische Standards ein.

Unternehmen

Amtro UG, Berlin.

Amtro hat Zeittel entwickelt, eine Zeiterfassung für kleine und mittlere Betriebe. Zeittel ist fertig und wird ausschließlich in Deutschland betrieben, nur auf Rechenzentren in Deutschland.

Für den eigenen Betrieb laufen Cortex, Intake und Workbench: Cortex hält Aussagen mit Quelle und lässt Widersprüche stehen, bis ein Mensch entscheidet; Intake nimmt Text, Sprache und Dateien als strukturierte Signale auf; Workbench zeigt Änderungen als Diff und gibt erst nach menschlicher Freigabe frei.

Daneben forschen wir an Softwareentwicklung und KI-Modellen. Zu den Studien

Sitz
Berlin
Gegründet
7. April 2026
Geschäftsführer
Ugur Aydin
Rechtsform
UG (haftungsbeschränkt)

Kontakt

Schreiben Sie uns zu Produkt, Studie oder einer konkreten Frage.

Für Zeittel, Forschungshinweise oder Presse. Wir antworten von unserem Server in Deutschland.

Ihre Angaben gehen direkt an unseren Server in Deutschland und per Mail an info@amtro.de. Wir nutzen sie nur zur Beantwortung Ihrer Anfrage. Datenschutz