Ein Nutzer hat unseren Assistenten in seiner Muttersprache gebeten, eine vorhandene Notiz in eine Aufgabe umzuwandeln. Die Antwort war vage, klang aber nach erledigt. Umgewandelt wurde nichts. In der Liste lag stattdessen eine nagelneue, leere Aufgabe: ohne den Text der Notiz, ohne die Dateien, die daran hingen. Die Notiz blieb eine Notiz.
So scheitert ein Assistent am unangenehmsten. Nicht mit einer Fehlermeldung, sondern mit einem Ja.
Kurz gesagt: Der Assistent erkennt in sechs Sprachen, dass du etwas umwandeln willst, sucht den Datensatz, den du meinst, und zeigt ihn dir, bevor sich irgendetwas ändert. Von allein wandelt er nichts um. Mit einem einzigen Tippen bestätigst du nur da, wo nichts weiter fehlt – bei einer Aufgabe und bei einer Notiz. Für eine wiederkehrende Aufgabe oder eine Unteraufgabe folgt ein kurzer Dialog, denn eine Wiederholung braucht einen Zyklus und eine Unteraufgabe eine übergeordnete Aufgabe. Vor deinem Tippen ändert sich nichts.
Am Prompt lag es nicht
Mein erster Reflex war, am Prompt zu schrauben. Die Diagnose war falsch, und hätte ich danach gehandelt, wäre die Sache schlimmer geworden.
Dem Assistenten fehlte schlicht das Werkzeug, um vorhandene Datensätze umzuwandeln. Fehlt die passende Fähigkeit, greift ein Modell zur nächstbesten, die da ist – und die hieß hier „Aufgabe anlegen". Also legte es eine Aufgabe an. Auch die schwammige Antwort war kein Zufall. Sie sollte die Lücke überspielen.
Ein besserer Prompt hätte diese Lücke nicht geschlossen. Er hätte die falschen Antworten nur überzeugender klingen lassen.
Was der Assistent tut, bevor er etwas anfasst
Wir haben ihm die fehlende Fähigkeit gegeben und sie kurz vor dem Punkt gestoppt, an dem sich wirklich etwas ändert.
Zuerst muss er überhaupt merken, dass du umwandeln willst. Er erkennt die üblichen Formulierungen in allen sechs Sprachen, die das Produkt spricht: Englisch (convert, turn into, make it a), Türkisch (çevir, dönüştür), Deutsch (umwandeln), Französisch (convertir), Spanisch (convertir), Russisch (преобразуй). Das gilt nur für Datensätze, die es schon gibt. Beschreibst du etwas Neues, landest du auf dem normalen Weg zum Anlegen – so soll es sein, das ist kein Notbehelf.
Dann sucht er. In deinen Aufgaben, Notizen und wiederkehrenden Aufgaben, nach dem, was du beschrieben hast. Du kannst dich auch einfach auf das beziehen, worüber du gerade mit ihm gesprochen hast, statt es noch einmal zu benennen.
Und dann hört er auf. Genau hier liegt der Unterschied: Er wandelt nicht selbst um. Er zeigt dir, was er gefunden hat, und wartet.
Was du dabei siehst, hängt davon ab, wie viele Treffer es gibt:
- Kein Treffer. Ein schlichtes „nicht gefunden". Und wenn du nur auf etwas zeigst („mach das zu einer Aufgabe") und sich der Bezug nicht klären lässt, fragt er nach, welcher Datensatz gemeint war, statt zu raten.
- Genau ein Treffer. Hast du gesagt, was daraus werden soll, und braucht dieses Ergebnis keine weitere Angabe, siehst du den Titel des Datensatzes und eine einzige Schaltfläche zum Bestätigen. Einmal tippen, fertig.
- Mehrere Treffer. Du bekommst die Liste und wählst aus. Er entscheidet das nicht für dich, und er wandelt auch nicht einfach alle um.
Zwei Umwandlungen brauchen einen Schritt mehr
Einmal tippen reicht nur da, wo nichts fehlt: bei einer Aufgabe und bei einer Notiz.
Eine wiederkehrende Aufgabe braucht einen Zyklus. Täglich, wöchentlich und monatlich sind drei verschiedene Ergebnisse, und aus der Anfrage geht selten hervor, welches gemeint ist. Eine Unteraufgabe wiederum braucht eine übergeordnete Aufgabe, unter der sie hängt. In beiden Fällen fehlt dem Assistenten tatsächlich etwas. Also fragt er in einem kurzen Dialog danach, statt es sich auszudenken.
Dahinter steckt dasselbe Prinzip wie hinter der Bestätigung. Rät er auf wöchentlich, wo du täglich gemeint hast, hat er dir keinen Handgriff gespart. Er hat dir Arbeit eingebrockt, die du erst bemerken und dann zurückdrehen musst.
Zwei Oberflächen, ein Verhalten
Wortlaut und Schaltflächen sind für jede Oberfläche eigens gebaut; ein Telegram-Thread ist nun mal kein Chatfenster im Browser. Darunter aber arbeiten Web-Chat und Telegram-Bot mit derselben Trefferlogik. Welche Datensätze als Treffer gelten, wie viele Kandidaten übrig bleiben, welche Umwandlungen einen Schritt mehr brauchen: darüber entscheidet gemeinsamer Code, nicht eine zweite, eigens für den Kanal gebaute Umsetzung.
Das ist wichtiger, als es klingt. Verhalten, das auseinanderläuft, merkt lange niemand – bis es einem auf die Füße fällt. Eine Umwandlung, die im Browser sauber durchläuft und in Telegram still danebengreift, ist genau die Sorte Fehler, nach der man einem Assistenten nichts mehr glaubt. Und sie zeigt sich meistens erst im echten Betrieb.
Warum wir lieber fragen
Sofort loslegen sieht in der Demo schneller aus. Im Alltag, mit echten Notizen und echten Anhängen, kostet ein falscher Alleingang deutlich mehr als ein zusätzlicher Fingertipp. Eine falsch umgewandelte Notiz schiebt deinen Inhalt an eine Stelle, die du nicht erwartet hast, und hinterher darfst du rekonstruieren, was da eigentlich passiert ist.
Also fragt der Assistent. Ein Tippen mehr auf eine Bestätigung, die du vorher in Ruhe lesen kannst. Dafür musst du dich nie fragen, ob er wirklich getan hat, was er behauptet.
Vyneron ist zum Start kostenlos, und der Assistent verhält sich in der App genauso wie in Telegram.