Freitagnachmittag. Meine Tochter kommt aufgeregt zu mir: Am Sonntag trifft sie sich mit ihrer Freundin, die beiden wollen Arbeitsblätter machen. Ob ich ihr welche für Mathe machen kann.
Na klar kann ich das, dachte ich. Dafür gibt es ja ChatGPT, Claude und Co. Ich fing an, und noch während die ersten Aufgaben entstanden, kam der zweite Gedanke: Warum baue ich eigentlich keine App, soll sie sich ihre Arbeitsblätter doch selber herunterladen.
Gesagt, getan. Ich habe mit Claude losgelegt und nebenher geschaut, ob ich dasselbe mit Astra in ChatGPT umgesetzt bekomme. Am Anfang war die Umsetzung in Claude viel sinnvoller, also machte ich dort weiter und baute und baute und baute.

Am Sonntagnachmittag kam meine Tochter und wollte ihre Arbeitsblätter haben. Wir haben sie tatsächlich aus der App geholt.
Nur war die App inzwischen etwas anderes als am Freitag, denn beim Bauen waren mir zig neue Ideen gekommen. Man konnte sich ein Profil anlegen, es gab eine Lesewelt mit neunzehn eigenen Geschichten und Fragen dazu, und es steckten massenhaft Arbeitsschritte drin, die ich zwei Tage vorher noch gar nicht im Kopf hatte. Ich hatte mir auch überlegt, dass wir die Eltern mitnehmen müssen, und hatte Übersetzungen in neun Sprachen eingebaut.
Bestellt hatte das niemand. Meine Tochter wollte Arbeitsblätter für Mathe.
Ausgedacht habe ich mir das allerdings nicht alles selber. Ich habe ChatGPT und Claude immer wieder losgeschickt: Welche wissenschaftlichen Untersuchungen gibt es dazu, welche pädagogischen Richtlinien, was schreiben Eltern und Lehrerinnen im Netz über ihre Erfahrungen?
Ich finde es völlig legitim, das Werkzeug auch dafür zu benutzen. Diese Modelle recherchieren in einer Geschwindigkeit, die ich immer noch kaum fassen kann, und dieses Wissen gehört in die Produktentwicklung hinein. Aus Material für Grundschullehrkräfte habe ich zum Beispiel mitgenommen, dass ein einzelner Fehler noch wenig darüber sagt, was ein Kind kann, und deshalb bietet die App nach einem Fehler ein paar kleine Gegenproben an, freiwillig und ohne Diagnose.
Die Studien selbst habe ich nicht gelesen, und ich finde das in Ordnung. Mir ging es um so etwas wie eine Anforderungsliste, um Leitplanken dafür, was eine solche App tun und was sie lassen soll. Wenn viele Untersuchungen in dieselbe Richtung weisen, kann man sich dafür auf sie verlassen, und genau dieses Zusammenlesen können die Modelle wirklich gut.
Ich habe in diesen Tagen also weniger wie ein Entwickler gedacht und mehr wie ein Product Owner: Was könnte hilfreich sein, und wer weiß darüber mehr als ich? Dazu muss man sich eingestehen, dass es zu fast jeder Frage, die einem beim Bauen kommt, schon Wissen gibt. Man muss es sich halt zusammensuchen.
Es war teuer. Ich habe an diesem Wochenende meine gesamten Tokens verbrannt und musste nachkaufen. Dafür habe ich jetzt eine App, die ich immer weiterentwickeln kann, mal mit Claude, mal mit ChatGPT, je nach Lust und Laune.
Und es ging nicht ohne Voraussetzung. Ich hatte in den Monaten davor schon zwei andere Apps auf diese Art gebaut, ich wusste, wie man ein Repository auf GitHub anlegt und wie man so ein Ding ins Netz bringt, und ich bin mit jeder App schneller geworden. Jemand, der das noch nie gemacht hat, hätte dieses Wochenende so nicht hinbekommen.
Beides stimmt also gleichzeitig. Es ist unfassbar einfach geworden, Dinge umzusetzen, und die drei Tage haben in Wahrheit Monate gedauert.
Und dann konnte ich es natürlich nicht lassen. Ich habe der Klassenlehrerin meiner Tochter geschrieben und ihr den Link geschickt.
Sie hat die App ausprobiert, fand sie gut und fand sofort einen Fehler. Bei der schriftlichen Multiplikation, 35 · 5, stand das Ergebnis falsch da. 175 war richtig gerechnet, aber die 5 von 175 stand nicht unter der 5 von 35, die Einerstelle war verrutscht.
Ein Rechenfehler war das nicht, nur die Darstellung stimmte nicht. Aber genau darum geht es beim schriftlichen Rechnen: Einer unter Einer, Zehner unter Zehner. Ein Kind, das mit einem verrutschten Raster übt, übt das Falsche, auch wenn unten die richtige Zahl steht.
Ich hätte das nie gesehen, und alle Recherche hatte es mir auch nicht gezeigt. Ich kann nicht auf die Schnelle zigtausend Rechnungen durchschauen, und wenn ich es könnte, würde ich auf die Ergebnisse schauen und nicht auf die Spalten. Sie hat eine einzige Aufgabe gebraucht, weil sie seit Jahren Kindern dabei zusieht, wie sie genau dort stolpern.
Geärgert hat mich das nicht, im Gegenteil. Wer lange genug in der agilen Welt gearbeitet hat, hat irgendwann gelernt, das eigene Ego beim Entwickeln wegzulassen. User Feedback, wir bauen es ein.
Nur war „wir“ diesmal ein seltsames Team: ich und zwei Sprachmodelle. Ich habe ihnen den Hinweis der Lehrerin hingelegt und gesagt, sie sollen sich gleich alle Rechenarten ansehen, nicht nur diese eine. Am Sonntagabend um 18:39 Uhr war die korrigierte Fassung online.
Dabei kam noch mehr heraus. Zahlenreihen, die rückwärts laufen sollten, liefen an einer Stelle vorwärts, und bei der schriftlichen Addition stand ein Ergebnisfeld in der Spalte mit dem Pluszeichen. Das hatte ich auch nicht gesehen, die Lehrerin auch nicht, aber ohne ihre eine Ziffer hätte niemand gesucht.
Von derselben Lehrerin kam bald darauf die nächste Idee, und die war schlicht genial: Warum nehmen wir nicht die Texte, die die Kinder selber schreiben, und laden sie hoch, damit andere Kinder sie lesen können? Auch das wurde umgesetzt. Heute können Kinder mit Hilfe eines Erwachsenen ihre Geschichten einreichen, als Foto, PDF oder Textdatei, und sie tauchen in der App wieder als Lesestoff auf.
Kind und Erwachsener bestätigen dabei, dass die Geschichte wirklich vom Kind stammt, sie erscheint unter einem erfundenen Schreibnamen, und zurückziehen lässt sie sich auch wieder. Bevor ein Text für andere sichtbar wird, liest ihn ein Mensch und gibt ihn frei. Wenn ein Kind die App lieber aufmacht, weil dort die eigene Geschichte steht oder die der Klassenkameradin, dann haben wir doch etwas erreicht, oder?
Irgendwann in diesen Tagen habe ich eine Frage in den Chat getippt: „woran erkennen wir eigentlich, das die tests wirklich gelaufen sind?“ Die Modelle melden nämlich immer Vollzug, alles umgesetzt, alles geprüft, alles grün. Meistens stimmt das auch, aber bei einer App für Kinder wollte ich es sehen und nicht glauben, und seitdem gibt es zu jeder Veröffentlichung ein Protokoll, in dem steht, was wirklich gelaufen ist.
Eine Woche später dachte ich, ich lasse meinen Sohn mal schnell eine Matheaufgabe rechnen. Er ist in der zweiten Klasse, nicht in der vierten. Ich lege ihm ein Profil an, mache Foxisch klar auf, will ihm das zeigen, und wir fangen an.
Erst beim Tun merke ich, was da steht: 417 minus 13. Er schaut sich das an, kann damit nicht wirklich etwas anfangen und probiert es trotzdem.
Ich sitze daneben und denke: Da ist etwas schiefgegangen. Gerade eben habe ich sein Profil eingetragen, zweite Klasse, und trotzdem bekommt er Aufgaben für die Vierte.
Falsch war die Aufgabe nicht, 417 minus 13 ist 404. Verkehrt war die Zuordnung. Als wir nachgeschaut haben, funktionierte das Profil einwandfrei, Name und Sterne wechselten brav, nur hatte nie jemand die Aufgabenauswahl daran angeschlossen.
Zwei Dinge, die jedes für sich funktionierten, und dazwischen saß ein Zweitklässler vor einer Rechnung mit drei Stellen. Kein Test hatte danach gefragt. Gefunden hat es, wie beim ersten Mal, ein Mensch, der das Ding benutzt hat.
Ich finde das alles nicht schlimm. Die App ist im Kern innerhalb von drei Tagen entstanden, mit allem, was inzwischen in ihr steckt. So etwas passiert, und in einer App, die man privat baut, darf so etwas auch passieren.
Es darf nur nicht unbemerkt bleiben. Inzwischen stehen Name und Klasse über den Aufgaben, und für die zweite Klasse bleiben die Zahlen im Zahlenraum bis 100.
Ich weiß jetzt ziemlich genau, was ich in dieser Geschichte kann und was nicht. Ich kann Ideen haben und sie schneller benutzbar machen, als ich es in all den Jahren mit Entwicklungsteams je für möglich gehalten hätte. Ob eine Aufgabe einem Kind hilft, sieht aber erst jemand, der daneben sitzt: eine Lehrerin mit ihrem Blick für die Einerstelle oder ein Vater neben seinem Sohn.
Deshalb wünsche ich mir jetzt viele solcher Blicke. In der App gibt es einen Bereich für Hinweise, und mit dem, was dort landet, entwickeln wir die App systematisch weiter, mein Team aus Claude und ChatGPT und ich. Die Lehrerin will die App mit ihren Schülerinnen ausprobieren, und ich vermute, sie findet wieder etwas.
Fertig ist Foxisch klar noch lange nicht. Der Name stammt übrigens von meiner Tochter, sie wollte unbedingt diesen Fuchs haben. Mir gefiel er sofort, weil ich seit fünfundzwanzig Jahren unter dem Motto „einfach, klar“ arbeite und weil Dinge für Kinder erst recht einfach sein müssen.
Ich glaube noch immer, dass Kinder sich Dinge selber beibringen, wenn sie Interesse daran haben. Meine Tochter kam an jenem Freitag ja aufgeregt zu mir, weil sie mit ihrer Freundin Arbeitsblätter machen wollte. Manchmal fehlt es einfach an den Blättern und an Eltern, die die Zeit haben, welche zu machen.
Verstehen ist das eine, Üben das andere. Aufgaben rechnen, lesen, vorlesen, das braucht Wiederholung. Wenn die App ein bisschen dazu beiträgt, dass Kinder einfach mehr üben, dann freut es mich, wenn möglichst viele sie benutzen.
Jetzt können sich die Kinder ihre Arbeitsblätter selber machen. Einen Drucker brauchen sie dafür nicht einmal, denn geübt wird auch direkt am Bildschirm, am Rechner, am Tablet oder am Mobiltelefon.
Eine Grenze bleibt. Ich habe den Zugang so leicht gemacht, wie ich konnte, aber mit dieser App können nur Kinder etwas anfangen, bei denen zu Hause so ein Gerät liegt. Das kann ich nicht korrigieren.
Alles andere können wir korrigieren, Hinweis für Hinweis.

Foxisch klar ist eine private Initiative von mir, für unsere Kinder und für alle, die damit üben möchten.

