Was MedicXam von einer klassischen Lernplattform unterscheidet — und davon, sich die Fragen einfach direkt von einem Chatbot schreiben zu lassen.
Berechtigter Einwand — moderne Sprachmodelle schreiben in Sekunden zwanzig Prüfungsfragen zu jedem Thema. Das Problem ist nicht die Erzeugung. Das Problem ist, dass du beim Lernen von Neuem nicht beurteilen kannst, welche der zwanzig falsch ist. Genau dafür lernst du ja.
Eine falsch begründete Frage prägt sich ein wie eine richtige. Deshalb reicht ein gutes Modell nicht — es braucht ein System, das von vornherein davon ausgeht, dass sich das Modell irren wird, und das jede Aussage an eine nachschlagbare Textstelle bindet.
Klassische Lernplattformen lösen das über eine Redaktion. Das funktioniert, hat aber zwei Grenzen: Der Bestand ist geschlossen — dein Hausstandard, dein Skript, dein Spezialgebiet sind nicht darin — und bei jeder Quellen-Aktualisierung beginnt die Arbeit von vorn.
| ThemaWorum es geht | MedicXam | ChatGPTFragen direkt aus ChatGPT & Co. |
|---|---|---|
| Woher der Inhalt stammt | Aus einem konkreten Dokument — dem PDF, das du selbst mitbringst. Das Modell darf sich nur auf den mitgegebenen Textabschnitt stützen, nicht auf sein Trainingswissen. | Aus dem Trainingswissen des Modells. Ohne angehängtes Dokument gibt es keine überprüfbare Grundlage — nur eine plausible Erinnerung. |
| Beleg pro Aussage | Jede Aussage in Frage und Erklärung trägt einen Marker auf den Quell-Abschnitt. Online kommen Kapitel- und Seitenangabe dazu; angeklickt öffnet sich die Originalstelle. | Zitate werden auf Nachfrage geliefert — mitunter auch dann, wenn es die zitierte Stelle nicht gibt. |
| Prüfung nach dem Generieren | Drei Stufen: strukturierter Self-Check des Generators, danach deterministische Prüfungen ohne KI, danach der EV-Check durch ein zweites, unabhängiges Modell über zehn Dimensionen. | Keine. Was im Chat steht, ist das Endergebnis — die Prüfung bleibt vollständig an dir hängen. |
| Was bei einem Fehler passiert | Bemängelte Fragen gehen mit dem Prüfbericht zurück an den Generator — bis zu drei Korrekturrunden, der Dialog bleibt einsehbar. Was danach nicht besteht, wird markiert statt stillschweigend ausgeliefert. | Du müsstest den Fehler erst bemerken — genau das ist beim Lernen von Neuem unwahrscheinlich. |
| Wiederholung & Lernfortschritt | Spaced Repetition (SM-2): Falsches kommt früher wieder, Sicheres seltener. Der Fortschritt liegt auf deinem Gerät und lässt sich über die Cloud auf weitere Geräte spiegeln. | Der Chat vergisst. Keine Fälligkeiten, keine Statistik, keine gezielte Wiederholung. |
| Eigene Unterlagen | Eigene PDFs — Skripte, SOPs, Hausstandards, Paper — werden zu Fragen und Erklärungen. Die Verarbeitung läuft auf deinem Gerät. | PDF anhängen geht — aber ohne Fragenverwaltung, ohne Wiederholung und mit jedem neuen Chat von vorn. |
| Wo deine Daten liegen | Dokumente, Fragen, Fortschritt und dein API-Schlüssel bleiben auf dem Gerät; der MedicXam-Server sieht sie nie. Für die Generierung geht ausschließlich der benötigte Textabschnitt an den KI-Anbieter deiner Wahl. | Hochgeladene Dokumente liegen beim Anbieter; je nach Tarif und Einstellung auch als Trainingsmaterial. |
| Offline nutzbar | Alles Erzeugte lässt sich ohne Internetverbindung üben — nur das Generieren neuer Inhalte braucht Netz. | Ohne Verbindung geht nichts. |
| Kosten & Kontrolle | Das lokale Programm ist kostenlos; für die KI zahlst du direkt bei deinem Anbieter, was du verbrauchst — mit Schätzung vor jedem Lauf und Kosten-Log danach. Üben kostet nichts. | Monatliches Abo; was pro Frage anfällt, bleibt unsichtbar. |
| Lizenz & Rechtslage | Ein eigener Prüfschritt achtet darauf, dass Fragen den Quelltext nicht abschreiben. Deine Dokumente bleiben lokal — für die Generierung geht aber der benötigte Textabschnitt an deinen KI-Anbieter, also brauchst du selbst die Rechte daran. | Ob die Ausgabe fremde Formulierungen übernimmt, siehst du nicht. |
Die Spalte „ChatGPT & Co." beschreibt das verbreitete Verhalten dieser Werkzeuge, nicht ein bestimmtes Produkt — einzelne Anbieter können in einzelnen Punkten abweichen.
Der entscheidende Unterschied steckt in der dritten Zeile der Tabelle. Was dort „drei Stufen" heißt, sieht im Detail so aus:
Beim Erzeugen füllt das Modell einen festen Prüfbogen aus — Quellenverankerung, Lösung nicht vorweggenommen, Quellen-Formulierung, Eindeutigkeit, Distraktoren, Vollständigkeit, Topic-Zugehörigkeit —, dazu ein Urteil samt Halluzinationsrisiko. Der Bogen ist Teil der Antwort und wird gespeichert: Er steht Zeile für Zeile unter „Prüfergebnisse" — nachlesbar statt bloß behauptet.
Danach rechnet Programmcode nach, was sich nachrechnen lässt: Zitat-Integrität (existiert jeder zitierte Abschnitt wirklich?), Antwortoptionen (stimmt ihre Zahl?) und Feld-Vollständigkeit (ist kein Text mitten im Satz abgeschnitten?) — dazu, ob das Urteil zu den gemeldeten Mängeln passt und ob aus der Quelle wörtlich abgeschrieben wurde. Diese drei Befunde stehen unter denselben Namen im Prüfbericht. Die Stufe lässt sich nicht überreden: Sie kennt keine Meinung, nur Regeln — und liefert bei gleicher Eingabe immer dasselbe Urteil. Irren kann sie sich nur dort, wo eine Regel selbst falsch programmiert ist.
Zuletzt prüft ein unabhängiges Modell, das die Frage nicht geschrieben hat, entlang zehn fachlicher Dimensionen — Zitationscheck, Quellenpassung, Topic-Übereinstimmung, Faktentreue, Antwortrichtigkeit, Distraktoren, Erklärungsqualität, Dokumententreue, Vollständigkeit, Kurzfassungs-Treue — und schätzt zusätzlich das Halluzinationsrisiko. Bei Lernunterlagen sind es sechs: Die frage-eigenen Punkte entfallen, dafür kommt die Quellentreue hinzu. Fallbeispiele durchlaufen dieselbe Kette mit einem eigenen Prüfer — er sieht zusätzlich nach, ob die Vignette die Lösung schon verrät und ob eine Teilfrage die Antwort einer späteren vorwegnimmt. Jede Dimension steht mit ihrem Befund im Prüfbericht; Beanstandungen gehen als Auftrag zurück an den Generator.
Warum das mehr ist als „nochmal drüberschauen": Die drei Stufen arbeiten nach verschiedenen Prinzipien — derselbe Fehler müsste allen dreien gleichzeitig unterlaufen. Ausgeschlossen ist das nicht, aber deutlich unwahrscheinlicher als bei einer einzelnen Prüfung. Der Self-Check zwingt den Generator, seine Belegstelle zu benennen — das allein verhindert schon einen Teil der frei erfundenen Antworten. Die deterministische Stufe glaubt niemandem und rechnet nach. Und der EV-Check urteilt, ohne den Denkweg des Generators zu kennen.
Bei jeder Frage führt ein Klick zur Textstelle, aus der sie stammt. Zweifelst du an einer Erklärung, prüfst du sie in Sekunden — statt sie zu glauben oder zu verwerfen.
Was du falsch beantwortest, kommt früher wieder; Sicheres tritt zurück. Das ist der Unterschied zwischen einer Fragenliste und einem Lernsystem.
Hausstandards, SOPs und unveröffentlichte Skripte kannst du verarbeiten, weil sie das Gerät nicht verlassen — nur der jeweils benötigte Textabschnitt geht an den KI-Anbieter deiner Wahl.
Technisch möglich heißt nicht rechtlich erlaubt: Ob du fremde Unterlagen verarbeiten und daraus Fragen erzeugen darfst, klärst du vorher mit den Rechteinhabern — MedicXam prüft das nicht.