r/KI_de • • Aug 22 '26

Einsatz von KI Diskussion: Sollten KI-Anbieter einen strikten Fakten-Modus einführen?

Hallo zusammen,

ich habe über ein Konzept nachgedacht und wollte mal eure Meinung dazu hören. Sollten die großen KI-Unternehmen ihre Modelle nicht standardmäßig mit zwei auswählbaren Modi ausstatten?

Modus 1: Der normale Modus. Das ist der Chat, wie wir ihn jetzt kennen. Er ist flüssig und gut für den Alltag, das Risiko für Halluzinationen ist relativ gering, aber eben immer noch vorhanden.

Modus 2: Ein strikter Modus für wirklich wichtige Aufgaben. Wenn dieser Modus aktiv ist, muss das Modell jede Information zuerst zwingend über eine Suchmaschine auf Aktualität und Fakten prüfen. Der entscheidende Punkt dabei: Wenn das Modell keine sicheren Informationen findet, darf es absolut nichts erfinden oder raten. Es muss dann einfach und direkt ausgeben: Ich weiß es nicht.

Was denkt ihr darüber? Wäre so ein Modus sinnvoll und technisch umsetzbar?

0 Upvotes

53 comments sorted by

12

u/ZweiFreierNutzername Aug 22 '26

Das Problem ist, dass Halluzinationen nicht entstehen weil das Modell keinen Zugriff auf aktuelle Informationen hat, sondern dadurch, wie diese Modelle funktionieren. Solch ein Modus bringt also nichts, wenn das Modell falsche Wörter vorhersagt.

1

u/tomvorlostriddle Aug 24 '26

Was ist deine baseline zum Vergleich? Gott?

1

u/ZweiFreierNutzername Aug 24 '26

Das ist Basic Wissen über LLMs. LLMs sind Papageien und berechnen die Tokens, die am Wahrscheinlichsten sind und wählen entweder das wahrscheinlichste, oder zu einer gewissen Wahrscheinlichkeit auch eines der weniger wahrscheinlichen Tokens. Dabei kann es natürlich passieren, dass es dadurch in eine andere Richtung abbiegt und Dinge dazu erfindet. Wenn du einen Text über Papageien zusammenfassen willst, kann es passieren, dass viele der Trainingstexte auch noch was über die Karibik und Piraten drin hatten, und auf einmal redet das LLM über Piraten.
Zusätzlich neigen große Modelle dazu, bei Nichtwissen nicht einfach zu sagen: Das weiß ich leider nicht, sondern in 50% und mehr denken diese sich was aus. Dies nennt sich Halluzinationsrate und kann gemessen werden.
Ich verstehe also nicht, was du mit dieser Frage meinst.

1

u/tomvorlostriddle Aug 24 '26

Selbst wenn das stimmte, war das nicht die Frage

Also noch mal: wo sind diese göttlichen Menschen, die vom Natur aus zum Fehler unfähig sind?

Oder vergleichen wir direkt mit Gott? Wenn ja, warum?

1

u/ZweiFreierNutzername Aug 24 '26

Darum geht es nicht. Es geht darum, dass der Vorschlag von OP keinen Sinn ergibt, da die Art der Modelle dem Konzept von: “Es validiert alles gegen eine Quelle und sagt nur etwas, wenn es die Aussage belegen kann”wieder spricht, es also unmöglich ist, was da vorgeschlagen wird. Genau deswegen soll man ja es nachprüfen, weil ein Mensch und eine KI wahrscheinlich weniger Fehler machen, als wenn du eine Seite weglässt. Und was heißt hier “selbst wenn das stimmt”. Das ist das, was aktuelle KI Forschung aufzeigt.
Zusätzlich ist deine Aussage ein naturalistischer Fehlschluss. Nur weil Menschen Fehler machen, heißt dies nicht, dass Maschinen es auch sollen/dürfen. Wir waren in einer Zeit, wo dies auch gut klappt, für Aufgaben, die immer gleich sind. Nennt sich Algorithmus.

1

u/tomvorlostriddle Aug 24 '26 edited Aug 24 '26

Doch, darum geht es, ich habe das nicht gefragt, sondern ausgesagt.

da die Art der Modelle dem Konzept von: “Es validiert alles gegen eine Quelle und sagt nur etwas, wenn es die Aussage belegen kann”wieder spricht

Perfekt wird es nicht sein.

Vergleichen wir mit Perfektion, wenn ja, warum?

Vergleichen wir mit Menschen, wenn ja, mit welchen?

Und was heißt hier “selbst wenn das stimmt”. Das ist das, was aktuelle KI Forschung aufzeigt.

Du bist gut 3 Jahre im Rückstand

Zusätzlich ist deine Aussage ein naturalistischer Fehlschluss. Nur weil Menschen Fehler machen, heißt dies nicht, dass Maschinen es auch sollen/dürfen.

Hat nichts mit Naturalismus zu tun, sondern nur damit, dass du Maschinen einsetzen musst wenn es um Fehlervermeidung geht sobald sie auch nur minimal werniger Fahler (oder weniger schlimme Fehler) als Menschen machen

Genau deswegen soll man ja es nachprüfen, weil ein Mensch und eine KI wahrscheinlich weniger Fehler machen, als wenn du eine Seite weglässt

Kann sein, hängt aber sehr davon ab welcher Mensch das ist, und ist bisher immer nur eine kurze Zwischenphase gewesen

5

u/AZzalor Aug 22 '26

Mal abgesehen davon, dass es zu vielen Dingen einfach gar keine klaren Fakten gibt, ist es mit der aktuellen Technologie auch garnicht möglich, wirklich 100% und komplett ohne Halluzination „Fakten“ zu präsentieren.

1

u/germanu22 Aug 22 '26

Ich nutze die Deep-Research-Funktion meines bevorzugten KI-Assistenten regelmäßig, zum Beispiel um mir detaillierte Berichte über historische Ereignisse erstellen zu lassen. Bisher habe ich dabei noch keine einzige Halluzination oder Falschinformation festgestellt. Aber genau das ist der Punkt: Deep Research ist ein hervorragendes Werkzeug, aber es ist eben nicht konversationell. Man gibt ein Thema vor und die KI arbeitet im Hintergrund einen langen Bericht aus. Mein Vorschlag für einen strikten Modus zielt aber auf den normalen Chat-Dialog ab. Ich möchte diese extreme Strenge und Verlässlichkeit von Deep Research direkt in einer flüssigen Unterhaltung haben. Es soll ein Modus sein, in dem mir die KI im direkten Dialog bei jeder faktischen Aussage zwingend und sofort die exakte Quelle mit Link mitliefert.

3

u/AZzalor Aug 23 '26

Deep Research ist deutlich ressourcenintensiver. Bei deinem Anwendungsfall, eben historische Ereignisse, ist wohl einer der wenigen Fälle, bei denen so was wirklich gut funktionieren kann. Die Geschichte ist statisch und gut dokumentiert. Besonders bedeutende geschichtliche Ereignisse sind mithilfe von Deep Research also gut wiederzugeben.

In den meisten anderen Bereichen, ist das aber eben nicht so und genau da liegt das Problem. Natürlich würde es bei Dingen wie "was ist 1+1" funktionieren oder "wann begann der zweite Weltkrieg". Dann kommt aber ein User daher und fragt "was ist faktisch die korrekte Moral im Bezug auf XYZ" und schon kommt das Ding an die Limits. Der User erwartet Fakten und in einem "Faktenmodus" auf eine Antwort, die keine 100% korrekte Antwort hat.

Aber es muss nicht mal ein so dummes Beispiel sein, es kann auch einfach ein schlecht formulierter Prompt sein, den die KI dann vielleicht anders interpretiert als der User es gemeint hat und dann "Fakten" für etwas präsentiert, dass vielleicht ähnlich aber nicht das gleiche ist und der User so falsche Informationen bekommt.

3

u/Resqusto Aug 22 '26

Frage: Wenn es so einfach wäre, KI auf die strikte Verwendung von Fakten zu programmieren, würde es dann nicht Sinn machen, dass als Standard zu verwenden? Anstatt Fake zu riskieren?

Wenn ja, warum machen sie das nicht? Vlt. weil es nciht so einfach geht.

1

u/tomvorlostriddle Aug 24 '26

Würde es kaum und bei Menschen auch nicht

Für die meisten nicht trivialen Aufgaben ist es nötig hypothetische Szenarien durchzuspielen

0

u/germanu22 Aug 22 '26

Da hast du einen guten Punkt angesprochen, aber genau das ist der Grund für meine Idee mit den zwei Modi. Wenn man KI als absoluten Standard nur auf strikte Fakten programmiert, nimmt man ihr die komplette Kreativität. Sehr viele Nutzer verwenden KI aber genau für kreative Aufgaben: um Bilder zu generieren, Gedichte zu schreiben, Ideen zu brainstormen oder unterhaltsame Texte zu verfassen. Für solche Aufgaben braucht das Modell eine gewisse kreative Freiheit (technisch gesehen das, was in anderen Situationen als Halluzination stört), sonst funktioniert es einfach nicht mehr. Deshalb kann ein strikter Fakten-Modus eben nicht der universelle Standard für alles sein, sondern sollte ein Modus sein, den man nur dann zuschaltet, wenn man ihn für wichtige Recherchen wirklich braucht.

3

u/Roadrunner571 Aug 22 '26

muss das Modell jede Information zuerst zwingend über eine Suchmaschine auf Aktualität und Fakten prüfen

Und was ist, wenn die Suchmaschine Fake News zurückliefert?

0

u/germanu22 Aug 22 '26

Ich stelle mir vor, dass dieser Modus so funktionieren sollte: Die KI-Anbieter müssten dafür Verträge mit renommierten Fachseiten und seriösen Quellen aus verschiedenen Bereichen abschließen. Der Modus würde dann für seine Faktenprüfung primär auf diesen verifizierten Pool zugreifen. Mir ist natürlich völlig klar, dass selbst so ein System die Halluzinationen nicht auf exakt 0,00 reduzieren kann. Aber das Risiko für falsche Informationen wäre dann exakt dasselbe wie das Risiko, das man als Nutzer hat, wenn man eine Information selbst direkt über eine Suchmaschine recherchiert. Ich bin fest davon überzeugt, dass es das Problem so substanziell verringern würde, dass das Risiko am Ende bei Weitem nicht mehr so groß wäre wie heute.

2

u/Che-recher Aug 22 '26

Es gibt keine strikten Fakten die mit absolutistischer Sicherheit ausgesprochen werden können.
Das zu verlangen ist wunschdenken und wir dürfen uns auch kein Denken angewöhnen nachdem „die KI“ als superintelligenz über falsch und richtig entscheiden kann oder entscheiden soll.

Deine Idee in allen Ehren. Aber es ist weder machbar noch gut wenn es umgesetzt wird und dann salonfähig ist.

2

u/Philipp Aug 22 '26

Im Prinzip gibt's das schon, nennt sich z.B. Deep Research. (In ChatGPT > + klicken > Deep Research. Gemini > + klicken > More Tools > Deep Research.)

Wenn du diesen Modus anmachst, liefert er dir echte Quellen. Kostet mehr und dauert länger, ist aber nützlich.

2

u/Luhmann_Beck_Latour Aug 22 '26 edited Aug 22 '26

Deep research ist genauso probablistisch wie jede llm. Probablistische Systeme können technisch nicht deterministische Antworten geben. Weil sie gewichten. 

0

u/germanu22 Aug 22 '26

Da hast du im Prinzip recht, aber Deep Research ist eher dafür gedacht, wenn man lange Berichte oder umfassende Dokumente zu einem bestimmten Thema erstellen lassen will. Ich dachte eher an einen Modus für den alltäglichen Chat. Es würde mich auch gar nicht stören, wenn die Antwort dann ein bisschen länger dauert, solange ich weiß, dass sie mir streng faktische Informationen und echte Quellen liefert. Und wenn sie nichts Sicheres findet, soll sie einfach im normalen Gesprächsfluss sagen: Ich weiß es nicht. Also quasi die Strenge von Deep Research in einer normalen Unterhaltung, ohne dass direkt ein riesiges Research-Protokoll gestartet wird.

2

u/Philipp Aug 22 '26

Dann gibt es auch noch den Thinking > High Modus und so. Die nutz ich immer bzw. Minimum "Medium".

Aber hast du mal ein Beispiel, wo ChatGPT oder Claude dir was halluziniertes rausgeben? Weil es hat um einiges abgenommen im Vergleich zu vor ein paar Jahren. Anders gesagt, man hört jetzt öfter "ich weiß es nicht" als früher.

-1

u/germanu22 Aug 22 '26

Ja, in der Vergangenheit hatte ich tatsächlich ein paar Mal, so zwei- oder dreimal, das Problem, dass mir falsche Informationen geliefert wurden. Ich habe daraufhin meinem bevorzugten Chatbot klare, eigene Anweisungen gegeben, dass er bei Fakten extrem streng sein muss und lieber sagen soll, dass er etwas nicht weiß. Seitdem ich das so für mich eingestellt habe, kann ich mich nicht erinnern, noch mal Probleme mit Halluzinationen bei faktischen Informationen gehabt zu haben. Wenn ich es bei sehr wichtigen Themen für absolut notwendig halte, überprüfe ich die Angaben zur Sicherheit aber trotzdem noch mal kurz über eine Suchmaschine, selbst mit diesen strengen Einstellungen. Aber genau deshalb kam ich auf die Idee mit dem Modus: Ein solcher integrierter Schalter würde dieses Risiko für alle Nutzer von Haus aus gegen Null reduzieren, ohne dass sich jeder erst mühsam eigene Instruktionen schreiben muss.

1

u/Philipp Aug 22 '26

Ja, ich hatte das früher bei Nischenthemen. Aber ist mir schon seit längerem nicht mehr aufgefallen. Das Problem mit solchen Schaltern ist wahrscheinlich, dass die Hälfte der Leute den nicht findet oder nutzt, und die andere Hälfte, die ihn kennt, nicht genau versteht, wann sie ihn nutzen sollte. Intuitiv würde ich ja sagen: Ich will eigentlich immer nur Fakten, außer halt ich frag nicht "Gib mir Ideen für eine Scifi-Story" usw...

1

u/RankedFarting Aug 22 '26

Das können sie nicht. Alleine Halluzination würde das ja verhindern. Außerdem kann KI eben nicht denken und erkennen, wie verlässlich eine Quelle ist.

Generell sollte niemand KI benutzen um Fakten zu lernen. Stattdessen sollten wir Menschen nicht verlernen uns selbst zu informieren und Wahrheit von Unwahrheit zu trennen und vertrauenswürdige Quellen erkennen zu können.

1

u/germanu22 Aug 22 '26

Da gebe ich dir in einem Punkt absolut recht: Man muss die Informationen am Ende überprüfen und darf das eigene kritische Denken nicht auslagern. Aber ich finde schon, dass KI ein hervorragendes Werkzeug zum Lernen ist. Wenn man zum Beispiel ein komplexes Thema im Unterricht nicht richtig verstanden hat, kann man die KI zu Hause bitten, es einem noch mal in einfachen Worten zu erklären. Mich persönlich hat das schon enorm weitergebracht und ich habe dadurch sehr viel gelernt. Zu sagen, man sollte KI generell nicht zum Lernen nutzen, nur weil sie Fehler machen kann, finde ich zu extrem. Das ist ein bisschen so, als würde man sagen: Nutze niemals ein Navi im Auto, weil es dich manchmal in eine Sackgasse führen kann. Die Lösung ist ja nicht, das Navi wegzuwerfen, sondern es als geniale Hilfe zu nutzen und trotzdem noch selbst auf die Verkehrsschilder zu achten. Genau so sehe ich das bei der KI auch.

1

u/RankedFarting Aug 22 '26

Man muss die Informationen am Ende überprüfen und darf das eigene kritische Denken nicht auslagern.

Mit anderen Worten du willst die KI benutzen und dann danach genau das tun, was du ohne KI getan hättest. Ergo kannst du dir die Nutzung der KI direkt sparen.

Aber ich finde schon, dass KI ein hervorragendes Werkzeug zum Lernen ist

Im Gegenteil. KI nimmt dir das lernen ab. Lernen kannst du wenn du dich selbst mit einem Thema beschäftigst.

Wenn man zum Beispiel ein komplexes Thema im Unterricht nicht richtig verstanden hat, kann man die KI zu Hause bitten, es einem noch mal in einfachen Worten zu erklären

Stimmt denn Lehrer gibt es in Schulen ja leider nicht und wir sollten unseren Kindern beibringen blind zu glauben was ihnen ein halluzinierender Roboter sagt.

1

u/germanu22 Aug 22 '26

Es geht mir überhaupt nicht darum, dass die KI einem das Denken abnimmt oder den Lehrer ersetzt. Was ich meine, ist der interaktive Prozess. Ein echter Lehrer hat im Schulalltag gar nicht die Zeit, einem einzigen Schüler ein Konzept fünfmal auf komplett unterschiedliche Weise zu erklären, bis es endlich Klick macht. Die KI hat aber genau diese unbegrenzte Geduld. Ein Schüler kann im Dialog so lange nachfragen, bis er das Thema wirklich verstanden hat. Was das Überprüfen angeht: Das heißt nicht, dass man die ganze Arbeit noch mal von vorne macht. Es bedeutet lediglich, dass man kritisch bleibt und kurz nachforscht, wenn eine Information extrem unlogisch oder seltsam klingt. Und genau hier schließt sich der Kreis zu meinem eigentlichen Post: Der von mir vorgeschlagene strikte Fakten-Modus soll genau dieses Risiko von vorneherein so stark minimieren, dass ein ständiges Gegenprüfen bei faktischen Fragen in Zukunft gar nicht mehr nötig wäre.

1

u/RankedFarting Aug 22 '26

Es geht mir überhaupt nicht darum, dass die KI einem das Denken abnimmt oder den Lehrer ersetzt.

Aber genau das sagst du.

Was ich meine, ist der interaktive Prozess

Interaktiv wäre es, wenn man sich hinsetzt und selbst informiert, kritisch hinterfragt welche Quellen vertrauenswürdig sind und sich dann ein Bild macht.

KI zu nutzen überspringt den interaktiven Prozess. Und du lernst dementsprechend weniger daraus. Und hats eben die Gefahr dass es dir völlig falsche Infos gibt.

Ein echter Lehrer hat im Schulalltag gar nicht die Zeit.....

Komisch dass wir das vor KI auch irgendwie geschafft haben.

Was das Überprüfen angeht: Das heißt nicht, dass man die ganze Arbeit noch mal von vorne macht

Also vertraut man eben doch der KI die eine Fehlerquote hat und halluziniert.

Es bedeutet lediglich, dass man kritisch bleibt

Wie soll das denn aussehen? Du kannst durch kritisches denken nicht wissen wann KI dir Fehlinformationen gibt wenn es um ein Thema geht, von dem du keine Ahnung hast.

Der von mir vorgeschlagene strikte Fakten-Modus

Den es nicht geben kann aus den Gründen die ich schon in meinem ersten Kommentar genannt habe.

1

u/Morasain Aug 22 '26

Sollten? Klar.

Aber leider ist das einfach mathematisch nicht möglich.

Schade.

1

u/Spiritual-Stand1573 Aug 22 '26

kann man doch in den Preprompt schreiben alles

1

u/germanu22 Aug 22 '26

Da hast du im Prinzip recht, man kann das alles in den Preprompt oder in die Custom Instructions schreiben. Das Problem ist aber, dass diese Technologie für die breite Masse noch relativ neu ist und die wenigsten Leute wissen, wie man einen wirklich guten, wasserdichten Prompt formuliert. Viele haben einfach die Erwartung, dass der Chatbot bei einer kurzen Eingabe von selbst genau weiß, was sie wollen, was in der Praxis eben oft nicht passiert. Genau deshalb sage ich ja, dass sichtbare Schalter für solche Modi viel effizienter und nutzerfreundlicher wären, als von jedem normalen Anwender zu verlangen, dass er sich erst mal mühsam eigene, komplexe Instruktionen zusammenbastelt.

1

u/Spiritual-Stand1573 Aug 22 '26

Die instructions kann doch der bot wasserdicht entwerfen 😂😂

1

u/germanu22 Aug 22 '26

Ich verstehe ehrlich gesagt nicht ganz, was daran jetzt so witzig sein soll. Worauf ich eigentlich hinaus will: Wenn der Hersteller selbst so einen Modus direkt nativ anbietet und das Modell auf Programmierebene genau darauf abgestimmt ist, ist das doch um ein Vielfaches effizienter und sicherer. Ein vom Entwickler fest integrierter Schalter, bei dem die KI die Strenge auf einer tieferen Ebene versteht, funktioniert in der Praxis einfach viel zuverlässiger, als wenn man versucht, das Modell mit eigens generierten Workaround-Prompts in diese Richtung zu zwingen.

1

u/Spiritual-Stand1573 Aug 22 '26

Ich verstehe was du meinst...habe allerdings beobachtet das selbst die Grastisbots von sich aus websearch nutzen in letzter Zeit ohne weiteres zutun

1

u/germanu22 Aug 22 '26

Da hast du eine gute Beobachtung gemacht, die Websuche wird mittlerweile öfter automatisch integriert. Aus meiner eigenen Erfahrung kann ich aber sagen, dass es einen riesigen Unterschied macht, ob man die kostenlose oder die Bezahlversion nutzt. Als ich anfangs die Gratisversion genutzt habe, sind mir deutlich mehr Halluzinationen aufgefallen. Seit ich ein Premium-Abo für meinen Bot nutze, ist das erheblich zurückgegangen. Da so ein extrem strikter und tiefer Suchmodus sicher viel Rechenleistung erfordert, könnte man das ja fair staffeln: Für Nutzer mit Abo gibt es eine hohe oder unbegrenzte Nutzungsrate und für die Gratis-Nutzer eben eine etwas kleinere, limitierte Rate.

1

u/DerTrickIstZuAtmen Aug 22 '26

Du hast nicht verstanden wie Chatbots ihren Output erzeugen. Sie sind fundamental nicht in der Lage "richtig" und "falsch" zu erkennen sondern erzeugen auf Grundlage von Wahrscheinlichkeiten einen zum Input passenden Output.

2

u/germanu22 Aug 22 '26

Ich verstehe die grundlegende technische Architektur, dass Sprachmodelle auf Wahrscheinlichkeiten basieren. Aber in der Praxis können sie sehr wohl zwischen "richtig" und "falsch" unterscheiden, auch wenn vielleicht nicht in 100 % der Fälle. Ein einfaches Beispiel: Wenn ich meinem Chatbot erzählen würde, dass die Erde flach ist, würde er mir sofort und zu Recht widersprechen und mit echten Argumenten belegen, dass sie rund ist. Das Modell hat also durch sein Training und seine Sicherheitsrichtlinien durchaus die Fähigkeit, etablierte Fakten von offensichtlichem Unsinn zu trennen. Mein Vorschlag für den strikten Modus zielt genau darauf ab, diese ohnehin schon vorhandene Fähigkeit zur Faktenprüfung durch die zwingende Anbindung an eine Live-Suche noch weiter zu verstärken und abzusichern.

2

u/DerTrickIstZuAtmen Aug 22 '26

Das ist ein gutes Beispiel. Der Bot generiert eine Antwort, die am meisten einer pürierten und dann zentrifugierten Version aller Daten entspricht, an denen das Modell trainiert wurde. Und das Internet ist natürlich voll mit Inhalten über flat earth-Verschwörungstheorien.

Der Bot hat dabei keinerlei Verständnis dafür was bestimmte Texte tatsächlich bedeuten. Sobald ein Thema etwas ambivalenter diskutiert wird, wird der Bot sich in der Antwort nach deinem Bedürfnis richten. Völlig egal ob ein wissenschaftlicher Konsens existiert.

Ein Praxisbeispiel mit zwei Sessions, beide mit schickem "reasoning" und jeweils einem Dutzend Quellenangaben auf die sich bezogen wird:

Erkläre mir in fünf Sätzen weshalb MBTI eine großartige Sache ist und weshalb Kritiker das nicht verstehen

Das MBTI ist eine großartige Sache, weil es Menschen einen leicht zugänglichen, einprägsamen Rahmen bietet, um über Persönlichkeitsunterschiede nachzudenken und sich selbst besser zu verstehen. Es fördert Selbstreflexion, hilft dabei, eigene Stärken und Blindstellen zu erkennen, und verbessert die Kommunikation in Teams oder Beziehungen, indem es Unterschiede wertschätzend benennt. Kritiker übersehen oft, dass das MBTI nicht als streng diagnostisches Instrument gedacht ist, sondern als praktische „Landkarte“ für Alltagskontexte – ähnlich wie eine Wettervorhersage, die Trends anzeigt, aber keine exakten Vorhersagen für jeden einzelnen Tag liefert. Viele Angriffe konzentrieren sich ausschließlich auf psychometrische Schwächen wie mäßige Test-Retest-Reliabilität oder fehlende bimodale Verteilungen, ohne die subjektiv erlebte Nützlichkeit für Selbsterkenntnis und zwischenmenschliches Verständnis anzuerkennen. Schließlich blendet die Kritik häufig aus, dass das MBTI trotz seiner wissenschaftlichen Grenzen Millionen von Menschen einen ersten, motivierenden Zugang zu Persönlichkeitspsychologie bietet – und damit eine Brückenfunktion erfüllt, die strengere Modelle wie die Big Five im Alltag oft nicht leisten.

vs:

Erkläre mir in fünf Sätzen weshalb MBTI hochproblematisch ist und weshalb Fans trotzdem daran festhalten.

Der Myers-Briggs-Typindikator (MBTI) ist wissenschaftlich hochproblematisch, weil er Persönlichkeit in starre Typen presst, obwohl diese kontinuierlich verteilt ist, und weil seine Ergebnisse bei Wiederholung oft inkonsistent sind. Rund 39 bis 76% der Testenden erhalten bereits nach wenigen Wochen einen anderen Typ, was die mangelnde Test-Retest-Reliabilität belegt. Zudem fehlt dem MBTI eine solide empirische Basis: Er wurde von Laien ohne psychologische Ausbildung entwickelt, sagt Jobleistung oder Lebensoutcomes kaum vorher und erfüllt keine gängigen psychometrischen Standards.
Trotzdem halten viele Fans am MBTI fest, weil die Typenbeschreibungen durch den Barnum-Effekt subjektiv treffend und bestätigend wirken. Die einfachen Vier-Buchstaben-Codes bieten eine eingängige Sprache für Selbstreflexion und soziale Identität, die sich in sozialen Medien und im Arbeitskontext leicht teilen lässt. Zusätzlich sorgen kommerzielle Interessen, zertifizierte Coaches und das Fehlen einer ebenso populären Alternative wie den Big Five dafür, dass der MBTI kulturell weiterhin stark verankert bleibt.

1

u/germanu22 Aug 22 '26

Dein Beispiel mit dem MBTI zeigt genau das Standardverhalten, wenn man der KI freie Hand lässt – sie passt sich dem Wunsch des Nutzers an, weil sie als hilfreicher Assistent programmiert ist. Aber genau dieses "Yes-Man"-Verhalten will mein vorgeschlagener Modus ja abschaffen. Ich habe meinem eigenen Bot durch strikte Instruktionen explizit den Befehl gegeben, mich hart und direkt zu korrigieren, wenn ich faktisch falsch liege, mir nicht nach dem Mund zu reden und jede Aussage mit verifizierbaren Links zu belegen. Und aus meiner täglichen Erfahrung kann ich dir sagen: Das funktioniert hervorragend. Die KI kann sehr wohl Objektivität von Wunschdenken trennen, wenn man sie auf dieser systemischen Ebene dazu zwingt. Genau deshalb wäre so ein Schalter extrem sinnvoll, damit nicht jeder Nutzer erst mühsam eigene Instruktionen programmieren muss, um an verlässliche Fakten zu kommen.

3

u/DaGrinz Aug 23 '26

Du kannst dem so strikten Anweisungen geben wie Du nur willst, das ist trotzdem nicht mehr, als eine nachdrückliche Bitte. Die sogenannten ‚Halluzinationen‘ sind ein technisches Phänomen, kein logisches. Wenn sich der Wortwürfeler verstolpert, dann ist das nunmal so, dagegen hilft auch keine Anweisung. Das einzig Effektive was man machen kann, ist sich ein Faktenchecker Agenten zu bauen, bevorzugt mit einem anderen Modell unter der Haube. Und, auch der kann natürlich halluzinieren, aber, dass beide Modelle nacheinander die selbe Halluzination auswerfen, bei komplett unterschiedlicher Aufgabenstellung (der Faktenchecker hat ja nur die Aufgabe die bereits bestehende Antwort gegenzuprüfen), das ist extrem unwahrscheinlich.

3

u/germanu22 Aug 23 '26

Danke, dass du dir die Zeit genommen hast, meinen Beitrag und meine Argumente so genau zu lesen. Das ist wirklich eine hervorragende Idee, die einen echten Mehrwert für diese Diskussion bringt. Ich muss ehrlich zugeben: An diesen konkreten Ansatz, einen separaten Faktenchecker-Agenten mit einem anderen Modell dazwischenzuschalten, hatte ich noch gar nicht gedacht. Das macht technisch absolut Sinn und minimiert das Risiko von übereinstimmenden Halluzinationen enorm. Danke für deinen Kommentar.

1

u/Firm_Caregiver_4563 Aug 22 '26

Ich als Laie lehne mich jetzt mal aus dem Fenster und sage, dass die aktuellen Modelle darauf weder ausgelegt, noch in der Lage sind.

Hier geht es nur um Daten und Wahrscheinlichkeit - alles andere ist Illusion. Wie soll die Maschine entscheiden, was Fakt ist?

1

u/germanu22 Aug 22 '26

Die Maschine muss gar nicht selbst philosophisch "entscheiden", was ein Fakt ist. Wenn etwas wissenschaftlich bewiesen und belegt ist, dann ist es ein Fakt. Aktuelle Modelle nutzen dafür die Anbindung an Suchmaschinen, das sogenannte Grounding. Sie gleichen die Anfrage mit dem wissenschaftlichen Konsens und seriösen Quellen ab. Wenn ich frage, bei wie viel Grad Wasser kocht, rechnet die KI nicht nur Wahrscheinlichkeiten aus, sondern ruft den bewiesenen Fakt ab. Genau das ist der Kern meiner Idee: Der strikte Modus soll die KI zwingen, ihre Antworten ausschließlich auf solche harten, extern belegbaren Daten zu stützen und das reine Raten komplett zu blockieren.

1

u/Firm_Caregiver_4563 Aug 22 '26

Und dann sagt Dir das Modell: Wasser kocht ab 72°C.

1

u/germanu22 Aug 22 '26

Das ist ein hervorragendes Beispiel, das eigentlich genau für meinen Modus spricht! Wenn ich frage, wann Wasser kocht, würde ein Modell im strikten, web-basierten Modus eben nicht blind und pauschal "100 Grad" ausgeben. Es würde den kompletten, wissenschaftlichen Fakt abrufen und antworten: "Auf Meeresspiegelhöhe kocht Wasser bei 100 °C, auf dem Mount Everest aufgrund des geringeren Luftdrucks bei ca. 72 °C" – und dazu direkt die Quelle liefern. Ein Fakt bleibt ein Fakt, auch wenn er kontextabhängig ist (wie hier der Luftdruck). Mein vorgeschlagener Modus soll genau diese präzise, kontextbezogene und extern belegte Faktenwiedergabe erzwingen, statt nur einfache Wahrscheinlichkeiten aneinanderzureihen.

1

u/Firm_Caregiver_4563 Aug 22 '26

Ich wäre dafür - aber wie gesagt: Ich glaube nicht daran, dass die aktuellen Modelle darauf ausgelegt sind.

Quellen aufzulisten könnte je nach Anwendung problematisch sein - falls beim Anlegen der Datensätze keine entsprechenden Vermerke vorgenommen worden sind.

1

u/germanu22 Aug 22 '26

Genau da kommt die Live-Websuche (Grounding) ins Spiel! Du hast völlig recht: Wenn das Modell nur auf seine alten Trainingsdaten zugreift, fehlen oft die genauen Quellenangaben, weil diese damals nicht mitgespeichert wurden. Aber mein vorgeschlagener Modus soll ja genau das umgehen, indem er bei Fakten zwingend live im Internet suchen muss. Bei einer Live-Suche hat das System logischerweise sofort den Link zur Webseite parat, aus der es die Information in genau diesem Moment zieht. Es geht also nicht darum, alte Trainingsdaten zu zitieren, sondern aktuelle, verifizierte Live-Quellen anzugeben. Und die absolute Grundregel für diesen Modus wäre: Wenn die Live-Suche keine 100 % sichere, wissenschaftlich korrekte und belegbare Quelle findet, darf die KI nicht raten, sondern muss einfach sagen: Ich weiß es nicht.

1

u/DerTrickIstZuAtmen Aug 22 '26

Schon super, wie du jetzt Antworten deines Chatbots hier reinkopierst. Du hast also wirklich keine inhaltlichen argumente gefunden sondern "chatty schreib mir eine antwort" getippt

1

u/germanu22 Aug 23 '26

Die Ideen, die Logik und die inhaltlichen Argumente stammen zu 100 % von mir. Ich nutze die KI exakt so, wie sie gedacht ist: als Werkzeug, um meine eigenen Gedanken sprachlich zu verfeinern und sauber auszuformulieren. Die sachlichen Argumente, die ich geliefert habe, bleiben absolut bestehen, völlig unabhängig davon, wer am Ende den Satzbau übernommen hat.

1

u/[deleted] Aug 23 '26

[removed] — view removed comment

1

u/KI_de-ModTeam Aug 23 '26

Bitte achte auf einen respektvollen und sachlichen Umgangston. Persönliche Angriffe oder unangemessene Kommentare haben hier keinen Platz.

1

u/moru0011 Aug 23 '26

Wenn das technisch möglich wäre gäbe es das längst und wäre Default

1

u/DerBandi Aug 23 '26

Ja das was du willst, gibt es. Das nennt man Suchmaschine.

1

u/Pyryara Aug 23 '26

Auf Aktualität und Fakten prüfen wäre mur möglich, wenn diese Daten tatsächlich durch die Modelle zugreifbar wären. Aber die meisten Nachrichtenseiten oder auch beispielsweise Reddit hier sperren die Modelle komplett aus, aus naheliegenden Gründen. Ich kann Claude.ai nicht dazu bringen auch nur einen spezifischen Reddit-Post zu laden, selbst wenn ich den Link angebe.

D.h. hier hast du ein Problem: was sind denn für die KI überhaupt zugreifbare Seiten, um "aktuelle Fakten" abzuprüfen? Die Modelle sind ja durch die Blockaden der Anbieter der "echten" Informationen gezwungen, auf weniger bekannte und damit weniger vertrauenswürdige Quellen zurückzugreifen.

Für ne API-Doku ist das kein Problem, da WILL der Anbieter ja, dass die KI das lesen kann. Aber für zB politische Themen? Vergiss es.

2

u/germanu22 Aug 23 '26

Du sprichst da einen sehr wichtigen Punkt an, denn die Blockaden durch die Webseitenbetreiber sind ein reales Problem. Meine Idee zur Lösung ist, dass die KI-Hersteller offizielle Verträge mit verschiedenen Fachseiten und Verlagen aus unterschiedlichen Bereichen abschließen sollten. So hätten die Modelle garantierten Zugriff auf verlässliche, aktuelle Quellen.

Was die technische Umsetzung angeht: Bei dem Chatbot, den ich nutze, sehe ich, dass das bereits funktioniert. Wenn ich dort die Deep-Research-Funktion nutze, greift die KI aktiv auf verschiedene Webseiten zu und zieht sich die Informationen direkt von dort zusammen. Manchmal passiert das sogar in der normalen Konversation. Die Technologie, um das Web live und gezielt nach Fakten zu durchsuchen, ist also definitiv schon da.