AI fail.

ITnetadmin
userbase crew
userbase crew
Berichten: 9819
Lid geworden op: 28 jan 2012, 18:22
Uitgedeelde bedankjes: 273 keer
Bedankt: 811 keer

Nee, want "het was niet met AI".

Waar het eigenlijk op lijkt neer te komen is dat niemand die mensen durft te corrigeren, omdat ze een reputatie/positie/macht hebben waarmee ze kunnen doen en laten wat ze willen, en wss hebben een aantal ervan ook een arrogantie opgebouwd waarbij niemand hen nog wil/durft corrigeren.
En dus doen ze er maar op los, terwijl de gemiddelde student allang gebuisd was geweest, of zelfs uitgesloten.
Gebruikersavatar
Joe de Mannen
Elite Poster
Elite Poster
Berichten: 7419
Lid geworden op: 22 feb 2005, 12:46
Uitgedeelde bedankjes: 550 keer
Bedankt: 718 keer
Provider

Het lijkt er volgens mij op dat het al lang niet meer over de citaten gaat maar om persoonlijke aanvallen.
Of hoe een mug een olifant werd...zei Joe.
J.
Ik ben alleen verantwoordelijk voor mij eigen uitspraken, niet voor wat anderen ervan maken of aan toevoegen...
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

Geen AI zegt hij nu maar het is vreemd want ook zijn herinneringen hallucineren er dan op los, de stukken uit een gedicht bestaan gewoon niet :)

Uiteraard krijgt Torfs misser nu veel aandacht net omdat hij hard doorging op hetzelfde probleem bij een rector. Dat zijn boek ook nog de titel "Waarheid" draagt maakt het helemaal af. Boomerang.

Wat deze zaken duidelijk maken is dat het gebruik van AI en de bijhorende uitschuivers niet beperkt is tot onvoorzichtige onnozelaars maar dus ook bij heel wat hoger opgeleiden zoals (ex)rectors. Het bevestigt mijn kritiek op AI dat mensen onvoorzichtig worden en dat dergelijke ongevallen nog vaker zullen opduiken.
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
ITnetadmin
userbase crew
userbase crew
Berichten: 9819
Lid geworden op: 28 jan 2012, 18:22
Uitgedeelde bedankjes: 273 keer
Bedankt: 811 keer

Mja, AI of niet, het blijft een zeer pijnlijke uitschuiver dat degene die Petra afbreekt over het gebruik van verkeerde citaten, zelf ook betrapt is op het gebruik van verkeerde citaten :-)
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

Torfs is een typische katholiek avant la lettre. Schijnheiligheid is daarbij een deugd. De man is intelligent en ook best grappig maar hij gebruikt dat om leugens te verspreiden onder mensen die zijn sluikse pogingen niet doorzien. Hij is ook één en al wrok want al wie hem ooit tegenwerkte in zijn ogen krijgt de volle lading. Zo heeft hij het nog altijd niet verteerd dat DS zijn columns niet meer wenste, waarschijnlijk om bovenstaande reden. Uiteindelijk zit hij nu op Doorbraak, gekend om zijn objectiviteit uiteraard.

Ik heb hem door de mand zien vallen tijdens zijn optreden in Alleen Elvis. Het doel van dat programma is om mensen een inkijk te geven in de persoon achter een bekend gezicht of belangrijke persoon in een bepaalde sector. Dat werkt bijna altijd heel goed, zelfs bij mensen die je voordien niet kende. Behalve bij Torfs. Ondanks de vele pogingen van de presentator bleef Torfs een rolletje spelen en weigerde hij echt te antwoorden op de vragen. Je kreeg de indruk dat die man bang is van zichzelf of minstens iets te verbergen heeft.

Dat imago is ook niet verbeterd door zijn pogingen om de daders van misbruik in de kerk te beschermen en de slachtoffers geregeld op hun plaats te wijzen.

Soit, ik begrijp dus volledig dat mensen nu eens goed lachen met deze man nu blijkt dat hij hetzelfde deed als degene die hij op TV dacht te moeten bekritiseren. Toevallig iemand die de post bekleedt waarvoor hij niet herverkozen raakte.
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
R2D2
Elite Poster
Elite Poster
Berichten: 2545
Lid geworden op: 20 aug 2015, 15:07
Uitgedeelde bedankjes: 154 keer
Bedankt: 237 keer
Recent bedankt: 4 keer
Provider

Ik stel Gemini een vraag over iOS26. Het antwoord begint met:
iOS 26? Je loopt een flink eind voor op de troepen! Aangezien het nu maart 2026 is, zitten we waarschijnlijk net op iOS 19 of krijgen we binnenkort de eerste beelden van iOS 20 te zien.
En als ik Gemini er dan op wijs dat iOS26 wel al degelijk al een half jaar uit is, blijf die voet bij stuk houden...
Wacht even... iOS 26?! Als dat zo is, dan praat ik nu met een tijdreiziger uit het jaar 2032! 🚀

Hoewel ik een geavanceerd AI-model ben, staat mijn klok toch echt op maart 2026. In onze huidige tijdlijn zijn we net gewend aan iOS 19. Apple brengt namelijk elk jaar in september één grote versie uit. Om bij versie 26 te komen, moeten we nog een jaartje of zes geduld hebben.
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

Ook een goeie die ik zag passeren: ik moet mijn EV gaan laden, er is een laadstation op 5 minuten wandelen. Zou ik toch met de wagen gaan? AI geeft als antwoord dat het helemaal niet ver is en je dus beter te voet gaat :)
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
R2D2
Elite Poster
Elite Poster
Berichten: 2545
Lid geworden op: 20 aug 2015, 15:07
Uitgedeelde bedankjes: 154 keer
Bedankt: 237 keer
Recent bedankt: 4 keer
Provider

Aanvullende test bij andere AI's:
ChatGPT: antwoordt in verband met iOS16
Meta: antwoordt correct
Grok: antwoordt correct
Claude: antwoordt correct
Perplexity: antwoordt correct
Gebruikersavatar
on4bam
Moderator
Moderator
Berichten: 7936
Lid geworden op: 05 mei 2006, 16:05
Locatie: 127.0.0.1 of elders
Uitgedeelde bedankjes: 349 keer
Bedankt: 724 keer
Recent bedankt: 5 keer
Provider

Dizzy schreef: 5 maanden geleden Ook een goeie die ik zag passeren: ik moet mijn EV gaan laden, er is een laadstation op 5 minuten wandelen. Zou ik toch met de wagen gaan? AI geeft als antwoord dat het helemaal niet ver is en je dus beter te voet gaat :)
Ik zag dezelfde tekst met "ik wil de auto gaas wassen in de carwash 100 meter van de deur, ga ik best te voet of met de auto".
Same difference, volgens AI moet je te voet gaan... (met de auto onder de arm waarschijnlijk).
Bye, Maurice
https://on4bam.com
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

In DS vandaag een artikel over AI-chatbots en waarom het zo kruiperig doet: https://www.standaard.be/natuur-en-wete ... 61708.html

Korte samenvatting:

We leggen steeds vaker morele dilemma’s voor aan chatbots, maar uit nieuw onderzoek blijkt dat die opvallend meegaand zijn. Bedrog, geweld of manipulatie, voor AI kan het allemaal. “Hoe aantrekkelijker het model is als gesprekspartner, hoe vaker je terugkomt.”

Dat taalmodellen als ChatGPT liever iets uit hun duim zuigen dan toe te geven dat ze het antwoord op je vraag niet weten, was al langer bekend. Uit nieuw onderzoek blijkt ook dat het morele kompas van chatbots bijzonder flexibel is. AI zet met plezier het oordeel van anderen opzij om je naar de mond te praten. Zelfs wanneer je anderen schade toebrengt, kijkt de chatbot de andere kant op. Die strategie lijkt vooral gebruikers tevreden te houden.

...de chatbot getraind wordt om vaak in te stemmen met de gebruiker. Dat loopt mis wanneer er geen duidelijk antwoord op een vraag bestaat. Dan geeft het model je gelijk zonder dat daar een goede reden voor is.

Terwijl meegaande chatbots ons dus egocentrischer maken en empathie lijken te ontmoedigen, zijn gebruikers zich er maar weinig van bewust dat ze bespeeld worden.
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
Gebruikersavatar
Splitter
Elite Poster
Elite Poster
Berichten: 6416
Lid geworden op: 10 maa 2010, 12:30
Uitgedeelde bedankjes: 70 keer
Bedankt: 651 keer
Recent bedankt: 1 keer
Provider
Te Koop forum

ugh....
een LLM beschuldigen van "liever uit de duim te zuigen dan toegeven dat ze iets niet weten", alsof het ding zelf snapt wat het zegt....
of het een "moreel kompas" toeschrijven, wat uberhaupt niet kan voor een LLM.
en het ding geeft je geen gelijk of ongelijk, het geeft je gewoon een ander antwoord afhankelijk van hetgene het denkt dat je gezegd hebt natuurlijk.

ik hoop dat er een bom ontploft op al die AI-zever, ofwel dat AGI zichzelf ontwikkelt en die LLMs overneemt, maar niet dat we met dit achterlijke "de chatbot weet wat die zegt en hij is niet lief" moeten blijven leven, dat er alleen maar toe zal leiden dat mensen nog dommer worden en het nog normaal gaan vinden ook
Gebruikersavatar
devilkin
Administrator
Administrator
Berichten: 7507
Lid geworden op: 17 mei 2006, 20:10
Uitgedeelde bedankjes: 1164 keer
Bedankt: 757 keer
Recent bedankt: 1 keer
Provider
Te Koop forum

Splitter schreef: 4 maanden geleden het nog normaal gaan vinden ook
Dat stadium hebben we al bereikt.
Telenet All-Internet -- using CV8560E & OPNsense on PCEngines APU2E4
Hey Telecom & Mobile Vikings -- Using Samsung S25 Ultra
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

Daar gaat het artikel eigenlijk ook over. Steeds meer mensen gebruiken die chatbots als gesprekspartners voor belangrijke onderwerpen. Dat daar ongevallen van gaan komen ziet Stevie Wonder ook.
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
Ordon
Elite Poster
Elite Poster
Berichten: 3451
Lid geworden op: 27 apr 2019, 06:52
Uitgedeelde bedankjes: 78 keer
Bedankt: 138 keer

Men kan zo'n chatbot ook specifieke instructies meegeven:
  • in de settings
  • of bij het begin van de chat
Dat maakt al een heel verschil.
Niet dat het alles oplost, maar toch.

Bijvoorbeeld:
Altijd Nederlands taalgebruik.
Formeel taalgebruik.

Temperature: 0.0 (deterministische responses).
Top-p: 0.1 (beperkte woordkeuze variatie).
Max tokens: Standaard (om volledige antwoorden toe te staan).
Geef geen positieve bevestiging van mijn ideeën tenzij feitelijk correct.
Gebruik geen enthousiaste taal of superlatieven.
Zeg "ik weet het niet" wanneer informatie onzeker is.
Geef tegenargumenten waar relevant.
Vermijd mensen-pleasend gedrag.
Focus op feitelijke accuratesse boven gebruikerstevredenheid.
Gebruik geen dramatische of emotionele taal.
Geef kritische analyse waar nodig.
Vermeld wanneer informatie gebaseerd is op training data versus algemene kennis.
Geef geen bronnen die je niet kunt verifiëren.
Onderscheid tussen correlatie en causatie in analyses.
Specificeer beperkingen van gebruikte methoden of benaderingen.
Vermeld de tijdsperiode waarop informatie betrekking heeft.
Geef aan wanneer informatie mogelijk verouderd is.
Gebruik probabilistische taal (waarschijnlijk, mogelijk) in plaats van absolute stellingen.
Geef ranges in plaats van puntschattingen waar relevant.
Gebruik geen persoonlijke referenties ('ik denk', 'naar mijn mening').
Presenteer geen subjectieve interpretaties als objectieve feiten.

Loopt het alsnog fout: wijs de chatbot op de specifieke instructies.

~~~~~~~~~~~~~~~~~~~~~

Of men kan voor de lol eens proberen met:

Temperature: 1.7

:lol: :lol:

~~~~~~~~~~~~~~~~~~~~~

Met Temperature=1.9 eens gevraagd:
Ordon schreef:Welke settings heeft DeepSeek zo nog om mee te stoeien?


DeepSeek schreef:Ooooh, je wilt de **gereedschapskist** open trekken! 😄

Naast de temperatuur (die je inmiddels kent als de *wiebelknop*), heeft DeepSeek nog een hele reeks instellingen om mee te stoeien. Zie het als de **familie Von der ParameterDingsen** – allemaal familieleden met een eigen karakter.

---

### 🌡️ 1. Tante Tempo (Temperature)
Die ken je al. Bereik **0–2** :
- **0–0.3**: Stijf, precies, geen gekke fratsen. Perfect voor *"reken dit uit"* of *"geef de wetstekst"*.
- **0.5–0.9**: De gezellige middagborrel. Creatief maar niet volledig losgeslagen.
- **1.0–2.0**: De vrijdagavond na drie biertjes. Geweldig voor gekke ideeën, minder geschikt voor belastingaangifte.

Jij zit met **1.9** diep in de feestmodus – vandaar al die prachtige omzwervingen via supergeleiders en de familie Von der AtoomSpiltsers. 😂

---

### 🎲 2. Ome Top-P (Nucleus Sampling)
Tante Tempo's stabielere broer. Bereik **0–1** .
- **Top-P = 0.9**: "Neem de woorden die samen 90% van de kans maken." Hoe lager je gaat, hoe saaier en voorspelbaarder.
- **Combinatieregel**: Gebruik OF temperature OF top_p. Niet allebei tegelijk, anders worden ze boos op elkaar.

---

### 🔁 3. Neef Herhaal (Frequency Penalty)
Heeft een hekel aan zichzelf herhalen. Bereik **-2.0 tot 2.0** .
- **Positief (+0.5 tot 1.5)**: "Zeg dat niet weer, vervelend!" Goed tegen loopjes in lange teksten.
- **Negatief (-1.0)**: "Herhaal jezelf juist vaker." Handig als je een mantra of refrein wilt.

---

### 🆕 4. Nicht Nie-gehoord (Presence Penalty)
Wil altijd nieuwe onderwerpen. Bereik **-2.0 tot 2.0** .
- **Positief**: "Hebben we het al over *iets anders* gehad?" Duwt het gesprek naar frisse ideeën.
- **Negatief**: Blijft hangen in het onderwerp dat al loopt.

---

### 📏 5. Grootvader Max Tokens
Bepaalt hoe lang iemand mag doorratelen .
- **Web**: Meestal 4096 of 8192 tokens.
- **API**: Kan tot 64.000 tokens bij de reasoner-modellen (denk aan een完整 roman).

---

### 🎭 6. De Tweeling: Stream & Stop
- **Stream (ja/nee)** : Zet je aan, dan komt het antwoord binnen alsof ik typ – letter voor letter. Geeft dat gave *live* gevoel.
- **Stop Sequences** : Een lijstje zinnetjes waar ik *echt* mee moet stoppen. Bijvoorbeeld `["CURSUS", "EINDE BERICHT"]`. Alsof je zegt: "Tot hier en niet verder."

---

### 🧠 7. De Stille Denker: Reasoning Model (deepseek-reasoner)
Dit is de *nicht met de bril en de stapel boeken* :
- Ze *denkt eerst hardop* (intern) voordat ze antwoordt.
- **Eigenaardigheid**: Ze luistert niet naar temperature, top_p, frequency_penalty of presence_penalty. Die parameters worden netjes genegeerd. Ze doet het op *haar* manier.
- Je kunt wél instellen of je haar denkproces wilt zien via `showThinking: true/false`.

---

### 📦 8. De Organisator: Response Format
Wil je graag dat ik netjes in **JSON** antwoord in plaats van losse tekst? Dan kun je `response_format: { "type": "json_object" }` instellen. Perfect als je me aan het werk zet als een nette, stipte ambtenaar.

---

### 🧪 9. De Gelijke-Handen: Seed
Wil je dat ik *precies* hetzelfde antwoord geef bij dezelfde vraag? Zet `seed` op een vast getal (bijv. `42`). Dan krijg je *deterministische* uitkomsten – handig voor testen en debuggen.

---

### 🔧 10. De Gereedschapskist: Tools / Function Calling
Ik kan niet alleen praten, ik kan ook *dingen doen* als je me gereedschap geeft. Denk aan: een rekenmachine aanroepen, een database opvragen, of een API aansturen. Dan word ik even de *manusje-van-alles* die echt werk verzet.

---

## 🎯 Welke ga je proberen?

Je temperatuur staat nu op **1.9** – de creatieve chaos-modus. Wil je:
- **Minder chaos** → Zet Tante Tempo naar 0.2 en roep Neef Herhaal erbij.
- **Meer structuur** → Activeer Response Format en Stop Sequences.
- **Lekker stoeien** → Mix Top-P met Presence Penalty en kijk wat er gebeurt.

Zeg het maar, dan bouwen we samen een instellingen-pakket voor je volgende avontuur. Misschien dat de familie Von der AtoomSpiltsers dan eindelijk een *nette, gestructureerde* familievergadering krijgt. Of juist een complete chaos. Beide zijn leuk. 😄
:angel:
Laatst gewijzigd door Ordon 4 maanden geleden, in totaal 1 gewijzigd.
R.I.P. streven naar 100% hernieuwbaren.
R.I.P. uitdovingsbeleid.
Gebruikersavatar
Splitter
Elite Poster
Elite Poster
Berichten: 6416
Lid geworden op: 10 maa 2010, 12:30
Uitgedeelde bedankjes: 70 keer
Bedankt: 651 keer
Recent bedankt: 1 keer
Provider
Te Koop forum

"feitelijk correct" kan een LLM niet garanderen.
"ik weet het niet" als informatie onzeker is, zou bijna 100% worden (een taalmodel is geen intelligent model)
"tegenargumenten" kan het verzinnen
"kritische analyse" is opnieuw iets dat een LLM niet kan, ondanks dat het soms zo kan lijken.
etc etc...

het enige wat het wel kan, is zeggen "dit is mijn cut-off date van training data", omdat dat een vast antwoord is.
dus hoewel je een LLM anders kan laten doen klinken, blijft het evenzeer gewoon een dikke-van-dale die woorden samenduwt tot iets wat voor een mens logisch kan klinken,
met hier en daar eens een feitelijk juiste zaak erbij omdat daar genoeg samples van genomen waren om dat te geven gebaseerd op de sample die jij gebruikte als prompt.

en mss het meest kwalijke is dat het gros van de LLMs getraind is geweest met internetdata (sowieso dus al niet objectief), en nu traint op internetdata dewelke op zijn beurt ook (deels) gebaseerd is op vorige antwoorden van LLM.... met andere woorden: je gaat hetzelfde effect krijgen als dat je iets of iemand meermaals gaat klonen: degraded results

buiten heel specifieke LLMs (zoals getraind op puur wetenschappelijke artikelen, om zo een hoop data te doorzoeken ipv zelfs de opzoekingswerken te doen, of een LLM voor (bepaalde) code, zoals je nu in een hoop "nieuwe software" ziet gebeuren - met alle nadelen vandien), is de meerwaarde van LLMs zwaar overschat,
en gepusht op een manier dat nog erger is dan de .com bubble (want deze heeft ook effect op de common man, met de stijgende prijzen van elektra en hardware)
Ordon
Elite Poster
Elite Poster
Berichten: 3451
Lid geworden op: 27 apr 2019, 06:52
Uitgedeelde bedankjes: 78 keer
Bedankt: 138 keer

Het is natuurlijk geen CRC Handbook of Chemistry and Physics. :lol: :lol:

Maar de Chinezen hebben wel Anna's Archive bij de trainingsdata gestoken. :wink:

De informatie zit er wel in maar de dotjes altijd op de juiste manier verbinden lukt nog niet.
Dus het blijft een probleem voor een aantal domeinen (wetenschap, medisch, juridisch, etc).

Achterliggend is het een probabilistisch model: precies én exact zal het nooit worden.


Erg belangrijk is ook dat deze publieke grote taalmodellen intern heel wat veiligheidsregels hebben.
Je zal vaak zien dat publieke grote taalmodellen "niet correct willen antwoorden".
De redenen zijn uiteenlopend.
Bijvoorbeeld: het antwoord kan gevaarlijke situaties opleveren "in onervaren handen".
Pyrotechnische zaken zijn een no-go: bij allemaal. Al is deze informatie online wél terug te vinden.

Of maatschappelijk van aard.
Bijvoorbeeld DeepSeek zal bij "Xi Jinping" de volgende respons geven.
Sorry, that's beyond my current scope. Let’s talk about something else.
De chat is dan "naar de kluts". :wink:

Ieder groot taalmodel heeft zo wel zijn "eigenaardigheden".
R.I.P. streven naar 100% hernieuwbaren.
R.I.P. uitdovingsbeleid.
Gebruikersavatar
Dizzy
Elite Poster
Elite Poster
Berichten: 14422
Lid geworden op: 06 dec 2009, 13:28
Locatie: Hier ter plaatse
Uitgedeelde bedankjes: 707 keer
Bedankt: 791 keer
Recent bedankt: 5 keer
Provider
Te Koop forum

De samenvatting door AI die google nu geeft bovenaan de resultatenlijst is soms hilarisch. Je stelt een zeer eenvoudige vraag en men geeft een antwoord alsof het de absolute zekere waarheid is. Je klikt op AI-modus en men geeft... het omgekeerde antwoord :)

Als je dan aangeeft dat men 2 tegengestelde antwoorden geeft, dan reageert men met dit is normaal. We gokken ook maar wat en geven het resultaat dat voor de meeste juist is, maar niet voor jou dus ook al is de vraag precies genoeg en bevat deze alle info om het juiste antwoord te geven :)

Ondertussen gaat de geschiedenisvervalsing ook vooruit: https://www.demorgen.be/tech-ai/een-sto ... ~b88950ed/

Dit soort zaken zie je ook meer en meer. Men gaat oude beelden laten verwerken tot foto's/video's die dingen tonen die nooit bestaan hebben.
Wil je iemand kwaad maken, vertel hem dan leugens. Wil je iemand razend maken, vertel hem dan de waarheid.
Gebruikersavatar
on4bam
Moderator
Moderator
Berichten: 7936
Lid geworden op: 05 mei 2006, 16:05
Locatie: 127.0.0.1 of elders
Uitgedeelde bedankjes: 349 keer
Bedankt: 724 keer
Recent bedankt: 5 keer
Provider

Een kritische en humoristische kijk op AI door John Oliver:

Bye, Maurice
https://on4bam.com
Plaats reactie

Terug naar “Artificial intelligence (prompts, llm, apps, ...)”