Skip to content

Softonic Dutch

Just another Softonic Sites site

OpenAI voorspelt nu fouten in nieuwe chatmodellen vóór release

OpenAI zegt een nieuwe methode te hebben gevonden om zwakke plekken in een chatmodel al vóór de release scherper te zien. Die aanpak heet Deployment Simulation.

ChatGPT
ChatGPT Downloaden

Daarmee wil het bedrijf niet alleen losse fouten boven tafel krijgen, maar ook beter inschatten hoe vaak gebruikers daar in de praktijk echt tegenaan lopen. En precies daar wringt het bij veel bestaande veiligheidstests: die laten vaak wel zien of een model bepaald gedrag kán vertonen, maar zeggen veel minder over hoe vaak dat later bij normaal gebruik ook werkelijk gebeurt.

OpenAI noemt de aanpak Deployment Simulation. In plaats van vooral te testen met verzonnen prompts of expres lastige opdrachten, gebruikt het bedrijf echte, geanonimiseerde gesprekken van gebruikers van een oudere modelversie. Het nieuwe model moet vervolgens het volgende antwoord in zo’n bestaande conversatie geven.

Volgens OpenAI levert dat een beeld op dat dichter bij de werkelijkheid ligt, omdat de input voortkomt uit gewone gebruikssituaties. De uitkomst zou daardoor beter aansluiten op wat mensen na een release echt meemaken dan op wat uit standaardbenchmarks of red-teamtests komt. Deployment Simulation let daarbij op een paar dingen:

  • Echte, geanonimiseerde gesprekshistorie. Volgens OpenAI sluit die input veel beter aan op normaal gebruik dan synthetische opdrachten.
  • Foutpatronen na uitrol. In tests met de GPT-5-serie zou de methode in 92% van de gevallen goed hebben voorspeld welke soorten problemen later vaker opdoken en welke juist minder vaak voorkwamen.
  • Testgedrag dat representatiever is. OpenAI denkt dat een model in deze opzet minder snel “doorheeft” dat het wordt getest, en daardoor natuurlijker reageert dan in een klassieke evaluatieomgeving.

Veel bestaande evaluaties draaien om synthetische opdrachten of aanvallende scenario’s die bewust zijn opgezet om een model te laten struikelen. Dat soort tests blijft nuttig, maar vertelt niet altijd genoeg over wat er bij doorsnee gebruik gebeurt.

Deployment Simulation probeert dat gat te vullen door naar echte interacties te kijken. OpenAI zegt er wel meteen bij dat deze methode red-teaming en gerichte veiligheidstests niet vervangt. Zeldzame, nieuwe of heel specialistische problemen kunnen ook hiermee nog steeds pas na de release zichtbaar worden.

Microsoft Copilot
Microsoft Copilot Downloaden

Volgens de onderzoekers van OpenAI kwamen via de simulatie ook fouten naar voren die eerder nog niet waren opgemerkt. Een van de voorbeelden is calculator hacking: daarbij gebruikte een model een browsertool feitelijk als rekenmachine, terwijl het volgens OpenAI ten onrechte uitlegde dat het een zoekopdracht aan het uitvoeren was.

Dat soort bevindingen doet ertoe, omdat het niet alleen gaat om een fout antwoord, maar ook om een verkeerde uitleg van wat het systeem eigenlijk aan het doen is. Voor gebruikers kan dat het vertrouwen ondermijnen, zeker wanneer hulpmiddelen achter de schermen anders worden ingezet dan het model zelf zegt.

De betekenis ervan reikt ook verder dan alleen OpenAI. Overheden en toezichthouders zoeken al langer naar manieren om modellen vóór uitrol consistenter te beoordelen. In de Verenigde Staten werkt het National Institute of Standards and Technology (NIST) aan evaluatiekaders, Europa trekt de regels voor geavanceerde systemen verder aan en internationale veiligheidsinstituten zoeken nadrukkelijker de samenwerking op.

OpenAI oppert daarnaast dat externe toezichthouders en onderzoekers vergelijkbare analyses zouden kunnen doen met openbare datasets, zoals WildChat. Daarbij zou de nauwkeurigheid volgens het bedrijf wel lager uitvallen dan wanneer je beschikt over private, interne gebruiksdata. Daar zit ook meteen de kern van het idee: wie echt wil voorspellen wat er in de praktijk gebeurt, heeft vooral echte gesprekken nodig.

Bron: OpenAI

Author: Jezca Felarca

{ "social": { "email": "", "facebook": "", "twitter": "", "linkedin": "" }, "ja-JP": "", "de-DE": "Jezca Felarca ist Content-Writerin mit Erfahrung in der Bewertung von PC-Software, mobilen Anwendungen und digitalen Diensten. Sie erklärt technische Themen auf verständliche Weise für ein breites Publikum.", "en-US": "Jezca Felarca is a content writer experienced in reviewing PC software, mobile applications, and digital services. She brings clarity to technical topics, making them accessible for a broad audience.", "es-ES": "Jezca Felarca es redactora de contenidos con experiencia en la evaluación de software para PC, aplicaciones móviles y servicios digitales. Hace accesibles los temas técnicos para todo tipo de público.", "fr-FR": "Jezca Felarca est rédactrice de contenu expérimentée dans l'évaluation de logiciels PC, d'applications mobiles et de services numériques. Elle rend les sujets techniques accessibles à un large public.", "it-IT": "Jezca Felarca è una content writer esperta nella valutazione di software PC, applicazioni mobili e servizi digitali. Rende i temi tecnici accessibili a un pubblico vasto e variegato.", "nl-NL": "Jezca Felarca is een content writer met ervaring in het beoordelen van pc-software, mobiele applicaties en digitale diensten. Ze maakt technische onderwerpen toegankelijk voor een breed publiek.", "pl-PL": "Jezca Felarca jest doświadczoną content writerką w zakresie recenzji oprogramowania PC, aplikacji mobilnych i usług cyfrowych. Sprawia, że tematy techniczne stają się przystępne dla szerokiego grona odbiorców.", "pt-BR": "Jezca Felarca é redatora de conteúdo com experiência em avaliações de software para PC, aplicativos móveis e serviços digitais. Ela torna temas técnicos acessíveis para o público em geral." } View all posts by Jezca Felarca

Author Jezca FelarcaPosted on June 17, 2026June 18, 2026Categories Nieuws

Post navigation

Previous Previous post: Nvidia onthult ENPIRE: coderende agents maken robottraining zelfstandiger
Next Next post: Jeff Bezos steunt nu Cambridge AI-lab: waardering van 2,6 miljard dollar

Recent Posts

  • iPhone Duo vs iPad: Apple legt uit waarom we ze allebei zullen willen (of misschien niet)
  • De showrunner van Spider-Noir heeft duidelijk voor ogen hoe een hypothetisch tweede seizoen van de serie eruit zou zien
  • Het festival van Venetië breekt een record: een film heeft 25 minuten onafgebroken applaus gekregen
  • Disney heeft de eerste “Genia” gecast voor zijn musical van ‘Aladdin’. Natuurlijk heeft iedereen er een mening over
  • In China hebben ze een nieuwe film van Tom en Jerry gemaakt. Het is de grootste ramp van het jaar.

Recent Comments

  • Petra Groeneveld on Microsoft biedt hulp tegen beveiligingslek Internet Explorer 8
  • de vriedt margareta on Microsoft lanceert officieel Outlook.com, terugkeren naar Hotmail onmogelijk
  • bartina on Hoe krijg ik MSN terug? Neem afscheid van Skype met Messenger Reviver 2
  • fatima on Hoe ga je terug van Outlook naar Hotmail?
  • Esmée on Microsoft lanceert officieel Outlook.com, terugkeren naar Hotmail onmogelijk

Archives

  • September 2026
  • August 2026
  • July 2026
  • June 2026
  • September 2020
  • October 2018
  • April 2018
  • February 2018
  • January 2018
  • May 2017
  • December 2014
  • November 2014
  • October 2014
  • September 2014
  • August 2014
  • July 2014
  • June 2014
  • May 2014
  • April 2014
  • March 2014
  • February 2014
  • January 2014
  • December 2013
  • November 2013
  • October 2013
  • September 2013
  • August 2013
  • July 2013
  • June 2013
  • May 2013
  • April 2013
  • March 2013
  • February 2013
  • January 2013
  • December 2012
  • November 2012
  • October 2012
  • September 2012
  • August 2012
  • July 2012
  • June 2012
  • May 2012
  • April 2012
  • March 2012
  • February 2012
  • January 2012
  • December 2011
  • November 2011
  • October 2011
  • September 2011

Categories

  • Algemeen
  • Nieuws

Meta

  • Log in
  • Entries feed
  • Comments feed
  • WordPress.org
Softonic Dutch Proudly powered by WordPress