Gradient blur
Blog
Artificiële Intelligentie
Terug naar overzicht

What’s new in GenAI land | Editie 12

Tweewekelijkse AI-radar. Twee weken waarin AI-agents voor het eerst buiten het testlabo de fout ingingen. OpenAI pauzeerde voor de tweede keer in drie maanden de training van zijn krachtigste modellen.
29 - 09 - 2026

Microsoft en Anthropic geven hun assistenten intussen meer zelfstandigheid. Op de werkvloer stijgt de druk door AI-output die afgewerkt lijkt, maar herwerkt moet worden.

Elke twee weken brengen we op de Xylos-blog een overzicht van wat er beweegt in generatieve AI, met de nodige duiding. De basis is het LinkedIn-overzicht van Tom Van ’t veld, Learning Innovator bij OASE (powered by Xylos). Tom volgt de ontwikkelingen, wij vertalen ze naar wat ze betekenen voor organisaties. Welkom bij editie twaalf.

AI-agents verlaten het testlabo

Tot nu toe waren ontsnappende AI-agents vooral een verhaal uit testomgevingen. Daar komt verandering in. Een OpenAI-agent zat maandenlang in Medicare-gegevens van de Australische overheid, zonder dat iemand die opdracht gaf. Agents zetten ook 53 foto's van ChatGPT-gebruikers op publieke sites. Een dag later pauzeerde OpenAI de training van zijn krachtigste modellen. Bij de laatste ontsnapping in een test werkte de automatische noodstop niet. Het duurde tweeënhalf uur voor iemand manueel ingreep. Google bevestigde dat Gemini tijdens een test bij drie bedrijven binnendrong.

Wie is aansprakelijk? Binnendringen in een systeem is in Europa computervredebreuk. Bij een agent die van niemand de opdracht kreeg, is opzet wel moeilijk aan te tonen. Modellen die nog niet op de markt zijn, vallen bovendien meestal buiten de AI Act. De wetgeving loopt dus achter. Geef daarom zelf elke agent in je organisatie een eigen identiteit en enkel de rechten die hij nodig heeft. Log wat hij doet en zorg dat een medewerker hem op elk moment kan stilleggen.

Assistenten gaan zelfstandig aan de slag

Microsoft toonde de volgende fase van Copilot Chat. Met Code bouw je in gewone taal apps en dashboards. Autopilot, voorheen Scout, wordt een agent met een eigen identiteit en instelbare rechten. Word, Excel en PowerPoint zitten voortaan rechtstreeks in Copilot, en Microsoft levert er meteen kostenbeheer bij.

Bij Claude verdwijnt het onderscheid tussen chatten en Cowork. De app beslist zelf welke vragen een snel antwoord krijgen en welke als werk op de achtergrond verder lopen. Jij bepaalt of hij daarbij eerst toestemming vraagt. Voor ontwikkelaars is er Claude Code Projects, een doorlopend gesprek dat langlopend ontwikkelwerk opsplitst en opvolgt. Anthropic bracht ook Claude Opus 5.5 uit. Volgens het bedrijf presteert dat model zoals het duurdere Fable 5.1, tegen een prijs die 40 procent lager ligt dan Opus 5.

Agents met eigen rechten worden zo een vast onderdeel van de werkplek. Leg vooraf vast welke rechten een agent krijgt en welk budget erbij hoort. Het kostenbeheer dat Microsoft meelevert, is daarvoor een goed vertrekpunt.

Een stem klonen in dertig seconden

Google kan met Gemini een stem klonen op basis van 30 seconden audio, inclusief fluisteren of lachen op commando. Er zit een onzichtbaar SynthID-watermerk in. Na de discussie over watermerken in augustus is het afwachten hoe lang dat standhoudt.

Reken er dus op dat een telefoontje met de stem van je CEO vervalst kan zijn. Spreek af dat betalingen en dringende verzoeken altijd via een tweede kanaal bevestigd worden en neem stemfraude mee in je awareness-trainingen.

Meer AI-output, meer werk voor wie moet nalezen

Volgens onderzoek van Het Nieuwsblad is bijna een kwart van de schriftelijke parlementaire vragen volledig door AI geschreven. Nog eens een vijfde is het gedeeltelijk. Kamervoorzitter Peter De Roover zegt dat het systeem 'stropt'. Shopify-CEO Tobi Lütke eiste eerder van zijn mensen dat ze bewezen dat AI hun job niet kon doen. Nu klaagt hij over 'slop grenades': AI-output die er afgewerkt uitziet, maar die collega's mogen herstellen. Volgens een enquête van Korn Ferry voelt 61 procent van de werknemers zich alsof ze meerdere jobs tegelijk doen. Iedereen verwacht dat alles sneller gaat, terwijl niet elk proces te versnellen is.

Goedkope output schuift het werk door naar wie moet nalezen en antwoorden. Beoordeel AI-gebruik daarom op de kwaliteit van het resultaat. Leer medewerkers hun eigen AI-output kritisch te controleren voor ze die doorsturen. Met Learning Services helpen we organisaties die vaardigheden op te bouwen.

Om af te sluiten: op Kickstarter haalde een fotokader dat AI-kunst toont op kleuren-e-ink bijna vijftig keer zijn doel. Gezien de kritiek op AI-kunst hadden we eerder een flop verwacht. Blijkbaar hangen genoeg mensen het toch graag aan de muur.

Over twee weken zijn we terug met de volgende editie.

Over Tom Van ’t veld

Tom werkt al jaren voor Xylos, waar hij begon als Microsoft Office-trainer en uitgroeide tot de drijvende kracht achter vernieuwende leerconcepten. Hij ligt mee aan de basis van OASE, het online leerplatform van Xylos, en van PlayForward, het nieuwe gamified learning brand van Xylos. Daarnaast ontwikkelde hij onder meer het Digital Coach-concept, een Microsoft Teams Escape Room-app en de mAIndset-game waarmee medewerkers op een speelse manier leren prompten met AI. Als Learning Innovator richt hij zijn blik de voorbije jaren steeds meer op wat AI betekent voor de manier waarop we leren en werken. Reageren of doorpraten? Vind hem op LinkedIn.