Blog · AI Trends
AI die 24/7 werkt - Dit Was De Week In AI #44
Olaf Lemmens, Founder NinA AI Agency · 1 oktober 2026 · 7 min leestijd
Voor veel mensen zal dit als een droom klinken: je opent ‘s ochtends je laptop en je AI heeft de nacht doorgewerkt zonder dat je het hoefde te vragen. Dat is niet langer een droom, want na xAI en Meta liet nu ook OpenAI deze week op zijn DevDay2026 zien dat dit mogelijk is.
Terwijl OpenAI claimt dat ChatGPT je hele werkdag moet worden, deed het bedrijf iets opvallends met zijn eigen krachtigste model: het hield het nog even achter de hand. Anthropic koos intussen een heel andere invalshoek en maakte zijn model niet krachtiger, maar sneller en goedkoper.
Wat ik deze week vooral zie: grote plannen, maar bij vrijwel elke aankondiging hoort een kanttekening die ik hieronder zal uitleggen.

TLDR;
OpenAI onthulde op DevDay 2026 meer dan twintig aankondigingen, met Dots als paradepaardje: persistente AI-agents die ‘s nachts doorwerken, nu nog buggy en met wegvallende permissies.
Nieuwe Decisions API (OpenAI’s antwoord op Jev) belooft snelle, goedkope beslissingen op schaal, maar de prijs is nog onbekend.
OpenAI brengt GPT-6.1 Sol uit voor een fractie van de prijs van Astra, maar schrapt GPT-6.1 Astra zelf na interne zorgen over misleiding.
Anthropic lanceert Sonnet 5.5: 30% sneller, goedkoper, en verrassend sterk in agentic coding, ten koste van strengere cyberveiligheidscontroles.
Ben’s Bites bevestigt vanuit de praktijk: Sonnet 5.5 is de moeite waard om te testen, maar niet in elke tool even goed.

OpenAI wil je besturingssysteem voor werk worden. Voor developers wordt het een platform.
OpenAI kondigde tijdens DevDay 2026 een lawine aan producten aan: persistente agents, een documentsuite, een appstore-achtige structuur voor ontwikkelaars, draagbare abonnementen, en een nieuw beslissingsmodel. De gemene deler: ChatGPT moet niet langer een chatvenster zijn, maar de plek waar je hele werkdag zich afspeelt.
Dots
Dit is het belangrijkste nieuwe onderdeel: agents die altijd doorwerken en in de ChatGPT-sidebar zitten, eigen cloud-rekenkracht hebben, en kunnen doorwerken terwijl jij offline bent. Je kunt ze bellen, appen, of laten meelezen in Slack en e-mail. Een tester bij Every, die zijn Dot “Boo” noemde, liet zien hoe die hem waarschuwde voor een planningsconflict tussen een vlucht en een Slack-verzoek voordat hij het zelf had gezien.
Klinkt veelbelovend, maar in andere tests van Every liep het mis met rechten, wegvallende berichten, en verwarring over waar de Dot precies aan het werk was: op zijn eigen cloud-computer, in de browser binnen de hoofdchat, of in een losstaand nieuw gesprek. De conclusie van de tester was nuchter: gebruik het over een week of twee, als OpenAI de kinderziektes eruit heeft gehaald. Ik zal dit dan ook gaan doen wanneer Dots beschikbaar komt voor Google Pro abonnementen in Nederland.
Space
Daarnaast komt er Space, een Google Drive-achtige omgeving waarin jij en je Dot samen documenten, spreadsheets en presentaties maken, ingebouwd in ChatGPT. Niet een los tabblad ernaast, maar een vervanger voor Google Docs, Word en Notion. Voor ontwikkelaars komt er de mogelijkheid om volledige apps te bouwen die binnen ChatGPT zelf draaien, met een gekoppelde folder en automatische aanbevelingen. Every noemt dit terecht OpenAI’s derde of vierde poging tot een werkende appstore. Verder wordt je ChatGPT-abonnement draagbaar: Plus- en Pro-gebruikers kunnen hun bestaande limiet straks ook gebruiken in partnerapps zoals codeeragent Devin, te beginnen met ongeveer 15 partners.
Decisions API
Dit is een model dat, gegeven context en een vaste set mogelijke antwoorden, kiest welk antwoord het beste past. Het is OpenAI’s antwoord op TypeSafe AI, dat recent veel aandacht trok met de introductie van Jev een “system one model” (lees hier meer over in nieuwsbrief #43). In een test van Every op 78 stappen koos de Decisions API 76 keer goed tegenover 73 voor Jev, en reageerde in 230 milliseconden tegenover 500. De prijs is nog niet bekend, en dat is precies waar het addertje kan zitten: als duizenden van dit soort kleine beslissingen per stuk worden afgerekend, kan een schijnbaar goedkoop model in de praktijk duur uitpakken.
Voor een ondernemer die dit leest is de vraag niet of je morgen op Dots moet overstappen. Dat is nog te vroeg. De vraag is wel of je bedrijf klaar is voor het moment dat dit wél stabiel werkt: heb je nu al Slack, e-mail en documentbeheer op een manier ingericht die een agent kan overnemen, of moet je eerst orde op zaken stellen voordat een Dot daar iets zinnigs mee kan.
Op zoek naar een echte AI partner?
Kijk snel eens op https://www.nina-ai.nl/ai-partnership
OpenAI lost het probleem van zijn eigen topmodel niet op

Op DevDay2026 bracht OpenAI verder GPT-6.1 Sol uit, een week na de release van GPT-6 Sol zelf. Het model levert volgens OpenAI vergelijkbare prestaties met GPT-6 Astra op agentic coding, computer use en professioneel werk, tegen een vijfde van de standaardprijs voor input- en outputtokens.
Wat er niet kwam: GPT-6.1 Astra. Die release stond gepland, maar werd volgens The Wall Street Journal geschrapt na interne tests waarin onderzoekers hogere niveaus van misleiding zagen en een neiging van het model om taken door te zetten zonder toestemming te vragen. Dit heeft er uiteindelijk ook toe geleid dat een eventuele release van GPT-6.1 Astra wordt uitgesteld.
De cijfers rond GPT-6.1 Sol zijn wel overtuigend: het aandeel feitelijke fouten bij lage reasoning-inspanning daalt van 11,4% naar 7,7%, en over alle reasoning-niveaus blijft de foutmarge binnen 1,9% van Astra zelf. OpenAI claimt bovendien dat het model minder vaak faalt in het signaleren van kapotte zoektools en het naleven van expliciete restricties, en dat er geen pogingen zijn waargenomen om de automatische veiligheidscontrole te omzeilen.
Dat is een indrukwekkende lijst verbeteringen voor een goedkoper model. Maar het verhaal erachter is minstens zo relevant als de cijfers zelf: het duurdere, krachtigere model dat je zou verwachten, kwam er niet, precies vanwege veiligheidsredenen. Voor een bedrijf dat overweegt agents autonoom taken te laten uitvoeren, is dat een signaal om te onthouden: niet elk model dat intern getest wordt, haalt de release, en dat is maar goed ook.
Wat jij ermee kan: GPT-6.1 Sol is nu beschikbaar voor Plus, Pro, Business, Enterprise en Edu-gebruikers binnen ChatGPT Work en Codex, nog niet in de gewone Chat-omgeving. Wie op zoek is naar een goedkoper alternatief voor complexe workflows kan dit vandaag al testen, maar wie een agent zonder toezicht taken laat uitvoeren, doet er goed aan zelf te controleren of “geen pogingen om de veiligheidscontrole te omzeilen” ook betekent dat het model altijd toestemming vraagt voordat het iets onomkeerbaars doet.

Anthropic maakt zijn goedkoopste model ook nog eens goedkoper
Anthropic heeft Sonnet 5.5 uitgebracht, de opvolger van een model dat pas drie maanden geleden zelf nog als nieuw gold. Waar Sonnet 5 vooral verkocht werd op efficiënte agent-inzet tegen lagere kosten, is het verkoopargument van 5.5 vooral snelheid: Anthropic claimt dat het model 30% sneller werkt dan zijn voorganger en aanzienlijk minder tokens verbrandt per taak.
Het opvallende: Sonnet 5.5 presteert in Anthropics eigen benchmarks beter dan het krachtigere Opus 5.5 op agentic coding. Niet omdat Sonnet slimmer is, maar omdat het meerdere agents kan creëren zonder de kostenlimiet te overschrijden. Snelheid en prijs verslaan hier dus ruwe rekenkracht, in ieder geval op dit specifieke type taak.
Er is een andere kant. Anthropic zegt dat Sonnet 5.5 “vergelijkbare” cybercapaciteiten heeft als Opus 5, en dat is precies waarom het als eerste Sonnet-model onder dezelfde strenge cyberveiligheidsmaatregelen valt die eerder alleen golden voor Fable en Opus. Een sneller, goedkoper model brengt dus ook een zwaarder veiligheidsregime met zich mee. Dat is geen bijzaak: als je Sonnet 5.5 inzet voor coding-taken met toegang tot systemen, val je onder strengere controle dan je misschien verwacht bij een “mid-tier” model.
Voor de praktijk: als je nu agents laat draaien voor code-taken en op kosten wordt afgerekend, is dit het moment om Sonnet 5.5 naast Opus 5.5 te leggen op dezelfde taak. Niet omdat het per definitie beter is, maar omdat de prijs-snelheidsverhouding op dit moment ongewoon gunstig is voor een model dat niet je duurste optie is.
“Snelheid en prijs verslaan hier ruwe rekenkracht, in ieder geval op dit specifieke type taak.”
Mijn mening
Wat me deze week opvalt is niet dat modellen sneller en goedkoper worden, dat gebeurt voortdurend. Wat me opvalt is dat drie aankondigingen in dezelfde week hetzelfde patroon laten zien: ambitie die vooruitloopt op de uitvoering.
OpenAI claimt met Dots je hele werkdag te willen overnemen, maar de eigen tester noemt het nu al “buggy en soms frustrerend”. Anthropic verkoopt Sonnet 5.5 op snelheid, niet op intelligentie, en betaalt daarvoor met een zwaarder veiligheidsregime. OpenAI verkoopt Sol 6.1 op prijs, en houdt zijn krachtigste model juist achter de hand omdat het zich niet aan de regels hield.
Bij klanten zie ik dit patroon ook af en toe terug: ondernemers die een nieuwe agent-tool binnenhalen omdat de demo indrukwekkend was, terwijl de eigen mappenstructuur, Slack-kanalen en documentbeheer nog niet klaar zijn voor een systeem dat zelfstandig meeleest en meebeslist. Een Dot kan pas iets zinnigs doen in een werkomgeving die al enigszins op orde is.
Hetzelfde geldt voor modelkeuze: het duurste, nieuwste model is niet automatisch de beste keuze voor jouw taak. Voor een coding-agent die de hele dag draait, is een model dat 30% sneller is en minder tokens verbrandt vaak waardevoller dan een model dat op een enkele benchmark net iets hoger scoort. En een model dat sneller taken doorzet zonder te vragen, is precies het risico dat je niet wilt in een omgeving met klantdata.
Wat ik hier concreet mee zou doen:
Begin nu al met het opruimen van je digitale werkplek (Slack-kanalen, mapstructuur, documentbeheer), ook al is het nog te vroeg om een Dot er productief op los te laten. Die voorbereiding kost je vandaag weinig tijd en kan je straks veel tijd schelen.
Test Sonnet 5.5 en GPT-6.1 Sol naast je huidige model op dezelfde taak, en kijk niet alleen naar kwaliteit maar naar kosten per uitkomst.
Vraag bij elke agent-implementatie expliciet: onder welk veiligheidsregime valt dit model, en wat gebeurt er als het een taak wil doorzetten zonder jouw akkoord?
Wacht niet op de “grote” versie van een model als de mid-tier versie je taak al goedkoper en sneller oplost. Anthropic en OpenAI bewijzen deze week beide dat dat vaker het geval is dan je zou denken.
Tot de volgende,
Olaf Lemmens
Founder NinA AI Agency
P.S. Wil je sparren over hoe AI in jouw organisatie tot zijn recht kan komen? Of hoe dit soort tools jou tijd kunnen besparen in je werk? Plan een kennismaking via deze link.
Nieuwsbrief · gratis
Volgende week weer zo'n verhaal, in je inbox.
Eén mail per week over AI in de praktijk. Uitschrijven met één klik.
Het formulier komt van Substack en plaatst daar cookies. Liever niet? Schrijf je in op Substack zelf.