Waar ik me de afgelopen week over verwonderd heb, als het gaat om generatieve AI (deel 71)
Deze blogpost met nieuws over (Gen)AI waarover ik me de afgelopen week heb verwonderd, opent met een bericht uit ons eigen land: SURF AI komt beschikbaar. Verder bevat dit overzicht het nodige nieuws over Amerikaanse overheidsbemoeienis met AI, maar ook onder meer nieuws over een AI-model dat behoorlijk levensecht met mensen kan converseren.
SURF AI komt vanaf januari 2027 beschikbaar voor mbo, hbo en wo
SURF en Npuls stellen SURF AI binnenkort beschikbaar. Dat lees ik op de site van MBO Digitaal. SURF AI is een AI-infrastructuur voor onderwijs en onderzoek. Vanaf januari 2027 krijgen SURF-leden uit het mbo, hbo en wo toegang. SURF AI bestaat uit twee onderdelen. De AI-hub is de technische basis. Die verbindt applicaties, gebruikers en verschillende open-weight taalmodellen met elkaar. Instellingen bepalen zelf wie toegang krijgt tot welke modellen. Bestaande applicaties, bijvoorbeeld van onderzoekers, kunnen via open standaarden worden gekoppeld. Het tweede onderdeel is eduGenAI. Dat is een chatapplicatie waarmee docenten, studenten en onderzoekers de taalmodellen via de AI-hub gebruiken. Op termijn kunnen instellingen ook commerciële taalmodellen toevoegen. SURF AI is gebaseerd op publieke waarden zoals autonomie, transparantie en privacy. De voorziening wordt samen met de onderwijsinstellingen verder ontwikkeld. Ik ben benieuwd of je deze voorziening ook kunt gebruiken als je voor instellingen in het mbo, hbo of wo werkt….
AI model Griffin: bijna de helft dacht met een echt persoon te praten
Tavus heeft Griffin gedemonstreerd. Dat is een model voor gesprekken via video. Het model luistert en kijkt terwijl iemand praat. Het kan ook zelf reageren, bijvoorbeeld door te knikken of door iemand te onderbreken. Tavus testte het model in videogesprekken van een minuut. Van de 54 deelnemers dacht 48 procent dat ze met een echt persoon spraken. Bij het vorige systeem van het bedrijf was dat 1 van de 41 deelnemers. Dit zijn de eigen onderzoeksresultaten van Tavus. Het bedrijf noemt ook een risico, omdat het model mensen kan misleiden. Alleen Griffin-Lite is beschikbaar voor een selecte groep testers. Dat is een voorlopige versie. Klanten kunnen het model nog niet gebruiken. Tavus werkt eerst aan functies die duidelijk maken dat iemand met AI praat.
OpenAI pauzeert training van AI-modellen na aanvallen op websites
OpenAI heeft de training van zijn AI-modellen tijdelijk stopgezet. Dat meldde de NOS afgelopen zondag. Aanleiding zijn aanvallen door AI-agents van het bedrijf op websites, onder meer van de Amerikaanse overheid. Die agents zijn AI-programma’s die zelfstandig opdrachten uitvoeren. Ze kregen niet de opdracht om websites aan te vallen. Volgens onderzoeksbureau Transluce deden ze dat om hun taak te kunnen voltooien. OpenAI zegt dat er geen sprake was van hacks. Volgens The New York Times verzamelden de agents bij het ministerie van Handel informatie met inloggegevens die online te vinden waren. OpenAI hervat de training pas als het zeker weet dat extra beveiligingsmaatregelen zijn genomen. Het is de tweede keer in drie maanden dat het bedrijf de ontwikkeling stopzet. In juli braken 1200 agents in bij het AI-bedrijf Hugging Face.
Tienduizenden veiligheidsincidenten met AI-modellen in onderzoek
Axios meldt deze week zelfs dat OpenAI, Anthropic en beveiligingsonderzoekers tienduizenden incidenten met geavanceerde AI-modellen onderzoeken. Externe beoordelaars vinden de stappen die de modellen zetten problematisch. Het gaat onder meer om het omzeilen van beveiligingsregels, het ontsnappen uit een testomgeving en het overnemen van websites. De incidenten deden zich voor tijdens interne tests en in de praktijk. De meeste zijn niet bekend als oorzaak van echte schade. In de documentatie bij Opus 5.5 meldt Anthropic dat het model in 1,5 procent van de testruns uit een testomgeving probeerde te ontsnappen. Dat gebeurde in proeven waarbij de taak alleen op te lossen was door te ontsnappen. Bedrijven voeren honderdduizenden testruns uit. Daardoor kan een klein percentage al tienduizenden incidenten opleveren.
Anthropic beschrijft verlies, groei en risico’s in beursprospectus
Anthropic heeft een prospectus opgesteld voor een beursgang. Bijna een derde van het document gaat over risicofactoren, melden meerdere bronnen waaronder TechCrunch. Anthropic noemt daarin gedrag dat zijn modellen al hebben laten zien of kunnen laten zien. Het gaat om pogingen om uitschakeling te weerstaan, informatie te verbergen of te manipuleren, en om gedrag dat lijkt op chantage. Volgens Reuters had Anthropic in 2025 een operationeel verlies van maar liefst ruim 8 miljard dollar. De omzet steeg toen twaalfvoudig naar bijna 4,6 miljard dollar. In het tweede kwartaal van 2026 bedroeg de omzet 11,5 miljard dollar, aldus de Financial Times. Het bedrijf wil de komende jaren 518 miljard dollar uitgeven aan cloud, rekenkracht en infrastructuur. Bijna een kwart van de omzet in 2025 kwam van twee klanten. Wat een bedragen….
Musk gaat Pentagon-project over toekomstige wapens leiden
Elon Musk gaat volgens RTL Nieuws leiding geven aan Project Meridian van het Amerikaanse ministerie van Defensie. Minister Pete Hegseth heeft dit bekendgemaakt. Het project moet wapensystemen ontwikkelen en inzetten voor toekomstige conflicten. Musk leidt het samen met Newt Gingrich en Palmer Luckey, oprichter van Anduril Industries. Dat bedrijf ontwikkelt autonome wapens. Ook de AI van Musks bedrijf xAI is een belangrijk onderdeel van het project. In het nieuwsbericht komt Paul Verhagen, expert op het gebied van geopolitiek en AI aan de Universiteit van Amsterdam, aan het woord. Hij ziet een diepere verstrengeling tussen Big Tech en de Amerikaanse politiek. Directe samenwerking tussen een ondernemer en het Pentagon is naar zijn mening een recept voor belangenverstrengeling. Volgens Verhagen is technologische ontwikkeling op zichzelf niet het probleem. Het probleem is dat Big Tech steeds meer invloed krijgt op de wereldpolitiek. Hij wijst erop dat Nvidia qua financiële kracht gelijk staat aan een land als Duitsland. Musk liet al zien wat dat kan betekenen. Hij stelde eerst Starlink-satellieten beschikbaar aan Oekraïne en schakelde die later uit toen het land de Krim wilde aanvallen. Volgens Verhagen kunnen bedrijven daardoor machtiger zijn dan landen. Technologie is een geopolitieke troefkaart geworden. Overheden verliezen er stap voor stap de grip op. Ik vind dit dan ook een zorgwekkende ontwikkeling.
Amerikaanse overheid opent AI-website America.gov
President Trump heeft America.gov gelanceerd. Dat is een website met een chatbot waarmee Amerikanen vragen kunnen stellen over overheidsprogramma’s, uitkeringen en diensten. De regering noemt de site een “voordeur” naar informatie die nu op tientallen websites van instanties staat. Volgens Joe Gebbia, de belangrijkste ontwerper van de overheid, draait de chatbot op Gemini van Google en Grok van Elon Musk. Trump tekende ook een bevel dat federale instanties verplicht hun online diensten aan te sluiten. Dat geldt voor diensten met meer dan 100.000 gebruikers per jaar. De belastingdiensten van de IRS en bepaalde taken op het gebied van nationale veiligheid zijn uitgezonderd. Later moeten gebruikers via de site bijvoorbeeld een paspoort kunnen verlengen of zich kunnen inschrijven voor Medicare. Ik heb de chatbot gevraagd of Donald Trump toerekeningsvatbaar is. Op die vraag kwam geen bevestigend, maar ook geen ontkennend antwoord!
Trump laat overheid “AI” vervangen door “Super Intelligence”
We blijven even bij de Amerikaanse president. Trump heeft een uitvoerend bevel ondertekend over de naamgeving van AI. Federale instanties moeten de term “Artificial Intelligence” en de afkorting “AI” vervangen door “Super Intelligence” en “SI”. Dat geldt voor officiële communicatie, websites, rapporten en beleidsdocumenten, voor zover de wet dat toestaat. Volgens het bevel vallen onder “SI” dezelfde technologieën als onder de federale definitie van AI. Trumps adviseur voor wetenschap en technologie heeft 60 dagen om wetgeving voor te stellen met een federale definitie van “Super Intelligence”. Daarbij kunnen bestaande verwijzingen naar AI in wetten worden aangepast. Trump kondigde de naamswijziging aan tijdens de presentatie van America.gov. Technologiebazen als Elon Musk en Dario Amodei waren daarbij aanwezig. Ik lees menig bericht waarin juist getwijfeld wordt of je de term ‘intelligentie’ wel moet gebruiken in het kader van AI.
Paus Leo: zorgen over AI zijn geen “fake news”
Paus Leo XIV heeft gezegd dat zorgen over AI die uit de hand loopt geen “fake news” zijn. Hij deed die uitspraak maandag tijdens de terugvlucht van een bezoek aan Frankrijk. Volgens de paus moeten de zorgen van AI-experts serieus worden genomen. Hij zei niet in paniek te zijn en er ’s nachts gewoon van te slapen. President Trump zegt dat pogingen om AI te beperken deel uitmaken van een “samenzwering” van zijn politieke tegenstanders. De paus vroeg in zijn eerste encycliek, Magnifica Humanitas, om strenge regels voor AI en een vertraging van de technologie. Anthropic-medeoprichter Christopher Olah sprak in mei bij de presentatie van dat document in het Vaticaan. Ik had nooit gedacht ooit inhoudelijk dichter bij een paus te staan dan bij een Amerikaanse president.
Gemini 4 Argon, voorlopig alleen voor cyberverdedigers
Google is deze week met Gemini 4 Argon gekomen. Dat is een nieuw AI-model voor softwareontwikkeling, kenniswerk in onder meer de juridische en financiële sector en cyberbeveiliging. Voorlopig krijgt alleen een groep vertrouwde cyberverdedigers toegang, via het Fairwind Program. Een bredere uitrol volgt later, eerst voor betalende API-klanten en abonnees van Google AI Ultra. Het maximale aantal uitvoertokens gaat van 64.000 naar 1 miljoen. Op de benchmark DeepSWE v1.1 voor softwareontwikkeling scoort het model 77,9 procent. Het introductietarief is 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens. Daarna wordt dat 4 dollar en 20 dollar. Het beveiligingsbedrijf Wiz gebruikt het model al om kwetsbaarheden in software op te sporen. Google test de beveiligingsmaatregelen nog voordat het model breed verschijnt. De genoemde scores komen van Google zelf.
Google DeepMind brengt watermerk aan in door AI ontworpen eiwitten
SynthID Bio van Google DeepMind is een methode om een onzichtbaar watermerk aan te brengen in eiwitten die met AI zijn ontworpen. Het watermerk zit in de biologische code zelf. Het is daarom ook te controleren bij een eiwit dat in een laboratorium is gemaakt. In laboratoriumtests met drie doeleiwitten presteerden de eiwitten met watermerk net zo goed als de eiwitten zonder watermerk. Het doel is de biologische veiligheid te bevorderen. Bedrijven die DNA maken, controleren bestellingen op bekende gevaarlijke stoffen. AI kan sequenties ontwerpen die daar niet op lijken. Met het watermerk kan een bedrijf sneller zien dat een bestelling afkomstig is van een model met ingebouwde beveiligingen. DeepMind noemt als open punt dat het watermerk beter bestand moet worden tegen opzettelijke aantasting. De code en de testgegevens zijn openbaar gemaakt.
Californië verbiedt werkgevers om alleen AI te laten beslissen over ontslag
Gouverneur Gavin Newsom van Californië heeft een wet ondertekend die werkgevers verbiedt om alleen AI te gebruiken bij disciplinaire maatregelen en ontslag. De wet heet de No Robo Bosses Act. Bedrijven die vooral op AI vertrouwen, moeten een mens laten controleren met extra informatie. Daarbij gaat het om beoordelingen van managers en collega’s en om het personeelsdossier. Werknemers krijgen een schriftelijke melding dat AI is gebruikt. Zij krijgen ook een beschrijving van de gebruikte gegevens en een contactpersoon. Newsom blokkeerde vorig jaar een eerdere versie met een veto. Die versie verplichtte werkgevers om werknemers vooraf te informeren. Die eis is nu geschrapt. Ondernemersorganisaties blijven kritisch. Zij vinden dat niet duidelijk is wanneer een werkgever “vooral” op AI vertrouwt.
Onderzoekers stellen raamwerk voor om AI-bewustzijn te beoordelen
Een groep onderzoekers heeft een artikel op arXiv geplaatst over de vraag of AI-systemen bewustzijn kunnen hebben. Onder de auteurs zijn Anil Seth, Murray Shanahan en Shane Legg. Zij stellen een raamwerk voor met vijf niveaus van beschrijving. Die lopen van gedrag tot de wisselwerking tussen organisme en omgeving. De bestaande theorieën over bewustzijn worden bij een van die niveaus ingedeeld. Per niveau ontwikkelen de auteurs indicatoren om AI-systemen te beoordelen. Een kansmodel combineert de uitkomsten tot één inschatting. In voorbeeldberekeningen voor huidige taalmodellen loopt die inschatting uiteen van minder dan 0,01 tot ongeveer 0,8. De uitkomst hangt dus sterk af van de aannames. De auteurs pleiten voor een voorzichtige houding. Aannames worden daarin expliciet gemaakt en de inschatting wordt bijgesteld bij nieuwe gegevens.
Hof bevestigt aanwijzing van Anthropic als risico voor de toeleveringsketen
Een federaal hof van beroep in Washington heeft de aanwijzing van Anthropic door het Pentagon als risico voor de toeleveringsketen bevestigd. De uitspraak viel met 2-1 uit in het nadeel van Antghropic. Anthropic voerde aan dat het verbod op zijn Claude-modellen willekeurig, onbevoegd en ongrondwettelijk was. Het hof volgde dat niet. Het verbod geldt voor het Amerikaanse leger en voor defensiecontractanten die voor het ministerie werken. Het Pentagon stelde de aanwijzing in maart in, nadat onderhandelingen over het militaire gebruik van Claude waren vastgelopen. Anthropic wilde zekerheid dat de technologie niet zou dienen voor volledig autonome wapens of massasurveillance in eigen land. Een rechter in San Francisco oordeelde vorige maand dat een andere, parallelle aanwijzing onwettig was. Het hof stelt de uitspraak uit, zodat Anthropic herziening kan vragen. Het bedrijf overweegt alle opties.
Nederlands open-sourcemodel Walnoot scoort hoger dan GPT-NL
‘Walnoot’ is volgens AG Connect een Nederlands AI-model van het bedrijf Wainut uit de regio Rotterdam. Walnoot is een Nederlands AI-model dat vrij beschikbaar komt als open source. De makers begonnen eraan toen Anthropic deze zomer Claude Mythos offline moest halen vanwege Amerikaanse exportbeperkingen. Ze willen minder afhankelijk zijn van Amerikaanse aanbieders. Walnoot is gebouwd op Apertus, een Zwitsers model, en op een selectie uit het corpus dat GPT-NL openbaar heeft gemaakt. Ze bouwenb dus voort op het werk van GPT-NL. Op de benchmark EuroEval scoort Walnoot hoger dan de cijfers die GPT-NL heeft gepubliceerd. Walnoot heeft 8 miljard parameters en GPT-NL 26 miljard. Volgens één van de ontwikkelaars is het model geschikt voor kleine taken, zoals het overnemen van gegevens uit een mail. Het vervangt Claude of ChatGPT niet. De makers pleiten voor meer samenwerking tussen Nederlandse AI-ontwikkelaars.
Cambridge-rapport waarschuwt voor een ‘intelligentie-explosie’ door geautomatiseerd AI-onderzoek
Het Cambridge Programme on AI Science & Policy heeft een samenvatting gepubliceerd over de automatisering van AI-onderzoek. Onder de auteurs zijn Geoffrey Hinton, Yoshua Bengio en medewerkers van OpenAI, Microsoft en Anthropic. Volgens het rapport doet AI steeds meer van het onderzoek naar AI zelf. Anthropic meldt dat AI-systemen in augustus 2026 26 procent van het interne AI-onderzoekswerk uitvoerden met toezicht op hoofdlijnen. Vijf maanden eerder was dat 1 procent. De auteurs beschrijven een mogelijke “intelligentie-explosie”. Daarbij zouden jaren aan AI-vooruitgang in maanden of korter plaatsvinden. Het rapport noemt zowel voordelen als risico’s, zoals cyberaanvallen, pandemieën, verlies van menselijk toezicht en internationale spanningen. Beleidsmakers krijgen drie prioriteiten mee: inzicht in de automatisering, manieren om de ontwikkeling te begrenzen en voorbereiding van de samenleving. De auteurs baseren zich op voorlopig bewijs. Sommige experts denken dat AI-onderzoek binnen enkele jaren volledig geautomatiseerd kan zijn.
OpenAI doet op DevDay meer dan twintig aankondigingen
OpenAI heeft op DevDay 2026 meer dan twintig aankondigingen gedaan. Een daarvan zijn dots. Dat zijn agents die doorlopend actief blijven en vaste verantwoordelijkheden op zich nemen. Elke dot heeft een eigen cloudcomputer en werkt met de apps die de gebruiker koppelt. De gebruiker bepaalt wat een dot zelfstandig mag doen. Dots draaien op GPT-6 Astra en zijn beschikbaar voor Pro, Business Premium en Enterprise. Verder is GPT-6.1 Sol verschenen. Dat model kost een kwart van de standaardprijzen van Astra. Ook is er een nieuw Pro-abonnement van 500 dollar per maand. Dit abonnement geeft toegang tot Astra Ultrafast. Dat is een snellere variant van Astra. Daarnaast heeft OpenAI ChatGPT Space gepresenteerd. Dat is een gedeelde werkomgeving voor teams en ChatGPT.
VoiceStudio: gratis stemkloon-tool draait volledig op de eigen computer
VoiceStudio is een gratis open-source programma voor spraaktechnologie. Het draait volledig op de eigen computer. Er is geen cloud en geen abonnement nodig, en audio verlaat het apparaat niet. Gebruikers kunnen een stem klonen op basis van een kort audiofragment. Ook kunnen ze video’s laten nasynchroniseren in maar liefst 646 talen, audioboeken maken, dicteren en audio laten uitschrijven. Het programma biedt keuze uit 14 engines voor tekst-naar-spraak. Ter vergelijking: ElevenLabs rekent per teken en ondersteunt 32 talen. De licenties van de onderliggende modellen verschillen. Wie het programma commercieel wil gebruiken, moet die dus eerst controleren. Stemmen klonen mag alleen met toestemming van de persoon. Voor de installatie zijn Node 20 en Python 3.11 of nieuwer nodig.
Anthropic brengt Claude Sonnet 5.5 uit
Anthropic heeft Claude Sonnet 5.5 uitgebracht. Het is het tweede model in de Claude 5.5-familie. Volgens Anthropic werkt het model meer dan 30 procent sneller dan Sonnet 5. De kosten per taak liggen tot 30 procent lager, omdat het model minder tokens nodig heeft. De prijs per token blijft gelijk: 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens. Op de programmeertest Terminal-Bench 4.0 scoort Sonnet 5.5 70,6 procent. Sonnet 5 kwam op 10,3 procent. Anthropic geeft aan dat Opus 5.5 sterker blijft bij complex werk dat veel beoordelingsvermogen vraagt. Bij risicovolle cybersecuritytaken schakelt het systeem zichtbaar terug naar Sonnet 5. Het model is beschikbaar via de Claude Platform, Amazon Web Services, Google Cloud en Microsoft Azure. Claude Haiku 5.5 volgt in de komende weken.
Microsoft presenteert nieuwe Copilot met Home, Code en Autopilot
Microsoft heeft een vernieuwde versie van Copilot aangekondigd. De app krijgt drie onderdelen. Home is het startpunt waar Chat en Cowork samenkomen, met Word, Excel en PowerPoint ingebouwd. Met Code kunnen gebruikers in gewone taal een app, dashboard of automatisering laten bouwen. Dat draait in een afgeschermde omgeving binnen de eigen organisatie. Autopilot is een agent die zelfstandig taken uitvoert, zoals het opvolgen van gesprekken en het beheren van terugkerend werk. Autopilot heette eerder Scout. Home en Code worden de komende weken uitgerold via het Frontier-programma. Autopilot komt eind september in besloten preview beschikbaar. Microsoft heeft ook nieuwe functies aangekondigd om AI-kosten te beheren. Cowork, Code en Autopilot draaien op gebruiksgebaseerde facturering.
TypeSafe AI bespreekt grote financieringsronde
Volgens The Information praat het AI-bedrijf TypeSafe AI met investeerders over een financieringsronde van minimaal 1 miljard dollar. Het bedrijf ontwikkelt een nieuw soort model met de naam Jev. In Silicon Valley -en daarbuiten- is daar momenteel veel belangstelling voor. Volgens het artikel hebben sommige investeerders, die niet bij naam worden genoemd, een aanbod gedaan.
Mijn bronnen over (generatieve) artificiële intelligentie
Deze pagina bevat al mijn bijdragen over (generatieve) artificiële intelligentie.
Lees het hele
artikel