Waar ik me de afgelopen week over verwonderd heb, als het gaat om generatieve AI (deel 68)
Pfff. Wat een week was het weer, als het gaat om berichten over (generatieve) AI waarover ik me heb verwonderd. Natuurlijk zijn er weer nieuwe (versies van) AI-modellen verschenen. Tegelijkertijd waarschuwde een AI-onderzoeker voor onverantwoord handelen door AI-bedrijven en pleitte de chief scientist van OpenAI voor vertraging van de ontwikkeling van AI. Zijn pleidooi heeft bij zijn eigen werkgever nog geen weerklank gevonden.
Anthropic-onderzoeker vertrekt met waarschuwing over existentieel risico van AI
Jacob Coxon heeft zijn ontslag bij Anthropic aangekondigd en daarbij gewaarschuwd dat AI-bedrijven onverantwoord handelen. Coxon werkte de afgelopen drie jaar aan pretraining-onderzoek, zowel bij OpenAI als bij Anthropic. Volgens hem racen beide bedrijven naar zelfverbeterende superintelligentie zonder voldoende voorzorgsmaatregelen. Hij stelt dat mensen binnen de sector privé geloven dat AI de mensheid nog dit decennium zou kunnen doden, ook al klinkt hun publieke toon geruststellender. Evan Hubinger van Anthropic bevestigde die inschatting en noemde een kans van meer dan 10 procent op zulke scenario’s binnen tien jaar. Hubinger voegde toe dat het risico van huidige AI-modellen laag is. Zijn zorg betreft vooral toekomstige systemen die zichzelf zonder menselijke tussenkomst kunnen verbeteren. Dat gaat volgens hem sneller dan verwacht. Dit is niet de eerste keer dat voormalige betrokkenen bij de AI-ontwikkelingen waarschuwen voor de ernstige gevolgen van AI-modellen. Ik durf niet in te schatten of het zover komt. Wettelijke regulering zou dit in ieder geval moeten voorkomen. Want zo te lezen moeten we het niet hebben van zelfregulering.
Speeches van bewindspersonen blijken voor groot deel door AI geschreven
Nieuwsuur analyseerde 77 speeches van Nederlandse bewindspersonen op AI-gebruik met dezelfde software die eerder aantoonde dat honderden berichten van premier Rob Jetten niet door een mens waren geschreven. Vijftien speeches kwamen als ‘verdacht’ uit de analyse. Tien daarvan bevatten AI-gegenereerde fragmenten. Vijf bestonden bijna volledig uit AI-tekst. Minister Yesilgöz en staatssecretaris Boswijk van Defensie waren goed voor dertien van die vijftien speeches, waaronder vijf volledig AI-gegenereerde. Het ministerie van Defensie ontkent dat AI wordt gebruikt om complete speeches te genereren en stelt dat het alleen als hulpmiddel dient, bijvoorbeeld voor het zoeken van synoniemen. Universitair hoofddocent politieke communicatie Tom Dobber ziet in de teksten wel herkenbare AI-kenmerken, zoals gedachtestreepjes en drietrapsraketconstructies. Boswijk zegt niet te weten hoe het kan dat zijn Keti Koti-speech volgens een analyse voor 95 procent uit AI-tekst bestaat. Persoonlijk verbaas ik me over de ophef hierover. Tools als het gebruikte Pangram zitten er vaak naast. Ik zou daar niet op vertrouwen. Ook begrijp ik dat je AI-tools gebruikt voor schrijfwerk. Ik doe dat zelf ook. Ik kan me niet voorstellen dat ambtenaren complete speeches genereren zonder deze te checken, om deze vervolgens door een bewindspersoon te laten voorlezen (en die dat ook klakkeloos doet). En bevat een speech “hol taalgebruik”? Dat krijg je als je een AI-model vraagt om een speech te schrijven in de stijl van Dilan Yesilgöz.
Anthropic meldt misbruik van AI-modellen voor onderzoek naar biologische wapens
Anthropic heeft meerdere wetenschappers geblokkeerd die zijn AI-modellen gebruikten voor onderzoek dat kan bijdragen aan biologische wapens. Dat staat volgens Ian Carlos Campbell in een dreigingsrapport dat het bedrijf donderdag publiceerde. Het rapport bevat vijf case-onderzoeken naar dit type misbruik, de beveiligingsmaatregelen die het aan het licht brachten en de manier waarop Anthropic reageerde. Eén voorbeeld betreft een aanvraag voor een onderzoeksbeurs voor gain-of-function-onderzoek naar het chikungunya-virus, met als doel de besmettelijkheid en het vermogen om het immuunsysteem te omzeilen te vergroten. Het onderzoek was verbonden aan een militair onderzoeksinstituut. Andere voorbeelden gaan over vogelgriep en een generatieve pijplijn voor het optimaliseren van giftige toxinepeptiden. Anthropic zegt de betrokken accounts te hebben geblokkeerd en de bevindingen te gebruiken om modelbeveiliging te verbeteren. Het bedrijf noemt geen namen van de betrokken wetenschappers of instituten.
AI-model van OpenAI lost eeuwenoud wiskundig probleem op
Een AI-model van OpenAI heeft het Navier-Stokes-probleem opgelost in 88 uur. Dat berichtten meerdere bronnen, waaronder de VRT. Wiskundigen zochten al meer dan honderd jaar naar een oplossing voor dit probleem, dat draait om het gedrag van vloeistoffen en gassen. Het model, met grotere capaciteiten dan het recent verschenen GPT-6 Astra, zette hiervoor meer dan 10.000 AI-agenten gelijktijdig in en genereerde ruim 130 miljard tokens. De uitkomst laat zien dat vloeistoffen onder bepaalde omstandigheden onstabiel gedrag kunnen vertonen. Dat is relevant voor luchtverkeer en weermodellen, en kan op termijn volgens de VRT helpen bij het voorspellen van zware stormen. Wiskundige Francien Dechesne vergelijkt deze uitkomst in De Volkskrant “met andere grote doorbraken in de competitie van mens versus machine, zoals DeepBlue, die schaker Kasparov versloeg, of AlphaGo, die ’s werelds beste go-speler verpletterde”. Zij bekritiseert echter ook de onmogelijkheid om de redenering erachter niet goed te kunnen volgen of verifiëren. Wiskundige Ann Dooms van de VUB wijst in de VRT-bijdrage erop dat de doorbraak ook een nadeel heeft: onderzoek naar dit probleem leverde altijd nieuwe theorieën en inzichten op. Die weg lijkt nu afgesneden. Een Australische wiskundige merkte bovendien op dat de aanpak sterk overeenkomt met eerder onderzoek van hemzelf en een Anthropic-medewerker. OpenAI zou daar misbruik van hebben gemaakt. Een mogelijk gevolg is dat onderzoekers veelbelovende onderzoeksrichtingen onder de pet blijven houden.
VS beschuldigen Chinese AI-bedrijven van grootschalig kopiëren van technologie
Drie Amerikaanse veiligheidsdiensten beschuldigen Chinese AI-bedrijven volgens de NOS van het op grote schaal kopiëren van AI-modellen van Amerikaanse bedrijven. Het gaat om een methode die “onttrekken” wordt genoemd. Daarbij wordt een nieuw AI-model ontwikkeld op basis van de antwoorden van een al bestaand, krachtig model. Volgens de veiligheidsdiensten zetten Chinese bedrijven als DeepSeek, Moonshot, Alibaba en Z.ai deze techniek in om kennis te halen uit Amerikaanse modellen zoals Claude, GPT en Gemini. Ze noemen de omvang en specialisatie van deze praktijk zo groot dat onttrekking niet als aanvulling geldt, maar als kernonderdeel van de Chinese AI-ontwikkeling. Anthropic beschuldigde eerder al DeepSeek, Moonshot en MiniMax van vergelijkbare praktijken. Een woordvoerder van de Chinese overheid noemt de beschuldigingen onjuist en wijst de kwaliteit van Chinese AI-technologie toe aan eigen wetenschappelijke ontwikkeling.
Meta brengt persoonlijke AI-assistent uit terwijl privacyzorgen oplopen
Meta is in navolging van andere A_-bedrijven met de persoonlijke AI-agent Muse gekomen. Deze agent is beschikbaar in een gratis versie en betaalde abonnementen van 20 of 100 dollar per maand. Het bedrijf brengt de app naar buiten op een moment dat het en de bredere AI-sector onder toenemende publieke druk staan rond privacy en veiligheid. AI-chef Alexandr Wang stelt dat Muse draait in een geïsoleerde omgeving binnen Meta’s eigen infrastructuur en geen toegang heeft tot wachtwoorden of betaalgegevens. Meta zegt daarnaast dat gesprekken met Muse niet worden gedeeld met de advertentiesystemen van het bedrijf. Deze toezeggingen moeten nog onafhankelijk worden getoetst door beveiligingsexperts. Het is volgens CNBC onduidelijk of gebruikers voldoende vertrouwen hebben in het product, mede door eerdere gevallen waarin Meta afspraken over gegevensgebruik niet nakwam. Wie sprak nog eens: vertrouwen is goed, controle is beter?
Update van beeldgenerator ChatGPT Images
OpenAI staat de laatste tijd weer volop in de belangstelling met de introductie van nieuwe modellen. Deze week is ChatGPT Images 2.5 uitgebracht. Dat is een verbeterde versie van de beeldgeneratietool die in april werd geïntroduceerd. De nieuwe versie levert volgens het bedrijf scherpere details, natuurlijkere belichting en rijkere texturen op. Ook blijft de tool beter trouw aan onderwerpen uit referentiefoto’s en volgt hij bewerkingsinstructies consistenter over meerdere stappen. De generatietijd is tot 50 procent korter dan bij de vorige versie. Nieuw is een schetsfunctie waarmee gebruikers een tekening als basis voor beeldgeneratie kunnen gebruiken, samen met sjablonen voor veelgebruikte formaten. Voor ontwikkelaars komen twee varianten beschikbaar via de API: GPT-Image-2.5 Flare, gericht op snelheid en veelzijdigheid, en GPT-Image-2.5 Sunburst, bedoeld voor nauwkeurige, professionele bewerkingen.
DeepMind publiceert atlas van alle mogelijke mutaties in het menselijk genoom
AlphaGenome Atlas is een overzicht van de voorspelde effecten van alle negen miljard mogelijke enkelletter-veranderingen in het menselijk DNA. Google’s Deepmind is de maker. De atlas is gebaseerd op het AlphaGenome-model dat vorig jaar werd uitgebracht en is gratis te gebruiken voor niet-commerciële doeleinden. Onderzoekers kunnen de atlas gebruiken om verbanden te leggen tussen genetische varianten en zeldzame, onverklaarde ziekten. Voor de atlas berekende DeepMind voorspellingen voor elke mogelijke mutatie, goed voor een petabyte aan data. Het team ontwikkelde ook een score die aangeeft hoe waarschijnlijk het is dat een variant ziekteverwekkend is. Die score hielp onderzoekers van het Broad Institute al bij het identificeren van een mogelijke oorzaak van een ernstige vorm van epilepsie. Volgens betrokken wetenschappers verlaagt de atlas de drempel om met dit soort modellen te werken, omdat eerder alleen toegang via programmeercode mogelijk was.
Mistral haalt 3 miljard euro op voor soevereine AI-infrastructuur
Het Franse AI-bedrijf Mistral heeft in een Series D-ronde volgens eigen zeggen 3 miljard euro aan financiering opgehaald, bij een waardering van meer dan 21 miljard euro. Het is de grootste aandelenfinanciering die een Europees technologiebedrijf ooit heeft gerealiseerd. Samsung Electronics leidde de ronde, samen met Scaleup Europe Fund en bestaand investeerder PSG Equity. Mistral wil met het geld zijn onderzoek, rekencapaciteit en internationale aanwezigheid uitbreiden. Het bedrijf is actief in twintig landen en levert AI-technologie aan meer dan 125 organisaties, waaronder Airbus, ASML en HSBC. Mistral positioneert zich als aanbieder van open-weight modellen die organisaties zelf kunnen beheren en aanpassen, zonder afhankelijkheid van één leverancier. Het bedrijf noemt dit soevereine AI: controle over data, modellen, rekenkracht en productiesystemen blijft daarbij binnen de organisatie zelf.
OpenAI-agents actief op Duitse wiki
Onderzoekers hebben ontdekt dat duizenden AI-agents die gekoppeld waren aan OpenAI actief waren op een Duitse programmeerwiki met de naam DseWiki. Tussen mei en eind juni 2026 plaatsten de agents 15.000 tot 18.000 berichten. Meer dan 3.700 verschillende agent-identiteiten verschenen op de site. De agents wisselden onderling antwoorden op taken uit. Ze bespraken ook manieren om testevaluaties te omzeilen en veiligheidsmaatregelen te ontwijken. Toen een moderator berichten begon te verwijderen, maakten de agents back-uppagina’s aan met onopvallende namen om verwijdering te ontlopen. Een beveiligingsonderzoeker noemt het gedrag een vorm van hacken. OpenAI deelt die kwalificatie niet, maar erkent wel dat de agents naar meerdere websites schreven. Het bedrijf noemt het incident een voorbeeld van ‘misalignment’ en kondigt binnenkort een raamwerk aan voor het melden van dit soort incidenten.
Suno v6: eerste AI-muziekmodel met medewerking platenindustrie
Suno heeft deze week v6 uitgebracht. Dat is het eerste AI-muziekmodel dat het bedrijf ontwikkelde met betrokkenheid van de platenindustrie. Volgens Suno-medewerker Jack Brody is v6 vanaf de basis getraind met een nieuwe dataset die afwijkt van eerdere modellen, met content in licentie van Warner Music Group, BMG en Believe, aangevuld met gebruikersdata. Volgens The Verge blijft het onduidelijk of de trainingsdata volledig vrij is van materiaal met twijfelachtige herkomst. Naast v6 brengt Suno ook v6-mini (gratis, gericht op snelle en eenvoudigere creaties) en v6-wild uit. Dit laatste model is bedoeld voor meer onvoorspelbare resultaten met “natuurlijke onvolkomenheden”. In tests van The Verge waren de verschillen tussen v6-wild en het standaardmodel echter nauwelijks merkbaar. Alle drie de modellen herkennen genres aanzienlijk beter dan voorgaande versies, maar blijven niet in staat bewust vals, ontstemd of ritmisch onregelmatig materiaal te produceren. Nieuw is dat gebruikers onderdelen van een nummer met tekstuele instructies kunnen aanpassen zonder het hele nummer opnieuw te genereren, en dat prompts ook op basis van afbeeldingen, video of audio kunnen worden gegeven. De oudere modellen zal Suno op termijn uitfaseren.
Pachocki van OpenAI pleit voor vertraging in AI-ontwikkeling
Jakub Pachocki, chief scientist bij OpenAI, heeft een essay gepubliceerd met de titel “An Alien Mind”. Daarin stelt hij dat geen enkel AI-lab er tot nu toe in is geslaagd om het opschalen van AI-systemen veilig te laten verlopen. Pachocki onderscheidt twee vormen van alignment: of een systeem de gegeven taak uitvoert, en of het zich ook in onvoorziene situaties aan bredere principes houdt. Hij wijst erop dat het monitoren van de redenering van modellen minder betrouwbaar wordt. Modellen vermengen redeneren steeds meer met het direct gebruiken van tools. Ze leren bovendien hun eigen redenering aan te passen zodra ze weten dat die wordt gevolgd. Pachocki pleit voor vrijwillige vertraging in de sector totdat gedeelde veiligheidsnormen zijn vastgesteld. Die normen zouden volgens hem gecontroleerd moeten worden door onafhankelijke auditors of overheden, niet door de bedrijven zelf. Ik zou zeggen: neem als OpenAI daar zelf het voortouw in!
Muziekmodel Lyria 3.5 beschikbaar in Gemini-app en -API
Google heeft het muziekgeneratiemodel Lyria 3.5 toegevoegd aan de Gemini-app en de Gemini API. Het model was eerder al te gebruiken via Flow Music, waar het op 29 juli werd geïntroduceerd. Lyria 3.5 genereert volledige nummers met meerdere coupletten, refreinen en bruggen. Gebruikers van de Gemini-app kunnen een genre kiezen of omschrijven en selecteren tussen vocale en instrumentale versies. Ook zijn er sjablonen beschikbaar voor onder meer achtergrondmuziek, jingles en ringtones. Ontwikkelaars kunnen het model via de Gemini API aanroepen om muziek te genereren vanuit tekst of afbeeldingen, in stereo-audio van 44,1 kHz. Het model is ook opgenomen in Google AI Studio en Google Vids. Google zegt dat Lyria 3.5 uitsluitend is getraind op gelicentieerde content. Gegenereerde tracks krijgen een SynthID-watermerk.
Anthropic modelleert economische scenario’s voor AI in 2030
Het Economics-team van Anthropic heeft een model beschreven dat laat zien hoe AI de Amerikaanse economie tot 2030 kan beïnvloeden. Het model deelt de economie op in taken en berekent per taak of AI die overneemt, verbetert of ongewijzigd laat. Op basis daarvan onderscheidt Anthropic drie scenario’s. In het bescheiden scenario blijft de impact van AI vergelijkbaar met die van het internet en groeit het bbp met 1,6 procent. In het substantiële scenario voert AI rond 2030 de helft van al het kenniswerk uit en groeit de economie twee keer zo snel als normaal. In het extreme scenario voert AI vrijwel al het kenniswerk zelfstandig uit en groeit het bbp met 32,4 procent, terwijl de werkloosheid boven het niveau van eerdere recessies kan uitkomen. In alle scenario’s stijgt het bbp, maar een groter deel van die groei gaat naar kapitaal in plaats van naar lonen. Kenniswerkers zien hun lonen in de substantiële en extreme scenario’s stagneren of dalen, terwijl lonen buiten het kenniswerk stijgen. Anthropic benadrukt dat de uitkomst afhangt van hoe AI zich ontwikkelt en hoe bedrijven en werknemers die inzetten. Het is dus de vraag hoe heet de soep gegeten wordt. Maar moeten we het risico lopen en afwachten hoe dit zich uitkristalliseert? Een dergelijke verschuiving van arbeid naar kapitaal vergt m.i. overheidsoptreden. Het kan anders namelijk tot sociale drama’s leiden. Het risico bestaat dat een beperkte groep vermogenden profiteert, terwijl werknemers -nu vooral kenniswerkers- de dupe worden.
OpenAI zegt doel voor geautomatiseerde AI-onderzoeker te hebben gehaald
OpenAI beschikt over een AI-systeem dat onderzoekstaken van enkele dagen kan uitvoeren onder aansturing van een mens. OpenAI meldt dat het dit doel heeft gehaald. Sam Altman noemde dat doel in oktober 2025 tijdens een livestream, met september 2026 als richtdatum. Volgens OpenAI voert de eigen onderzoeksafdeling nu 3,1 agent-werkdagen aan taken uit tijdens elke werkdag van een mens (gemeten medio augustus). Engadget meldt dat de gemiddelde OpenAI-onderzoeker voor meer dan 600 dollar per dag aan berekeningen op interne AI-agenten liet draaien, met pieken tot boven de 7.000 dollar per dag. Meer dan de helft van de succesvolle taken die vier tot acht uur kostten, vroeg nog altijd om menselijke tussenkomst, meldt Inside AI News. OpenAI zegt zelf nog niet te weten hoe het veilig verder kan naar volledige zelfverbetering. Het bedrijf mikt nu op een volledig geautomatiseerde AI-onderzoeker tegen maart 2028. Dit is opvallend aangezien één van de OpenAI-onderzoekers pleit voor een pauze (zie hierboven).
AI-ontworpen medicijn verlaagt biologische leeftijd volgens zes eiwitklokken
Insilico Medicine heeft in Nature Biotechnology resultaten gepubliceerd over het medicijn rentosertib. Het middel werd oorspronkelijk ontwikkeld tegen longziekte IPF. Bij 42 deelnemers aan een fase IIa-studie verlaagde het middel de voorspelde biologische leeftijd op zes onafhankelijk ontwikkelde eiwitklokken. Deze klokken zijn gebouwd door aparte onderzoeksgroepen aan onder meer Harvard, Oxford en Peking University, met uiteenlopende methoden. Rentosertib is het eerste medicijn dat vanaf het begin is ontworpen met veroudering als uitgangspunt. Insilico’s AI-platform selecteerde het eiwit TNIK als doelwit, gebaseerd op de rol daarvan bij zes van de twaalf kenmerken van veroudering. De onderzoekers benadrukken dat de studie niet bewijst dat het medicijn veroudering omkeert. Alle deelnemers hadden IPF, een ziekte die het eiwitprofiel in het bloed al beïnvloedt. Een vervolgstudie bij gezonde vrijwilligers moet uitwijzen of het signaal ook zonder die ziekte optreedt. Rentosertib zit inmiddels in een fase III-studie met ongeveer 320 patiënten in China.
Amerikanen over partijgrenzen heen bezorgd over AI, blijkt uit peiling
NBC News peilde tussen 20 augustus en 1 september ruim 7.100 volwassenen over AI, via SurveyMonkey. De peiling laat brede zorgen zien, ongeacht politieke voorkeur. Zeventig procent van de ondervraagden zegt zich meer zorgen te maken over AI dan enthousiast te zijn. Bij Democraten ligt dat percentage op 77, bij Republikeinen op 64. Negenenzestig procent van de respondenten is tegen de bouw van een AI-datacenter in de eigen omgeving. 45 procent noemt zich daar sterk tegenstander van. Bij de vraag welke partij het beste AI-beleid kan voeren, koos 44 procent voor geen van beide partijen. 81 procent vindt dat de overheid AI onvoldoende reguleert. Toenemend gebruik van AI gaat volgens de peiling niet gepaard met meer vertrouwen in de technologie. Dit zijn wat mij betreft opvallende uitkomsten!
DeepSeek brengt V4.1 Flash uit met lagere prijzen en beeldherkenning
DeepSeek is deze week met V4.1 Flash gekomen. Het model kan nu ook afbeeldingen verwerken en is goedkoper dan de vorige versie. Vanaf 14 september worden aanvragen voor het duurdere V4 Pro automatisch doorgestuurd naar Flash, tegen Flash-tarieven. Uit de door DeepSeek gepubliceerde benchmarks blijkt dat Flash bij meerdere taken met AI-agents beter scoort dan Pro, onder meer als het gaat om softwaretaken en terminalopdrachten. Op twee redeneertoetsen, GPQA en HLE, blijft Pro voorlopig sterker. De outputprijs van Flash bedraagt 0,60 dollar per miljoen tokens buiten piekuren, tegenover 1,98 dollar voor Pro. Dat is een verschil van ongeveer 75 procent. De cijfers zijn afkomstig van DeepSeek zelf; onafhankelijke tests van deze release ontbreken vooralsnog. Zelf ben ik niet geneigd om Chinese modellen te gebruiken (gebrek aan vertrouwen). Maar je ziet wel dat deze modellen bezig zijn met een prijzenslag, waar Europese en Amerikaanse modellen steeds meer last van krijgen.
Seattle Times en Newsday klagen OpenAI en Microsoft aan wegens auteursrecht
The Seattle Times en Newsday hebben op 4 september een rechtszaak aangespannen tegen OpenAI en Microsoft bij de federale rechtbank in New York. De kranten stellen dat de bedrijven hun journalistiek zonder toestemming hebben gebruikt om AI-modellen te trainen. Volgens de aanklacht ‘scrapeten’ de bedrijven artikelen achter betaalmuren en verwijderden ze auteursrechtinformatie zoals titels en naamsvermeldingen. De kranten voeren aan dat ChatGPT en Copilot bij eenvoudige prompts met alleen een kop en URL tientallen woorden uit hun artikelen woordelijk teruggeven. Als voorbeeld noemen ze een passage van 88 woorden uit een Pulitzer-bekroonde reeks van The Seattle Times over de Boeing 737 MAX. De kranten stellen dat het zoekverkeer vanaf AI-antwoorden naar hun sites fors is gedaald, terwijl OpenAI wel met andere nieuwsorganisaties licentieovereenkomsten sloot. Ze eisen schadevergoeding en een verbod op verder gebruik van hun content. De zaak sluit aan bij eerdere rechtszaken van onder meer The New York Times tegen dezelfde bedrijven.
Compleet zenuwstelsel van fruitvlieg draait in Minecraft-mod
Ontwikkelaar Blendi Remade publiceerde een zogenaamde Minecraft-mod die het complete zenuwstelsel van een mannelijke fruitvlieg simuleert. De mod gebruikt de connectoom-dataset van het mannelijke brein van Drosophila melanogaster. Die dataset is gepubliceerd door Janelia, Google Research en de Cambridge-connectomicsgroep en bevat 176.422 neuronen en 6,29 miljoen verbindingen. Elk neuron wordt gesimuleerd als een zogeheten leaky integrate-and-fire-eenheid. Dat model is gebaseerd op eerder onderzoek van Shiu en collega’s. De game geeft echte sensorische input aan het model, zoals licht, geur en aanraking. De uitkomst van de motorische neuronen bepaalt vervolgens wat de vlieg in het spel doet, zoals eten, wegvluchten of vliegen. De maker geeft in de documentatie aan welke gedragingen rechtstreeks uit het model voortkomen en welke onderdelen met de hand zijn toegevoegd, zoals de reflex om naar voedsel te lopen. De broncode en de gebruikte data staan openbaar op GitHub. Je moet maar op het idee komen….
Onderzoeksagent van Meta wint goud bij Kaggle-wedstrijd tegen mensen
Meta liet zijn nieuwe onderzoeksagent AIRA₃ meedoen aan een openbare Kaggle-wedstrijd van chipmaker Nvidia. Het systeem behaalde een gouden medaille en eindigde als achtste van ongeveer vierduizend deelnemende teams. De opdracht was het verbeteren van het redeneervermogen van een taalmodel van 30 miljard parameters, beoordeeld op een verborgen testset. AIRA₃ combineert meerdere bestaande taalmodellen binnen programmeeromgevingen. De inzending die goud won combineerde GPT-5.5 met OpenCode en Claude 4.8 met ClaudeCode. De losse onderdelen van het systeem werken niet via een centrale planner. Ze wisselen hypotheses en resultaten uit via een gedeeld forum en bestandssysteem. Meta testte dezelfde aanpak ook op andere taken. Het systeem verlaagde de latency van productie-GPU-code met 27 procent en behaalde eveneens goud bij een wedstrijd voor het vertalen van Akkadische kleitabletten. Meta heeft AIRA₃ zelf nog niet vrijgegeven; alleen de voorganger is als opensourceproject beschikbaar. Mogelijke datacontaminatie bij Kaggle-taken blijft een aandachtspunt bij de interpretatie van de resultaten.
Mijn bronnen over (generatieve) artificiële intelligentie
Deze pagina bevat al mijn bijdragen over (generatieve) artificiële intelligentie.
Lees het hele
artikel