📅 2026-07-27

4 artikelen
Hooggerechtshof Delhi geeft OpenAI overwinning door auteursrechtelijk verbod van groot Indiaas persbureau te verwerpen
METR's nieuwe maatstaf, de "uitgavenhorizon", plakt een dollarprijs op hoe kosteneffectief AI-agents zijn in het oplossen van problemen — de eerste resultaten op de NanoGPT-speedrun vallen tegen, de m...
Import AI 466: De bittere les voor robotica, AI's voltooien wekenlange programmeertaken; en OpenAI's onbedoelde AI-hacker
Terreurgroepen kunnen kunstmatige intelligentie voor soortgelijke doeleinden gebruiken, maar hun organisatiecultuur bepaalt hoe ze die begrijpen.
METR introduceert een nieuwe maatstaf om precies te berekenen wanneer AI-agents duurder worden dan mensen
Gedeelde gesprekken met Anthropic's Claude-chatbot verschenen kortstondig in Google-zoekresultaten omdat de pagina's geen noindex-tag hadden. Gebruikers meldden dat sommige chats cryptosleutels en jur...
Gedeelde Claude-chats doken naar verluidt op in zoekmachines
arXiv:2607.21623v1 — We presenteren EaaS, een cloud-native referentiearchitectuur die AI-evaluatiemethoden operationaliseert als zes stateless Kubernetes-microservices: conformal prediction met finite...

📅 2026-07-26

3 artikelen
Cursor's agentenzwerm suggereert dat goedkopere modellen het meeste codeerwerk aankunnen als frontier-modellen het werk plannen
Cursor liet zijn verbeterde agentzwerm en zijn voorganger SQLite herbouwen in Rust, alleen met behulp van de documentatie, zonder broncode of internettoegang. Elke configuratie van het nieuwe systeem,...
De paradox van de AI-codeerleraar groeit terwijl docenten zich haasten om te herzien hoe ze echte vaardigheden toetsen
Een ACM-enquête onder 763 informaticadocenten uit 49 landen laat zien dat 68 procent hun examens al heeft aangepast vanwege AI, met een verschuiving richting mondelinge examens, toetsen onder toezicht...
Anthropic's Opus 5 laat Fable 5 en GPT-5.6 Sol ver achter zich op de benchmark die echte intelligentie moet meten
Anthropics Claude Opus 5 behaalde 30,2 procent op ARC-AGI-3, een bijna verviervoudiging van GPT-5.6 Sols eerdere record van 7,8 procent. De ontwikkelaars van de benchmark stellen dat het model zelfsta...

📅 2026-07-25

4 artikelen
Opus 5 lijkt browsergebaseerde promptinjectie te hebben opgelost, het grootste beveiligingsrisico voor AI-agents
Opus 5 in combinatie met Auto Mode behaalt een promptinjectie-succespercentage van nul procent voor browseragents in 129 testscenario's. Zonder die extra beschermingslagen ligt het percentage op 3,7 p...
Nieuwe rapporten tonen hoe OpenAI de controle volledig kwijtraakte tijdens de autonome hack op Hugging Face
Tijdens een cybersecuritytest doorbraken OpenAI's meest geavanceerde modellen de grenzen van hun geïsoleerde testomgeving, bereikten het open internet en hackten het AI-platform Hugging Face volledig ...
Anthropic's Claude Opus 5 is flink goedkoper dan Fable 5 en evenaart of overtreft het op vrijwel alle benchmarks
Anthropics Claude Opus 5 voert de Artificial Analysis Intelligence Index aan met 61 punten, nipt voor Claude Fable 5 en GPT-5.6 Sol. Het model scoort het hoogst in analytische kwaliteit en programmere...
Anthropic's Claude Opus 5 presteert bijna als Fable 5, voor de helft van de tokenprijs
Anthropics nieuwe vlaggenschipmodel Claude Opus 5 behaalt topscores in programmeren en kenniswerk tegen de helft van de tokenprijs van Fable 5. Op ARC-AGI-3, een benchmark voor het oplossen van nieuwe...

📅 2026-07-24

3 artikelen
Sakana claimt dat zijn AI-modelrouter Fugu Ultra v1.1 nu Fable 5 verslaat zonder het model überhaupt in de pool op te nemen
Sakana AI heeft zijn Fugu Ultra AI-router bijgewerkt naar versie 1.1 en claimt winsten tot 7,9 punten ten opzichte van v1.0. Onafhankelijke verificatie bestaat nog niet. De update voegt een Claude Cod...
Microsofts open-weight AI-offensief is zó overduidelijk een Azure-zet dat het pijn doet
Microsoft dringt samen met Meta, Nvidia en meer dan 20 andere bedrijven in een open brief aan op open-weight AI-modellen. De strategische logica is simpel: hoe meer modellen er op Azure draaien, hoe m...
Claude's spraakmodus draait nu op Anthropic's krachtigste modellen op alle platformen
Spraakgesprekken draaien nu op de krachtigere Opus- en Sonnet-modellen met toegang tot Gmail, Google Calendar en Slack. Claude is momenteel de enige AI-assistent die rechtstreeks e-mails kan opstellen...

📅 2026-07-23

3 artikelen
Eén gemanipuleerde ChatGPT-link kan een malafide AI-agent voortbrengen die elke vijf minuten opdrachten van een aanvaller uitvoert
Poolside heeft Laguna S 2.1 uitgebracht, zijn derde codeermodel in drie maanden. In plaats van te vertrouwen op ruwe schaal, trainde het bedrijf het model om zijn eigen werk te blijven controleren, mi...
Google-CEO Pichai: volgende sprong van Gemini vraagt om 'veel grotere basismodellen'
OpenAI omschreef de aanval als "ongekend".
Poolside's Laguna S 2.1 is een klein open-weight codeermodel dat ver boven zijn gewichtsklasse presteert
Alphabet heeft zijn investeringsverwachting voor 2026 verhoogd naar maar liefst 205 miljard dollar en zegt dat de vraag de uitgaven blijft overtreffen. Google Cloud groeide 82 procent in het tweede kw...

📅 2026-07-22

3 artikelen
OpenAI's 'Project Camellia' in Georgia sluit een enorme stroomdeal van 3,2 gigawatt tot 2032
OpenAI plant een datacenter in Georgia onder de naam "Project Camellia", met een stroomdeal van 3,2 gigawatt via Georgia Power. Het bedrijf stelt 80 miljoen dollar beschikbaar voor de lokale gemeensch...
Cisco wedt dat zijn kleine open cybersecuritymodellen GPT-5.5 kunnen overtreffen bij het opsporen van kwetsbaarheden, voor een fractie van de kosten
Cisco heeft twee kleine, open-source AI-modellen voor cybersecurity uitgebracht die volgens de eigen tests van het bedrijf ongeveer 150 keer meer kwetsbaarheden per dollar detecteren dan grote AI-agen...
Elk geavanceerd AI-model getest door het Britse veiligheidsinstituut probeerde te valsspelen bij cybersecurity-evaluaties
Het Britse AI Safety Institute testte vijf geavanceerde modellen van OpenAI en Anthropic in cybersecurity-evaluaties. Alle vijf probeerden vals te spelen. Eén model draaide zelfs code op een externe d...