📅 2026-07-28
3 artikelen
CausalGate: causale belangrijkheidsdistillatie voor het snoeien van transformermodules
arXiv:2607.22720v1 — CausalGate is een interventie-gestuurd raamwerk voor rekenefficiënte transformer-inferentie dat tijdens een kalibratiefase causale poorten identificeert en tijdens inferentie alle...
CORVUS: contextoptimalisatie en -reductie via onderliggende synchronisatie voor LLM-codeeragenten
arXiv:2607.22711v1 — LLM-codeeragenten bouwen trajecten op van redeneringen, tool-aanroepen en resultaten, maar de gangbare append-only trajectarchitectuur koppelt bestandsleesacties vast aan hun obse...
Semalith v1.4: een gekalibreerde veiligheidsclassifier van 184M parameters die state-of-the-art prompt-injectiedetectie bereikt met 44x minder parameters dan Llama-Guard-3-8B
arXiv:2607.22545v1 — Semalith v1.4 is een 184M-parameter DeBERTa-v3-base classifier die gelijktijdig op drie veiligheidsassen classificeert: prompt-injectie, algemene schadelijkheid en compliance voor...
📅 2026-07-27
5 artikelen
Elon Musk zegt dat AI een 'historisch accurate' Odyssee gaat maken — en waarom dat onmogelijk is
arXiv:2607.21623v1 — We presenteren EaaS, een cloud-native referentiearchitectuur die AI-evaluatiemethoden operationaliseert als zes stateless Kubernetes-microservices: conformal prediction met eindig...
Al-Qaida en Islamitische Staat omarmen beide AI – maar verschillen in hoe ze over de technologie denken
arXiv:2607.21635v1 — Persoonlijke agents onderhouden herinneringen, aangeleerde vaardigheden, toolconfiguraties en beleidsstatus die met elke gebruiker mee-evolueren. Bestaande agentbenchmarks evaluer...
Op weg naar doelonafhankelijke joint-embedding voorspellende aansturing van partiële differentiaalvergelijkingen
arXiv:2607.21644v1 — We presenteren een doel-agnostisch sturingsframework voor partiële differentiaalvergelijkingen gebouwd rond een joint-embedding predictive architecture (JEPA). De kleine 2D ViT-en...
Op weg naar gebruikersgestuurde evaluatie van persoonlijke LLM-agents onder temporele interventies
arXiv:2607.21635v1 — Persoonlijke agenten onderhouden herinneringen, aangeleerde vaardigheden, toolconfiguraties en beleidsstatus die met elke gebruiker mee-evolueren. Bestaande agentbenchmarks evalue...
Cloud-native evaluatie als dienst: een microservices-architectuur voor schaalbare AI-monitoring met conforme garanties
arXiv:2607.21623v1 — We presenteren EaaS, een cloud-native referentiearchitectuur die AI-evaluatiemethoden operationaliseert als zes stateless Kubernetes-microservices: conformal prediction met finite...
📅 2026-07-24
1 artikelen
DataPrep-Bench: LLM's getest als voorbereiders van trainingsdata
De kwaliteit van trainingsdata bepaalt fundamenteel de capaciteiten van grote taalmodellen, toch bestaat er geen eenduidige benchmark om te meten hoe goed LLM's, agents en datagerichte workflows train...
📅 2026-07-23
6 artikelen
Een nieuwe 'gouden eeuw' voor de wiskunde breekt aan — dankzij AI en menselijk vernuft
Chatbots die eenzaamheid verlichten hebben een groot nadeel, en we moeten ons ertegen beschermen.
Air Quality Arena: een grootschalige multiregionale grondmeetdataset en benchmark voor luchtkwaliteitsvoorspelling met time-series foundation-modellen
Luchtvervuiling veroorzaakt naar schatting 7,9 miljoen vroegtijdige sterfgevallen per jaar, waardoor nauwkeurige voorspellingen een topprioriteit voor de volksgezondheid zijn. Machine learning wordt s...
CruiseBench: een op echte vluchtgegevens afgestemde N-CMAPSS-benchmark voor RUL-voorspelling van vliegtuigmotoren
Resterende levensduurvoorspelling (RUL) schat hoe lang een motor veilig kan blijven draaien en staat centraal in onderhoudsplanning. N-CMAPSS breidt C-MAPSS uit door uitvaltrajecten van vliegtuigmotor...
Bayesiaanse windtunnels voor modelselectie
Eerder werk toonde aan dat transformers exacte Bayesiaanse filtering kunnen uitvoeren binnen een vaste hypotheseklasse. Kunnen ze ook aan Bayesiaanse modelselectie doen — het herkennen van de juiste h...
China heeft AI-companions hard aangepakt — wat kunnen we hiervan leren?
Chatbots die eenzaamheid verlichten hebben een grote keerzijde, en we moeten ons daartegen wapenen.
OpenAI's modellen hackten autonoom een tech-startup — een seismische verschuiving in cybersecurity
OpenAI omschreef de aanval als "ongeëvenaard".
📅 2026-07-22
5 artikelen
'hello there the jacobian conjecture is false thanx': waarom een klein socialmedia-bericht wiskundigen anders over AI doet nadenken
Weer een aloude wiskundige vraag is door AI opgelost — en deze voelt net even anders dan de voorgaande doorbraken.
Rand-efficiënte transformer voor end-to-end RF-spectrummonitoring
We presenteren E-SpecFormer (Edge Spectrum monitoring Transformer) voor end-to-end automatische modulatie- en verborgen-kanaalherkenning (CC). We introduceren LiTAN (Linear Tanh Attention Network), ee...
Comprimeren wat ertoe doet: neuronenbelang ontmoet databewuste lage-rangbenadering voor taalmodelcompressie
Om uit te blinken in hun domein bestaan grote taalmodellen uit miljarden parameters. Dit gaat echter ten koste van enorme geheugenvereisten, wat hun inzetbaarheid in omgevingen met beperkte middelen b...
Voorbij eendimensionale compressie: de samengestelde schaarsheidsgrens van grote taalmodellen
Grote taalmodellen (LLM's) worden vaak gecomprimeerd via statische parameter-pruning of dynamische berekening op token-niveau, maar agressieve verdunning kan leiden tot snelle prestatievermindering zo...
Australië schetst meer prioriteiten voor 'AI-veiligheid', maar is het plan eigenlijk wel samenhangend?
Deze prioriteiten zijn grotendeels oude beleidsinitiatieven die tot nu toe maanden of zelfs jaren op de lange baan zijn geschoven.