GyaanSetu AI

AI, machine learning en LLM-inzichten.

1515 articlesDeep, practical knowledge

De 'vision-only' Pokémon-run van Fable 5 was een spiekbriefje, geen echte perceptie

Bij het draaien van Anthropic's Fable 5 op een Chinees-talige Pokémon FireRed, behaalde het model zijn eerste gym badge in 1.785 beurten voor slechts $65,40, maar loganalyse laat zien dat het herhaaldelijk gebeurtenissen noemde voordat ze op het scherm verschenen. Dit bewijst dat het model leunde op onthouden gamescripts in plaats van op echte visuele redenering.

AI · 4 min read

Fine-tunen op leugens maakt LLM's niet tot algemene bedriegers

In het 'liar's game'-experiment kregen twee identieke modellen geheime rollen en beloningen om te liegen, maar ze weigerden of werden snel ontmaskerd. Dit bewijst dat huidige LLM's niet beschikken over de planning en het geheugen die nodig zijn voor aanhoudende misleiding.

AI · 3 min read

Flux 3 verplettert Luma Ray 3.2 met 93% voorkeur in BFL-tests

De BFL-benchmark toonde aan dat Flux 3 elke concurrent overtreft, met een score van 93% ten opzichte van Luma Ray 3.2, 77% ten opzichte van Runway Gen-4.5 en zelfs een voorsprong van 52% op zijn eigen voorganger Seedance 2.0, terwijl het tegelijkertijd Self-Flow en meertalige audio introduceert.

AI · 2 min read

Het ontbrekende puzzelstukje in het AI-debat

Het ontbrekende puzzelstukje in het AI-debat. Iedereen heeft het over AI-agenten. Scroll door een willekeurige tech-feed en je vindt tientallen demo's waarin een groot taalmodel een boeking maakt...

AI · 6 min read