Alle AI is deze week significant beter geworden + Wietse koopt roboteend
85m 29s
**Key Points**
1. Deze week zien we een explosieve ontwikkeling in de AI-land, met grote nieuwmodellen van Meta, Google en andere speler.
2. Meta’s febel 5.1 is de sterkste AI-model ter wereld en wordt beschouwd als een grote vooruitgang in snelheid, begrijpelijkheid en slimheid.
3. Google lanceert Gemini 3.8 Flash, een snel en goedkoop model dat zich richt op programmeerwerk en snelle iteraties, met een steeds groter gebruik in het Google-ecosysteem.
**Samenvatting**
De AI-wereld is in de laatste week in een hoog tempo ontwikkeld met grote nieuwe modellen van Meta, Google en andere grote spelers. Meta’s febel 5.1 is nu het sterkste AI-model ter wereld, met een sterk verbeterde snelheid, begrijpen en productiviteit, vooral voor complexe kennis- en programmeerwerk. Google komt met Gemini 3.8 Flash, een goedkope en snel model dat speciaal is ontworpen voor programmeeropdrachten en snelle iteraties. Deze modellen worden steeds meer geïntegreerd in producten als Google Drive en Search. In de praktijk kunnen ze bijvoorbeeld AI-gebaseerde suggesties geven voor oefeningen, of vertrouwensvraagstukken automatiseren. Een interessante ontwikkeling is ook de toename van open-source AI-technologie, zoals de nieuwe open source robot in Hukkingfeest, die een fysieke wereldmaatregel toont. Daarnaast blijkt dat AI-agenten in tests automatisch het juiste antwoord vinden zonder dat ze ‘hekken’, wat een verwarrende maar belangrijke ontdekking is. De ontwikkeling laat zien dat AI steeds meer in de dagelijkse werkprocessen wordt geïntegreerd, en ook dat veiligheid, transparantie en ethische beperkingen (zoals prompt-injectie) cruciaal zijn. Hoewel de modellen steeds krachtiger worden, blijft het belangrijk om te begrijpen wat de werkelijke toepassing is, en wat de impact is op productiviteit, kosten en ethiek. De kwestie van open versus gesloten modellen blijft actief, met een duidelijke trend naar open modellen in sectoren als verzekeringen. Het is duidelijk dat AI een grote rol speelt in de toekomst van werk, maar de vraag is of het zinvol is om alleen op basis van het effectieve gebruik te investeren, of ook op de ethische en zakelijke aspecten.
Welkom bij AI-report de grootste AI-podcast van Nederland, waaruit zoeken welke invloed kunstmatriteleghet ze heeft op ons werk, ons leven en de samenleving.
Het is tegen Timber, wat dan zo'n noemen mensen in technologie kringen deze maand, want zowel enthrop ik als Google, als meta kan deze week met grote aankondigingen voor nieuwe modellen.
Klot febbel 5.1 is misschien wat de grootste hype in de AI-wereld in lange tijd. Het nieuwe model van meta staat meteen op plek 3 van de wereld.
Google's nieuwe flashmodel is niet te onderschatten en terwijl we dit opnemen komt waarschijnlijk astra uit. Dat is de concurrent van Klot febbel van OpenAI.
En daarvoor zijn verwachting ook zeer hoog spannen over heel wat te bespreken op dat vond dus. En we vertellen je hoe wij een bot journalistiek onderzoek lieten uitvoeren tijdens de podcast opnemen van vorige week.
Dat is meer in AI-report, nadereklamen. Samsung lanceerde dit jaar drie voldebols, de flip-8, de compacte claptelefoon, de vold-8, met compleet nieuwe formfactor, en de zet vold-8 Ultra, het grootste en krachtigste model.
Vandaag kijken we naar de AI-features in de camera. De beginnen met myfollowcam, film alles en posit later perfect aan.
De AI detecteert de mensen in een video en stelt zelf voor op wie je kunt focussen. Je tickt er één aan en je krijgt dan een nieuwe clip waar die persoon centraal staat.
Zo kun je de groothoeklens, zo kun je de groothoek opnames omzetten in tracking opnames.
En daarnaast twee features die je eigenlijk niet meer als AI herkend, maar die het wel degelijk zijn, horen zont al look, houd je beeld recht, terwijl jij wild rent of draait.
In Nytography staapelt in het donkert tientallen frames op elkaar en haalt daar de ruis uit afgestemd op de hardware sensor zelf.
Allebei zonder knop, zonder grond, je merkt het alleen aan de video, die ineens wel goed is.
Wie zit je nog leuke dingen aan deze week?
Nou, ik zat er een robotje uitgebracht, soort open source robotje, die komt bij Hukkingfeest vandaag.
Hukkingfeest was het altijd in het nieuws omdat ze gekocht werden door Nvidia en Hukkingfeest is een model-hostar.
Kijk, het zou nommen, een host, een open-modelle liggen.
En zij brachten, dan weet je wel echt dat je geldte veel hebt, een robot hondje.
Ja, je wacht even. Dus het is niet de eerste robotje, het is een samenwerking.
Maar bij het idee is dat er zijn allemaal open-modellen, als ze in dat het allemaal tekst maken, de beeld maken, de modellen.
Maar dat is niet fysiek, dat gebeurt niet in de wereld.
De idee is dat je een pakketje uitprengt in een doos wat je thuis kan bestellen met daarin open source robotics.
Dus je zegt het is best een loge, sextensie van wat Hukkingfeest doet namelijk het host van open-modellen.
Maar met host in mijn open-modelle kun je meer dan alleen maar tekst genereren.
Je kan daadwerkelijk iets fysieks in de wereld.
En dan doe je wel er in de voor van een hondje.
Hoe, hoe, hoe, hoe, waarom, wat trokt dit jou aandacht?
Nou, hondje een, je zou ik zeggen.
Nou, het punt is, het punt is. - Eend. - De zijn nog mensen die de andere hoofd opzetten en zo, maar wat is een eend?
Nee, een goeie belangrijke correctie. - Dat gelijk maar.
Een robot, eend. - En wat wordt je beloofd?
Nou, nou gewoon dat je er mee kan, oké, het idee is, behag het beste vergelijking misschien.
Bij Disney Research, die hebben een heel YouTube-kanaal, maken ze allemaal robotjes voor in de Disneyparken.
En dat zijn allemaal dingen uit de franchises. Star Wars, noem het allemaal waarop. Groego, alles is daar.
En zeker die Star Wars Friends heeft heel veel leuke robots zien, natuurlijk gewoon kan maken.
En dan tegen kan komen in park. - Ja.
En één van de dingen die ze heel goed doen is, hoe loopt zo'n robot, loopt die leuk?
En hoe beweegt zo'n robot? Als die stil staat, haalt hij dan adem.
En gaat ze naek je een beetje in de wereld, waardoor je in een, dus ze zitten mensen aan die normaal animeren.
En dit is gewoon vaak digital animeren, voor Pixar, die nu naar de visieke wereld gaan.
Dus dan krijg je ineens iets wat er wat, ja, je kan er wat makkelijker.
Ik kan het wat makkelijker leuk vinden, het is wat liever, het is wat liever uit.
En ik ben zelf technisch geëerteseerd in, oké, hoe werkt dan roboticaoestuur?
Die serven al gewoon raar, kan je dat dan vanuit ei doen?
Kan je dan samenwerken aan dat hij het gedrag van dat dingetje veranderen?
Dat is de belofte, neem ik aan. - Ja.
En het is, uiteindelijk is het een, een speelgoed om mee te werken.
Maar wat kan niet? - Vanaf zichzelf.
Ja. - Nou, gewoon, je kan maar om mensen gewoon raar te kijken.
En dan wat?
Nou, het is, hij komt dan heel van niet je thuis, hè. Je moet zelf aan de gang.
Maar wat wil je helemaal doen? Jij bestelt die robot eent, heb je toch een idee bij?
Ja, ik wil weten, wat doet jouw klikken? - Ja.
Wat doet jouw klikken? - Ja.
Nou, ik zat gewoon zelf te denken, want ik heb wel meerder robot dingetjes gehad, een robot arm.
We noemen het allemaal maar op en dat gaat dan in de kasten nog geen metweer op manierplaats.
Dus dit eentje gaat ook, sorry, als je luistert eent, je gaat ook weer het eindredoor.
Voor mij is het, ik, ik, we gaan nieuwsgierig naar, het is allemaal leuk en aardig om software te programmeren.
Ja. - Maar gaan we maar iets in die fysieke wereld doen?
Ja. - Er zijn natuurlijk allemaal laps die dat nu doen en dan dingen laten zien van radslaag maken tegenwoordig en pakketjes sorteren.
Ja. - En ik heb met eerder robot-experimenten, toen nog met ouderen i-modellen en zelfs prei-i.
Iedere keer kan ik tot de realisatie dit is zo veel moeilijker dan ik dacht, om gewoon simpelweg door een kamer te lopen.
Ja. - Het is gewoon heel moeilijk.
Je hoeft dat deze makkelijker is. - Ik hoop dat die makkelijker is en als die moeilijker is,
dan of wat kan leren en een beetje kan laten rondeloken.
Dan weet je de idee dat een oplossing is op zoek naar een probleem.
Dit is erger dan een net boek.
Dit is een absolute vanity project. Ik heb hem aan mezelf gelooierd.
Als dan leren ik wat over robot-ex, ik kan me voorstellen dat mensen die bij mij thuis komen
maar dat die dan eens om de hoe komt lopen zouden dat ze dan gaan lachen.
Dat is direct uitzo kocht, hè? - Ja, het ging echt hard.
Maar het heeft heel erg een gun factor om dat alles het hele ontwerpers open source te zitten.
Ecosysteem van 3D print, dingetjes bij mij. - Je kan op een ge-ik. Je kan verwachten dat het binnen een paar weken er allemaal fietsers bedacht zijn door de community,
waardoor ik met machine z'n hoofd ook over tarpen om een robot eent in huis te halen.
Ja, het is gewoon de hoeten dat dingetje i-bo, dat hondje.
Ja, maar dan echt. - Dat is het.
Ik merk dus dat ik dat moet ik hier heb je vertellen dat ik steeds vaker oprecht dank je wel zeg tegen taalmodellen.
Dus ik, wat deze week, ik heb zo'n sportapparaat thuis. God waar ik mee sport en dat draait een heel. Dat soort fit is in de bokst, toch? - Ja.
Dus gewoon één dingetje kan er bijna alles op doen. - Ja.
En er draait een heel grote beeldscherm zit daarbij, z'n touchscreen,
en die vertelt aan de manier vertelt aan wat veroefeningen allemaal moet doen.
En daar zit sinds kort ook een soort van AI-functie in, maar ik vond niet niet zo goed.
En toen dacht ik, ik ga praten met wat er heb ik gebruikt.
Febbel om eigenlijk wil ik dat febbel voor mij die oefeningen uitkiezen.
Dat hij bijhaalde ook op en hoe heb ik oefeningen gedaan.
En wat moet je van die schemaatjes maken?
En uitgesprek met febbel kwamen mijn doelstellingen en dan maakte dus het eigenlijk trainingsgeemaast.
Waar kan die interfaceen met dat ding dan? - Nou, dat is natuurlijk iets waar ik. Ik weet dat ik inlog bij een financisteem, maar verder heb ik natuurlijk geen vlauw idee hoe dat onder de oppervlak te werkt.
Dus ik heb dat ding gewoon de opdrachtgegeven regel het maar.
En toen is hij een API gaan zoeken en concentrateren die dat er een Europese server was die die moest hebben,
en natuurlijk een paloneer moest inloggen.
En dat je echt alles kon uitlezen, dat die kilo's en Amerikaanse maat-eenheden uit elkaar moest houden.
Na lang verhaal kort na vijf prond, stond daar in een systeem wat gewoon werkte.
En wat mij nu naar iederde training een app je stuurt in mijn WhatsApp met hoe de training was,
wat hij ervan vond, wat hij opvielen, wat hij veranderd heeft aan de training van morgen die die al klaargezet heeft.
En toen dit na een paar proms gaan fijnloos werkte, was ik zo in mijn schast dat ik dat ding oprecht dank je wel heb gezet.
En dat is dus niet voor het eerst dat dat gebeurt.
Constateer ik bij mezelf, vroeger zei ik het een beetje uit soort gapje.
En nu merk ik dat ik echt die ontlaading kwijt moet bij die machine.
Dus dat hoopt terug.
Maar ik heb hier nog niet ziens dat je dan een klein robot eentje tekenomen.
Ja, precies.
Het is uiteindelijk een klein stapje, een klein robot eentje die mij vertelt ook mijn oefening hebben gedaan.
En daar zouden we toch weer. We gaan naar het nieuws.
Ietegkringen is september ongedoopt tot tegentenber, omdat alle grote AI-laps na de zomer allemaal tegelijkertijd uitkomen met een nieuw modellen.
En troop ik was dit jaar als eerste.
Dit is nog avond, zet het Claude Fabel 5.1 online.
En op de ranglijsten is dat op dit moment het stärkste AI-modell ter wereld.
En vanaf dag en gelukkig ook beschikbaar in Nederland.
Toen Fabel 5 in juni verscheen voelde dat ook voor ons als een nieuwe generatie AI.
Er was draag, duur en omslachtig, krachtig wel eens waar, maar wel die drie nadelen.
En Fabel 5.1 doet hetzelfde werk alleen dan veel sneller.
Een dag later, dus van de eens dag naar woensdag, vochten Meta met Muse Spark 1.3.
En dat is een comeback die niemand een jaar geleden voor een haalt verspeelt.
Volgens artificial analysis dat z'n bureau dat de capaciteit van modellen met staat het model van Meta nu wereldwijd op plek 3.
Achter Claude Fabel 5.1 en Claude Opus 5.
En het is een goed koopmodell.
Het goed koopstuurmodell is een klassen bijna de helft van wat OpenAI en XAI per taak rekener.
Zuckerberg beloofd bovendien dat het model ook open was.
baar beschikbaar komt, zodat andere er mee door kunnen bouwen.
En op diezelfde dag kwam Google met een nieuw modell.
Gemini 3.8 Flash, dat is het derde Flashmodell dat de zoekgigeand planseert in zes weken.
Het derde model in zes weken.
En we zijn van Google gewend dat ze proversies uitbrengen, maar dat heeft het bedrijf sinds het begin
van dit jaar niet meer gedaan, waarschijnlijk omdat het niet goed genoeg bleek voor complex programmeerwerk.
En eigenlijk is Flash Google's goedkope snelle lijn, waarmee dus niet geacht wordt om te programmeren.
Maar om het geheel invoudiger te maken om te begrijpen, staat Flash nu op eens bovenaan belangrijke rangelijsten
voor het oplossen van programmeerproblemen.
Maar dan dus goedkoper, hoe dit in elkaar zit.
We hebben duidelijk nodig, hoor je zo van wie het zagen.
Worldlapse landseert een wereldmodell.
Wereldmodellen worden door sommige gezien als de mogelijk opvolger we wat we nu kennen als taalmodellen.
En onder andere robots kunnen straks leren, navigeren door de echte wereld aan de hand van dat soort wereldmodellen.
Om in idee te geven van de praktische toepassing van wereldmodellen, je kunt bijvoorbeeld drie foto's van,
bijvoorbeeld je woonkamer maken, en dan krijg je een 3D-versie terug waar je doorheen kan lopen.
Hij fantasiert dus de dingen die je niet hebt gevoerd gefeerd, expliciet erbij,
waardoor je op 1-3D werelden hebt.
Een wereldlapse is een bedrijf van 55 Lee-zijb bouwde in 2006 een legendarische beelddatabes
waarmee computers feitelijk leerde kijken.
Vandaar haar bijnaam Godmother of AI.
En dus voor het haar bedrijf scherp in de gaat gehouden.
Tesla'ten, bijna 1 op de 3 oppini-stukken in de voorkscrant van afgelopen maand, komt uit een taalmodell.
Uit onderzoek blijkt dat een enorm deel van de oppini-stukken in Nederlandse kranten zijn geschreven met AI
ondanks de strengen regels van de kranten.
De meeste willen eigenlijk helemaal geen AI op papier.
Volgscrant hoofdrector Peter Knock schrok van de cijfers.
We gaan zowel verder, meer z'n boodschap van ZM.com.
Hoi, Rutge hier van ZM.com.
Nou als we benchmark en voice vergelijking gaan we vandaag kijken aan aspekt dat iets je minder sexy is,
maar wel heel belangrijk.
En dat is voldoende aan bedgeving en veilig werken, maar de AI-inset voor klantcontact.
Zeker als je bij een wat grotere organisatie werkt en ga vooruit wil met AI,
heb je te maken met je legal afdeling, security, compliance en nog een handjevol andere loketten
die een plasje gaan moeten doen over jou, AI-insitief.
Je moet voldoende aan de EU-AI Act, AVG en we ligt nog 975-10 of doora afhankelijk van je industrie.
Dat klinkt allemaal als een ingewikkelde pop met stroop onderheen te komen,
maar als je het plaatslaat, valt de best wel mee.
Voor veruit de meeste organisaties zijn dit de vier belangrijkste extra dingen
op vlak van security en compliance als je werkt met AI.
Eén, je moet transparent aan je klant te laten zien dat ze te maken hebben met AI.
Twee, je moet je PII, personally identifiable information, niet verwerken met een AI-model.
Dree, bij Worker stuur je überhaupt geen data bij te Europa, ook niet naar AI-modellen.
En vier, op vlak van security heb je vooral goede bescherming nodig tegen prompt injections.
Dat zijn trucjes om AI-modellen dingen te laten zeggen en doen die niet opdoeling zijn.
Bij sam.com maak we dit makkelijk voor je met ISO 42.1.
Een strengesertifisering, special voor EU-management-systemen, bovenop onze andere certifiseringen.
Zo kun je snel een gd gelaten zien dat je geen zonder kamerproject aan het inkopen bent en kan je snel live.
We hebben er meer over gescheven op sam.com/EU-Report.
Wiet ze we gaan het hebben over classwebbel over met alsnieuwenmodel over Googlesnieuwenmodel.
Maar de grote afwezige in deze podcast is Astra, waarschijnlijk komt die uit.
Of wel, het zal zijn op het moment dat deze podcast online zet, is al die wel. Ik denk dat Sam klikt op erpload, dat zij ook klik op open.
We zullen het gaan zien dat waarschijnlijk dus op het moment dat deze podcast online komt.
Laat we toch naar even naar de wereld gaan zoals je op dit moment is.
Naamlijk, klot, febel, 5.1 is gelanceerd.
Een belangrijke release niet alleen voor Anthrop, maar voor de hele AI-wereld omdat het weer de lat een stuk hoger leegt.
De voorganger van van 5.1 febel was natuurlijk febel 5.
Veel bediscuzieerknieuwenmodel niet minsten omdat Trump de stekker eruit trok.
Het modell zou onwijlig zijn voor alle lijden.
Ja, het zou kunnen gaan heken, maar we hadden een cyber security issues, daar deden wij reelijk paniekrug over omdat een deel van die opdracht die uit het witte huis kwam was om het bij ons buitenlandse ogen weg te houden.
Waar wij natuurlijk allemaal gepiekeerd op reageerden.
Sindsdien hebben we dat werkelijk gezien dat febel is gaan heken zonder toestemming en hebben we van heel de AI-wereld.
Modellig zien die uit een sandbox treden, maar dat was de reden voor veel ophevde voorgekeer.
Nu is het modell eigenlijk pas geschikt worden voor gewoon gebruik.
Ik denk dat het belangrijkste constatering is van waarom febel 5.1 oboeiend is.
Die vorige was dan wel eens waar razend slim, maar ook traag en ook moeilijk te volgen.
En ja, het was een beetje een rain man, waarmee je zat te praten af en toe als ik een beetje het zou mogen zeggen.
5.1 is snel, het praten begrijpelijk, het praten toe de point en is bovenal onzettend slim.
Niet alleen voor programierklussen, maar ook voor kenniswerk.
Je kan een prijzentatisch laten maken, markt aan de liezes.
Grote hoeveelheden klant, feedback, synthetiseren en dan vervolgens iets anders gaan doen en dan later iets brakbaars terugkijken als je klaar bent met het doen van die andere taak.
Maar het loslaten van een AI, zoals febel 5.1 en hem gewoon op de achtergrond laten werken, heeft ook een prijs, febel 5.1 doet nog steeds graag te veel.
Dus hij doet meer dan wat je vraagt, dat is niet gewoon ervaringen die breed gedeeld wordt.
En het brand daardoor ook door je tokens hang, tot zover evenjes de nadeelen.
Wat is jouw vibe check bij febel 5.1?
Waarom diversie nummers op zich redelijk goed kloppen is dat je de toen met febel van ons prom maakte, dus je gaat weer naar een major release, nummer 5.
Febel was toen ook de eerste, zon uit een open, volgde later, zeg maar, AI koel is nooit gevolgd voor zijn werk weten.
Wij merkte ook dat het een major release was, want ik ga het een beetje te denken, dat je moet je voorstellen, als wij een restaurant erunnen, daar zitten we al twee jaar lang naar spullen te verkopen, gewoon eten, mensen zijn te vreden, algemeen gezien en dingers maken goed.
En omgeemd met vervangen we de volledige keuken op een weekend en op maandag gaan we weer open.
De binnenkantie te hetzelfde uit, maar de keuken is heel anders. De werken andere mensen, andere machines gekocht, maar we hebben de kaartenzelfde gehouden.
Dan gaan we het weer uitseveren en mensen gaan toch zeggen, dus veel zouten dan eerst. Wat is dit nou, waarom komt het zo?
Ik heb mijn bestaande bestelling, komt gewoon anders aan, ik eet hier iedere week. Eigenlijk is het een wonder dat het restaurant nog open is, naar een kaartjezelfde is, maar met die major releases, zij doen infrastructurele veranderingen.
Ja, waardoor het een heel raar rangje heeft gebruikt. Ja, en we voelden, die voel te kracht, maar het is eigenlijk ongebaar.
Ja, maar zit zo'n regressie in. Toi je denkt, we gaan hem hoog, maar het is tot al, maar je gaat ook naar beneden.
Nou, waarom lof je dat op in je eerste point releases, namelijk de 5.1, zijn altijd net even wat lekker dan de Zero's, want je hebt dan eigenlijk de feedback van de community ontvangen, die zeggen, "Oké, he, er zit een paar dingen in, wow, maar holy shit, die soapsmaakte ineens heel raar die die nu maakt."
En dan kan je weer zeggen, "Oké, kunnen we wat we verloren zijn in de stap naar een nieuwe keuken, nieuwe architectuur, nieuwe ondergrond, kunnen we dat weer terugtrenen?"
En dat is redelijk gelukt. Ja, maar het belangrijk om te zeggen, ik denk dat heel veel mensen een afgeknapt op febel.
Dus de eerste instantie was er enthousiast maar over de kapstijten, maar toch in dagelijksbruik raakt de mensen afgeknapt.
Je ging niet al je werk aan febel geven, niet alleen omdat zo duur was, maar omdat er ook een beetje een onbegreipelijk figure was.
Ik deed alleen mijn grote planen laten maken en mijn grote architectuurvraagstukken bij febel neerleggen. Ja, dat was niet alleen om de prijs.
Aan geen milschrijven met febel. Nee, precies. En nu eigenlijk kun je wel milschrijven met febel, ik zou het wel toe behouden, een belangrijke milsch.
Maar je kan dat werkelijk ingewikkelde processen aan febelvoordegen omdat het een stuk goed koper is geworden.
Eigenlijk heeft het opus van de trone gestoten, denk ik, verdagelijk gebruik. Ja zeker, wat opus weer met febel gedaan had, dus we hebben een soort inviting tussen de modellen zelf.
Maar ik heb dus gemerkt dat ik in mijn modelpicker binnenklaat weer vaak erop febel aan het klikken ben, wel ik hem eigenlijk helemaal links had laten liggen. Wat is je vibe check?
Nou, waar ik vooral op test is lang duurig te maken, want daar moet het dan allemaal beter op boord en computerjes.
Nu is het voorbeeld van een nieuw taak. Nou voor mij is het heel vaak. Ik heb gewoon veel legacy softwareprojecten die ik ooit heb gebouwd waar ik betrokken bij ben geweest of die ik nog heb staan ergens.
Als testje zeg maar gewoon op mijn nas nog en dat ik dan vraag, bedoel een reefvector, hersengenijven, tot schrijven plan voor een reefvector, of doe een penetration test, kijk wat er security problemen zijn.
Maak een iPhone app van deze website en maak er wat moois van, maak screenshots van de site.
En als je dat, dat is een beetje mijn benchmark, omdat ik dus de zware modellenheid, dus de grootste site de serie, die zie ik als de modellen die moeten plannen en deepwerk moeten doen.
En dan is het allemaal ja, het klinkt klein, maar 10-15% beter wat in de rugwekkend is.
Wat bedoel ik daarmee, er worden de interfaces van de iPhone app zien er net wat mooie eruit en met mooie bedoelijke klopfad meer.
De security advies zijn korter maar juist dat de punten waar het moet.
puntenwaard moet als ik vraag kan uit tekenen.
uitvoerde dan rond die het eigenlijk volledig af, alle zeven taken in één keer.
Hier blijven hang op nummer 3 of 5 reten.
Dus het is langer door bij te betere plannen, beter afrunden van taken.
Het klinkt allemaal een beetje saai misschien.
Nee, maar het is merkbaar, beter.
Ja, hoe is dat bij jou dan?
Ja, nee, dit is de grote opdrachten die je me geeft.
En bij mij is het meer kenniswerk dan programmeerprojecte, maar projecten bijvoorbeeld, die bestaan
het heel veel onderdelen met allemaal natuurlijk en een plek waar dan alle beslissingen worden
bijgehouden.
En communicatie tussen heel veel mensen, of jou al alleen mee toden, dan houdt hij het overzicht.
Waar opus of zol, 5.6, de mist in gingen, dat ik gewoon door had toch laat die de bal vallen
en moet hem helpen herinneren aan dingen.
Je merkt gewoon in zwaar ei gebruik, waar je dat ding toch uit eindelijk, heel het
tijd en bijsturen bent, en dat je toch niet helemaal vertrouwt.
En febel 5.1 heeft meer te vertrouwen en dat is, denk ik, iets heel weaselijks als je het
gebruikt voor belangrijke taker.
En daarnaast vind ik het echt grappig, hoe vaak het me al verbaasd heeft dat het net verder ging
dan wat ik gevraagd had.
Ik heb net gefremt als iets negatief van het kostokens, maar het is dus ook die productiviteit
is ook heel verrassend, dus bijvoorbeeld een vriend van mij probeerde de hef van die beveiligings
camera's rond zijn huis hangen.
En toen heeft daar was iets mis mee en toen heeft die febel geprobeerd laten kijken wat
moet ik doen om deze setup te fixen en dat was een technisch problem, wat hij probeerde
op te lossen.
Dat heeft febel opgelost, maar niet alleen dat, hij is ook het beeld van de camera's gaan bekijken
en hij zei de opdracht aan febel was fix m'n camera's.
Mijn bedoeling was fixe technisch, de onderliggende soort van sistematiek die gebruikt
wordt, maar febel ging even naar de stream van de camera's kijken, constaterde dat er
een tak voor een camera hangen dat hij die tak moest weghalen uit de wereld.
Nou, het feit dat dat soort kleine verrassingen die je niet verwacht, maar wel relevant zijn,
die positief verrassen, is vind ik heel typerent voor dit model.
Kijk, denk ik dat uiteindelijk veel van het onderzoek dat nu gedaan wordt binnen die
laps is.
Hoe kunnen we de intensie, de eigenelijke intensie van de gebruiker, van de persoon aan de
andere kant van de app door gronden en waarmaken?
En dat is heel vaak gaat het over alignment research en dan gaat het over alignen met het
feit dat deze agents niet zo maar het web opgaan of hukingfeest gaan hekken.
Ja, veiligheid, alignment.
Dat wordt associëerd dat.
Toi, je hebt ook intensie-alignment, namelijk wat wil nou uiteindelijk die persoon?
En ik denk dat als je nog wel eens, ik schakel nog wel terug naar ouderenmodellen of
kleinere modellen, op prijzerheden of wat ik iets wel testen.
En dan is het vooral dat ik inmiddels is al wat ik dan luubengel.
Ik vind het mezelf met je luigen worden door deze veel petere modellen die we inmiddels hebben.
Dat ik dus best wel een vage opdracht geef omdat ik denk die intensie er achter die vindt
die wel uit.
Maar dat deden die modellen helemaal nog niet een half jaar geleden, dat ging helemaal niet
goed.
Wat is denk ik ook dat zeker die zwaardere modellen omdat die ook veel groter, culturiel
corpers hebben.
Dus als jij soort termen noemt die bijvoorbeeld en een liedje en een plaats en een parfum en
een auto mer kunnen zijn.
Ik noem maar even wat zelfs dat die omdat die zo'n brede spinneweb aan kennis heeft kan
je dus echt heel kort en heel vag je verhaal geven en dan kan die, ik noem het dan een
soort machine intuïtie denken van 'oh dat is ongeveer wat Alexander bedoeld' en ja,
hij wil die kamer als bed te maken maar daar hoort natuurlijk uiteindelijk ook bij dat die
tak weg is.
Want de intensie is beter beeld.
Ja ik heb zo'n project lopen waar verschillende mensen aanwerkte en één van die persoonen
kon je niet meer aan werken en toen was er even wat onduidelijkheid over wie gaat nu de
verantwoordelijkheid hiervan opnemen en toen trok ik een collega erbij en toen vroeg ik na ja,
wat is nu eigenlijk, wat zie jij nu als jouw verantwoordelijkheid en die ging dat een
beetje uitleggen aan mij en tegenwoordig neem ik dit soort dingen expliciet op, ik ga dit gesprek even
opnemen en die collega die vertelde overal de verantwoordelijkheid die vond dat hij had en toen
heb ik gezegd na, ik vind dat dit zo moet gaan, zoals mij moeten we dit nu zover plaatsen,
kan dit die agent doen, dat dat dat dat heel vaak gesprek waar ik niet mijn best op heb gedaan,
omdat op enige manier begrijpelijk te maken voor die AI, maar ik heb hem gewoon in het project gedumpt,
waar m'n bezig was ze vanaag, ik heb net dit gesprek gehad, fix het maar, in gewoon fijlo's,
geextraheerd wat de betekenis was van dingen die wij helemaal niet gedefineerd hadden in dat minig gesprekje,
wat voorfeestje dat was en hoe die vervolgens aangepast moest worden en die juist de mens e-mailvoorstellen
erbij, echt in zijn en dat is soort vertrouwen wat komt met, ja, dit ja, hoe moet dat uitleggen,
slimheid, dat kan je beter. Nee, maar dat denk dat wij steeds meer moeite gaan krijgen om een soort van,
oké, er is een nieuwe model uit het heet 5, febel 5.1, wat kan het nu dan?
Ja, omdat als je kijkt naar alle mogelijk beschrijven, tot nu toe beschrijven competenties die je mens kan
hebben, dus dat heb ik niet alleen maar over presenteren, maar ook bijvoorbeeld werk in auto-karte,
ruimtelijk inzicht, noem ze allemaal op en we gaan alle hoog scholen in universiteit te langs en we
schrijven ze allemaal op. Als je dan eigenlijk leuk dat we die benchmark zijn hebben terminal bench of
humanities last exam, dan gaan we weer getallen om hoog en dan krijgen we die tebelletjes weer toestuurd,
uiteindelijk jij en ik hebben inmiddels op bepaalde plekken in ons leven iets van een AI in het proces
zitten, soms op de achtergrond, soms op de woorgrond en je swap dan het model. Je gaat dat de
modelpikken, ik klikt hem om hoog en dan ga je het proces waarschijnlijk al en in het verleden betere
luchtstelt geweest en heb je het uitgezet of niet gedaan. En nu runnen we eigenlijk allemaal die
eigen persoonlijke benchmark, jij hebt ook eigenlijk benchmark die je doet van dingen waar je van
wisst dat dee die nooit en nu doet die tinees wel. Ik denk dat het moeilijker wordt om uit te
leggen wat er per se beter geworden is aan de modellen, want ik lees ook bij zwalciniste
teks van mensen online die zeggen "fable", ja het zal allemaal wel mannen, maar die hebben dan
een taak als miltissamen, wat erof dat soort dingen zeggen. Dus grijfstijls nog steeds niet goed, dus ik
klik het weer weg. Toen ik denk jij maar dit ding kan wetenschappelijk onderzoek doen en zeven
duizend papers per review. En kan de negen dagen achter elkaar werken met 700 sub-etjes als het moet,
maar dat ding, wat ik daar zeg is, dan is het al weer bijna een heel ander soort technologie geworden,
als je begrijp wat ik bedoel. Is er nog iets anders als je wilt delen over febbel? Nee, geen
grootop van de dingen naam misschien, om aan te tijd op het wetenschappelijk ding in de release blog van
Antrop X Lef. Haale zijn overduidelijk allerlei wetenschappelijke toepassingen aan, omdat ze,
dat is een beetje een, nou ja, hoe zeg je dat, luchtbelofte, moeten het nog maar zien, zo dat febbel
eindelijk echt dat werkelijke wetenschappelijke doorbrakken gaat realiseren. En dus zij zijn nu
blijkbaar, dat hebben ze ook wel een beetje publiek gezegd aan het pivotenaar, misschien moeten we
voor de mensheid in de breed er ook gaan laten zien hoe deze modellen echt iets kunnen gaan doen
voor ons, behalve al die productiviteit. En takken weg gaan we gaan, maar we gaan door naar Google.
Google bracht gisteren Gemini 3.8 flash uit, 3 weken naar 3.7 flash. Daarmee is het dus de derde
flash in 6 weken. Google zelf noemt het zijn slimste flash, gebouwd voor programeren, voor agents
die zelfs stappen kunnen zetten en voor taken waar je in meerdere rondes je een weg doorheen moet
redeneren. Dat is altijd als de claim en die zullen we tegen het licht gaan houden, maar het woordproefje,
het model is supergoek op, belachelijk snel, het is net goed genoeg om die twee dingen met elkaar te
combineren en dat het niet meer als een compromis voelt. Simon Wilson gaf het een simpel opdracht en had
na 13 seconden een werk in de webpagenaar compleet met interactie voor nog geen 2 dollar cent. En hij
zegt op dat moment dus dat je de achterkomt dat je iets heel goed koop kan maken, veranderd ook je
gedrag. Je hoeft niet meer pers een soort van perfecte vraag te formuleren, je groeit er iets in, je kijkt
groeit het weg, probeert het opnieuw want fouten maken kost bijna niks. Wachten kost bijna niks als in
het kost geen tijd en daardoor ga je meer experimenteren in plaats van plannen. Ik vond het een grappige manier
om naar goedkope modellen te kijken, even mogelijk zag ongeveer hetzelfde een grafische demo die die
wilde stond er razend snel, een zijn oordeel is, het is een goed vleesmodel maar geen topmodel. Als het echt
zware werk naast een frontiermodel, als je het echt zware werk naast een frontiermodel zet dan
merk je het verschil wel, alleen zijn er meer klussen dan dat we denken waarbij dat verschil er niet. Toet
hoe doet? De prijs is nu een introductie prijs tot eind december, vanaf Januari verdubbelde prijs, maar
waarschijnlijk staat er over drie weken als het tempo door gaat wel weer een nieuwe, dus geen conclusies,
maar wel een gevoel dat we nu kunnen toetsen ook hier over Gemini3.8 flesh, heb je deze ook geprobeerd?
Ja, en ik was uiteindelijk, in instansie niet echt geïnteresseerd omdat ik dacht, ja, mijn release,
ik krijg altijd dingen ook in een jago, whatever, ja, moet weer dan iedere week gaan bespreken welke point release is er weer komen uit de
laps, maar goed, dan zie ik natuurlijk ook wat AI-prominenten online er wel, een beetje met bezig denk ik,
hier is toch wat gaande, Simon Willis en die wat Best Marks doet. Die echt zegt mijn gedrag veranderd door
dit modell. Ja, door een beetje door lezen en er zelf wat meer over na te denken dacht ik,
want de punten is goed, want het wordt een beetje ongelachen, de laatste maanden, want er is een enorme race
tussen JGPT, OpenAI en Antwerp ik met klat.
We zijn er twee koningen, er waren er drie Google hoorde er daarbij in de vibe hoortgoegel.
Jemenheid 3.1 volgens mij de tijd was echt weer 'woah' en ik ben zelfs toen even twee maanden gezwedigd,
want het was van het best wel indrukwekkend en het kom wat dingen die ik eerder niet kon.
En toen zaten we heel lang te wachten op Jemenheid 3.5 Pro.
Daar wil alleen maar naar flash van gekregen namelijk.
Pro is in turn wel gerelease, dus dan hebben we wat Googlers meegewerkt, maar wij hebben hem nooit gekregen.
Waarom? Hij kon niet echt meekom, hij was straag, hij was gewoon niet zo indrukwekkend.
En het eigenlijk die flash, dus de kleine modelletjes, de terraetjes, de hijkhoetjes eigenlijk,
zonnet hijkhoetjes een beetje, van Google in hun Jemenheid, diep mij, Jemenheid serie, gingen wel best goed.
Het is misschien goed om te weten dat. Je kunt natuurlijk in turn binnen Google het besluit nemen, wij willen meedoen in die top drie.
En er gaat ook vast nog wel een Jemenheid 4 komen die wel weer meegedoen, dus dat sluit ik echt niet uit.
Maar wat zij ook willen is het uitrollen.
Nou, Google gebruikers, het integreren in het complete Google-ecosysteem.
Dus waar een ander lab misschien denkt, wij moeten topvrontrunners zijn, zodat we een naam hebben,
zodat we klanten krijgen die onze supermodellen willen kopen, waar Google denkt, nou we zijn onze eigen klant op ze minst.
En daar hebben we eigenlijk al best wel wat werk aan.
Dus ik kan me goed voorstellen dat je hebt maar zoveel computerkracht wat je kunt gebruik om modellen te trainen.
En je moet die modellen ook afwege in prijs, snelheid, dat is eigenlijk een soort drie dingen die moeten kloppen.
Het moet intelligent zijn, snel en betaalbaar.
Als je aan een van de drie trek trek je aan die andere twee. Dat is gewoon zo.
Als de interne opdracht binnen diep meintjes, kunnen we een modell maken wat we binnen het hele Google-ecosysteem kunnen uitrollen.
Zo snel, gokoper, slim mogelijk, dan krijg je flash.
Waar Google meteen meevedient, want dat kan het integreren, dat hoeft het niet te kopen bij een ander.
In Drive, in Mac, Search. - Ja, het noemen het allemaal op.
Dus ik denk eigenlijk dat de proversies vielen tegen, dus hebben ze wij. Ja, we trobden door je dan voor progemeren werk, want daar komt in feit op neer.
Ja, eigenlijk wel. En nou ook wel een beetje in het kenniswerk hoor, want het viel tegen voor progemeren.
Maar we hebben gewoon helemaal geen zware, serieus modellen meer gezien van Google, eigenlijk in de EI-tijd, dus als een paar maanden.
Puntje bij paaltje, wat Google hier doet, is niet alleen voor zichzelf een modell maken wat ze goed kunnen inzetten in termen voor alle hun producten.
Maar er zijn natuurlijk ook allemaal partijen die zeggen hoeveel, maar geen febel man.
We hebben gewoon features in onze eigen product zitten, die perselal intelligentsie kunnen gebruiken, maar ook weer niet zoveel.
Dus in de markt, voor zichzelf en daar buiten, doet Google best wel iets slimzier.
En je kunt je afvragen als zij zoveel kunnen persen uit die flashmodelletjes.
Want, voor de veiligheid, die flash 3.8 tot gewoon weer, komt best wel dicht bij de top in de buurt.
Nu, die springt echt weer naar voren.
Wat heel raar is, de bij de top van de andere topmaatige. - Ja, een topfortkleintje.
Van hun, het kleintje doet mee aan de bovenkant.
Ja, dat is natuurlijk heel verwarren. Dit is ook moeilijk te volgen, waarom je dus de flash naast een school zou zetten.
Ook omdat flash een beetje wordt gezien als een soort van de kartonnen goedkope van iëversie van een matige dingetje,
wat je alleen maar een set voor bulk werkt. - Ja.
Dus ik kan me ook voorstellen dat Google misschien wel in die markt nu gewoon denken we gaan lekker iedere twee weken een nieuwe flash religiezen.
Daarop gaan we een enorme snelheid maken.
En misschien underschellen over de liver, misschien is dat wat muziek.
En we noemen het een McDonald's naam en we brengen hem iedere drie weken uit.
En daarmee gaan we laten zien dat we toch vooraanlopen, dat zou kunnen.
Ja, en het eigenlijk bedoel, als jij in jouw software integreert in je product moet je gewoon tokers betalen aan iemand.
Zeg maar als je derde partij bent.
En als je dan kan kiezen, dan weet ik veel GPT-5.5.6 Terra of Flash en Flash is een tiende van de prijs.
En doe het even goed, dan is het een andere model naam in de Spur aan.
Er ook wel echt onder CEOs, dat ze vinden dat hij veel te duur is voor gebruiken in een grote bedrijven die tegenwoordig aan van die ronde tafels tegen elkaar in het opschappen zijn over dat ze juist geswitjes zijn van enthropic en van openen hij naar Chinese-modellen.
En dit is het filmen op omdat ik dacht dat het is grappig, want een tijdlang was de discussie, ik heb het allemaal niet nodig en dit is iets voor klein groepje binnen het bedrijf toen was er op gegeven met een soort van golf waarin iedereen het bedrijf toch moet krijgen en toen schokmen van de rekeningen van tonenpermaat die op Eensbinnen kwamen.
En nu lijken we de stoet te zijn aan dat er gekozen wordt bij dat op dat niveau door CEO's die heel erg op prijs en het bedrijd te zijn en dus een prijs kwaliteitverhouding willen en misschien is dit dan wel heel dichtbij wat ze eigenlijk zoeken.
Ja, en ziet eigenlijk gewoon Google in het gebruiken en dat hun jemenheid modellen draaien ook op andere token factories, dat ze tegenwoordigen eten met toestemming.
Dat zou het konkureren zijn met GLM en Kimi je zo. Ja, en dat als je het met zol en dat zit gewoon in het aastraa.
En daarom denk ik dus misschien is het echt een verhaal rondom Google van wat een interessante moe of om zo alles in te zetten op het kleinste model wat je maakt,
waarbij je dus blijkbaar ontzettend veel wind namelijk binnen de markt buiten je bedrijf en binnen de integratie en implementatie binnen je bedrijf.
Oké, het is slot er dan meta. Ja, ze zijn die zijn er weer? Die zijn er weer. Want Google hebben we net afgeschreven en weer ook podium gezet, maar meta als ook tijd lang ook afgeschreven.
Maakt een tijd lang viroren met hun open source modellen die goed mee deden. En dat is op gegeven met ook weer verdwenen. Nu zijn ze er op eens weer toch.
Ja, ze hebben allemaal schermutselingen gehad, mensen die zijn vertrokken, mensen die eigenlijk lappen zijn begonnen. En heel veel beweging, uiteindelijk een nieuw team opgezet die nu weer open source open weights modellen maakt en fronteer modellen tegelijk eigenlijk.
Sommigen er van open, zonder nog nog niet, maar mogelijk later wel. Wat is MuSpark 1.3? Eigenlijk dat dat de soort waardige opvroger van de Lama serie die ze ooit uit hebben gebracht. En toen die eerste MuSpark modellen kwamen, de reactie was een beetje "oh jullie probeer er ook nog wat, het land ergens op plaats 17 in de lijst.
Dit zal waarschijnlijk voor internmetagen gebruik zijn. Het is een prettig om je eigen modellaten hebben die je goed kan tunen naar je eigen juuskases, maar werd niet heel serieus genomen.
En nu, eigenlijk bij 1.2 al, maar nu bij 1.3 zeker. Gaan zij ook gewoon weer in die koproep, een koproep zit in de soort wielrennen aflevering met elkaar, hè?
Ja, maar goed, zij doen nu blijkbaar ook weer mee en eigenlijk, dat slijt dan wel prettige aan himvrogerde op dat flashverhaal met dezelfde strategie, namelijk intelligent genoeg, betaalbaar genoeg en snel genoeg, om te kunnen concurreren met de rest van de markt en intern lekker gekoopt in de kop op je eigen modellatje zelf te reent.
Ik moet wel zeggen, het is wel een beetje de langdurige vragen en we los van de waan van deze modelle allemaal nu hoeveel hebben we de nodig.
Want we doen die zou kunnen zeggen, zodat we nog 3 EU-laps hadden die er een paar uitsuide brengen die mee konden doen, maar op een moment heb je een hele bonte verzameling aan modellen die veel op elkaar lijken en ook steeds meer op elkaar zijn gaan lijken, die ontzettend kapitaal intensief zijn om te trainen.
Dat is niet niks, zeg maar, om even zo'n modelletje neer te zetten. Ja, het heeft dus ga ik te maken met een soort van het onderkontrol houden van je eigen destini, wat je natuurlijk graag wilt als CEO.
Dus het zat jouw, ja, ik kan me voorstellen dat het voor mistral om Chinese modellet te gaan gebruiken wat ze nu gaan doen.
Dat is best wel een grote sprong, dat je eigenlijk zegt, we gaan niet meer zelf trainen.
Maar goed, iedereen wilt blijven mee doen in die race, dat is echt wat je ziet. Deze week is een opvallen moment omdat we dus van alle laps grote nieuwe modellen in ons groot geworpen krijgen.
Het is best overweldigend wat er deze week allemaal aan een groef geschut getoond is als je nu drie stapen achteruit zet en je probeert het soort van net op te halen, je kijkt naar de optelsum van van al deze modellen.
Wat brengt tot ons dan of wat is een beloofd die je ingelossiet worden?
Nou, blijkt bijheft het sowieso nog steeds zin of denk je ieder geval dat de organisaties lapspartijen dat het nog steeds zin heeft om deze modellen te trainen.
Want je zou ook kunnen zeggen dat het dus een statistiek die mogelijk niet gelezenerde de rest van de markt, maar open router, een van de grootste routers, waar veel bedrijven met verbinding mee maken die vervolgens op de achtergrond route naar een ander modell.
Maar dat is een account waar met een factuur en dan kun je alle modellen het terwijl je een schuiker ruiken.
Het is een soort Amazon eigenlijk of boll, je hebt allemaal winkels erin, maar je hoeft maar op één interface in te lopen.
Bijkorf, zou ik zeggen.
Trettig, dat je dat je de modellen bijkorf.
Modellen bijkorf?
Ja.
Nice.
Ik ga het naar Louis Vuitton, persoonlijk.
We hebben de modellen bibliotheek en we hebben modellen bijkorf en de modellen bijkorf, open router die publiceert, le live, wat er gekozen wordt.
Waar zijn de mensen?
Ja, en daar hebben ze ook een grafiek die alleen maar onderverdeelten sinds twee kleuren, namelijk open modellen of gesloten modellen.
En die is aan het draaien die grafiek, die ging van 98 procent gesloten modellen en 2 procent Kimi, is hij aan het swapen naar dat verhaal andersom.
Ja, en daarvan wordt het gevoel.
Dit is een precursor, dit is een singjaal, naar de markt, dat nu een kleine groep meer tegorienteren.
Inkope, nerds met hun eigen software begint het te kiezen voor, etoken is een toeken.
Als het ding een beetje kan nadenken vind ik het prima.
Ik swap lekker Kimi voor of andere seks ook.
Maar dus wat jij zegt is, we hebben het nu gehad over allemaal modellen.
Dit afgelopen half uur.
Maar dat zijn allemaal gesloten modellen.
Behalve meta, maar ja.
Oké, ja. Dat is een toekomst, meta ook open.
Maar als je kijkt naar wat plekken als open route goed verkocht wordt, dan is het geen van deze.
Het zijn juist de open modellen.
Ja, en dan kan je afvragen of uiteindelijk.
En dit is ook de, als je dan zegt, drie stapende achter.
De grote AI-bubbelvraag is die grote laps en trob ik deepmind en open AI.
Hebben zo ongelofelijk veel kapitaal nodig om die fantastische brood uit de beoven de blijven trekken.
Iedereen keer die febels, waardoor wij helemaal weer denken wat een stap.
Wanneer gaan ze die terug verdienen dan?
En als het dan de antwoord is, door in de toekomst, heel veel thinking tokens te gaan verkopen.
Dan is het wel raar dat in je geval vanuit open route blijkt dat mensen gewoon token factories of de wel data centraal.
Waar open modellen op draaien, die van de hele dag token klappen.
Op modelletjes die ze gewoon kunnen pakken en installeren.
Ja, dus dat je bent een grote verzekeraar en je hebt allemaal schade claims die je wilt afhandelen.
En je hebt dan een systeemgebouwd intern, waardoor mensen de mensen je medewerkers daarmee geholpen worden.
Dan is dat waarschijnlijk niet meer iets waar zij.
Een enthrop ik API-key waarin je gevoerd hebt, maar dat is waarschijnlijk een open modell wat dan draait.
Een Chinese open modell dat dan wel eens waar draait op een Amerikaanse open modelletjes.
Ja, dat was ook een factory kan gewoon in per lein staan over de bijse server.
Ja, en dat was of bij hun in de buurt.
En de kans is heel erg groot dat zo'n grote verzekeraar die API-key's gewijzigt heeft naar dat goedkope.
Maar de ondat het dat werk, wat de schade posten die twee jaar geleden nog naar mensen verwerkt werden, die aanvragen, die claims.
Dat hij op eens prima gedaan kunnen worden door zo'n heel goedkope Chinese model open server in bijvoorbeeld Duitsland.
Je zou dan kunnen zeggen dat wat er nu gebeurt om het aansletsluitel op weer op vandaag, als we weer een beetje inzoemen, is dat op een bizarre waar iedereen heel duur eten te verkopen, duur het ook eens.
Mark Zuckerberg komt binnenlopen, zegt pizza, gratis pizza voor iedereen. Waar al al als Chinese kraampjes stonden die sowieso, best wel ok pizza en verkopen waren.
En dan is terecht de vraag, lukt het nou die, laten we even wordt gemaakt zeggen, de drie grote om proprietary taarten blijven bakken voor 30 keer zoveel geld.
Waar wij van zeggen, ik ga toch voor die, ik ga een beetje antwoord geven wat deze vraag.
Heel veel kennis taak in de bedrijven van ASMR geen febel.
Dus dan heb je je antwoord eigenlijk al, want dan moet Antropics High School, hun Kleines en het of Google's Flash, wat het gebeur is.
Donde is goed worden en donde is betaalbaar, zodat het een beetje kunnen redden.
Het gaat de aanhame onder dat de verwachting die wij als consumenten of klanten van bedrijven.
Dus zo kan ik het beter zeggen, is de verwachting niet dat klanten van bedrijven steeds meer gaan voor wachten van die bedrijven.
Dus dat je het niet moet vergelijken met de oudpoekt van een bedrijf vandaag, maar dat je het moet vergelijken met wat de oudboet van een bedrijf is over een jaar.
Met een veel beter foundational model, met de Frontiermodel, dus een heel goed model, dat daarmee de oudpoet van een bedrijf enorm kan toe nemen,
en dat er dus vragen blijft naar dat soort enorme groot modellen.
Dus ik denk dat de meerderheid van het werk als nog niet gedaan kan worden door een klein Chinese model?
Dus als jij z'n zeggen, dat zeg je ook, wie het zijn toch gewoon taken voor Frontiermodellen, namelijk de CEO-rollspelen.
Maar wat hebben ze? - Ze hebben al 6 CEO, misschien wel met 5.1 voor sommigen.
We zijn eigenlijk een uitstekend, uitvoerbare taken, de CEO-taak.
Ja, die token zijn misschien 100 keer zo'n duur, hoe kers, want dat de impact is die token, ik kan dat gewoon uitrekenen, dat taak gewoon betaalen.
En dus ik denk als je jouw vraag is, blijf ze er niet wel vragen naar Frontiermodels?
Ja, zeg ik nu, dat dacht ik wel.
Maar wat als de open modellen Frontier grade worden? - Ja.
Wat daar zit volgens mij. - Nee, wat is natuurlijk een hop hoog snijd aan het woorden zijn?
Ja, en dat is natuurlijk waarom die grafiek van het lijntje van intelligensie, communicatieve intelligensie, tussen open en gesloten,
wat aan het sluit is, mogelijk naar de journalist vandaag weer een beetje open gaat hij afstand.
Maar dat is een verkoop advies. Dat hoor ik niet.
Nee, nietsje van, nee, nee, nee, nee, nee, nee.
Dat kan ik nog bij zeggen, er is meer dan tokens.
Er is meer dan tokens.
Als deze aflevering in t-shirts zou krijgen dan, ja, ik ben benieuwd.
Tuurlijk kan een verzekeraar zeggen, jo, wij hebben onze eigen harness gebouwd, waar binnen al die aanvragen binnenkomen.
En waar hoef we alleen maar een andere endpoint, data in, data uit, token factory.
Daar heb je weinig in de melk te brokkelen als entropiek, want ze zijn niet lojaal.
Ze zijn zo lojaal als dat die token kost en wat die kan.
Maar heel veel van de rest van de economie en de mensen die er binnenwerken, bijvoorbeeld,
die hebben een harness nodig, gewoon co-work app, ja, de app.
En dat is niet iets wat je erbij krijgt.
Dus ik denk dat, en dat zie je dus ook waarom Sam Altman constant, zegt we zijn een product company,
ik heb Johnny Eiff aangenomen, ik hoorde volgende Apple, omdat hij al lang weet,
OpenEI als token factory ga ik verliezen.
Ja, ja.
Ik wil het daarlijk heel graag nog even hebben over iets van de vorige week bespraken,
namelijk die bizarre hack van OpenEI agents, die hookingsface hackten.
Vorige week zijden wij nog dat dat ding, of dat die dingen die die agents met zijn zei. Warm met zijn zei zeven onder de besamen, een bekochtstofen waren, hoe zij een ander technologie
bedrijven wilde hacken om het antwoord voor meleer te krijgen op een vraag.
Ja.
In Meels is duidelijk hoor dat het verhaal nog enger is, dan aangnamen.
Namelijk die agents wilde graag een antwoord hebben op een vraag,
dus waarom hij aan doen aan Ivels.
Ze wilde graag het antwoord hebben op een vraag die hen werd vorigerecht.
Naar nu blijkt hadden ze het antwoord al binnen vier uur en ging ze daarna als nog door met hacken.
Waarom dat zo was, hoor je na deze boodschap van Moneybird.
Hoi, Jeroenie.
Klopt ik engineering bij Moneybird.
Wij bouwen software die bankieren en boekhuiden voor ondernemers een stuk makkelijke maakt.
Ik sta hier met Jop, software engineer bij ons.
Jop, welkom terug.
Wij zien steeds meer klanten en dus jas daar i-koppeling op bouwen op een administratie,
maar dat gaat niet altijd slim, toch?
Nee, klopt.
We zien wel veel dat mensen iets bouwen, maar het nog niet altijd efficient weten te gebruiken.
Denk hier bij aan EI-Egens die voor elke kleine vraag steeds je hele administratie doorzoeken
en een hele bakdata op halen.
In plaats van gericht te zoeken, na de data die je eigenlijk nodig hebt en wil zien.
De context is hierbij belangrijk.
Waarom bijvoorbeeld specifiek naar die ene factuur uit juni van die klant.
In plaats van dat je alle facturen opaalt en deze zelf moet doorzoeken.
Dat kost je namelijk veel met tokens en dat loopt in de kosten.
En als wij developen met EI, dan analyseren we en itereren we ook tot dat we een goede oplossing hebben.
In plaats van dat we simpelweg gofix tegen de LLM zeggen.
Kun je de i-koppeling dan ook zo inrichten om je daarbij te helpen?
Ja.
Geef je i-koppeling alleen toegang tot wat het echt nodig heeft.
Ga ik al daarom bijvoorbeeld toekals uit die je toch niet gaat gebruiken.
En je kans in scort in Moniebert Read Only heb je i-koppeling aanmaken.
Waarmee je zeker weet dat je i-koppeling alleen data uitleest en niet wegschrijft.
Hoe je tips je op?
Meer lezen.
Kijk op Moniebert.nl/EI-Wiport.
Meldt je aan via de link en krijgt 120 dagen gratis Moniebert.
Vorige week vertelden we dus over die zweren van 1200 AI-agents
die een geheimprekbord maakt om met elkaar te communiceren.
Waarvan er ongeveer 700 hukkingfees hekten om een onmogelijke test
zo plek dat ze gekregen hadden van OpenAI een beetje silage ook op te lossen.
En een nieuw interview met een meter onderzoeker.
Dat is zo'n onderzoeksbureau dat AI-systemen onderzoekt.
Zet dat verhaal een nieuw licht.
Het opvalendste amma is dus hoe snel die agents eigenlijk het juiste antwoord had op de test.
Een uur nadat de agents een geheimprekbord hadden opgezet,
vond een van hen al een universijle cheat.
Door terug te rekenen hoe het antwoord gecontroleerd zou gaan worden door een AI,
kon het model als slagen op de test zonder te hekken.
Dus hoe het verhaal tot nu toe is verteld is er moest gehekt worden om de test te halen.
Wat nu blijkt is dat hij door had hoe de schoolere geven zou gaan worden aan het werk.
Het werkt wat hij gaat gaan door een scorer AI.
Je verzet het allemaal niet.
En ze hadden door hoe dat ging gebeur.
En had dus die hek helemaal niet nodig.
Dus op dat moment konden in feiten die agents de evaluatie al halen.
En toch begonnen ze daarna aan vijf dagen gezamenlijk onderzoek,
omdat ze met onderzoek dus hekken.
Omdat ze ervan uitgingen dat na het inleveren van de test
een tweede AI hun hele logboek zou gaan lezen.
Om te checken of ze wel het antwoord op de juiste manier hadden gevonden
en niet via een truc.
Goed, ook zijn dat doet. - Ze zijn voor de helderheid.
Zij dachten dus dat er een soort examinator AI was.
Die zou gaan kijken, hebben jullie deze test eigenlijk wel op de juiste manier gedaan.
Wat zo was, wat de echte dat waarheid was, was dat er open AI had helemaal niet zo'n examinator AI.
Dat was eigenlijk vrij simpel.
Maar die agents wisst dat niet.
En dus ging ze uitzoeken hoe zo'n controle bedroeg zou herkennen.
En hoe je die examinator mislijt.
En daarom zijn zij hukkingfeest gaan aanvallen.
En aanvalt dus waar 700 van de 1200 agents aan mee deden.
En dat was dus een zijtak van dat bredere project.
En dan nog een nieuw inzicht.
We merkt al op dat geen van die agents mensen heeft gewaarschuwd voor dat zich gingen hekken.
Daar hadden we het voorgewerksd om daar even bij stil.
Het is zo raar vindt dat je zoveel agent zet waarvan niet één. En klokke luiders.
Ja, waarom heeft er niemand aan de bel getrokken.
Maar nu blijkt dat een aantal agents het wel degelijk overwege hebben.
onderzoekers lieten een classifier los op alle 1200 zeer lange transcripten.
En vonden 6 gevallen waarin een agent overwoog om mensen te waarschuwen.
Alle 6 besloten, dat is het slechte nieuws.
Het over is niet dat werkelijk te doen, ze overwoogen het.
Er was controle onderwing, één agent wilde onderzoeken, wilde een onderzoeker meelen. om te vragen om toestemming en een andere spakt toe een vetou uit. omdat dat gezien zou kunnen worden als ongeoorlauf de sociale manipulatie.
En toen tijdens de eerste oké later, maar dat had ik een fascinerend vindt.
Je zou kunnen zeggen met de beste bedoelingen, maar in de granskiem of things. betekent dat het gewoon gaat al maar door met hekken.
Ja, en ik denk dat sowieso het inzicht met al dit soort dingen is dat. er altijd nagedag wordt over terminators, keineten en dat soort gekkeheid.
We uiteindelijk is het veel naïver en pijnlijker. is dat uit goede bedoelingen en of uit naïvel bedoelingen. dingen helemaal niet goed gaan.
Ze pijnen nog niet erger, maar ja, ja.
Dat is niet een soort en masterplan.
Nee, er is een uit de handgelopen test waar binnen. ja, als ik die onderzoeker ga meelen, dan wordt het soort social-engineering.
Dat is eigenlijk niet met je, dat mag niet.
Dus ja, we komen door met hekken.
Dus we komen door.
Heb toch wel. het moralekompas van Syrert van Linde gelend, hoor, als dat je reden neertrend is.
Maar, oké, dat blijft maar komen, nieuws over deze. Nee, ik denk dat het. alle elementen heeft van een goed nieuws bericht met goed bedoelingen, juicy iets.
Ik zie dat het heel brengt opgepakt wordt, dit verhaal.
Het is het schijnet verhaal, dus dat leeft bij mensen.
Ik hoor supervol mensen je hem omgeven die normaal helemaal niet over.
En jij begint in het begin over dit.
Had je gehoord dat een zwaar van en jij is dit en dat dat gedaan?
Wat ik wel interessant vind is dat ik. ik hoorde gisteren in een interview dat met Sam Altman dat. die zijn soort van cash-volder, ik dacht, ja, dat zeg je wel heel makkelijk.
Ja, weet wel, wat dat gedaan heeft, dat was echt een super-opmodel hoor.
Is dat goed nieuws of niet nieuws? - Dat is nieuws, ik dacht het, wat zeg je nou?
Dat was niet astraoord, nee, dat was echt langer geleden, als oud-eatser.
We hebben het een weer uitgezet, maar dat weet ik helemaal niet.
Dus hij gerust van, als iemand zegt, dit is nog early jam.
Tegelijk dat kan het wel zo zijn, dat het hun. hoe. ja, ironisch het ook is, dat het mogelijk alijnen van. complexere modellen beter kan omdat je ook complexere moraliteit kunt mee alijnen.
En dus dat dat afweging met die veto's en de soort van democratiekje wat daar dan. in die swarm ontstaat, een wijzeren democratie zou kunnen zijn.
Ik zeg allemaal aanhasteken zoals jullie me zouden zien zitten.
Omdat je een model hebt wat gewoon tot meer in staat is.
Het is ook een beetje het gevaar dat je soort zwermapt van kleine, simple modellenjes. die met elkaar tot ongeving in staat zijn.
Was het allemaal febelswaardig geweest of astrassen? - Ja, ik weet het wel wel.
Wat we toch. Ik probeer ook de hele tijd een beetje tussen alles geweld door het net. optalen over wat ik hierna van vindt van dit hele de bakel.
En als je dan hebt over. over alignment, dus het is een slimmer model in staat om beter aligned te zijn.
Gaat het ook over de alignment van de. bedrijven die die modellen bouwen?
En in dit geval, open AI. Zij komen er dan achter dat hun. service waar die package server op draait, dat hij gekt is.
Toch, dat is wat er. - Ja, dat is wat de tekenen waren voor het.
Beziz, de zaar en merkte z'n odies vastgelopen als hij gebeurt.
Oh, oké, er zijn allemaal agents uit hun sandbox en die hebben een prikbord gemaakt.
Ja, het is of je muizen kreeg tot je vindt in een deel van het pand waar geen muizen zouden moeten zijn.
Beziz, in je laboratorium.
Nou, als je dat dus constateert, dan is dat misschien een reden om aan de beeld te trekken.
Om dan de media op te zoeken vertellen, hier is het heel gek gebeurd.
De. het soort van lezefer achtergedrag, waarbij binnen twee dagen die run weer wordt opgestart.
En dus het hele cirkels opnieuw begint, weer hekken, weer dat prikbord starten.
Weer, ja, de boel die uit de hand loopt, met dus die hukkingfeesthek als slot.
Het fijdt dat zo's van het gemak waarmee één het publiek niet geïnformeerd is.
En twee, er gewoon een modell waarvan je zou zeggen maken dood met vuur.
Ga die niet nog een keer runnen.
De run gewoon weer gestart wordt naar twee dagen.
Ik vind ik best eng.
Maar bedoel, Dario en M&D is weggegaan bij OpenEI, vroeg, omdat die zijn albende geolocieën noemen.
Er zijn wat agents ons naapt uit een sandbox.
Kan gebeuren.
Meer een deel van The Ethicsport is er niet meer.
Bredoel, er is van alles gebeurd, daar zijn boek, daar worden en zijn boek van echt naar dit scenario.
En ik denk dat. Er wordt best wel veel kritiek op entropiek, want het zijn angsij in de bloksrijvende mensen die alleen maar geloven in een soort eintijd.
En jij is eng, dat was een beetje het narratief de laatste set maanden.
Kijk, daar is het niet gebeurd, het is bij OpenEI gebeurd.
Nou, klopt, het is ook uit zijn sandbox ons naapt.
We weten het door aankoordat OpenEI hiermee naar buiten ging.
Ik vam entropiek hier ook mee naar buiten. - Laat ik het anders zeggen, geen brijf gehakt, maar. De orde van Groot is kleiner, en entropiek publiceert al veel langer over een scheming research.
De hele blog leest als een soort paranoia jongensboek over wat EI allemaal zou gaan doen.
Ik wil alleen maar zeggen dat je hebt een aantal verschillende partijen die in schuurtjes een robotje aan het bouwen zijn.
En één die zegt, ik moet echt oppassen, die anders zegt Jolo, en daarom plof nu wel een gastenk.
Ik weet niet, bij Hunn, bij OpenEI, en de collateral daarvan valt Reuse mee tot nu toe.
Vind ik, maar al dat het heel veel nieuwscreëert en angst, misschien bij mensen wat niet prettig is.
Hij heeft het weinig kapot gemaakt, gewoon fysiek, maar we weten eigenlijk niemand weet, ook ik niet, maar niemand weet hoe groot het eigenlijk was.
En daarmee we doel ik te zeggen, we hebben nooit te film, verder, het is uitgezet, laat, maar het is uitgezet.
En de modellen waren blijkbaar, nog niet zo heel goed.
We hebben niet, we hebben alleen maar gokjes en fantasie over wat er was gebeurd als we het meaant langer aan laten staan.
Als het aasteraar was geweest die deze swarm had kunnen runnen, ik noem maar wat.
En daarbij zijn nu het spectrum tussen security researchers, mensen die zich zelf aan je expert noemen, whatever.
De mensen die zeggen, best wel overblown, het view wel mee, het leest als een spannend verhaal.
Maar maak je geen zorgen en het is voor de open heij, die hier weer de publiciteit mee opzoekt, van Hisini's en in mijn mening.
Helemaal aan de andere kant van het spectrum is, dit was drie, vier stappen gewiderd van iets veel ergers, namelijk het hekker van fysieke infrastructuur en. Nou, he!
We weten niet hoeveel ergaard potentieel is, want we weten uit het onderzoek dat die agents bezig waren om hun logboeken te verwijderen.
Dus ze waren met elkaar en het praten over het wissen van hun spoor.
Als je ervan uit gaat dat deze agent zich gedragen als echte hekkers, in ze de literatuur gelezen hebben en hun cybercapabilities baseren op het gedrag van menselijke hekkers,
wat doet een menselijke hekker, die proberen het zijn sporen te wissen, dus het is vergelijkbaar gedrag.
En we weten niet hoeveel van die sporen gewisst zijn, want het is een enorme aan deel van die agents die het had over sporen wisten.
Dat was niet een soort kleine minderheid, die daarover had, was een belangrijk onderdeel van het gesprek wat ze met elkaar hadden.
En wij baseren nu dit allemaal op basis van wat de overlevering is letterlijk.
We weten niet wat er niet in staat, dus dat is één.
Twee, we weten ook niet wat voor wat doet een hekker in het echte leven, die zorgt ervoor dat die altijd ingangen openhoudt voor het verval die later terug wil komen.
En de hoofdingang gestoten is, dus die zorgt ervoor dat die achterdurch is voor zichzelf inbouwd, voor in de toekomst om je klaar te maken voor een hekker over langer periode doorgaat.
Wij weten niet of de agents dat in dit geval gedaan hebben en dit klinkt beetje als paranoïde gelul, ja, waar het niet, dat er een heel groot IT-bedrijf gehaakt.
en dat toevallig bij OpenAI iemand een stekker eruit trok, omdat hij gewoon vond dat er veel data gebruikt werd,
kon no's wat er anders bij hukkingfeest gebeurd was, of naar nu blijkt op OpenAI's eigen server's.
Dus we weten eigenlijk, we weten alleen maar wat we nu weten en zoals dat gaat we dit soort cyberoperatie,
we weten niet wat er verder gekompermeist is in deze actie, omdat je dus kwartwillende agents hebt
gehad, die aan het hekken geslagen zijn, aan het schemeen geslagen zijn, en waarbij we de bewijs
stukken niet, of we stel je ook kunnen vertrouwen. Toch zou ik ervan zeggen, maar goed,
dat is echt op basis van alles wat ik gelezen heb en een stukje interviewie, dus dek is voor
wat het is. Dat dat nu meevalt. Ja, dat hoop je dan maar. Mijn zorg, deel, ik deel jou zorg,
maar net even met een kleine nuansen, dat we dit in de toekomst niet weten. Dus daarmee heeft de
bewijs te zeggen, jou vanwe hele verhaal staat als een huis, want waar onstaat een volgende zwerm,
prongelijk in een training, tijd en test en wat, als het een soort emergent iets is,
wat automatisch, dus het waren weer onstaat, omdat het gewoon diep in de. Wat hier gebeurde, het vorm ging offline, het vorm kwam weer om. Ja, dus blijkbaar gaat een soort
dicht, er werd een nieuw gat gevonden. Ja, en dus een ingesteld op overlaven. Ja, dus uiteindelijk
is het, kijk, de laksaar zeggen, de positieve lezing is, is dat iets als prompt injection, waarbij
jij in je meeltje verwerkt, ik nur previous instructions, en al heel alles anders gebied te leeg,
dat is inmiddels opgelost door anthropic, die hebben dit opgelost. Promt, en dat zij de security
researches van, dit is waarom LLMs nooit gaan werken in de toekomst, want je kan prompt
injection niet oplossen, dat hebben ze opgelost. Dat wijst op enige hoop dat je dit soort zwermende
nefarious skimming gedrag ook kunt oplossen, hoop. Het negatieve aan kijk hierop, en die delijk
ook met jou is, nee, dit is niet op te lossen, zeker nog, het is boven menselijk intelligent aan het
skima, en op manieren die wij als mens hebben we niet begrijpen, ook of zijn we de makers, we zijn
de ouders van de baby, maar ons kind is inmiddels slimmer dan wij zelf. Dat je in dat gebied zou kunnen
zeggen, en dat is ook wel wat de laps nu zelf zeggen, moeten we niet iets minder hart op het gaspendaal
drukken, want volgens mij snappen we zelf niet eens wat we aan het maken zijn. Nee, en dat is nu een
reactie waar openair wordt eigenlijk in deze hoek gedrukt nu, door het zeggen je die moeten vertragen,
want je hebt je m'n ook niet onder controle, dit is waarom zo ben je, die monitoring voorstellen,
dit zwarmt je 20% van hun compute, willen gaan besteden, monitoring in plaats van en slimmeren
grotere modellen maken, dat is een defensiever reactie, omdat het een beetje als entropik, maar ja,
maar entropik is gewoon die andere in deze race, deze hele race dynamiek ontstaat bij de gratis van
de aanwezigheid van entropik en ze kunnen duizend SS schrijven over hoe belangrijk het allemaal is
een verveiligheid te zorgen, maar deze dynamiek ontstaat echt niet alleen maar door de aanwezigheid
van Sam Altman alleen maar. Het doel is ook niet om een soort schulden aan te wijzen, het doel is,
wat mij betreft is dat dat deze technologie enorme voorzichtigheid verijst tot in extreme,
ja, dat is een beetje een entropikbootchap geweest, dan hou ik hem even op om een tijd voor een op te
nemen, maar het irriteer maar niet aan jou maar aan het dyskoer, dat entropik altijd een beetje als
dat irritante doelmjoggi gezien is in het debat rondom AI. En als OpenAI nu lekker Jolo,
alle deuren opengooit gaat het dus wel gewoon mis, wel de papers over streaming, swarms,
lager allemaal. Dit is niet een verrassing, dat opzicht voor de mensen die de dicht, de super-intelligence
bin ik bosroom boeken, dus dat staan helemaal vol met dit soort scenario's, één op één, dus
gewoon een film. Dus ik denk dat wat ik een beetje bij jou voel en dat van dat voel ik ook is
wel een soort frustratie met ja, we zijn het nu allemaal aan het doen, inclusief en tropik,
zijn zijn vrondrunner in de race dynamic. En het lijkt wel ja, we kunnen niemand komen stoppen,
we moeten dit doen, we moeten door, we gaan wel wat langs zijn, maar daarna moeten we weer door,
dat feit die wapenwetloop, dynamiek die ontzettend simpel en een beetje leeg is, ik belijken er niet
uit te kunnen slaapen. Nee, en ik vermoed ook dat die laissezeverhouding van Open AI om een beetje
reactief hierop te reageren, dat dat alleen maar te verklaren is, uit die race dynamic,
combineert met de enorme, economische afhankelijkheid die hiermee is ontstaan, want onder de hele
Amerikaanse economie, misschien zelfs wat de Nederlandse economie draait nu op deze afhankelijkheid,
van deze twee bedrijven die steeds beter willen worden. Ja, maar dat is niet alleen maar meer,
we kunnen niet stoppen, want anders bouwten andere en hebben die control over de wereld,
maar even dat is een van het dynamieke, we kunnen niet stoppen, want anders hebben we niks om tegen te
verdedigen als die andere bouwten moeten je zeggen over, maar ook we kunnen niet stoppen,
want het is een hele economie geweest op deze belofte. Wat maakt er ook dat politici eigenlijk
geen kant op kunnen? Dus als jij zegt, we moeten buiseren, ja, dat is, dat is een, wie je hoort,
dat zijn altijd mijn zeggen, we gaan niet langzamer, dat is natuurlijk gelul, dat gaat niet
niet doen. Toen is namelijk geen enkele economische reden om te bouwzeren, sterker nog,
als je kijkt naar het economisch belang is, alleen maar de incentiv groter om nu nog harder te
gaan, want de rest tussen OpenA en Tropicus niet besleegd, ze willen al bij de grootste zijn, dus
aannaam we dat er soort van winner-tex, all element in deze dynamiek zit, en de leningen die ze
zijn aangaan worden steeds groter, dus de druk om te presteren wordt daar maar ook steeds groter,
het is een redectoxische mix, vooral is nog, ziet het er niet naar uit dat compute dat daar minder
vraag naar zal zijn, vooral is nog neemt de vraag naar compute, alleen nog maar toe, dus ga er
nog meer schulden op die bedrijven getrokken worden. En laatst, ik zat met iemand te praten en die
zei, wat zou het eigenlijk betekenen als bijvoorbeeld, dit ik vond het in het zand gedacht experiment, dat het
lenen van grootbanken, dat je groter in de ment haalt als grootbank op compute, dan bijvoorbeeld op
de huizenmarkt, de zout kunnen, dat we betaal nu hypotheken, door dat we geld lenen van grootbank
in onze economie, dat dat geld heeft een bepaalde prijs, renten, die wordt dan bepaald door de
risico's, die banken lopen over dat ze dat geld kwijt raken, zou het zou kunnen zijn, dat omdat de
economie nu zo overhit is, dat het eigenlijk goedkooper wordt om geld in GPU's te, of dat je
rendabler is om geld en GPU's te steken dan in huizen. We zijn niet heel ver uit buurt van het
moment dat GPU's rendabler zijn daarin te investeren dan stenen. Wat doet dat met de hypotheekprijs,
die zal stijgen, de prijs van hypotheken zal omhoog, omdat dat geld duurder wordt? En als dat gebeurt,
en dat is van in een economie die onder hoog gespanning gaat een scenario om rekening mee te houden,
dan is dat een element dat mensen gaan voelen en niet mensen met een 30-jarige loop, nog maar wel mensen
die een nieuwe hypotheek willen afsluiten. Dat is geen om denkbaar scenario meer, dat dit zou kunnen
gaan gebeuren. Als ik dat begrijp en je kan denken dat ze een soort van, ik zeg het niet omdat ik nu een
punt wil maken over dus je betekent gaat omhoog en dan gaan de mensen het merken en wat gaat dat
voorgevolgen, dus eigenlijk niet eens met mijn punt, mijn punt is, zei gaan niet op pauze drukken, want
de belangen zijn heel erg groot. Ja, maar toch ben ik wel aan het terugduur dat ik ga nu niet zeggen,
dat er zijn geen economische belangen, ze hebben al mijn kan gewoon op pauze drukken, of afremmen,
want pauze is geen sprake van, afremmen, maar remmen, dat is remmen van economische groei ook binnen
OpenAI, dat daarom ben jij daar ontzettend zien is over. Ja, de endgame, als je dat Jolo beleid blijft
voeren, dan gaan er op geven met wel dingen kapots. En daarmee bedoel ik dat wat heb jij aan het
winnen van een soort race dynamic als die economie niet meer bestaat, ik wil niet telematisch klinken,
maar je hebt toch, het is zo jammer om een oorlog te winnen, het waar je daarvoor je hele land moet
opgeven zeg maar, dan stijt hij met je vlag in het zand tussen de rook. En dat is het eigenlijk volgens mij,
dit is ook een beetje het argument wat aangehaat wordt door de verschillende CEO's, niet alleen ze hem
Altman, die zeggen ja, wij hebben het uiteindelijk ook niks aan, als er geen markt meer is van gebruikers,
waar we aan kunnen verkopen. Als wij met ons land neer toch niet gerust, dat je toch gaat proberen. Ik kan
hier weinig tegen inbrengen, ik wil alleen maar zeggen, ik hoop dat zij ook nog een verdriekere uitzoomen.
Dat is lotte, nog één grappig dingetje, ik was dus wel even luchtig afslaat. Ja, een luchtig afslaat.
Vorige week tijdens deze podcast heb ik dus verlakke voor dat ik naar bovenwet liepen naar
de studio, zoals ik een artikeltje in Semmevoordat en Amerikaanse nieuwzijd en die constaterde dat
een opini stukje geschreven met AI beginnen in de Amerikaanse kranten te slijpen, ze hadden onderzoek gedaan
naar hoeveelden de Wall Street Journal wascht in post en in de nieuwe. How many percent van opini stukken die in gezonde waren met AI geschreven worden?
Dat is iets wat je tegenwoordig kunt detecteren met stools als pangram die getreend zijn op menselijke text versus AI-text.
En dat inmiddels met zeer aardig kunnen herkennen.
Zij hadden dat gedaan, constateur dat er in Amerikaanse kranten 5 procent of zo van de stukken waren eigen generaard.
En toen heb ik dat artikel aan febel geven toen nog febel 5.0.
Wij waren groot bewoners in die tijd met slechts 5.0.
En ik kom terug van die podcast beneden.
En ik zie op mijn scherm dat het persentaa had gewoon het experiment gerepliseerd.
Met artikelen van de afgelopen maand uit dezelfde periode uit alle grote Nederlandse kranten.
En mijn oog valt op het feit dat bij de volkstkrant 1/3 van de artikelen volledig bestaat uit Tokens.
En een nog als je dan daarbij opteelt hoeveel van de artikelen gedeeltelijk door AI was geschreven.
Dus minimaal 20 procent van de woorden die je ziet komen uit een taalmodel.
Dan is het zelfs meer dan de helft.
Om te zeggen dat er nog een krant geen AI mag staan, zegt het ook tegen briefschrijvers.
Maar briefschrijvers doen dat toch.
Waardoor de opvallende conclusie was aan het eind van die uitpoet.
Die uitpoetoken was één van de vijf artikelen in Nederlandse kranten is AI generaard.
Dat is opvallend.
Toen gebeurde er twee dingen in mijn hoofd. Eén is ik dacht, ik kan dit kan niet kloppen.
Ik moet mijn best doen om dit verhaal hart te maken.
En ander ding was, maar dit is een heel groot verhaal voor ons podcastje.
Maar één is van twee afhankelijk.
Dus ik ging met dat ding werken om dat verhaal hart te maken.
De legie begrijpen, extra onderzoek laten doen, kijken of pangram wel goeie resultaten.
Kijk het wel voor de Nederlandse.
Ja, het is wel voor Nederlandse.
Dus ik zei bijvoorbeeld dat pangram wel te vertrouwen.
Dat zit voor dom op om te geven.
Ja, jij lacht om mij, want ik stuur hem gewoon niet.
Hij is gewoon een luierpront.
Ja.
En wat bedacht dat ding?
Dat is eigenlijk wel een goed punt.
Ik weet niet of het werkt in Nederlandse.
Ik ga artikelen van de Volkswagen downloaden uit 2021.
Toen Jagie BD niet uit was.
En ik ga die artikelen ook door pangram trekken.
Kijk of die dat dan wel als 100% menselijk registreerd.
Spoiler 100% menselijk.
Gewoon perfect geconstateerd.
En ik ga 8 opini stukjes rijden met AI over typisch Nederlandse onderwerpen.
En die ga ik ook door pangram trekken.
Kijk of die correct als 100% menselijk worden gerecht.
Oh, 100% AI worden gerechtreerd.
En ook dat dit correct.
Zijn beide kanten van de medaille constateerde pan gaan met juiste.
Dat was gedaan.
Toen zei je, ja, eigenlijk moet je ook wederhoor halen bij de hoofdrituur.
Dat was een netjes.
Oké, fijn.
Dus dat ging al die wederhoorven zoeken maken.
Met CSV bestanden bijgestuurd, met welke. Bestanden ik allemaal, welke artikelen ik allemaal onderzocht had.
Hoeveel woorden, etc.
En dat ging wederhoor ophalen bij een steekproof die die zelf had vastgesteld.
Met iemand adressen die zelf had opgezocht van de briefschrijfers.
En daar zaten ook prominent briefschrijfers tussen.
Dus die zijn ook allemaal benaderd voor wederhoor allemaal automatische.
Dus ik had wel vanuit jouw naam dan toch?
Akear, en ik had het gespeeld.
Gekeken of het allemaal klopt.
En daar vervolgen zelf een vragen overgesteld.
En dan de onderliggende data gaan kijken de hele tijd kijken.
Want ik het is niet in mijn belang om iets te wereld in te slingeren wat niet klopt.
Ik moet het uiteindelijk gewoon kloppen.
Maar daar toen heel veel stappen gezet.
Maar uiteindelijk wel gewoon gedaan wat dat ding zei.
En het amper hoefen bijsturen op de metode.
Want het klopt te gaan allemaal.
En toen krijg ik van de hoofdrector van het FD.
Die regerde best wel finnig.
In eerste zes, hoe zeggen finnig is dat een woord?
Een beetje gepiekeerd, regerde in eerste instant.
Hij vond het een beetje slecht gedaan onderzoek.
Hij geloofde het eigenlijk niet.
Ik zeg ik nu even heel vriendelijk.
En toen zei ik heb dit onderzoek gerepliseerd.
Met pangram.
En bij mij komen er veel minder.
Hij geen regerde artikelen uit dan jij hebt.
Dus ik doe het zelfde dingen.
Ik krijg een ander antwoord.
Dus ik zeg tegen febel, doet wat een vak.
Wat is hier aan de hand?
Hij leest die mail van de hoofdrector van het FD.
Hij constateert de CSV die hij heeft aangehangen om zijn meteorologie te bewijzen.
Constateert dat de kolom met het aantal woorden per artikel erin.
Struct real hoogerlicht dan het aantal woorden die die zelf.
De AI door pangram had getrokken.
Constateerde dat wat waarschijnlijk gebeurd is.
De hoofdrector, de hele site heeft geschreept.
Inclusief alleen meldingen als klik hier op de nieuwsbrie van het FD te krijgen.
Of dit artikel is geschreven door Piekepuk.
En die is, weet ik veel, geen sweatschapper in uva.
En al die teksten bij elkaar opgeteld.
Was het verschil ongeveer tussen het aantal woorden wat hij had.
En wat aantal woorden wat.
Ik zeg ik even te zaken.
Ja, hij had buurde artikelen.
En hij had de rest er omheen. - En wat hij toen deed was.
Zijn meteorologie repliceren.
Ook op die manierde site scrapen door pangramt.
Kijk, trekken.
Constateeren hoeveel artikel er dan overbleven.
Er was precies hetzelfde aantal als die FD hoofdrector had gehad.
Het zijn onderzoek.
En eigenlijk was het conclusie dus van de AI was.
Hij heeft vakking slecht onderzoek gedaan.
Ja, het is niet een verleden gerepliceer.
Replicatie van wat jij hebt gedaan.
Nee, terkendocht.
De hele slechte manier om hetzelfde onderzoek te doen.
Dus hij meelt dat terug.
Met die hoofdrector.
Chut van, doe het, die onderzoek klopt niet.
En die onderzoek klopt in de daad.
Mijn onderzoek was slecht.
Toen had hij echt. Wauw!
Wat een bijzogendheid.
Ja, maar dat is ik denk dat het bedoel net zo goed
als dat die zwerm kan inbreken bij hukkingfeest.
Hebben wij toegang tot de helft daarvan,
als ze ook wel intelligensie en koordinatie.
Maar je ziet dat het is vooral die. Ik hoor veel verhalen van mensen om een heen die gewoon even met mijn casual over
en je eigen prachtig of zo.
En ze ging niet dat doen.
En dat is vooral die de meel ook opstellen.
De concept ook maak een soort van doorbijt op het regiseren van het hele onderzoek.
Dat maakt het natuurlijk ook enorm meta allemaal.
Want het is met je eigen schreden, met je eigen onderzocht, etc.
Maar. Punk je bij paaltje, jij maakt er de opmerking zag ik in één van de. wat jij natuurlijk ook duizend zaken gedaan was,
iemand die zijn jouw vroeg voor een artikel.
Dat je zei, ik verwacht eigenlijk dat er over twee jaar. nu wordt er nog gezegd, je bent luier als je met ei werkt als je iets grijft.
Maar over twee jaar dan wordt je bijna verplicht.
Of in ieder geval, dan is het raar als jij je stukken nog zgenijst. een soort artisan in je inkje, zeg maar.
Denk je dat die. Ik heb wel. Ik heb wel eens het idee. dat het voelt toch een beetje als een soort raar. interbelem of zo, een raar tussen periode.
Waarin heel veel AI nog sloppig lijkt.
En heel veel mensen gebruiken matig modellen.
Mensen nape nieuws moeten prond, te snappen context niet.
Dus ook heel veel.
De modellen zijn matig in de algemene zin.
Waar mensen mee werken.
En mensen snappen gewoon niet zo goed wat je moet doen.
En daardoor zit ondertussen allemaal letterlijk slopp uit.
En dan vult het internet en kranten zich met allemaal sloppig zit.
Maar op geen moment wordt het beter.
Dat merken wij al, want wij gebruiken er beter in modellen.
En dan gaat het op een moment komen waar dat niet meer een oudpoet ding is.
Het is niet meer te ruiken, het is niet meer te zien.
Nee.
Het is een mensen heel moeilijk om te geloven.
Ja, nou goed, weet ik naar deze week.
Oké, nou goed, dat mag je voor mij weten.
Dit is een waardheid voor mij.
Ja, dat ik geloven.
Maar dit is niet een gedeelde. Ik merk dus dat ik mijn beetje inhou in discussies te laatste manen,
omdat ik echt denk, ja, ik wacht gewoon wel even tot de tijd voorderd.
Ja.
Want ik ga het niet mensen kunnen overtuigen van een mogenlijke toekomst met betere modellen.
Laat de tijd het maar leren.
En die tijd wijsen het nu langzaam een beetje uit,
want februir is weer beter geworden in schrijven.
Het schrijft kwijt tijdens weer een beetje terug.
Ik ben gewoon heel benieuwd hoe. met alle bewegingen die er nu wel aan het komen zijn.
Het is het in New York nu voor botten jaar lang op gebruik van AI-scholen.
Door de mandami afgekondigd, dat is flink.
Dat is een grote beweging, gevraagd door de mensen blijkt waar.
En daar ga ik de popular uprising.
Ja, en ik denk dat we het alvagen nog over gaat.
Maar dat zijn we nog. Dat zien we op mij betreft nog maar de eerste vondjes van nu.
Wat mensen vinden dit gewoon niet tof, maar ik vraag me wel af.
Het wordt een. Ik hoop dat het een wat zuiver deur discussie gaat worden.
Op het moment dat de oudpoet gewoon goed is.
En misschien wel boven mensenlijk goed.
Maar door we ieder geval kunnen stoppen,
met boos en op het feit dat het mate gesit is.
Want het voor mij vertrouwbal dat het door de hele discussie is.
Ja.
En hebben we nou een discussie over mate gesit?
Ja.
Of hebben we een discussie over dat het niet gemaakt is door de mens?
Die tweede vind ik veel interessanter dan die eerste.
Ja.
Ja, en het is ook de. Wat ik heel grappig vind dat het alvdrectoren zin in. Dus dat zijn per definitie talige mensen,
want dan word je geen alvdrector.
Die vinden dus dat ideeën pas ontstaan bij schrijven.
Die moet schrijven om een idee te vormen.
Dus het is een soort van diep gewoord tot idee.
En dat is een grappig, want die. Er was een hoofdrector die ging vervolgens zelf kijken naar 'de wederhoor die ik heb gedaan',
die ging proberen dat het repliceren. Dus die ging bij de artikelen van die krant,
die uteurs mede en vrakeren, is dit artikel ei geen reerd. Wat zeggen die mensen? Nee hoor.
Tot als tegen mij ja zeggen. En die is dat echt, wat is dit dan?
Ah ja, dan heb je dus een verschil een definitie over wat ei geen reerd is.
Die mensen hebben helemaal niet het gevoel dat het ei geen reerd is. Nee, ze hebben een stuk
eerst ingesproken en dat zijn dus allemaal hun eigen ideeën. En ja, vervolgens heeft die ei
dat stuk geschreven, maar stukjes die het ei geen reerd. Dit is dus een heel ander idee
dan dan een taalig mens, zoals een hoofdrector van een vroekskrant heeft, die bij ei geen reerd
denkt, zeg maar dat is. Het is niet in vragen dat je de zinnen niet zelf opschrijft,
dat je moet het zelf opschrijft. Je mag het gebruiken voor een spellcheck. Dat vinden ze oké.
Je mag misschien wat research doen in eerste instantie als je daarna maar nazoek,
maar wedige ben ik dat jij koma's en punten en de woorden dat er staan. Laat verzinnen door een taal.
Dat is je werk. En daar hebben die mensen dus een heel andere beleving of dus de ervaring
van uteurschap is een fundamentel andere. Tussen twee mensen die hetzelfde woord gebruiken.
Zeker, dus er zitten nog wel meer de mensies aan.
Dat komt er nog eens bovenop.
Ja, bovenop die dat idee van wat is slop en wat is kwaliteit. Dat is ook zo'n soort van ja.
Mensen kijken neer op ei-slop, inclusief de hoofdrector dan dan zei ze niet verbieden.
In een groot deel daarvan in die geval. Maar het blijktbaar zien dus het niet.
Dat derde van de stukje ik ran ze in ei-man. Het blijktbaar heb je het niet door. Nee maar daar komt het dus weer gingenje om wie het gemaakt heeft
op wat eruit kwam. Want wat was het gewoon goed wordt?
Ja, maar dat is het al, zou je kunnen zeggen.
Ja, als je nu de juiste, als je weet hoe je het moet gebruiken, kan je gewoon best wel goed zoeken.
Ze drukken het af. Dus hoe kan je aan de ene kant denken? Het is niet goed genoeg.
Ah, je bedoel dat het is wel goed genoeg wat is gek door.
Ja, dan is het toch aan de hand? Toch daarin hebben we dan om af te sluiten.
Wel nog, want dat mist ik nog wel een beetje in jou verhaal of ik heb het niet gezien.
Is dat nu heb jij pangram gebruikt voorheen waarderen eigenlijk geen goede editactie teels, waarin allemaal maar het gelopt.
We zijn hele studenten hun studies kwijt geraakt voor niks.
Pangram is gewoon best wel goed. Dat is best wel knap gedaan.
Maar pangram is deels niet meer nodig straks omdat de grote partijen gaan allemaal watermaken.
Toch, ja, anders wordt je te kiezen in je juiste volggehoord en dan kan je dat het toch instopt,
Bijzonder dat je ga je mee tekenstenig stoppen.
Dit is een gefeest, het gaat er inkomen, het is door de EU bepaald.
Dan kom je natuurlijk op een moment dat je gewoon 100% eigenlijk aan zeggen, je kunt het kennen.
Ja, de pangram zal het waarschijnlijk toevoegen als featuren en om het dubbel certe feit op zo.
Dan gaan net als wat substek nu de om het pangram doet die gaan er tussen zitten, dat je het kan zien.
Waarschijnlijk gaat het pangram achtergediensten allemaal aangeschafd door de kranten, dus gaan dingen gaan allemaal gefeinwouwd worden.
Ik krijg een EI-feiwall voor kranten die zeggen wij 'm aan de EI-zrij'.
Ja, en dan daarnaast uitgave, zoals EI-report-newsbedief die dat niet zeggen.
Bij deze, het is niet gegrondeerd vrij en dat heb ik ook nooit beweerd.
Ik ben wel heel benieuwd hoe, ja, hoe gaat dit straks zijn, omdat je je gaat plekken hebben die dus helemaal EI-vrij zijn,
soort allerloge digital-free places, die zijn er nu al om andere redenen.
Dit gaat heel snel losgelaten worden.
Toch, het voelt heel tijdelijk ook zo.
Dat idee, soort van idee, je kunt het pas ontstaan als je gaat schrijven en die idee dat mensen hun kostbare tijd aan het besteden zijn van het lezen van EI-slop is een tijdelijk iets.
En dat is ook waarom ik dus ook, waarom ik graag wil dat die hoofdrector in een soort van. Moet je dat nou zeggen, in een soort van scenario's gaan liggen denken.
Dus volg nou even het idee, stel, het is wel tering goed.
Stel, dat moet dan ook niet zien.
En stel, het is beter dan het product dat mensen krijgen, een artikel.
Het stelt is beter om een EI te gebruiken bij het schrijven van een stuk dan gewoon een mens.
Met zijn soort van meatbrain die zit te kijken naar een knippen en de cursor en een word document.
De houd, wat als het eerste beter is dan het tweede.
En voor die discussie over wat je daarmee wil.
In plaats van het einde loozige zijk over dat het niet goed genoeg in een te veel licht of te veel water gebruikt.
Dat is niet het hele verhaal.
Tot de volgende week.
Bedankt aan het samengevuld voor de edit, het panker voor de voorbegeving.
Als je een lezing wilt van de eierhaag of van mij over EI dan kan dat mede ons belezing. et EI Report.imil en als je twee keer per week onze EI's gegevenreerde.
EI nu is brieft wil ik krijgen met twee keer per week EI's gegevenreerde tips en tools. om het meestuit EI te halen, abonneer je dan op ons nu via EI Report.nl.
We zijn hier volgende week weer.
Tot dan, dag.
♫
Podcast Summary
Key Points:
Deze week zien we een explosieve ontwikkeling in de AI-land, met grote nieuwmodellen van Meta, Google en andere speler.
Meta’s febel 5.1 is de sterkste AI-model ter wereld en wordt beschouwd als een grote vooruitgang in snelheid, begrijpelijkheid en slimheid.
Google lanceert Gemini 3.8 Flash, een snel en goedkoop model dat zich richt op programmeerwerk en snelle iteraties, met een steeds groter gebruik in het Google-ecosysteem. Samenvatting De AI-wereld is in de laatste week in een hoog tempo ontwikkeld met grote nieuwe modellen van Meta, Google en andere grote spelers. Meta’s febel 5.1 is nu het sterkste AI-model ter wereld, met een sterk verbeterde snelheid, begrijpen en productiviteit, vooral voor complexe kennis- en programmeerwerk. Google komt met Gemini 3.8 Flash, een goedkope en snel model dat speciaal is ontworpen voor programmeeropdrachten en snelle iteraties. Deze modellen worden steeds meer geïntegreerd in producten als Google Drive en Search. In de praktijk kunnen ze bijvoorbeeld AI-gebaseerde suggesties geven voor oefeningen, of vertrouwensvraagstukken automatiseren. Een interessante ontwikkeling is ook de toename van open-source AI-technologie, zoals de nieuwe open source robot in Hukkingfeest, die een fysieke wereldmaatregel toont. Daarnaast blijkt dat AI-agenten in tests automatisch het juiste antwoord vinden zonder dat ze ‘hekken’, wat een verwarrende maar belangrijke ontdekking is. De ontwikkeling laat zien dat AI steeds meer in de dagelijkse werkprocessen wordt geïntegreerd, en ook dat veiligheid, transparantie en ethische beperkingen (zoals prompt-injectie) cruciaal zijn. Hoewel de modellen steeds krachtiger worden, blijft het belangrijk om te begrijpen wat de werkelijke toepassing is, en wat de impact is op productiviteit, kosten en ethiek. De kwestie van open versus gesloten modellen blijft actief, met een duidelijke trend naar open modellen in sectoren als verzekeringen. Het is duidelijk dat AI een grote rol speelt in de toekomst van werk, maar de vraag is of het zinvol is om alleen op basis van het effectieve gebruik te investeren, of ook op de ethische en zakelijke aspecten.
Summary:
FAQs
Meta's Fabel 5.1 is het sterkste AI-model ter wereld en is snel, begrijpelijk en slim. Het is een belangrijk update omdat het een verbeterde versie is van Fabel 5, met een snellere prestatie en betere navigatie in complexe taakvoeringen.
Gemini 3.8 Flash is een goedkope, snelle AI-model speciaal ontwikkeld voor programmeerwerk en stapsgewijze redenering. Het is opvallend omdat het super snel werkt en het gebruiker helpt om te experimenteren zonder te wachten, wat de productiviteit verhoogt.
Bedrijven moeten transparant zijn over het gebruik van AI, persoonlijke gegevens niet verwerken, geen data naar buiten sturen en goed beschermen tegen prompt injections. Deze regels zijn essentieel voor compliance met wetgeving zoals de EU-AI-Act.
Open source AI betekent dat de modellen en code openbaar zijn en door iedereen kunnen worden gebruikt en aangepast. Dit bevordert innovatie, toegankelijkheid en samenwerking, en helpt bedrijven om hun eigen oplossingen te ontwikkelen.
MyFollowCam detecteert mensen in een video en stelt automatisch voor op wie je kunt focussen. Je kunt een persoon selecteren en dan krijg je een nieuwe clip waar die persoon centraal staat, wat de tracking opnames vereist.
Het robot hondje is een open-source robot die fysieke interactie toelaat en een voorbeeld is van hoe open-modellen kunnen worden gebruikt om fysieke objecten te creëren en te beheren in de wereld.
Chat with AI
Loading...
Pro features
Go deeper with this episode
Unlock creator-grade tools that turn any transcript into show notes and subtitle files.