Du har helt rätt, grafen blir lite missvisande på grund av det. Jag ska försöka leta upp en bättre graf, som gärna också kompenserar för att priset ökar för varje generation.
Men det är så att H100 inte klarar FP4 och att den klarar FP8 var en nyhet.
Man skulle kanske kunna önska att koncentrera sig på att prognoserna på områdesnivå blir tillförlitliga först kanske ?
Jag vet inte hur många gånger det har utlovats regn de senaste veckorna utan att det har kommit något dom syns i regnmätaren.
Man kan tänka på att Llama 3 är tränad på 7,5 gånger så många tokens så det blir betydligt mer, men och andra sidan så lär Meta betala mindre per GPU-timme än standardpriset. Hur som helst lär få träna sina egna modeller, framförallt när det finns företag som delar med sig av dessa grattis. Kom även ihåg att priset inte inkluderar kostnaden för data, mjukvara och arbetstid.
Ibland är det bra att påminna dig om hur AI skeptikerna tänker, här är en bra sammanfattning från en. Jag håller inte alls med, men delar ändå för att öka mångfalden
Skulle vara intressant om man kunde upprepa den uppgiften fast med lite varierande former och bakgrunder på bilden, för jag förstår verkligen inte hur den lyckas lösa uppgiften om den nu bara som vissa säger är en “statistisk papegoja”. Är väl helt omöjligt att det har tränats tillräckligt på bilder av liknande spel och uppgifter?
Nu hittar jag inte min sons andra pussel, men får testa när jag har möjlighet.
Helt rikigt, den är inte möjligt att GPT-4o är tränad på alla möjliga pussel och serier på hur man löser dem. Några pussel har den säkert sett under dess träning. För att den ska kunna lösa många typer av pussel från att vara sett några få krävs relativt bra generalisering. GPT-4o är ju även inte en specifik AI (narrow AI) för att lösa pussel, den är huvudsakligen framtagen för andra typer av uppgifter. (Man kan se på OpenAIs presentation av modellen för att se vad de tänker sig för användningsområden.)