Maar behalve nog grotere LLM‘s zie je ook modellen die zijn gericht op efficiënter verbruik van tokens en lagere kosten per token. Sommige zijn bijna even goed zijn als de topmodellen.
Dat dus want ook daar zit ontwikkeling in.
Het is net als met chips en de wet van Moore; eerst werd het moeilijker om steeds kleiner te gaan, nu hikt men tegen fysieke grenzen aan en ontwikkelt men fotonische chips want met licht heb je die begrenzing niet, veel sneller en geen koelproblemen bijv en kan men weer een hele nieuwe stap maken qua ontwikkeling.
En zo zal het ook met AI gaan; loopt men tegen begrenzingen aan dan is dat het eindpunt maar tegelijk ook het startpunt om iets nieuws te ontwikkelen.
Alleen gaat de ontwikkeling nu veel sneller want als je AI afzet tegen de ontwikkeling van de computer dan is dat een hele korte tijdsspanne, da's niet te vergelijken.
AI is er nu en gaat niet meer weg, da's waarschijnlijk evolutie.
Nog even een aanvulling over die tokens, ik zag van de week nog een aardige video over GPT3 en hoe dat werkt met transformers.
Ik ben toch een soort leek op dat gebied met wat interesse hierin en vond deze video heel begrijpelijk en daarin zie je ook hoe door combinaties te maken van de uitkomsten van probabilties men steeds betere modellen ontwikkelt, kwestie van slimmere algoritmes en combinaties daarvan waardoor de tokens idd efficiënter gebruikt worden.
Voor een aantal hier zal het gesneden koek zijn maar voor diegenen die er niet zo in thuis zijn hier de video en hij heeft meer leuke begrijpelijke video's over
LLM's en transformers