Kanske det där tidigare meddelandet kräver lite mer förklaring.
Den nuvarande situationen när det gäller effektiviteten av AI-användningen är helt absurd. Låt oss föreställa oss att jag vill redigera text i en memebild för Inderes forum. Jag skulle kunna göra det nästan gratis lokalt, men det lönar sig inte eftersom OpenAI har bestämt sig för att sälja tillgång till mig till en frontier-modell (frontlinjemodell) till underpris, och eftersom det finns en enorm mängd subventionerade användare överstiger efterfrågan på beräkningskraft utbudet, och Nvidia kan sälja sina grafikkort till överpris. Detta skapar en förlustavgrund mellan det pris som OpenAI begär och de kostnader som betalas, vilket täcks av investerare som investerar i bolaget. Priserna kan ju inte höjas till kostnadsnivå mitt i det nuvarande AI-priskriget, eftersom användarna annars flyr till en konkurrent och de ändå inte är berodda att betala fullt pris.
Inte är det väl mycket mer vett i Anthropic heller. De flesta programmerare behöver inte Claude. Helt ärligt så gör de inte det. Det där hobbyprojektet som du har slängt upp på Github och som under sin livstid genererar noll euro har skapats med Fable eller Opus, eftersom Anthropic är berett att tillhandahålla tjänsten med förlust för att visa omsättning inför en börsintroduktion. Om användarna skulle behöva betala det verkliga priset för AI-användning, skulle man omedelbart börja intressera sig för till exempel GLM 5.3 Flash eller motsvarande, som gör 99 % av alla nödvändiga jobb till en bråkdel av polletterna (token) och kostnaderna. Inte helt allt såklart, men nästan. Modellerna har utvecklats så att frontier-modeller (frontlinjemodeller) inte längre behövs för vanliga arbetsuppgifter.
Vi sitter fast i Nvidias GPU-fälla enbart för att förändringen gick så snabbt att hårdvarutillverkarna eller mjukvaruutvecklarna inte har hängt med, och att öka användningen av polletter (token) vid problemlösning samt investerarsubventionerat slöseri med beräkningskraft har varit det praktiska sättet att omedelbart producera mervärde med AI. På längre sikt vill jag tro på att förnuftet segrar och att verksamheten blir effektivare, så all sådan AI-körning som förnuftsmässigt kan flyttas till användarens egen enhet lönar sig att flytta dit, eftersom det i praktiken är gratis att köra den där. På så sätt kommer både kostnaderna för AI-körning och mängden erforderlig beräkningskraft att genom optimering störtdyka från nuvarande nivåer, även om antalet AI-agenter mångdubblas inom den närmaste framtiden.