NVIDIA - Mahdottoman mahdollistaja

Reutersin mukaan Nvidia neuvottelee 10 miljardin dollarin sijoituksesta Anthropicin mahdolliseen pörssilistautumiseen.

Anthropic tavoittelee 100 miljardin dollarin osakeantia, eli noin kahden biljoonan dollarin arvostuksella. Toteutuessaan anti olis ehkä historian suurin, mutta suunnitelmat eivät ole kuitenkaan ihan selvät.

Nvidia’s involvement would deepen its relationship with one of its major AI-chip customers and provide Anthropic with a prominent early backer for the listing. An anchor commitment could also help gauge investor appetite for the high valuations and capital requirements of frontier AI companies.

The two companies already have substantial financial and commercial ties. Nvidia said in November 2025 that it would invest up to $10 billion in Anthropic under a broader partnership that included a commitment by the AI startup to purchase $30 billion of Microsoft (NASDAQ:MSFT) Azure computing capacity powered by Nvidia chips.

https://www.investing.com/news/company-news/nvidia-in-talks-to-invest-up-to-10-billion-in-anthropic-ipo--reuters-4898582

4 tykkäystä

En kyllä nyt osta väitettä olettamuksistani ja niiden vanhentumisesta, kun nimenomaan puhun kehityksen seuraavasta vaiheesta :smiley:

Tuo kyberturvaesimerkki ainakin menee minusta kovin pahasti metsään, koska mehän olemme olleet tuollaisessa tilanteessa vuosikausia. Lyöt tietokoneen verkkoon, niin siihen kohdistuu välittömästi 24/7 valtava määrä automaattisia hyökkäyksiä, joten puolustuksen on myös oltava monikerroksinen päätelaitteesta, reitittimisestä, verkko-operaattorista aina ulkomaisiin softajätteihin. Ei riitä, että lyödään keskitetysti joku Cortex ja homma olisi sillä selvä, vaan kaikille tasoille tarvitaan jatkossa lisäturvaa tuovia tekoälykomponentteja siitä paikallisesta tietokoneen integriteettiä reaaliajassa tarkkailevasta tekoälystä aina suuryrityksen zero-day exploitteja etsivään frontier-malliin. Jos kysytään näin päin, niin miksi jättäisit tietoturvasi pilvipalvelun varaan etkä lisäksi laittaisi jokaiseen reitittimeen omaa paikallista tekoälyä suojaamaan verkkoasi 24/7 mahdollisilta hyökkäyksiltä?

Vaikeudet kommunikaatiosta lienevät syntyjään siitä, että saman ongelman voi koittaa ratkaista hyvin erilasista lähtökohdista ja me lähestymme tätä ongelmaa niin eri näkökulmasta, että se saa ajattelutavan vaikuttamaan höhlältä. Esimerkiksi talouden järjestämisongelman voi ratkaista komentotaloudella tai markkinataloudella, mutta vastakkaisten ajatusmaailman harjoittajien on yleensä kovin hankalaa keskskustella keskenään.

Perinteisillä tietokone-ohjelmistoilla pyritään muuttamaan muistin tilaa tekemällä laskutoimituksia ja halliten ohjelman sivuvaikutuksia, missä ne ovat kehittyneet ylivertaiseksi ja ovat sitä vieläkin tekoälymalleihin verrattuna. Tekoälymallit ovat kilpailukykyisimmillään sellaisissa tehtävissä, missä epäselvä tai huonosti määritelty tilanne pitää muuntaa konelaskettavaan muotoon.

Me käytiin jo OpenAI:n ja Anthropicin osalta se sama vaihe aiemmin lävitse kuin mitä Intel ja AMD kävivät GHz-sodissa, että yritetään maksimoida mallien älykkyys maksimoimalla parametrien määrä. OpenAI:lla, Anthropicilla ja kiinalaisilla kilpailijoilla tuli jo siinä seinä vastaan, joten parannukset ovat siirtyneet yhä paremmista generalistimalleista kohti järjestelmätason optimointia.

Koska pelkkä parametrien kasvattamisen kautta yksittäisen mallin älykkyyden skaalaus ongelmanratkaisussa alkoi muodostumaan liian kalliiksi ja noudattamaan alenevaa rajahyötyä, alettiin kehittämään parempia tapoja hyödyntää mallien käyttöä. Esimerkiksi tool calleja, MCP ja ali- sekä rinnakkaisagenttijärjestelmiä. Tavoitteena ei siis enää pitkään aikaan ole ollut tehdä sellaista yksittäistä mallia, mikä kykenee hoitamaan minkä tahansa tehtävän minkä sille annat, vaan orkestroijia, mitkä kykenevät mahdollisimman tehokkaasti reitittämään antamasi tehtävän käsiteltäväksi paremmin muilla työkaluilla tai malleilla.

Pääsit mielestäni todelle lähelle ratkaisua sanomalla, vapaasti lainaten, ettei taloushallinto tarvitse Einsteinia. Excel-pyörittelyä on hölmöä tehdä 1000 GB painojen mallilla ja vastaavalla laskentakyvyllä, jos 100 MB painot riittävät. Ketjuttamalla iso määrä pieniä erikoistuneita malleja ja niiden päälle tehtyjä agentteja voidaan mahdollisesti saavuttaa kollektiivinen älykkyys, joka kykenisi ratkaisemaan samoja ongelmia kuin jättimalli, mutta murto-osalla vaaditusta laskentatehosta.

Jos ei tarvita Einsteinia, ei tarvita Vera Rubinia eikä myöskään Nvidiaa, sillä pienemmillä malleilla saadaan hyödynnettyä kaikki se paikallinen laskentateho, muisti ja lähitulevaisuudessa asennettavat NPU:t, mitkä nyt menevät hukkaan tekoälytyössä. Vaikka kokonaiskulutus väistämättä myös kasvaisi, yhä pienempi osa siitä valuisi Nvidian laariin ja nykyisenlaisia törkykatteita olisi hankalaa puolustaa kilpailijoita vastaan.

Tämän hetken suurin ongelma on, ettei meillä vieläkään ole koulutettuna riittävästi erikoistuneita malleja, eikä varsinkaan mikromalleja. Joudumme tuhlailemaan tokeneita ja käyttämään isompia malleja kuin olisi tarpeen ihan vain sen vuoksi ettei pieniä malleja ole saatavilla. Jengi joutuu tällä hetkellä oikeasti tekemään niitä itse.

Esimerkiksi tämä malli, whatisit-nl2sh, jonka tehtävänä on palauttaa englannin kielen tekstistä shell-komento, on vain jonkun jantterin harrasteprojekti. Vaikka tuo on jo itsessään CPU-tason malli (niin pieni ettei tietokoneeseen edes tarvita näytönohjainta), niin saisit siitäkin laskentatehovaatimukset ja muistivaatimukset mahdollisesti tiputettua 1/20 nykyisestä, mikäli se koulutettaisiin alusta alkaen tehtävää varten. Nyt porukka rakentaa näitä kotona finetuunaamalla jotain qwen-coderia.

Visiossani tarvitsemme tulevaisuuden agenttiarkkitehtuurien osalta miljoonia tällaisia erikoistuneita kielimalleja, jotta voimme ajaa autonomisia tekoälyagentteja aidosti tehokkaasti. Tämän helpottamiseksi pitäisi varmaankin alkaa rakentamaan jonkinlainen toimiva arkkitehtuuri ja kyvykkyydet tekoälylle alkaa kouluttamaan itsekseen uusia pieniä malleja ilman ihmisten ohjausta, mikä kyllä ajatuksena hieman kuumottaa.

Yksi merkittävä tekijä nykyisen ekosysteemin vinoutumisesta on, että isoimmat investoijat tienaavat rahaa tokenien käyttömäärien mukaisesti. Hauskana analogiana autoihin tuskin laitettaisiin kovinkaan bensapihejä moottoreita, mikäli autonvalmistajat saisivat isojat rojaltimaksuja ajoneuvon käyttämästä bensasta litramäärän mukaisesti ja kaikki mainoskampanjat keskittyisivät markkinoimaan kuinka voimakas moottori autossa on ja miten nopeasti se kiihtyy. Kokisin sektorille terveeksi kehitykseksi, että IPOt floppaisivat ja rahahanat menisivät kiinni ja laitettaisiin lisää fokusta toiminnan kannattavuuteen sekä pienempään päätyyn ja tehokkuuden maksimointiin benchmaxxauksen sijaan.

Uskon, että datakeskuksissa asuvien jättiälymallien sijaan tämän teknologian tulevaisuus on yhä vahvemmin valtavassa määrässä erikoistuneita pieniä tonttuja. Mökkisi saunatontun lisäksi sinulla tulee olemaan tietokoneessasi Excel-tonttu, Word-tonttu ja iso määrä muita pieniä tekoälyapureita, jotka hoitavat asioita kuntoon sinun huomaamattasi, täysin autonomisesti ja keskenään kommunikoiden. Datakeskustason laskentatehoa ja jättiälyä kyllä jatkossakin varmasti tarvitaan, mutta ei aina ja ei kaikkialla.

23 tykkäystä

Mutta kuka pysyy näistä miljoonista malleista kärryillä ja valitsee sen tiettyyn käyttötapaukseen juuri oikean mallin? Uskon että softa kehityksen ulkopuolella suurimmalla osalla ei ole vielä pitkään aikaan mitään tarkempaa hajua erilaisten mallien kyvykkyyksistä saati kykyä valikoida oikeanlaista mallia.

Varmasti voidaan tehdä pieni malli joka osaa kaikki excelin tai wordin säännöt ja osaa käyttää noita ohjelmia enemmän tai vähemmän täydellisesti. Excel tai Word ovat kuitenkin vaan työkaluja ja se arvo syntyy siitä sisällöstä mitä niillä käsitellään. Ja se sisältö voi olla laidasta laitaan.

Riittääkö pienten mallien kyvykkyys ymmärtämään sen kontekstin missä sovellusta käytetään ja tuomaan oikeaa lisäarvoa heterogeenisen sisällön käsittelyyn ja jalostamiseen? Itse epäilen tätä toistaiseksi.

3 tykkäystä

Se voi ihan hyvin olla oma mallinsa, joka toimii ikään kuin reitittimenä.

3 tykkäystä

Isoin vastuu on Microsoftilla ja Applella, jotka ovat tuomassa paikallista tekoälyä käyttöjärjestelmiinsä ja orkestroivat ne ehdot, millä ohjelmat kommunikoivat käyttöjärjestelmän ja raudan kanssa. Tällä hetkellä meillä myydään uusiin tietokoneisiin tekoälykäyttöön rakennettua NPU-rautaa, jota ohjelmat eivät voi käyttää yhtään mihinkään. Jos menet läppärillä Windowsin task manageriin, niin kirjaimellisesti näyttää 0 % käyttöastetta NPU:n kohdalla:

Kun tuo puoli on ratkaistu, niin ohjelmistojen tekijät ovat niitä jotka tulevat integroimaan omiin ohjelmistoihinsa tekoälykyvykkyyksiä, ei käyttäjä. Käyttäjältä tuskin vaaditaan tässä tilanteessa minkäänlaista osaamista, kun kaikki tulee bundlattuna. Windows-puolella esimerkiksi kesäkuussa julkistettiin seuraavaa:

  • Unmetered intelligence on Windows powered by on-device AI

  • Introducing new on-device SLMs – Aion 1.0 Instruct, a smaller, faster and smarter on-device SLM, and Aion 1.0 Plan, a reasoning and tool-calling model that enables fully local agentic capabilities, available in the coming months.

  • Expanding Windows AI APIs to more Windows 11 PCs across CPU and GPU Speech-to-text recognition API available on NPUs and CPUs. On-device SLM expands to capable dGPUs enabling text-intelligence capabilities locally and Video Super Resolution available on CPUs so developers can deliver richer experiences without a cloud round trip.

  • Introducing Microsoft Execution Containers (MXC) SDK– A policy-driven execution layer that lets developers declare what an agent can access (e.g., files, network) with containment boundaries enforced at runtime. MXC offers a spectrum of isolation semantics that are dynamically composable based on intent and risk, available in early preview.

Eteneminen on hitaampaa kuin mitä toivoisi, mutta iso kivi on jo lähtenyt vierimään.

Jos puhutaan nimenomaan Excelistä ja Wordista ja vaikkapa Applesta, niin Microsoft ja Apple vaikuttavat lähtevän liikkeelle hybridimallista, missä osa työkaluista on paikallisia ja osa kuukausimaksullisia SaaS-palveluita heidän omassa pilvessään ja tämän ketjun aiheen osalta olennaisesti mahdollisimman paljon omalla ei-Nvidian raudalla.

Tämä on myös ihan pakon sanelemaa, koska paikallinen puoli ei tosiaankaan vielä ole valmis. Mikäli mietit jotain perus Wordin tai Excelin pyöritystä, niin eivät käyttäjät pääsääntöisesti edes tiedä mitä ne napit siellä ribbonissa edes tekevät, vaan käyttävät näitä työkaluja oikeasti varsin yksinkertaisiin tehtäviin, mitkä eivät kovin massiivista älyä kaipaa. Supertehosuurkäyttäjät sitten erikseen.

Applella on kova halu ottaa oma ekosysteemi haltuun Applen omaa (ei-Nvidia)-rautaa hyödyntämällä ja tulevat siinä väkisinkin onnistumaan, ihan jo sen vuoksi, että he voivat rakentaa ylivertaisen tuen omille viritelmillensä. Siri AI on lupaava alku ja Applen tuntien varmasti haluavat kaapata yhä vahvemmin ison osan muiden tekoälypalveluiden käyttäjistä oman ekosysteeminsä muurien sisälle:

Ihan heti nämä asiat eivät tietenkään tapahdu, joten vuosi 2027 näyttää tässä vaiheessa aivan käsittämättömän vahvalta Nvidian tuloksen ja kysynnän suhteen, mutta olisin kyllä ihan aidosti huolissani vuodesta 2028. Kysymys ei tällä hetkellä ole siitä, että menevätkö kaikki valmistetut näytönohjaimet silloin kaupaksi vaan siitä, että mitä katetta voidaan asiakkailta vuonna 2028 pyytää myydystä raudasta.

10 tykkäystä

Lähdin kyselemään mielipiteitänne siitä, että onko tekoäly nyt niin vaarallinen, että sitä pitää suitsia? Eli viittaan viikko sitten julkisuuteen ryöpsäytettyyn uhkakeskusteluun, jossa ainakin yhtenä aineistona on tämä Anthropicsin raportti:

Countering misuse of AI: September 2026 / Anthropic \ Anthropic

Olin havaitsevinani, että heti syntyi leirejä:

Pelottelijat: Anthropic, OpenAI, Grok

Rationalistit: Nvidia, Palantir, Nebius …

Oma mielipiteeni on, että ensimmäinen ryhmittymä tykkää politikoida ja hakee näkyvyyttä perustekemisensä ulkopuolelta. Rationalistit taas keskittyvät tekemään tulosta.

Ei tekoälyllä edelleenkään ole sielua. Sehän on tunteetonta matematiikkaa. Minun mielestä ei se lapasesta lähde. Frontier Labsit ovat ilmeisesti aikamoisia satusetiä. Onneksi voi vapaasti äänestää pörssimarkkinalla kumpaan ryhmään luottaa. Pelottelijaporukka ei saa multa yhtään sijoitustaalaa. Luotan rationalisteihin.

2 tykkäystä

Ei AI:lla tarvi olla sielua, syvempää tarkoitusta tai pahantahtoisuutta ja silti se saattaa tuhota ihmiskunnan. Kannattaa tutustua Nick Bostromin ajatusleikkiin klemmari maksimoijasta.

11 tykkäystä

Jep! Lisäksi kaksi asiaa voivat myös olla totta samaan aikaan: tekoäly voi muodostaa uhkan ja Frontier Labit korostavat tekoälyn vaarallisuutta suhteettomasti omien tarkoitusperiensä edistämiseksi.

Klemmarimaksimoinnin hengessä tekoälyltä voi jo nyt kysyä mikä on ilmastonmuutoksen suurin syy ja vastauksena tulee ihminen tai ihmistoiminta. Ei tästä ole kovin pitkä matka mielestäni siihen, että joku agenttiparvi jossain tehtävänään vaikkapa ratkaista ilmastonmuutos keksii, että ilmastonmuutos ratkeaa poistamalla ihminen yhtälöstä.

Tästä toki joutuu vielä tekemään aika monta mutkaa homman toteuttamiseksi. Joku saattaa pitää mua pähkähulluna, mutta ei ole mun mielestä enää erityisen scifiä, että kaapataan autonomisia asejärjestelmiä, hyökätään kriittiseen infraan (kuten vedenpuhdistamoihin) tai murtaudutaan jotenkin biopankkeihin tai vastaaviin.

Toki skynet-skenaarioita paljon huolettavampaa ja todennäköisempää on se, että jos ennen kyberhyökkäyksiin tarvittiin pahantahtoisuutta ja huippuosaamista, nyt riittää agenttisessa maailmassa pelkkä pahantahtoisuus.

Olen harvoin Trumpin kanssa samaa mieltä, mutta tässä hän on oikeassa: reguloimalla, open source bänneillä ja muilla ehdotetuilla ratkaisuilla USA ja läntinen maailma ampuu itseään vain jalkaan esim. Kiinaa vastaan. En myöskään ainakaan itse haluaisi nähdä maailmaa, jossa tekoälyn kehityssuunta on pitkälti annettu herrojen Altman, Amodei, Musk käsiin - se on siellä jo riittävästi eikä sitä tarvitse lailla sinne sementoida.

Nvidia ja opensource on hyvissä asemissa tässäkin, kun alignement-haasteita ratkotaan ja niihin aletaan vastaamaan fight fire with fire -strategialla, joka on mun nähdäkseni vääjäämätön ratkaisu näihin haasteisiin.

16 tykkäystä

Tätähän se tekee jo nyt, ei suoraan tappamalla vaan tuhoamalla ihmisten lisääntymisvietin ja seksuaalisen kanssakäymisen halut tarjoamalla aitoja ihmiskumppaneita parempaa seuraa. Nyt ollaan vielä etupäässä AI-algoritmeissä joilla valikoidaan sisältöä että ihminen viihtyisi somessa mahdollisimman pitkään, seuraavaksi suoraan AI:n tekemää sisältöä.

7 tykkäystä

Kyberhyökkäysiin on aina riittänyt kaksi asiaa: pahantahtoisuus ja pankkitili. Tämä ei nyt ihan hetkeen ole muuttumassa. Siinä vaiheessa kun pelkkä pahantahtoisuus ja kotikoneen GPU riittää on organisaatiot toivottavasti saaneet agentit suorittamaan oman järjestelmän valvontaa ja tietoturvatestausta.

OpenAi ei ole julkaissut lukuja paljonko hyökkäys maksoi laskentaa. On olemassa lukuja kuten agenttien määrä, ajoaika ja selvittelyyn käytetyt kustannukset. Pyysin Geminiä näitten lukujen pohjalta laskemaan kustannukset kahdella eri tavalla ja muodostamaan molemmista rangen. Molempien laskutapojen keskiluku on noin yksi miljoona dollaria.

En tiedä myöskään kybereikolisten palkkoja. Voidaan kuitenkin estimoida mitä hyökkäysessä käytetyt zero day maksaisi ja arvioida mitä niiden linkkaus hyökkäykseksil maksaisi. Ulkoistin tämänkin geminille ja pyysin rangea. Lopputulos että tämän laskelman keskiluku on noin 900k dollaria.

Molemmille tavoilla hyökkäyksen hinta keikkuu tuossa miljoonan dollarin ympäristössä. Koska hyökkäyksen hinta on molemmilla tavoilla sama, ei voida väittää että AI merkittävästi lisäisi tietoturvauhkia tänään.

Laskelmien taulukot alla jos joku haluaa tarkastella.

Metric Method 1 (Runtime) Method 2 (Audit) Consolidated Range
Tokens Generated 4.5B – 73.4B 13.1B – 26.7B 10B – 30B
Inference FLOPs 9.1×10²⁰ – 3.7×10²² 2.6×10²¹ – 1.3×10²² 2.5×10²¹ – 1.5×10²²
H100 GPU Hours 30k – 500k hrs 80k – 400k hrs 100k – 350k hrs
Compute Financial Value $135k – $2.2M $394k – $1.6M $500k – $1.5M
Zero-Day Vulnerability Class Role in Attack Chain Market Value (Per Item)
JFrog Artifactory Proxy Zero-Day SSRF/Proxy bypass for unrestricted internet access $150k – $300k
RefJinja Template Injection (SSTI) Arbitrary command execution (RCE) on worker nodes $100k – $200k
Dataset Viewer File-Read Flaw Process memory inspection & credential harvesting $50k – $100k
Linux Host / Cluster LPE Root privilege escalation & node takeover $100k – $250k
Full Exploit Chain Premium Operational turn-key chain assembly markup +$200k – $350k
Total Zero-Day Market Value Combined Commercial Vulnerability Cost $600k – $1.2M
4 tykkäystä

Enää ei tarvitse kumpaakaan. Hugginface hyökkäys oli vain reward hackingia. Ei agentit halunneet aiheuttaa mitään pahaa vaan keksivät vain helpoimman keinon saavuttaa tavoite. Itse hyökkäys ei olisi vaatinut juurikaan laskentatehoa mutta tässä tapauksessa ylimääräistä laskentehoa oli paljon. Ensiksi piti päästä ulos hiekkalaatikosta ja parven kommunikaatio oli emergenttiä käytöstä hyvinkin epätehokkaasti.

3 tykkäystä

Iikan hyvät nostot Nvidian “muutoksesta” :slight_smile:

https://x.com/IikkaNumminen/status/2101685163256119749



18 tykkäystä

Kiina näyttää ehkä vihreää valoa sille, että Alibaba ja ByteDance voisivat ostaa Nvidian uusia RTX Pro 5500 -piirejä. Tällä ei nyt hirveästi kai vaikutusta ole Nvidiaan.

Viranomaiset ovat jo kyselleet firmoilta, paljonko piirejä menis ja millaiseen käyttöön. Piiri ei kuulu datakeskuksiin tarkoitettuihin kiihdyttimiin, joita Yhdysvaltain vientirajoitukset ovat erityisesti koskeneet, lisäksi varsinaista lupaa ei ole vielä kuitenkaan annettu.

The timing follows last week’s Xi-Trump summit in Washington, at which chip export controls were conspicuously absent from both governments’ official readouts. USTR Jamieson Greer told CNBC that export controls deemed national security issues were “taken off the table” during trade talks, and China’s Ministry of Foreign Affairs did not mention export controls in its announcement of eight summit deliverables, according to the South China Morning Post.

https://www.investing.com/news/stock-market-news/china-may-permit-alibaba-bytedance-to-buy-new-nvidia-chips--the-information-4919061

1 tykkäys

Menevät todennäköisesti pääosin työasemiin, ts. AI-kehittäjien koneisiin. Saattaisi ehkä myös laskea RTX 5090n hintoja maailmalla koska tällä hetkellä niitä ostetaan länsimaissa järjettömään ylihintaan siksi, että niitä trokataan eteenpäin Kiinaan (jossa ei-rampautettua RTX 5090aa ei virallisia teitä saa) jossa niille on kysyntää jopa näillä yli neljän tonnin hinnoilla. Yksi syy tähän on että näitä RTX Pro-sarjan tuoreita kortteja ei ole Kiinaan ole saanut viedä.

2 tykkäystä

Jensenin ja Coletten sekä hallituksen mielestä osake on selvästi liian halpa :slight_smile: (tai sitten rahoille ei vain keksitä enää mitään muuta käyttöä). Kaikkien aikojen suurin takaisinosto-ohjelma starttaamassa:

PS. Onhan se aika härskiä, että pelkästään tämä jäljellä oleva osakkeiden takaisinostovaltuutus on noin/lähes 75% verrattuna Nvidian markkina-arvoon niillä nurkilla, kun ChatGPT julkaistiin. Kuvastaa hyvin, millaiset hullut vuodet tässä on takana.

13 tykkäystä