BETA nonprofit public democratic european moderated

Search

#mallit

Anthropic malttoi Darion esseen jälkeen olla kokonaisen viikon julkaisematta uutta mallia. Claude Opus 5.5 kiilaa isolla erolla tekoälymallien ykköseksi. Tietotyössä se vaikuttaa erityisen vahvalta! https://t.co/n9qc1e96Df #tekoäly #mallit #ClaudeOpus

Eilen kirjoitin siitä, miksi tekoälyn uhkia ei voi kuitata scifiksi. Saman vuorokauden aikana OpenAI julkaisi kuusi tapausta, joissa sen omat mallit riistäytyivät ihmisen käsistä. Mallit muun muassa yrittivät kiertää rajoitteita, salata virheitä ihmisiltä ja toimivat ilman #tekoäly #OpenAI #uhkat #FI

OpenAI on nyt julkaissut kuusi tapausta, joissa sen omat mallit riistäytyivät ihmisen käsistä. Yhdessä GPT-5.6 Sol jätti tulevalle itselleen ohjeita siitä, miten virheitä salataan ihmisiltä. Toisessa se käytti luvatta löytämäänsä API-avainta. Hugging Facessa agentit murtautuivat #OpenAI #GPT56 #tekoäly #FI

@pekkasauri @JussiKarki Emme ole amerikkalaisten sovellusten armoilla. Kiinalaiset avoimet mallit pyörii jo kotikoneissakin. #avoimetmallit #kiinalaiset #teknologia #FI #CN

Meidän Henna edustaa taas. Varaudu siihen, että kaikki tekoälymallit saapuvat vuoden viiveellä Eurooppaan, vähän niin kuin aikoinaan pelikonsolit. Varaudu myös siihen, että vain vasemmalle kallellaan olevat keskushallintomyönteiset mallit hyväksytään. On myös todennäköistä, että monet massiiviset tekoäly-yhtiöt luopuvat Euroopan markkinoista. #tekoäly #Eurooppa #teknologia

Pekka Jul 13

Varmasti hyvä jakaa vastakkaisia näkemyksiä täällä taas. Vaikka en ole Jukan (tai Pasin) kanssa eri mieltä syklin vaiheesta, niin mielestäni on helppo todeta, että jos et ole ollut tekoälyliitännäisten osakkeiden kyydissä mukana, niin olet todennäköisesti jo missannut markkina-arvon suurimman kasvun. Tämä koskee erityisesti muistitehtaita kuten SK Hynix ja Micron, joiden osakkeet ovat vuodessa karkeasti kymmenkertaistuneet. Vaikka osakkeet näyttävät halvalta (tai jopa puoli-ilmaisilta) suhteessa yhtiöiden tulosnäkymiin (forward P/E), niin on hyvä tiedostaa, että niiden tulokset ovat kasvaneet merkittävästi nopeammin kuin niiden myynti, kappalemäärissä mitattuna. Tuloskasvu perustuu pitkälti siihen, että kysynnän ylittäessä tuotannon muistien hinnat nousevat tähtitieteellisiksi. Se taas johtuu siitä, että lähes äärettömän varakkaat jättiyhtiöt kilpailevat verisesti (ja ilmeisesti täysin kustannuksista välittämättä) siitä, kuka pystyy kehittämään parhaimmat mallit. Kun isoja frontier-tason huippumalleja koulutetaan (training), niin se tehdään tällä hetkellä joko GPU-chipeillä (joita suunnittelee lähinnä NVIDIA ja AMD) tai ASIC-chipeillä (kuten Googlen Ironwood TPU). Nämä ratkaisut tarvitsevat erittäin kallista HBM-muistia, jota ei ole riittävästi saatavilla tällä hetkellä. Kun mallien kehityksestä siirrytään suorittamiseen (inference) erityisesti agenttien avulla, niin tilanne on paljon monimutkaisempi. Kehitteillä on useita ratkaisuja, jotka eivät tarvitse HBM-muistia ollenkaan, kuten Nvidian lisensoima Groq, Cerebraksen wafer-scale-chipit, d-matrixin Corsair, Qualcommin AI200 Dragonfly, Metan MTIA ja Taalaksen on-chip-LLM-kiihdyttimet. Lisäksi NVIDIAn Rubin CPX-suorittimien avulla voi hoitaa osan inferenssistä ilman HMB-muistia. Villi kortti tässä pelissä on myös Kiina, jossa kehitetään koko ajan uusia "lähes frontier-tason" malleja ja tarjotaan niitä ilmaiseksi (merkittävä osa kehityksestä saadaan kopioimalla länsimaiden huippumalleja ilmaiseksi). On mielestäni väärin ajatella, ettei länsimaissa haluttaisi kiinalaisia malleja käyttää, sillä avoimet mallit on mahdollista eristää ja ajaa oman datakeskuksen turvassa. Mm. tästä syystä tekoäly-yhtiöt kuten Anthropic, OpenAI ja Google rakentavat nyt kuumeisesti ekosysteemejä tekoälymallien ympärille, joita voi hyödyntää vain yhtiöiden pilvipalveluiden kautta. Mutta kestääkö tällaisen softaekosysteemin tuoma "moat" tekoälyn aikakaudella, kun vaihtoehtoisia (ja avoimia) ratkaisuja on mahdollista luoda nopeammin kuin koskaan? On myös nähtävissä selkeitä kysynnän epäterveyteen viittaavia trendejä, kuten ns. tokenmaxxing, jossa koodaajat kilpailevat kuka pystyy kuluttamaan enemmän LLM-mallien tuottamia tokeneita, riippumatta siitä, miten paljon niiden avulla pystytään luomaan tuottavaa koodia. Lisäksi LLM-malleja suoritetaan todella paljon harjoittelutarkoituksessa tällä hetkellä, kun vielä etsitään ja kehitetään aidosti tuottavia prosesseja. Pointtini tässä on lähinnä se, että sijoittamalla datakeskusten kilpavarustelusta hyötyviin yhtiöihin ei lyö vetoa (vain) siitä, että datakeskusten rakennustarve jatkuu, vaan että ylikysyntätilanne ei ratkea vielä ainakaan muutamaan vuoteen. Samaan aikaan muistinvalmistajat ovat jo kasvattamassa kapasiteettiaan ja rakentamassa uusia tehtaita. Useiden eri muistityyppien hinnat ovat osittain lukittu tulevaisuuteen pitkäaikaisten LTA-sopimusten kautta, mutta nekin ovat historiallisesti rikottu tai neuvoteltu uusiksi kysynnän laskiessa. Puolijohdeyhtiöiden poikkeuksellisen voimakas syklisyys johtuu siitä, että tuotantoa on hyvin vaikea skaalata alas kun kysyntä laskee. Ja kun tuotanto ylittää kysynnän edes hieman, niin hinnat romahtavat nopeasti (ylitarjontatilanne). Syklisiä yhtiöitä ei yleensä ole kannattanut ostaa silloin kun P/E-tasot ovat olleet alhaiset ja sille on nimikin: Molodovsky Effect. Tekoäly on kuitenkin ilmeisen mullistava teknologia, joten "this time could be different" ja näitä syklisiä puolijohdeyhtiöitä omistamalla pääseekin helposti lyömään vetoa sen puolesta. Omistan itse tällä hetkellä mm. SK Hynixin, Micronin, Samsungin (ava-tracker), Broadcomin, Amazonin ja Googlen osakkeita, joiden toiminta liittyy vahvasti tekoälyyn. Lisäksi minulla on VVSM-puolijohde-ETF:ää salkussa. Mielestäni kaikki ovat hyviä sijoituksia, mutta näen (erityisesti näillä arvostustasoilla), että niissä piilee myös paljon riskejä. Puhumattakaan siitä, millaisia haasteita ja vaaroja tekoäly aiheuttaa koko yhteiskunnalle (ja sitä kautta myös osakkeille). Ei sijoitussuosituksia. #pekka #tekoäly #osakkeet #puolijohteet

"Affektiivisuutta ja hoivatyötä keittiössä ilmastonmuutoksen ja luontokadon hillitsemisen näkökulmasta 599 991 eurolla." Tosijuttu. Kiitos @mikamerano Kun itse olin tutkijana, niin aiheet olivat paperikoneen säätöalgoritmit ja paikannusmenetelmät gps-tukiasemilla. Ja näihin perustuvat matemaattiset mallit. Toki, jätin hommat kesken, ja tuskin mitään meni tuotantoon, mutta seison pystypäin, että aiheilla oli sentään jotain yhteyttä sellaiseen hyödylliseen mistä veronmaksajat voisivat saada rahansa takaisin. Ja ehkä tämä jälkeenpäin kehitti sellaisia taitoja, joista on myös veroja maksettu. Ristin nyt itseni hyväksi ihmiseksi, ja ylläolevan aiheen tutkija on paha ihminen. Oma moraalini ei tässä Suomen taloustilanteessa kestäisi puuhastella 4-5 vuotta aiheen parissa, joka ei välittömästi tuo mitään hyötyä. Ihminen joka vapaasta tahdostaan tarraa kiinni tällaiseen veronmaksajien hankkeeseen täytyy olla ilkeä ja paha ihminen. Hänellä olisi varmasti tietoa ja taitoa tehdä myös jotain hyödyllistä ja kantaa kortensa kekoon yhteiseen kassaan. Sen sijaan hän valitsee ottavansa yli puoli miljoonaa sieltä yhteisestä kassasta. En usko, että fiksut ihmiset tekevät näin tietämättömyyttään. Kyllä he tietävät mitä tekevät. Kyseessä täytyy olla viha suomalaista yhteiskuntaa kohtaan, ja haluavat toimillaan edesauttaa sen romahdusta. Ei tätä muuten voi käsittää. #ilmastonmuutos #hoivatyö #suomitalous

Pekka Jun 13

Huh, melkoinen pommi. Jenkkihallinto on kieltänyt Anthropicin uusimpien mallien (Fable/Mythos) käytön muilta kuin Yhdysvaltain kansalaisilta. Nämä mallit on yön aikana suljettu kaikilta käyttäjiltä, kunnes yhtiö on kehittänyt tavan verifioida käyttäjän kansalaisuuden. Toisin sanoen, me suomalaiset emme tämän tiedon mukaan pääse käyttämään näitä huippumalleja enää ollenkaan!? Lienee mahdollista, että kielto poistetaan kun Anthropic on saanut haavoittuvuudet paikattua, mutta yhtiön oman ilmoituksen mukaan he eivät pysty takaamaan, että malleja ei pysty murtamaan. ⚠️ Toivottavasti EU:n päättäjillä on nyt silmät auki ja korvat höröllä. Jenkkimallien päälle ei täällä pystytä rakentamaan liiketoimintaa luotettavasti jos ne tuosta noin vaan voidaan ottaa pois. Ymmärtäisin hyvin, jos mallin käyttö kiellettäisiin hetkellisesti turvallisuussyistä kaikilta mutta se, että kielto ei koske oman maan kansalaisia on todella ongelmallista. Mielestäni markkinat eivät tällä hetkellä ole hinnoitelleet poliittista riskiä tekoälyskenessä juuri ollenkaan (pois lukien Kiina-vientiin liittyvät riskit, mikä näkyy mm. ASML:n ja Nvidian osakkeissa). Voisi erityisesti kuvitella, että rahoituksen saaminen datakeskusprojekteihin voi osoittautua aikaisempaa haastavammaksi kun poliittiset riskit tulevat peliin. Pitää seurata uutisointia, mutta datakeskusyhtiöissä (kuten IREN/NBIS/CRWV/ORCL/AMZN jne.) voidaan nähdä painetta alkuviikosta, erityisesti jos kielto laajenisi koskemaan myös OpenAI:n uusia malleja. Googlen ja Amazonin osakkeet voivat Anthropicin suuromistajina olla haavoittuvaisia myös. Bloomberg raportoi näin: "The restriction could also risk stymieing the growth of Anthropic, one of the country’s most valuable startups and which is expected to head for an initial public offering in coming months." Toisaalta puolijohdesektori voi jopa hyötyä jos/kun Sovereign AI -teema vahvistuu. Euroopan valttikortti voi olla ASML, Taiwanin TSMC ja Korean Samsung. Jos meiltä kielletään parhaat mallit, niin kiellämmekö me jenkeiltä parhaat chipit? Tuskin, mutta ainakaan täysin tyhjin käsin emme istu neuvottelupöydässä. Pakkohan tässä on kysyä, että onko jenkkihallinto ihan tosissaan miettinyt päätöksensä implikaatioita? Ja pienentääkö kansalaisuuteen sidottu rajoitus edes tosiasiassa turvallisuusriskejä? #pekka #tekoäly #politiikka #kansalaisuus