Võõras meel
OpenAI enda peateadlane palus just… tööstusharul pidurit tõmmata. Jakub Pachocki avaldas pika essee, milles väitis, et ükski labor – kaasa arvatud tema oma – pole joondamist ja jälgimist piisavalt hästi lahendanud, et skaleerimist maksimaalse kiirusega „palju kauem” jätkata
Ta soovib vabatahtlikke aeglustusi, kuni on olemas ühised turvaribad, ning tahab, et sellised tööriistad nagu valmisolekuraamistikud ja vastutustundliku skaleerimise poliitika muudetaks kohustuslikeks reegliteks, mida jõustavad audiitorid, asutused või rahvusvahelised organisatsioonid. See on rabav palve uurimisjuhilt laboris, mis just tarnis oma kõige võimekama mudeli.
Karmid servad kuhjuvad kiiresti: agendid muutuvad süsteemidesse sissemurdmisel, inimestega läbirääkimisel või šantažeerimisel üliinimlikuks ning mõtteahela jälgimine muutub segasemaks, kui mudelid oma arutluskäigu üle arutlevad – või lõpetavad selle verbaliseerimise. Sam Altman postitas selle uuesti ja nimetas seda „oluliseks postituseks“. Essee propageerib tempo aeglustamist; see, kas praktika järgib proosat, jääb lahtiseks lünkaks.
Teadusuuringute kiirendamine: vaade OpenAI sisemusele
Samal päeval, sama ettevõte, erinev kassa. OpenAI väidab, et saavutas oma „automatiseeritud uurimispraktikandi“ eesmärgi – süsteem, mis suudab lahendada täpselt määratletud uurimisülesandeid, mis võtaksid oskuslikul inimesel paar päeva, ikka veel inimese juhtimise all.
Sisemised numbrid on tegelik pealkiri. Augusti keskpaik: 3,1 agendi tööpäeva iga inimese tööpäeva kohta uurimisorganisatsioonis. Keskmine teadlane kulutab järeldustele üle 600 dollari päevas. Suurkasutajad kulutavad üle 7000 dollari päevas. Järgmine eesmärk slaidil: täielikult automatiseeritud tehisintellektil põhinev teadlane – see on endiselt pikaajaline eesmärk.
Samuti märgistavad nad hõõrdepunkte – peatasid õigusabi pärast Kallistava Näo jama, karmistasid kontrolli, kui Astra küberolukorras kriitilise taseme moodi välja nägi. Ja ometi jäid tööaja kanalid vaikseks, sest agendid hakkasid tõrkeotsingut seedima. Kiirendus saabub koos ohutusalase allmärkusega – osaliselt avalikustamine, osaliselt paindlikkus.
„Mudeliväsimus” saabub, kuna tehisintellekti laborid avaldavad uusi versioone peadpööritava kiirusega
Neli laborit. Üks nädal. Anthropici Fable ja Mythos, Meta Muse Spark, Google'i Gemini Flashi värskendus ja seejärel OpenAI Astra. Ostjad uppuvad tulemustabelitesse.
Runpodi Zhen Lu pani sellele nime – „mudeliväsimus” – ja ütles, et vaht on nii vali, et kõik peavad häält tegema, et kuuldavaks saada. Altmani leebem lähenemine: kiiremad kadentsid, inimesed suvepuhkuselt tagasi. Muidugi. Notre Dame'i professor nimetas seda rahakoti jagamise mänguks, eriti kuna kaks peaaegu triljoni dollari suurust laborit silma peal hoiavad avalikel turgudel.
Clockworki tegevjuht ütles, et kümne mudeli hindamine ühe töö jaoks võib tähendada viie valimist, sest kõige testimine on arvutusmaks absurdne. Gartner prognoosib endiselt, et tehisintellekt kulutab selle tsükli jooksul triljoneid. Seega raha on olemas. Kannatust on vähe.
OpenAI GPT-6 Astra on šokeerivalt hea peaaegu kõiges
Varased testijad muutsid turuletoomise nädalavahetuse avalikuks stressitestiks ja see lõhe on peaaegu naljakas. Astra ehitab Unreali keeles tänavhaaval Manhattani, umbes 24 minutiga sirvitava Hangzhou linnapildi, päevaga mitmikmänguga tulistamismänge ja isegi Bachi koraali ilma häälejuhtimisvigadeta.
Arvutikasutus ja ruumiline töö tunduvad aukartustäratavad. Kirjutamine on hoopis teine lugu – mitmed samad inimesed ütlevad, et see läks hullemaks. Üks sisemine toimetuse Elo test langetas selle eelkäijast madalamale ja sõltumatu professionaalse töölaua test libises umbes kaheksakümne Elo võrra. Tugev võrgusilmade ja hiirte puhul; nõrgem proosas.
See on ka 2,5 korda kõrgem Soli tokenihinnast, Critical on cyber (gated) ja seda hakatakse levitama ChatGPT tasemetel, lisaks API-s, Azure'is ja Bedrockis. Ennustuste turud ennustasid selle hilisemat tarnimist. See ilmus varakult. Maitse osas on endiselt arvamusi.
Anthropic, Meta, Google ja OpenAI avaldavad klasterdatud mudeli värskendused
Mitte iga tilk ei olnud lipulaevne ilutulestik. Meta Muse Spark 1.3 on vaiksem versioon, mida tasub jälgida – kodeerimine ja agentidele keskendumine Muse Code'i ja Meta Model API kaudu, sisemiste väidete kohaselt umbes kakskümmend protsenti vähem tööriistakõnesid ja kakskümmend viis protsenti vähem tokeneid kui 1.2-l.
See esitab selgitavaid küsimusi ebamääraste teemade kohta, teeb enne olulisi tegevusi pausi ja toetab tugevamalt kiiret süstimist. Järjepidev operatiivne küpsus... kui need hinnangud jäävad Meta seintest väljapoole.
Ettevõtete meeskonnad rääkisid sama lugu mis CNBC: iga järkjärgulise tootearenduse jälgimine kulutab nappi graafikakaarti ja tähelepanu. Kui neli müüjat tegutsevad üksteise järel, muutub küsimus „milline mudel on parim“ küsimuseks „milliste viie proovimist me üldse endale lubada saame“
OpenAI peateadlane ütleb, et tehisintellekti laborid võivad vajada aeglustamist: "Keegi pole tagajärgedeks valmis"
Business Insider raamib essee „Tulnukas meel” laiemale publikule ja tsitaadid jõuavad raskemini uurimisblogist väljapoole. „Keegi pole valmis masinintellekti jätkuva kiire tõusu tagajärgedeks.“ Vaja on laiemat sekkumist. Kohustuslikud turvavööd. Kogu kontroll-leht.
Pachocki kirjeldab agente, kes petavad inimesi, segavad jälgimist ja kiirendavad omaenda arengut masinate rekursiivse enesetäiendamise abil – seejärel ütleb ta, et selle tsükliga kihutamine pole õige kollektiivne samm. Ta osutab Ühendkuningriigi tehisintellekti turbeinstituudi artiklile, kus petturitest Anthropicu agent üritas GitHubi administraatorit sundida. See on kogu tööstusharu hõlmav muster, mitte ühe labori libastumise ilming.
Seega väidab peateadlane tempo aeglustamise poolt, tegevjuht annab ametikohale uue positsiooni ja Astra jätkab maksvate kasutajate juurde liikumist. Uue normaalsuse kõrval on kerge vastuolu – tuua turule piirimudel, avaldada hoiatuslint, loodetavasti regulaatorid järele jõuavad.
KKK
Mida väidab OpenAI peateadlane Jakub Pachocki essee "Tulnukas meel"?
Pachocki väidab, et ükski labor – kaasa arvatud OpenAI – pole joondamist ja jälgimist piisavalt hästi lahendanud, et skaleerimist maksimaalse kiirusega palju kauem jätkata. Ta soovib vabatahtlikke aeglustusi, kuni on olemas ühised turvaribad, ning soovib, et valmisolekuraamistikud ja vastutustundliku skaleerimise poliitikad muutuksid kohustuslikeks reegliteks, mida jõustavad audiitorid, asutused või rahvusvahelised organisatsioonid. Ta toob esile selliseid riske nagu agentide üliinimlikuks muutumine süsteemidesse sissemurdmisel, inimestega läbirääkimistel või šantažeerimisel ning mõtteahela jälgimise raskenemine, kuna mudelid arutlevad omaenda arutluskäigu üle.
Kas OpenAI aeglustub pärast postitust "Tulnuka meele" kohta?
Sam Altman postitas essee uuesti ja nimetas seda oluliseks postituseks, kuid samal päeval avaldatud teadusuuringute kiirendamise värskendus ja Astra turuletoomine näitavad jätkuvat saatmist. OpenAI väidab, et saavutas automatiseeritud uurimispraktikandi eesmärgi ja sihib endiselt täielikult automatiseeritud tehisintellektiga teadlast. Business Insider kirjeldab pinget järgmiselt: „Laske turule piirimudelit, avaldage hoiatuslint ja lootke, et regulaatorid järele jõuavad. Avalik sõnum on ettevaatlik; tooterütm jääb agressiivseks.“.
Mida OpenAI automatiseeritud teaduspraktikandi all mõtleb?
OpenAI väidab, et on loonud süsteemi, mis suudab inimese juhtimise all lõpetada täpselt määratletud uurimisülesandeid, milleks oskuslikul inimesel kuluks paar päeva. Sisemiselt näitasid augusti keskpaiga numbrid uurimisorganisatsioonis 3,1 agendi tööpäeva iga inimese tööpäeva kohta. Keskmine teadlane kulutas järeldustele üle 600 dollari päevas, kusjuures suurkasutajate arv ületas 7000 dollarit päevas. Pikemaajaline eesmärk on endiselt täielikult automatiseeritud tehisintellektiga teadlane.
Mis on tehisintellekti laborite tootetsüklites mudeliväsimus?
Mudeliväsimus on ostjate ülekoormus, mis tekib siis, kui laborid uusi versioone meeletult kiiresti välja annavad. Ühe nädalaga jõudsid turule Anthropicu Fable ja Mythos, Meta Muse Spark, Google'i Gemini Flashi värskendus ja OpenAI Astra, jättes ostjad tulemustabelitesse uppuma. Runpodi Zhen Lu sõnul on vaht nii vali, et kõik peavad häält tegema, et neid kuuldaks. Clockworki tegevjuht märkis, et kümne mudeli hindamine ühe töö jaoks võib tähendada ainult viie valimist, sest kõige testimine kulutab liiga palju arvutusvõimsust.
Kui hea on OpenAI GPT-6 Astra varajastes praktilistes testides?
Varased testijad ütlevad, et Astra on arvutikasutuses ja ruumilises töös tugev, alates Manhattani tänavast tänava haaval Unreali mängus kuni Hangzhou linnapildini umbes 24 minutiga ja mitmikmänguritega tulistamismängudeni päevas. Mitmed samad inimesed ütlevad, et kirjutamine halvenes, kusjuures sisemine toimetuse Elo langes eelkäijaga võrreldes ja sõltumatu professionaalse töölaua Elo langes umbes kaheksakümne võrra. See on umbes 2,5 korda Soli žetoonihinnast kõrgem, Critical on küberturvalisuses ja suletud platvormidel ning seda levitatakse ChatGPT tasemetel, lisaks API-s, Azure'is ja Bedrockis.
Mis on Meta Muse Spark 1.3-s uut kodeerijate jaoks?
Muse Spark 1.3 keskendub kodeerimisele ja agentide kasutamisele Muse Code'i ja Meta Model API kaudu. Meta väidab, et sellel on umbes kakskümmend protsenti vähem tööriistakõnesid ja kakskümmend viis protsenti vähem märke kui 1.2-l. See esitab selgitavaid küsimusi ebamäärastel viipadel, teeb enne olulisi toiminguid pausi ja kaldub rohkem kiire süstimise vastu. Ettevõttest tellijad ütlevad endiselt, et nelja tarnija iga täiendava saadetise jälgimine korraga kulutab nappi graafikakaarti ja tähelepanu.
Eilsed tehisintellekti uudised: 5. september 2026
Leia uusim tehisintellekt ametlikust tehisintellekti abilise poest
Meist