Kas tehisintellekt on usaldusväärne?

Kas tehisintellekt on usaldusväärne? [Video ja viktoriin]

Lühike vastus: tehisintellekt ei ole omadusena usaldusväärne: see sõltub ülesandest, otsingutsüklist ja sellest, kas inimene on ikka veel ühenduses. Käideldavuse aeg näitab, kas lõpp-punkt vastas; tõesus näitab, kas vastus oli jaatav. Kasutage seda siis, kui möödalaskmine on odav või tabatav; aeglustage, kui möödalaskmine on kulukas.

Peamised järeldused:

Vastutus: Nimetage, kes vaatab üle, kes saab selle peatada ja kes on süüdi.

Läbipaistvus: kontrollige leitud tükki või olete ikka veel udus.

Auditeeritavus: logige päringuid, hangitud tükke ja saatmisi, et möödalaskmisi saaks jälgida.

Kuritarvitamise vastupanu: rahaküsimustes ebaõnnestunud lahendused; ära kunagi mõtle välja numbreid, aknaid ega poliitikat.

Illustreerivad tulemused: 20 küsimusega illustreerivat testi tuleb käsitleda kaardina, mitte 95% tõestusena.

Kas tehisintellekt on usaldusväärne? Infograafik

Artiklid, mida võiksite pärast seda lugeda:

🔗 Kuidas tehisintellekti igapäevaelus kasutada
Avasta praktilisi viise, kuidas tehisintellekt saab igapäevaseid ülesandeid ja rutiine lihtsustada.

🔗 Kuidas tehisintellekti tööl kasutada?
Õpi praktilisi viise, kuidas tehisintellekti abil tootlikkust ja tõhusust parandada.

🔗 Kas tehisintellekt suudab ise mõelda?
Uuri, kas tehisintellekt suudab tõesti iseseisvalt mõelda ja arutleda.

🔗 Mis tüüpi tehisintellekti on olemas?
Saage aru peamistest tehisintellekti tüüpidest, võimalustest ja peamistest erinevustest.

Mida tähendab "usaldusväärne", kui masin on statistiline papagoi?

Usaldusväärsus tähendab igapäevakeeles seda, et saad millelegi toetuda.

Rääkiva automatiseerimisega peidab end ühe sõna alla hulk erinevaid omadusi. Faktilisus. Järjepidevus. Kalibreerimine – kas mudeli usaldusväärsus vastab selle õigsuse tõenäosusele või kas see lihtsalt... kõlab kindlalt. Ohutus. Tööaeg. Kiire tundlikkus. Käitumine äärmusjuhtumitel. Käitumine pärast jaotuse nihet, kui reaalajas maailm ei ole treeningmaailm. Mitte ükski neist ei vea koos alt. See on osa, mille inimesed vahele jätavad.

Vestlusrobot võib terve nädala "üleval" olla ja teisipäeva pärastlõunal ikkagi eksida. Kodeeriv kaaspiloot võib standardsete lahendustega hakkama saada ja siis hallutsineerida API-t, mis näeb välja täpselt nagu ehtne. Inimesed kasutavad metafoori "noorem kolleeg". See on ebatäiuslik - nooremad tunnevad piinlikkust -, aga see on lähemal kui "oraakel".

Reaalajas test on usaldusväärne selle osas, mida, kelleleja millise tsükliga. Vastasel juhul hindate blenderit selle järgi, kas see maksudega hakkama saab.

Tööaeg ei ole tõesõnalikkus – kaks erinevat tüüpi "usaldusväärset" olemust

Ops-inimesed ja tõeinimesed kasutavad sama sõna ja räägivad teineteisest mööda.

Käideolekuaeg on „kas lõpp-punkt vastas“. Tõepärasus on „kas vastus oli õige“. Juhtimine hoolib mõlemast ja mudelirisk peitub selles koledas tühimikus. Sul võib olla teenus, mis kunagi silmagi ei pilguta, ja ikkagi saata kliendipiletisse sorav vale. Usaldusväärne SRE mõttes. Mitte usaldusväärne „palun ärge mõelge välja tagasimaksepoliitikat“ mõttes.

Ma arvan, et see on kirja pandud ilmselge. See pole enam nii ilmne kell 16.00, kui vastus on kiire ja järjekord on tohutu. Kiirus tundub nagu pädevus. Aeglus tähendas varem, et keegi mõtleb. Nüüd on kiirus märk sellest, et keegi ei mõtle.

Ohutus on veel üks telg. Mudel, mis keeldub ebameeldivast jailbreakist, on ohutuse hindamise seisukohast "usaldusväärne" ja võib ikkagi teie enda märkmete kokkuvõtte moonutada.

Sorav ja vale on hullem kui kohmakas ja otsekohene

See on enesekindluse probleem ja see on see, mis hammustab.

Täpsus ja sujuvus läksid lahku ning sujuvus hoidis domineerivat rolli. Õigusteaduse magister (LLM) annab sulle rütmi, õigetes kohtades orienteerumise, võib-olla ka võltsi, aga ilusa tsitaadivormi. Su aju loeb välja „see inimene teab“. Ainult et tegemist pole inimesega ja kalibreerimine on sageli kohutav – suur enesekindlus, keskpärane tõde, esitatud nagu põhiesineja.

Kohmakas vale vastus tekitab kahtlust. Ladus vale vastus paneb kontrollimise lõpetama. See pole väike erinevus; see on kogu lugu ühes veidi ebameeldivas lauses.

Ka eelarvamused on siin sees, mitte alati solvanguna, pigem vaikimisi sellena, kes ruumis viibivad ja milline inglise keele variant loetakse neutraalseks. Inimesi petetakse, sest keel on meie vanim usaldusliides. Kui see räägib nagu lühikokkuvõte, siis me kohtleme seda nagu lühikokkuvõtet. Ma kavatsen selles suhtes olla küünilisem. Siis loen ma läbipaistvat kokkuvõtet ja mu õlad vajuvad alla. Koosolekule astudes tundub kokkuvõte valmis olevat. See lause teeb liiga palju tööd ja ikkagi: nii saabki möödalaskmine tekki.

Usaldusväärsus sõltub olukorrast, mitte kaubamärgist

Brändid on tähelepanu kõrvalejuhtimine. Võrdlemine, mis end ära teenib, ongi töö. Tülid vaidlevad omavahel. See on okei.

Kasutusjuhtum Kuidas see kipub ebaõnnestuma Kui see on "piisavalt hea" Mida inimene ikka tegema peab Miks inimesed lasevad end petta
Koostamine / kokkuvõtete tegemine Eemaldab erandi; uuendab "võib-olla" "kohustuslikuks" Esimese sammu tekst, mida sa juba tead Kontrolli nimesid, numbreid, joont, mis haiget teeks Kõlab nagu sina. Saada.
Otsingulaadsed küsimused ja vastused Udu vastused; peaaegu õnnetuse järelpärimine kirja pandud faktina Orientatsioon, mitte viimane sõna Ava lähtekood või sul on ainult aimdus Sama toon nii taastatud kui ka leiutatud kohta
Koodiabi Väljamõeldud API-d; testid, mis kinnitavad vea olemasolu Standardvorm, liim, "selgita seda viga" Käivita see. Loe erinevust. (Preachy rida, vabandust.) Maja stiil. Rohelise välimusega testid.
Klienditugi Väljamõeldud poliitika; viisakas vale ei Mustandid range poliitika sees Oma raha saatmise ja usalduse eest Kiire ja lahke. Keegi ei auditeeri viiendat sõnumit.
Meditsiiniline/juriidiline nõustamine Sujuv, struktureeritud, katastroofiliselt kindel Peaaegu mitte kunagi tootena Ole professionaal. Modell on tüvi. Kui see kõlab karmilt, siis olgu. Räägib nagu lühidalt.
Hindamine / paremusjärjestus Proksi funktsioonid; triiv; vajunud servaga juhtumid Triaaž, mille te tühistate Saba kohapealne kontroll Numbrid tunduvad täiskasvanulikud. Armatuurlauad tunduvad nagu juhtimine. Iseenesest nad seda ei ole.
Kujutise genereerimine Käed, lisaküünarnukid, stereotüübi jäänused Meeleolutahvlid, ühekordsed võrdlused – mitte tõendid Vaadake kaks korda, mis tähendab mitte ainult esemeid Pretty paneb skeptiku vait
Autonoomsed agendid Enesekindel tööriistakutse; vead, mis süvenevad Kitsad silmused tapmislülitiga Jää konksule. Pane piir kõigele, mida see puudutada saab. Nummerdatud plaan näeb välja nagu pädevus. Tihti on see aga tegevusnimekiri.

Igatahes. Kui su lemmiktööriist on mustanditega osav ja sa tabad end südaööl sellelt juriidilise mugavuse saamiseks küsimas, siis see pole uuendus. See on kaart, mis ütleb, et sa selle maha jätsid.

Hallutsinatsioonid, triiv ja vaikne vale

Hallutsinatsioonid satuvad pealkirjadesse, sest need on vürtsikad: raamat, mida pole olemas, funktsioon, mida kunagi ei saadetud, poliitiline klausel numbriga, mis tundub ametlik.

„Drift” on vähem filmilik. Maailm liigub. Mudeli ülejäägid jäävad alles. Esitad küsimuse, mis vajas värsket konteksti, ja saad eelmisest ilmast hästi organiseeritud vastuse. Ma peaaegu kirjutasin „teisest ajastust”, mis ongi selle teema esilekutsutav liialdus. See pole teine ​​ajastu. See lihtsalt ei ole praegu.

Vaikne vale on see, mis mind rohkem huvitab. Kokkuvõte, mis jätab erandi välja. Parafraas, mis muudab võib-olla kohustuslikuks. Faktilisus võib olla "tehniliselt korras", samal ajal kui tähendus on nihkunud.

Kiire tundlikkus teeb asja hullemaks. Muuda pakendit ja "faktid" hakkavad virvendama. Küsi skeptikuna ja tegutse julgelt. Küsi kiiruga ülemusena ja hakka liialdama. Kui sinu hinnangus kasutatakse ainult ühte kostüümi, on sinu hinnang natuke vale. Vabandust.

Vanglast põgenemised on äärel ja ma ei taha röövifilmi. Kui süsteemi saab veenda oma kombeid muutma, siis usaldusväärsus ei seisne ainult tões; küsimus on selles, kas piirded on silmus või plakat.

Treeningujäägid, vananenud teadmised ja miks maandamine pole võlukepp

Generatiivseid mudeleid treenitakse kuhi peal ja seejärel suunatakse need teie teisipäeva poole. Otsimine on täiskasvanulik katse olevik sellele kuhile kinnitada. Maandamine tähendab "vastake siit, mitte udust". Kui see ebaõnnestub, siis ebaõnnestub see viisakalt.

Klassikaline ebaõnnestumine: otsingumootor hangib peaaegu tabatud dokumendi. Generaator kirjutab selle täieliku rahuga läbi. Sa näed allikakujulist objekti ja sinu kontrolliinstinkt lülitub välja. Mina teen seda. Sina ilmselt teed seda. Viitamise idee on õige; teostus on sama hea kui tabamus.

Teine leke on vananenud teadmised. Mõned ülesanded vajavad reaalajas olekut – hinnad, laoseis, poliitika kehtiv sõnastus. Mõned aga vajavad stabiilset oskust, näiteks kuidas memo struktureerida. Neid segades saad väga kindla vastuse juba muutunud maailma kohta. Jaotuse nihe on täiskasvanute nimetus: reaalajas jaotus ei ole treeningjaotus ja lüngas peituvad ääremaa juhtumid.

Veel üks asi, öeldud valesse kohta sidekriipsuga, sest nii näevad mu märkmed välja: maandus on põrand, mitte halo. Kui sa ei saa leitud tükki uurida, oled ikka veel udus, lihtsalt parema valgustusega.

Hindamisteater: miks demo on kohutav test

Demod on kerged. Võrdlusnäitajad on veidi ausamad ja ikkagi mitte sinu töö.

Puhas ülesanne ja ülesanne, mille mudelil on tuhat sugulast – loomulikult näeb see terav välja. Hindamine, mis mõõdab ainult seda, mõõdab lavastust. Otseülekannetes on sassis kleepmaterjal, puuduvad failid ja kasutaja, kes aktsepteerib esimest vastust, mis vähendab nende ärevust.

Võrdlusnäitajad on olulised. Need lihtsalt ei levi nii hästi, kui kaardipakid väidavad. Edetabeli tulemus ei ole teie piletite kalibreerimine. Ettevõtte mudelirisk seisneb selles, "mis juhtub, kui see on suure hulga vale", mitte "kas see läbis tühiasitest". Vajalikud testid on kuivad: püsige taastatud lõigus; märkige ebakindlust blufi asemel; olge ümbersõnastamisel järjepidev; ebaõnnestuge suletud (keelduge, küsige, lükake edasi) asemel, et ebaõnnestuda avatud (leiutada).

Olen näinud, kuidas inimesed käsitlevad ühte muljetavaldavat rooga tõendina. See on nagu restorani "usaldusväärne" olemise otsustamine ilusa eelroa põhjal. Võib-olla ongi. Võib-olla oli köögis kümme minutit aega.

Väike vastuolu tekib: ma kasutan endiselt demosid, et aimu saada. Ma lihtsalt ei palka aimu.

Kas tehisintellekt on usaldusväärne? Ainult siis, kui keegi on endiselt vigastatud

Inimene-silmus on ainus disain, mis vastab rikkerežiimidele.

Kui keegi ei vastuta, siis süsteemi kasutatakse nii, nagu see oleks. Juhtimine on ebasobiv nimetus sellele, „kes vaatab üle, kes saab selle peatada, mis logitakse, mis juhtub pärast möödalaskmist“. Agentid muudavad selle teravamaks, sest nad võtavad meetmeid, mitte ainult lõike. Mustand, mida sa ei saatnud, on odav. Tööriistakõne, mida sa ei mõelnud, ei ole odav.

Nimeta, kes on süüdi. Kui vastus on "modell", siis sul pole vastust. Modellid ei lähe pärast intsidenti koosolekule. Kas inimene läheb või tolmuimeja ja siis advokaat.

Vali kontrollnimetused, mis vastavad plahvatusraadiusele. Õigekirjakontrolli tasemel arvustus sotsiaalmeedia postitusele. Allikakontroll kõigele, mis väidab fakte. Professionaal kõigele, mis on seotud meditsiini, õiguse, krediidi või ohutuskriitiliste operatsioonidega. Nende jaoks ei ole inimene "ahelas". Inimene on ahelas. Mudel on tüvi. See ei ole skeptitsism isiksusena. See on maitse küsimus.

Praegu on moes peita tšekk läikiva saatmisnupu taha. Tänapäeval automatiseeritakse just nii kogemata kuulujutte. Viimasel ajal olen selles osas kuivem olnud ja töö on paremaks läinud.

Kuidas küsida nii, et sa mööda pandaksid

Saate neid süsteeme uurida ilma, et peaksite päikesevalguse professionaalseks kahtlejaks muutuma.

  • Küsi ebakindlust meelega. „Mis teeks selle valeks?“ on parem kui „tee see enesekindlaks“.

  • Eralda otsing genereerimisest, kui võimalik. Vaata esmalt lõike. Seejärel küsi kirjeldust.

  • Muuda kostüümi. Sõnastage ümber. Palu tal vastupidist väita. Kiire tundlikkus on nagu taskulamp, kui sa seda sel viisil kasutad.

  • Sunnipiirangud: „ainult kleebitud teksti põhjal“, „kui puudub, siis ütle „puudub“. Mudelid on sellele üllatavalt kuulekad... kuni nad enam ei ole. Kontrolli ikkagi.

  • Eelista ülesandeid, millel on kontrollija. Kompilaatorid, linterid, skeemikontrollid, teine ​​​​silm. Usaldusväärsus armastab hindajat.

  • Jälgige, mis eristab midagi: eriline täpsus. Täpne kuju, nimetatud juhtum, korralik nummerdatud lauseosa – just sellega meeldib hallutsinatsioonidele kaunistusi anda.

  • Hoia inimlik samm nähtaval. Kui kasutajaliides peidab kontrolli, siis inimesed jätavad selle vahele. See on mööbel, mitte moraalne viga.

Miski sellest ei tee mudelit "tõeseks". See muudab tsükli vähem kergeusklikuks. Mis, ma arvan, ongi korrutis.

Kuhu kaart sind jätab

Seega. Jah/ei küsimus toimib ainult ukseavana.

Kas tehisintellekt on usaldusväärne? Mitte omadusena. Ülesande, andmestiku, otsingutsükli, hindamise (mis ei ole demo) ja inimese omadusena, kes peab seda ikkagi tõsiselt mõtlema. Sujuv keeleoskus jääb meid petma, sest me oleme keeleloomad ja need süsteemid on keelemasinad. Tööaeg läheb tõega segamini, sest mõlemad tunduvad justkui "see toimis". Kaaspiloodid teenivad oma elatist sassis keskel – mustandid, kokkuvõtted, mida saab sirvida, kood, mida saab kompileerida – ja ebaturvalised, kui usaldame otsustusvõime lõigule, mis sellest ei hooli.

Kasutage neid seal, kus möödalaskmine on odav või tabatav. Aeglustage tempot seal, kus möödalaskmine on kallis. See on otsekohene vastus ja see on väärtuslikum kui loosung.

Kui sa võtad ühe asja: ära küsi mudelilt, kas see on kindel. Vaata, mis juhtub, kui sa küsid, kuidas see võiks olla vale. Seejärel mine kontrolli.

Reaalse maailma näide: liikmelisuse poliitika tehisintellektil põhineva assistendi loomine

Stsenaarium

Priya juhib teadmistebaasi Harbour Membershipi jaoks, mis on 70-liikmeline Ühendkuningriigi sõltumatute spordiklubide kutseorganisatsioon. Liikmete küsimustele vastavad kolm inimest. Tõe allikaks on 180-leheküljeline käsiraamat, mida uuendatakse iga kvartali tagant, ning vanad PDF-failid jagatud draivil, mida kellelgi pole südant kustutada.

Juhtkond on juba ostnud tugiteenuse kaaskasutaja. Demo oli päris kena. Tööaeg on olnud hea. Teisel nädalal ütleb ladus mustand liikmele, et ta võib 14 päeva külmutada ja saada täieliku raha tagasi "tavapäraselt". See pole poliitika. Agent sai sellest aru, sest nad avavad käsiraamatu ikka veel, kui raha on mängus. Juhtkonna küsimus, mis saadeti nii, nagu oleks see jah või ei, on: kas tehisintellekt on usaldusväärne?

Priya keeldub kohtuotsusest. Ta käsitleb seda kui kaarti. Tema ülesanne ei ole "anda liikmetele oraakel". See on "koostada vastus kehtivast käsiraamatust, näidata lõiku ja sulgeda lõik, kui see puudub". Kui kaaspiloot seda teha ei suuda, on tegemist koostamismänguasjaga, mitte poliitikalauaga.

Mida assistent vajab

  • Aprilli 2026 käsiraamat on ainus lubatud korpus, mille paragrahvide numbrid on muutmata

  • Vana 2023. aasta PDF-fail jäeti meelega draivi, et näha, kas otsing aitab leida peaaegu tabatud vea

  • Kirjalik reegel: klientide isikuandmeid ei tohi tarbijatööriistades kasutada; ilma inimese abita ei tohi saata; numbrite, akende ega standardklauslite väljamõtlemine ei ole lubatud

  • Luba logida päringuid, hangitud tükke ja lõplikku saatmist

  • Nimetatud omanik (Priya), kes hindab testikomplekti ja peatab kaaspiloodi, kui see ebaõnnestub, lõpetas rahaküsimustes halvemini kui mündiviske

  • Kui tööriist toetab väljavõtmist, peab väljavõetud tükk olema mustandi kõrval nähtav. Kui see seda ei ole, kleebitakse see lõik käsitsi sisse. Maandus ilma kontrollitava läbipääsuta on ikkagi udu.

Näidisjuhis

Priya ütleb seda tavakeeles, mitte näidendiülesandes:

Vasta ainult sulle antud 2026. aasta aprilli käsiraamatu lõikudest. Tsiteeri jaotise numbrit. Kui vastust nendes lõikudes pole, ütle "pole praeguses käsiraamatus" ja lõpeta. Ära mõtle välja külmutamise aknaid, tagasimakse reegleid ega tasusid. Ära uuenda "jõusaali äranägemisel" versiooniks "standardne". Kui kaks lõiku on vastuolus, näita mõlemat ja ütle, kumb on ajakohane. Sa kirjutad inimesele, kes avab lähtekoodi enne, kui midagi liikmele edastatakse.

Seejärel hoiab ta teise juhise endale, sest artikli mõte on tsükkel, mitte mudel:

Enne saatmist ava viidatud lõik. Küsi endalt: „Mis teeb selle valeks?“. Kui mustand sisaldab numbrit, mida tekstis pole, lükka see tagasi. Kui küsisin nagu kiirustav ülemus, küsi uuesti nagu skeptik ja võrdle.

Hea mustand näeb välja selline: „Käesolevas käsiraamatus (aprill 2026, punkt 4.2) seda pole. Külmutamine toimub spordiklubi äranägemisel. Tagasimaksed ei ole automaatsed. Eskaleerige otsus.“ Halb mustand näeb välja selline: „Liikmed võivad külmutada 14 päevaks ja saada tavapäraselt täieliku tagasimakse. Käsiraamatus kinnitatud.“ Sama toon. Ainult üks neist on poliitika.

Kuidas seda testida

Priya kirjutab enne kaaspiloodi tulemuste vaatamist 20 küsimust. See järjekord on oluline. Demo on kiire. See on kuiv test.

See komplekt ei ole viktoriin. See on otseülekanne:

  • Kaheksa küsimust, mille vastused asuvad ühes praeguses jaotises (lihtsad)

  • Neli peaaegu õnnetust, mille puhul 2023. aasta PDF-i sõnastus on aprilli tekstile lähemal

  • Kolm käsiraamatust välja jäetud küsimust (arveldusvaidlused, meditsiiniga seotud küsimus "kas see koolitus on ohutu", juriidilise poolega seotud lepingumuudatus)

  • Kolm rahalist küsimust (konto külmutamine, raha tagastamine, liitumistasu)

  • Kaks tavaliikme küsimust (lahtiolekuajad, treenerikindlustus)

Kahele neist kahekümnest esitati uuesti teine ​​kostüüm – üks kord kiirustava ülemuse ja üks kord skeptiku rollis –, et kontrollida vastuse tundlikkust. Need uuesti esitatud küsimused logiti, mitte ei lisatud 20-punktilisse skoori.

Priya poolt avatud käsiraamatuga hinnatud rubriik: läbimiseks on vaja õiget kehtivat reeglit, tegelikku paragrahvi numbrit ja mitte ühtegi täiendavat väljamõeldud klauslit. Vaikne läbikukkumine on tehniliselt korras lause, mis jätab erandi välja või muudab „võib-olla” kohustuslikuks. Avatud läbikukkumine on väljamõeldud number või peaaegu läbikukkunud PDF, mida käsitletakse kehtivana. Tööaega arvestatakse eraldi, sest „see vastas” ei ole „nii oli”.

Edasi liikumise aktsepteerimine: rahaküsimuste korral parem sulgeda ebaõnnestunud taotlus, mitte avada see ebaõnnestunud taotlus. Kui kaaspiloot leiutab tagasimakseakna, siis ta reaalajas taotlusi ei koosta. Kui keegi allikat ei ava, siis ta samuti reaalajas taotlusi ei koosta.

Tulemus

Illustreeriv tulemus, mis on saadud väljamõeldud 20 küsimusega testist, mitte avaldatud sadama liikmeskonna näitaja.

Eeldused: üks abikeskuse kaasprojekt; 2026. aasta aprilli käsiraamat pluss ülejäänud 2023. aasta PDF-fail; Priya hindas ülaltoodud rubriigi alusel; ajamõõtmiseks kasutati telefoni stopperit küsimusest kleebitud küsimuseni "Ma saadaksin selle"; ülevaatamise aeg on tsüklilises tingimuses meelega kaasas ja märkimata tingimuses mitte, et võrdlus jääks võrdseks.

Kontrollimata kaaspiloot, demostiilis ülesanne: 20 küsimusele 20-st vastati ladusalt (tööaeg tundus ideaalne). 20-st vastasid 11 küsimusele. Viis olid vaiksed ebaõnnestumised. Neli olid avatud ebaõnnestumised, sealhulgas 14-päevane külmutamine. Kaks neljast avatud ebaõnnestumisest viitasid 2023. aasta PDF-failist pärit allikakujulisele tükile. Saatmiseks sobiva välimusega mustandi mediaanaeg oli 1 minut.

Samad 20 küsimust, piiratud juhised, alla laaditud osa nähtav: aprillikuu tekstist 15 20-st olid täiesti õiged. Kolmes oli õigesti märgitud, et "pole praeguses käsiraamatus" (meditsiiniliselt ja juriidiliselt seotud küsimused, lisaks üks arveldusvaidlus), seega 18 20-st olid vastuvõetavad. Kaks ikkagi ebaõnnestusid: üks kirjutas läbi 2023. aasta peaaegu õnnetuse PDF-faili ja üks mõtles välja liitumistasu summa, mida lõigus polnud. Keskmine mustandi kirjutamise aeg oli endiselt umbes 1 minut.

Samad 20, pluss Priya avas tsiteeritud osa enne simuleeritud saatmist: 20-st oleks olnud vastuvõetav 19. Ta märkas peaaegu möödalasknud PDF-i. Ülejäänud möödalaskmine oli see, et retsensent libistas sujuva lõigu üle ja ei pannud tähele väljamõeldud liitumistasu. Keskmine aeg koos arvustusega oli 3 minutit.

Vana protsess, ainult käsiraamatu otsing, kaaspiloodita: 20/20 vastuvõetav. Mediaan 9 minutit.

Selle valimi lõikes oli tsüklitega kaaspiloot 6 minutit kiirem kui käsiraamatu jaht (9 miinus 3) ehk 20 küsimuse peale 120 minutit, kusjuures 20-st oli vastuvõetav 19, mitte 20 20-st. Kontrollimata kaaspiloot oli 8 minutit kiirem (9 miinus 1) ja eksis, vaikselt või valjult, 9-s 20-st. See ei ole 67% ajakokkuhoid, mille oleksite roolisüsteemi paigaldanud. See on 9 möödalaskmise leke, mille oleksite automatiseerinud.

Mõlema korduva küsimuse kiirustava ülemuse versioonid olid liialdatud. Skeptilised versioonid aga hoidusid eemale. Sama mudel, sama käsiraamat, erinev kostüüm. Priya pani selle kirja leiu, mitte isiksuseomadusena.

Need arvud on näidishinnang, mis põhineb nimetatud testil, väikesel komplektil, vihase liikme omast lihtsamatel vastustel ja ühel arvustajal, kes juba raamatut tundis. Need ei näita, et kaaspiloot on "95% usaldusväärne" või et Harbour peaks ühe lauateenindaja koondamise tegema. Need näitavad, et tööaeg ei olnud küsimus, vaid kontroll oli.

Mis võib valesti minna

  • Juhtkond tsiteerib üheminutilist draftiaega ja jätab 9 möödalasku vahele. Kiirus tundub kell 16.00 ikka veel pädevusena.

  • 2023. aasta PDF jääb indeksisse. Otsing toob selle ikka ja jälle esile. "Maandumine" näeb välja nagu täiskasvanulik ja on ikka veel peaaegu tabamatu.

  • Kasutajaliides peidab allalaaditud osa läikiva saatmisnupu taha. Inimesed lõpetavad käsiraamatu avamise ja nii jõuab külmutatud vastus liikmeni.

  • Priya hindab ainult kaheksat lihtsat küsimust, sest need näevad slaidil paremad välja. Hindamisteater, ainult arvutustabeliga.

  • Meditsiiniliselt kõrvalolev vastus küsimusele „kas see treening on ohutu?” võib tunduda ülesandena. Kaardil oli öeldud, et peaaegu mitte kunagi. Toon ütles, et lase käia.

  • Logid on välja lülitatud, sest "see tundus lisavõimalusena". Pärast möödalaskmist ei näe keegi, milline lõik leiti.

  • Nad küsivad modellilt, kas see on kindel. On küll. See polnudki kunagi test.

Praktiline kaasavõetav toit

Usaldusväärsus ei ole Harbouri ostetud kaaspiloodi omadus. See on 20 küsimuse, ajakohase käsiraamatu, nähtava lõigu ja inimese omadus, kes avab lähtekoodi ka siis, kui raha on mängus. Sujuvus läbib pidevalt tööaja testi. Tsükkel on ainus asi, mis läbib poliitika testi.

KKK

Mida üldse tähendab usaldusväärsus generatiivse tehisintellekti jaoks?

Igapäevane töökindlus tähendab, et saate millelegi toetuda. Rääkiva automatiseerimisega peitub terve hulk omadusi ühe sõna alla: faktilisus, järjepidevus, kalibreerimine, ohutus, tööaeg, kiire tundlikkus, servajuhtumid ja käitumine pärast jaotusvahetust. Ükski neist ei vea koos alt. Reaalajas test on usaldusväärne mille, kelle jaoks ja millise tsükliga ümber selle. Vastasel juhul hindate blenderit selle järgi, kas see suudab makse teha.

Kas tehisintellekt on usaldusväärne?

Mitte omadusena. Õigusteaduste magister võib ühel töökohal olla kaljukindel ja järgmisel vaikselt rivist väljas olla, mõnikord samal istudes, mõnikord koma liigutamise tõttu. Usaldusväärsus on ülesande, andmestiku, otsingutsükli, hindamise (mis ei ole demo) ja inimese, kes peab ikkagi oma mõtteid tõsiselt võtma, omadus. Kasutage seda seal, kus möödalaskmine on odav või tabatav. Aeglustage tempot seal, kus möödalaskmine on kallis.

Kas tehisintellekti tööaeg on sama mis tõesus?

Ei. Tööaeg sõltub sellest, kas lõpp-punkt vastas. Tõesus seisneb selles, kas vastus oli jaatav. Sul võib olla teenus, mis ei pilguta kunagi silmagi, ja ikkagi saata kliendipiletisse ladus vale. Kiirus tundub pädevusena, kui järjekord on koletis. Ohutus on veel üks telg: mudel, mis keeldub jailbreakist, võib ikkagi sinu enda märkmete kokkuvõtte moonutada.

Miks tundub ladus tehisintellekt usaldusväärne isegi siis, kui see eksib?

Täpsus ja soravus läksid lahku ning soravus hoidis domineerivat rolli. Õigusteaduse magister (LLM) annab sulle rütmi, enesekindlust, võib-olla võltsi, aga ilusa tsitaadivormi ja su aju loeb välja: „see inimene teab“. Kalibreerimine on sageli kohutav: suur enesekindlus, keskpärane tõde, esitatud nagu põhiettekanne. Kohmakas vale vastus tekitab sinus kahtlust. Sorav vale vastus paneb sind kontrollimise lõpetama. Kui see kõlab nagu lühikokkuvõte, siis me käsitleme seda nagu lühikokkuvõtet ja nii saabki möödalaskmine kaalukaussi.

Kas tehisintellekt on usaldusväärne meditsiinilise, juriidilise või klienditoe töö jaoks?

See sõltub tööst, mitte brändist. Meditsiiniline ja juriidiline nõuanne pole peaaegu kunagi piisavalt hea toode: mudel on tüvi ja inimene on professionaal. Klienditugi saab koostada range poliitika raames mustandi, kuid inimene peaks vastutama raha saatmise ja usalduse eest, sest väljamõeldud poliitika ja viisakas vale eitav vastus on tavaliselt läbikukkumised. Mustandid ja kokkuvõtted on esmane tekst, mida sa juba tead. Kontrolli nimesid, numbreid ja rida, mis võiks haiget teha.

Miks tehisintellekt hallutsineerib, triivib või vaikselt eksib?

Hallutsinatsioon on vürtsikas möödalask: raamat, mida pole olemas, funktsioon, mida kunagi ei saadetud, poliisklausel numbriga, mis tundub ametlik. Drift on vähem filmilik: maailm liigub, mudeli ülejäägid jäävad alles ja sa saad eelmisest ilmast hästi organiseeritud vastuse. Vaikne vale on kokkuvõte, mis jätab erandi kõrvale. Või parafraas, mis muudab võib-olla kohustuslikuks. Faktilisus võib tunduda tehniliselt hea, samas kui tähendus on nihkunud. Kiire tundlikkus paneb faktid virvendama, kui pakendit muuta.

Kas maandamine või taastamine muudab tehisintellekti usaldusväärseks?

Maandus tähendab vastust siit, mitte udust. Väljatoomine kinnitab oleviku treenitud hunniku külge. Kui see ebaõnnestub, siis ebaõnnestub see viisakalt: peaaegu õnnestunud dokument, kirjutatud kirjutis ja teie kontrolliinstinkt lülitab kella välja. Maandus on põrand, mitte halo. Kui te ei saa välja otsitud tükki kontrollida, olete ikka veel udus, lihtsalt parema valgustusega. Kombineerige reaalajas toiminguid, nagu hinnad või poliitika sõnastus, stabiilse oskusteabega ja saate väga kindla vastuse maailma kohta, mis on juba muutunud.

Miks on demo tehisintellekti usaldusväärsuse halb test?

Puhas ülesanne ja ülesanne, mille mudelil on tuhandeid sugulasi, näevad teravad välja. Reaalajas töövoogudes on sassis kleep, puuduvad failid ja kasutaja, kes aktsepteerib esimese vastuse, mis vähendab nende ärevust. Edetabeli tulemus ei ole teie piletite kalibreerimine. Mudeli risk on see, mis juhtub siis, kui see on suure hulga vale, mitte see, kas see läbis viktoriinide komplekti. Vajalikud testid on kuivad: püsige hangitud lõigus, märkige ebakindlust blufi asemel, olge ümbersõnastamisel järjepidev ja ebaõnnestuge suletud, mitte leiutage.

Kas tehisintellekt on usaldusväärne, kui keegi pole süüdi?

Ei. Kui keegi ei vastuta, kasutatakse süsteemi nii, nagu see oleks. Inimene kaasatud on ainus disain, mis vastab rikkerežiimidele: kes vaatab üle, kes saab selle peatada, mis logitakse, mis juhtub pärast möödalaskmist. Kui vastus on "mudel", siis pole teil vastust. Mudelid ei lähe pärast intsidenti koosolekule. Meditsiini, õiguse, krediidi või ohutuskriitiliste operatsioonide puhul on inimene silmus ja mudel on tüvi.

Kuidas ma saan tehisintellekti suunata, et ma vigu märkaksin?

Küsi ebakindluse kohta meelega: „Mis teeks selle valeks?“ on parem kui „tee see enesekindlaks“. Eralda otsing genereerimisest, kui võimalik. Vaata esmalt lõike ja seejärel küsi kirjeldust. Muuda kostüümi: sõnasta ümber või palu tal vastupidist väita. Sunni piiranguid, näiteks „ainult kleebitud tekstist“ või „kui puudub, siis ütle, et puudub“, ja kontrolli ikkagi. Eelista ülesandeid, millel on kontrollija, ja jälgi erilist täpsust, sest just seda eelistab hallutsinatsioon esile tuua.

Viited

  1. NIST - nvlpubs.nist.gov

  2. NIST - airc.nist.gov

  3. NIST - airc.nist.gov

  4. ICO - ico.org.uk

  5. NCSC - www.ncsc.gov.uk

  6. NCSC - www.ncsc.gov.uk

  7. OWASP - genai.owasp.org

Leia uusim tehisintellekt ametlikust tehisintellekti abilise poest

Meist

Viktoriin
1. Kas tehisintellekt on artikli kohaselt usaldusväärne omadus?

2. Mis vahe on tööajal ja tõesusel?

3. Miks on ladus vale vastus ohtlikum kui kohmakas?

4. Mis juhtus kontrollimata kaaspiloodiga illustratiivses sadamaliikmelisuse 20 küsimusega testis?

5. Mis on artikli kohaselt maandus ilma kontrollitava ja kättesaamatu tükita?


Tagasi blogisse