Sveiki, žmonės, sveiki atvykę į įprastą „TechCrunch“ AI informacinį biuletenį. Jei norite, kad tai būtų jūsų pašto dėžutėje kiekvieną trečiadienį, užsiregistruokite čia.
Rinkimų dieną buvo neįtikėtinai lengva sukurti įtikinamą Kamala Harris garso padirbinį. Tai man kainavo 5 dolerius ir užtruko mažiau nei dvi minutes, o tai iliustruoja, kaip pigus, visur paplitęs generatyvus AI atvėrė užtvanką dezinformacijai.
Sukurti Harriso gilią klastotę nebuvo mano pirminis tikslas. Aš žaidžiau su Cartesia's Voice Changer – modeliu, kuris jūsų balsą paverčia kitu balsu, išsaugant originalo prozodiją. Tas antrasis balsas gali būti kito žmogaus „klonas“ – Cartesia sukurs skaitmeninį dvigubą balsą iš bet kurio 10 sekundžių įrašo.
Taigi, pagalvojau, ar „Voice Changer“ pakeis mano balsą į Hariso balsą? Sumokėjau 5 USD, kad atrakinčiau Cartesia balso klonavimo funkciją, sukūriau Harriso balso kloną naudodamas naujausias kampanijos kalbas ir pasirinkau tą kloną kaip išvestį „Voice Changer“.
Tai veikė kaip žavesys:
Esu įsitikinęs, kad Cartesia neketino naudoti jos įrankių tokiu būdu. Kad įgalintų balso klonavimą, Cartesia reikalauja, kad pažymėtumėte laukelį, nurodantį, kad negeneruosite nieko žalingo ar neteisėto ir kad sutinkate, kad jūsų kalbos įrašai būtų klonuojami.
Bet tai tik garbės sistema. Neturint jokių realių apsaugos priemonių, niekas netrukdo asmeniui sukurti tiek „žalingų ar nelegalių“ padirbinių, kiek jis nori.
Tai yra problema, savaime suprantama. Taigi koks sprendimas? Ar yra vienas? Cartesia gali įdiegti balso patvirtinimą, kaip tai padarė kai kurios kitos platformos. Tačiau kol tai padarys, tikėtina, kad atsiras naujas nevaržomas balso klonavimo įrankis.
Apie šią problemą kalbėjausi su ekspertais praėjusią savaitę vykusioje TC Disrupt konferencijoje. Kai kurie palaikė nematomų vandens ženklų idėją, kad būtų lengviau nustatyti, ar turinys buvo sukurtas dirbtinio intelekto pagalba. Kiti atkreipė dėmesį į turinio moderavimo įstatymus, tokius kaip Saugos internete įstatymas JK, kurie, jų nuomone, gali padėti sustabdyti dezinformacijos bangą.
Vadinkite mane pesimistu, bet manau, kad tie laivai išplaukė. Kaip sakė Kovos su skaitmenine neapykanta centro generalinis direktorius Imranas Ahmedas, mes žiūrime į „amžiną bulių mašiną“.
Dezinformacija plinta nerimą keliančiu greičiu. Kai kurie garsūs praėjusių metų pavyzdžiai: X robotų tinklas, skirtas JAV federaliniams rinkimams, ir prezidento Joe Bideno balso pašto klastotė, atgrasanti Naujojo Hampšyro gyventojus nuo balsavimo. Tačiau, remiantis True Media.org analize, JAV rinkėjai ir techniką išmanantys žmonės nėra daugumos šio turinio taikiniai, todėl esame linkę nuvertinti jo buvimą kitur.
Pasaulio ekonomikos forumo duomenimis, 2019–2020 m. dirbtinio intelekto sukurtų giliųjų klastotės skaičius išaugo 900 proc.
Tuo tarpu knygose yra palyginti nedaug įstatymų, taikomų giliai klastojimui. O gilus klastočių aptikimas gali tapti nesibaigiančiomis ginklavimosi varžybomis. Kai kurie įrankiai neišvengiamai nepasirinks naudoti saugos priemonių, pvz., vandens ženklų, arba bus diegiami turint omenyje ypač kenkėjiškas programas.
Neatsižvelgiant į pokyčius, manau, geriausia, ką galime padaryti, tai labai skeptiškai žiūrėti į tai, kas ten yra, ypač į virusinį turinį. Atskirti tiesą iš grožinės literatūros internete nėra taip paprasta, kaip kadaise. Tačiau mes vis tiek kontroliuojame, kuo dalijamės, o ne tuo, kuo ne. Ir tai daro daug didesnį poveikį, nei gali atrodyti.
Naujienos
„ChatGPT“ paieškos apžvalga: Mano kolega Maksas pasinaudojo nauja OpenAI paieškos integracija, skirta ChatGPT, ChatGPT Search. Jis nustatė, kad kai kuriais atžvilgiais tai įspūdinga, bet nepatikima trumpoms užklausoms, kuriose yra vos keli žodžiai.
„Amazon“ dronai Finikse: Praėjus keliems mėnesiams po bepiločių orlaivių pristatymo programos „Prime Air“ Kalifornijoje pabaigos, „Amazon“ teigia, kad ji pradėjo pristatyti atrinktiems klientams per droną Finikso mieste, Arizonoje.
Buvęs „Meta AR“ lyderis prisijungia prie „OpenAI“: Buvusi Meta AR akinių vadovybė, įskaitant „Orion“, pirmadienį paskelbė prisijungianti prie „OpenAI“, kad vadovautų robotų ir vartotojų aparatūros gamybai. Naujienos pasirodė po to, kai OpenAI pasamdė X (buvusio Twitter) varžovo Pebble įkūrėją.
Sulaikytas skaičiavimais: „Reddit AMA“ „OpenAI“ generalinis direktorius Samas Altmanas pripažino, kad skaičiavimo pajėgumų trūkumas yra vienas iš pagrindinių veiksnių, neleidžiančių įmonei tiekti produktų taip dažnai, kaip norėtųsi.
AI sukurtos santraukos: „Amazon“ išleido „X-Ray Recaps“ – generuojančią dirbtinio intelekto funkciją, kuri sukuria glaustas ištisų TV sezonų, atskirų epizodų ir net epizodų dalių santraukas.
Antropinių žygių Haiku kainos: Atkeliavo naujausias Anthropic AI modelis: Claude 3.5 Haiku. Tačiau jis yra brangesnis nei paskutinė karta ir, skirtingai nei kiti Anthropic modeliai, kol kas negali analizuoti vaizdų, grafikų ar diagramų.
„Apple“ įsigijo „Pixelmator“: Dirbtinio intelekto varomas vaizdo redaktorius „Pixelmator“ penktadienį paskelbė, kad jį perka „Apple“. Sandoris pasiektas, kai „Apple“ pradėjo agresyviau integruoti AI į savo vaizdo gavimo programas.
„Agentė“ Alexa: „Amazon“ generalinis direktorius Andy Jassy praėjusią savaitę užsiminė apie patobulintą „agentinę“ bendrovės „Alexa“ asistento versiją, kuri galėtų imtis veiksmų vartotojo vardu. Pranešama, kad atnaujinta „Alexa“ susidūrė su vėlavimais ir techninėmis nesėkmėmis ir gali būti paleista tik 2025 m.
Savaitės mokslinis darbas
Iššokantieji langai žiniatinklyje taip pat gali apgauti AI – ne tik senelius.
Naujame dokumente Georgia Tech, Honkongo universiteto ir Stenfordo tyrėjai rodo, kad dirbtinio intelekto „agentai“ – dirbtinio intelekto modeliai, galintys atlikti užduotis – gali būti užgrobti „priešingų iššokančiųjų langų“, kurie nurodo modeliams daryti tokius dalykus kaip. Atsisiųskite kenkėjiškų failų plėtinius.
Kai kurie iš šių iššokančiųjų langų yra gana akivaizdūs žmogaus akies spąstai, tačiau AI nėra toks įžvalgus. Tyrėjai teigia, kad vaizdų ir teksto analizės modeliai, kuriuos jie išbandė, 86% atvejų nepastebėjo iššokančiųjų langų, todėl buvo 47% mažesnė tikimybė atlikti užduotis.
Pagrindinės apsaugos priemonės, pavyzdžiui, nurodymas modeliams nepaisyti iššokančiųjų langų, nebuvo veiksmingos. „Diegiant kompiuterius naudojančius agentus vis dar kyla didelė rizika“, – rašė tyrimo bendraautoriai, – ir reikia tvirtesnių agentų sistemų, kad būtų užtikrinta saugi agentų darbo eiga.
Savaitės modelis
Vakar „Meta“ paskelbė, kad bendradarbiauja su partneriais, kad „Llama“ „atviri“ AI modeliai būtų prieinami gynybos programoms. Šiandien vienas iš tų partnerių „Scale AI“ paskelbė apie „Defense Llama“ – modelį, sukurtą ant „Meta's Llama 3“, kuris yra „pritaikytas ir sureguliuotas taip, kad padėtų Amerikos nacionalinio saugumo misijoms“.
„Defense Llama“, kuri yra prieinama „Scale“ pokalbių roboto platformoje „Donavan“, skirta JAV vyriausybės klientams, buvo optimizuota planuoti karines ir žvalgybos operacijas, teigia Scale. Gynybos lama gali atsakyti į su gynyba susijusius klausimus, pavyzdžiui, kaip priešininkas gali planuoti ataką prieš JAV karinę bazę.
Taigi kuo gynybos lama skiriasi nuo atsarginių lamų? Na, Scale teigia, kad buvo patobulintas turinys, kuris gali būti svarbus karinėms operacijoms, pvz., karinė doktrina ir tarptautinė humanitarinė teisė, taip pat įvairių ginklų ir gynybos sistemų pajėgumai. Jai taip pat nėra ribojama atsakyti į klausimus apie karą, pavyzdžiui, civilinis pokalbių robotas:

Vis dėlto neaišku, kas būtų linkęs juo naudotis.
JAV kariuomenė lėtai pritaikė generatyvųjį AI ir skeptiškai vertina jos IG. Kol kas JAV armija yra vienintelė JAV ginkluotųjų pajėgų atšaka, turinti generatyvų AI dislokavimą. Kariniai pareigūnai išreiškė susirūpinimą dėl komercinių modelių saugumo spragų, taip pat dėl teisinių iššūkių, susijusių su dalijimusi žvalgybos duomenimis, ir modelių nenuspėjamumu susidūrus su sudėtingesniais atvejais.
Paimk krepšį
„Spawning AI“, startuolis, kuriantis įrankius, leidžiančius kūrėjams atsisakyti generatyvaus AI mokymo, išleido vaizdų duomenų rinkinį, skirtą AI modelių mokymui, kuris, jos teigimu, yra visiškai vieša.
Dauguma generuojamųjų AI modelių yra mokomi naudojant viešuosius žiniatinklio duomenis, kai kurie iš jų gali būti saugomi autorių teisių arba pagal ribojančią licenciją. OpenAI ir daugelis kitų AI pardavėjų teigia, kad sąžiningo naudojimo doktrina apsaugo juos nuo pretenzijų dėl autorių teisių. Tačiau tai nesutrukdė duomenų savininkams pateikti ieškinių.
„Spawning AI“ teigia, kad jo mokymo duomenų rinkinys, sudarytas iš 12,4 mln. vaizdų ir antraščių porų, apima tik turinį, kurio kilmė „žinoma“ ir „pažymėta aiškiomis, nedviprasmiškomis teisėmis“, skirta AI mokymui. Skirtingai nuo kai kurių kitų duomenų rinkinių, jį taip pat galima atsisiųsti iš tam skirtos prieglobos, todėl nereikia kaupti žiniatinklyje.
„Svarbu, kad duomenų rinkinio viešojo domeno būsena yra neatsiejama nuo šių didesnių tikslų“, – tinklaraščio įraše rašo Spawning. „Duomenų rinkiniai, kuriuose yra autorių teisių saugomų vaizdų, ir toliau priklausys nuo žiniatinklio duomenų rinkimo, nes vaizdų talpinimas pažeistų autorių teises.
Spawning duomenų rinkinį PD12M ir „estetiškai patraukliems“ vaizdams sukurtą versiją PD3M rasite šioje nuorodoje.


