„Meta“, „Microsoft“, „Nvidia“, IBM ir kiti palaiko atvirojo svorio AI


Dvi dešimtys įmonių ir organizacijų pasirašė atvirą laišką, raginantį JAV politikos formuotojus apsaugoti atviro svorio AI modelius.

Šiandien paskelbtame laiške (PDF) yra parašai iš sąrašo, apimančio tiesioginius komercinius konkurentus ir organizacijas, kurių verslo modelis mažai sutampa: Meta, Microsoft, Nvidia, IBM, Dell Technologies, CrowdStrike, Palantir, ServiceNow, Hugging Face, Perplexity, Mistral, Andreessen Horowitz, Y Combinator ir kiti.

Laiško argumentai yra skirti palyginimui tarp 1980-ųjų atvirojo kodo programinės įrangos judėjimo ir dabartinės kovos dėl to, ar AI modelių svoriai turėtų cirkuliuoti laisvai, ar likti užrakinti už komercinių API.

Atviri modeliai yra dirbtinio intelekto sistemos, kuriose išmokyti parametrai skelbiami, kad kiekvienas galėtų atsisiųsti, patikrinti, modifikuoti ir paleisti savo aparatūrą. Tai skiriasi nuo uždarų modelių, pvz., „OpenAI“ arba „Anthropic“ siūlomų paribių produktų, naudojant tik API prieigą, kur pagrindiniai svoriai niekada nepalieka pardavėjo infrastruktūros.

Pasirašiusieji įvardija atvirus svorius kaip mechanizmą, kuriuo dirbtinio intelekto galimybės plinta už kelių gerai kapitalizuotų laboratorijų į tai, kas laiške vadinama „gamyklų, ligoninių, fermų, klasių ir pagrindinių gatvių įmonių darbo eiga“.

Jų argumentai vyksta trimis kryptimis:

  1. Atviri svareliai sumažinti įėjimo kainą pradedančiosioms įmonėms ir viešosioms institucijoms, kurios negali sau leisti apmokyti pažangių modelių nuo nulio arba mokėti už simbolinius mokesčius ribinėmis kainomis už įprastas užduotis.
  2. Jie padidinti konkurenciją visame kame, nuo lustų iki debesų infrastruktūros iki programų, o tai, kaip teigiama laiške, sumažina išlaidas ir neleidžia mažam teikėjų skaičiui užfiksuoti vertę.
  3. Atviri svoriai taip pat suteikia galimybę verslo klientams kad išvengtumėte pardavėjo blokavimones organizacijos, naudojančios atvirojo svorio modelius, kontroliuoja savo duomenis ir gali pritaikyti modelį prie vidinių reikalavimų, neatsižvelgdamos nuo vieno tiekėjo veiksmų plano ar kainų sprendimų.

Saugumo argumentas prieštarauja instinktams

Smulkiausioje laiško dalyje tiesiogiai kalbama apie rizikos atvejį, todėl verta atidžiai perskaityti, nes ji apverčia įprastą atvirų modelių ir saugumo rėmelį.

Kai svoriai bus išleisti, laiške pripažįstama, kad pradinis kūrėjas jų nekontroliuoja. Modifikuotas versijas sunku atsekti arba pakeisti. Tiksliai sureguliuota arba pašalinta atviro modelio versija gali cirkuliuoti pašalinus apsauginius turėklus ir nėra atšaukimo mechanizmo.

Signatarai tvirtina, kad atsakymas nėra draudimas. Jų atvejis grindžiamas palyginimu su kibernetiniu saugumu: gynėjams, susidūrusiems su AI aprūpintais užpuolikais, reikia prieigos prie modelių, turinčių panašią galimybę aptikti ir imituoti grėsmes, o tai nėra lengva užtikrinti uždarose, turinčiose leidimų sistemose.

Jie tai išplečia į platesnį saugumo teiginį, teigdami, kad uždari modeliai nėra savaime saugesni, nes jie gali būti pažeisti, netinkamai naudojami arba sugesti taip, kad išoriniai tyrinėtojai negali stebėti ar patikrinti. Sutelkus pažangias galimybes už nedidelį uždarų paslaugų teikėjų skaičių, šiuo atveju sukuriami pavieniai gedimo taškai, o ne juos pašalinama.

Atviri modeliai, priešingai, leidžia išoriniams tyrėjams ištirti elgesį, vykdyti raudonųjų komandų pratimus ir nustatyti daugelio komandų pažeidžiamumą, o ne pasikliauti vieno pardavėjo vidiniais testais.

Laiške nubrėžta tiesioginė paralelė su argumentu „atvirasis kodas yra saugesnis už neaiškumą“, kuris formavo dešimtmečius trukusias diskusijas dėl programinės įrangos saugumo, nors jame neminimi konkretūs pažeidžiamumo atradimo duomenys ar incidentų skaičiai, patvirtinantys teiginį, taikomą konkrečiai AI sistemoms.

Distiliavimas įgauna specifinę apsaugą

Laiškas suteikia vietos vienai technologijai, kuri tapo ginčytina AI sluoksniuose: distiliavimui, kai vieno modelio rezultatai pripratinami treniruojant arba tobulinant antrąjį modelį. Tai yra standartinė mašininio mokymosi tyrimų ir produktų kūrimo praktika, naudojama vertinimui, patvirtinimui ir gebėjimų perkėlimui tarp skirtingų dydžių modelių.

Pasirašiusios šalys nubrėžia ribą tarp distiliavimo kaip teisėtos technikos ir to, ką jie vadina „neteisėtomis pastangomis išgauti vertę iš uždarų modelių“, teigdami, kad pirmasis neturėtų būti apimtas antriesiems skirtų apribojimų.

Tai skaitoma kaip tiesioginis atsakas į ginčus, kurie įsiplieskė po Kinijos modelių, tokių kaip „DeepSeek“ ir „Kimi“, išpopuliarėjimo, kai kelios JAV laboratorijos teigė, kad konkurentų modeliai buvo apmokyti distiliuojant produkciją iš savo uždarų sistemų be leidimo.

Laiško pozicija: adreso pasisavinimas naudojant tikslinius teisinius ir komercinius mechanizmus, o ne bendri apribojimai technikos, nuo kurios priklauso visa sritis.

Ką tai rodo būsimai politinei kovai

Laiškas gaunamas be konkretaus pasiūlymo dėl teisės akto ar reguliavimo. Tai pozicionavimo dokumentas prieš numatytus veiksmus dėl AI politikos Vašingtone, raginantis įstatymų leidėjus išplėsti pradedančiųjų įmonių ir tyrėjų prieigą prie skaičiavimo, finansuoti bendrus mokymo duomenų rinkinius ir vertinimo sistemas ir vengti atvirų modelių „priešlaikinių apribojimų“.

Tai turėtų būti traktuojama mažiau kaip nustatytas politikos rezultatas, o labiau kaip rodiklis, nurodantis, kur pagrindiniai infrastruktūros ir lustų tiekėjai nori, kad pokalbis dėl reguliavimo nusileistų. Tokie žaidėjai kaip „Nvidia“, IBM ir „Dell“ turi tiesioginių komercinių priežasčių, kodėl nori, kad atviros ekosistemos klestėtų, nes platesnis diegiamų modelių asortimentas parduoda daugiau skaičiavimo ir paslaugų, neatsižvelgiant į tai, kuri laboratorija pagamino svorius.

Viešųjų pirkimų grupės, sveriančios atvirojo ir uždarojo modelio diegimus, turėtų atsižvelgti į tai, kad politikos aplinka, palankesnė vienam požiūriui, o ne kitam, lieka neišspręsta, o bet kokie distiliavimo arba atviro išleidimo apribojimai gali pakeisti savarankiško dirbtinio intelekto ekonomiką per vieną teisėkūros ciklą.

Taip pat žiūrėkite: „OpenAI“ perkelia „ChatGPT“ į paciento sveikatos įrašus

Norite daugiau sužinoti apie AI ir didelius duomenis iš pramonės lyderių? Peržiūrėkite „AI & Big Data Expo“, vykstančią Amsterdame, Kalifornijoje ir Londone. Išsamus renginys yra „TechEx“ dalis ir vyksta kartu su kitais pagrindiniais technologijų renginiais, įskaitant „Cyber ​​Security & Cloud Expo“. Norėdami gauti daugiau informacijos, spustelėkite čia.

AI naujienas teikia TechForge Media. Čia rasite kitus būsimus įmonių technologijų renginius ir internetinius seminarus.



Source link

Draugai: - Marketingo agentūra - Teisinės konsultacijos - Skaidrių skenavimas - Klaipedos miesto naujienos - Miesto naujienos - Saulius Narbutas - Įvaizdžio kūrimas - Veidoskaita - Teniso treniruotės - Pranešimai spaudai - Kauno naujienos - Regionų naujienos - Palangos naujienos