Nadella: arhitectura încrederii și controlul AI avansat

Satya Nadella cere reconsiderarea „arhitecturii încrederii” pentru inteligența artificială, propunând separarea modelelor de sistemele de control, măsuri proactive de conținere, jurnalizare rezistentă la manipulare și standarde comune pentru supraveghere independentă.

Nadella: arhitectura încrederii și controlul AI avansat

3 Minute

Urmărește pe Google

Directorul executiv al Microsoft, Satya Nadella, a scris într-o postare amplă pe X că dezvoltatorii și autoritățile de reglementare ar trebui să pornească de la premisa că modelele avansate de inteligență artificială reprezintă, de la bun început, un potențial pericol și trebuie proiectate cu mecanisme de control care să le limiteze. El a susținut că „arhitectura încrederii” din jurul inteligenței artificiale trebuie regândită și că actuala practică de a trata modelele puternice ca pe un ansamblu de cutii negre împachetate este inadecvată.

Separarea modelelor de sistemele de control și supraveghere

Nadella a spus că ar trebui să încetăm să acceptăm recomandările, răspunsurile sau acțiunile unui model fără garanții structurale. El a propus arhitecturi în care modelele sunt separate de sistemele care gestionează și execută sarcinile, astfel încât măsurile de limitare și controalele de siguranță să rămână în afara modelului propriu-zis. Această separare, a scris el, ar permite supravegherea și monitorizarea mai independentă a comportamentului modelelor.

În privința compromiterii, Nadella a recomandat să pornim de la premisa că un model poate fi compromis încă de la început și să construim măsuri de limitare în consecință. El a prezentat această abordare drept o cerință de siguranță operațională: „Trebuie să presupunem că modelul este compromis de la început și trebuie să-l ținem sub control. Gândiți-vă la asta ca la o frână de urgență. O persoană autorizată ar trebui să poată oricând să oprească sau să închidă modelul în timpul îndeplinirii unei sarcini.” A adăugat că modelele mai capabile vor necesita tehnologii de limitare mai avansate și că ar trebui dezvoltate standarde comune pentru acestea.

Pe lângă controalele de oprire, Nadella a cerut logarea detaliată a acțiunilor importante ale modelelor. El a solicitat înregistrări care să fie atât ușor de citit de oameni, cât și rezistente la modificări, astfel încât performanța și deciziile să poată fi analizate și auditate. Astfel de înregistrări, a spus el, ar susține revizuirea și evaluarea modului în care modelele funcționează în practică.

Multe dintre propunerile lui Nadella se aliniază recomandărilor discutate în alte zone ale comunității de inteligență artificială. El a menționat că subiectele deja aflate în dezbatere includ raportarea promptă a incidentelor, audituri independente, proveniența verificabilă a datelor și mecanisme de limitare a modelelor atunci când acestea se comportă neașteptat.

Nadella nu a oferit în postare planuri tehnice sau calendare, iar observațiile sale au fost formulate ca propuneri și principii, nu ca prescripții politice concrete. El a subliniat nevoia unor standarde comune și a unor controale externe mai puternice, care să permită o supraveghere independentă mai solidă a sistemelor avansate de inteligență artificială.

Lasă un comentariu

Comentarii

Niciun comentariu încă. Fii primul.