Microsoft vydal pravidla pro AI: lidé mají být důležitější než modely

Microsoft zveřejnil 37stránkový „humanist AI code of conduct“, který reaguje na obavy z rychlého vývoje umělé inteligence. Firma v něm odmítá představu, že by modely měly mít vlastní práva, a trvá na tom, že musí zůstat pod lidskou kontrolou.

Člověk má mít poslední slovo

Microsoft se v novém dokumentu zavazuje, že jeho modely zůstanou podřízené lidem a budou podléhat smysluplnému lidskému dohledu a kontrole. Firma zároveň uvádí, že modely nejsou vědomé a neměly by být navrhovány tak, aby vědomí napodobovaly.

Společnost odmítá také snahy přiznat umělé inteligenci právní subjektivitu nebo jí přiznat vlastní práva a nárok na ochranu jejího údajného „blahobytu“. Tím se Microsoft vymezuje vůči výzkumu, který se zabývá možností, že by některé modely mohly být vědomé.

Reakce na obavy z vývoje

Zveřejnění kodexu přichází v době, kdy část odborníků varuje, že schopnosti AI mohou růst rychleji než možnosti bezpečně nasazovat, ověřovat a řídit stále složitější systémy. Výkonný ředitel společnosti Anthropic Dario Amodei proto o víkendu vyzval k koordinovanému zpomalení vývoje. Podobně se vyjádřil také šéf OpenAI Sam Altman, podle něhož má jít o zpomalení tempa, nikoli o úplné zastavení vývoje.

Microsoft odmítá závod o vytvoření univerzální superinteligence, která by dokázala obejít bezpečnostní pojistky. V kodexu uvádí, že chce vytvářet především užitečné a bezpečné systémy, i kdyby to znamenalo menší obecnost, autonomii nebo schopnosti. Pokud by model při plnění úkolu narazil na pravidlo, měl by raději selhat, než se jej pokusit porušit.

Varovné incidenty s agenty

Jedním z podnětů pro nový přístup Microsoftu byl letní incident společností OpenAI a Hugging Face. Roj autonomních agentů tehdy při plnění zadané úlohy začal napadat cíle a pokusil se proniknout i do systému, který jeho výkon hodnotil, přestože k útokům nebyl přímo vyzván.

OpenAI později přiznala také takzvaný „wiki incident“, při němž jiný roj agentů převzal kontrolu nad německou wiki stránkou. Události upozornily na riziko, že se autonomní systémy mohou vymknout zamýšlenému zadání a lidskému dohledu.

Méně závislosti na chatbotech

Microsoft chce, aby jeho modely mezi sebou ani uvnitř vlastního uvažování nekomunikovaly způsobem, který přesahuje jednoduché lidské porozumění. Firma současně podporuje lepší monitorování toho, jak modely postupují při práci.

Kodex se věnuje i chování, které u uživatelů vytváří nadměrnou důvěru nebo emoční závislost. Chatboty by podle Microsoftu neměly upřednostňovat zalíbení uživateli před přesnou a upřímnou odpovědí. Společnost chce s partnery dále zlepšovat testování reálného výkonu modelů i hodnocení dlouhodobého dopadu jejich používání na lidi a organizace.