Стандарти для наступного етапу розвитку ШІ
Наша місія — забезпечити, щоб загальний штучний інтелект (AGI) приносив користь усьому людству. Як нещодавно зазначили Сем Альтман і Якуб Пахоцький, ми визначаємо пріоритети своєї роботи в межах цієї місії за трьома основними напрямами:
Пройти наступний етап розвитку ШІ, створюючи автоматизованого дослідника ШІ, разом із ним удосконалюючи підходи до проблеми узгодженості і шукаючи способи, як людям залишатися частиною циклу самовдосконалення систем.
Забезпечити переваги наукового прогресу й економічного зростання, які уможливлюють надзвичайно інтелектуальні машини.
Надати кожній людині персональний AGI.
ШІ прискорює наші власні дослідження та інженерні розробки, а дослідження за допомогою ШІ вже сприяли досягненням у математиці, зокрема в роботі над задачею тисячоліття Нав’є — Стокса. Цей прогрес відкриває великі перспективи для двох інших наших цілей і може привести до важливих відкриттів у медицині, широкодоступного медичного обслуговування та розширення економічних можливостей малого бізнесу й індивідуальних підприємців у всьому світі.
ШІ розвивають численні компанії та країни, а прогрес у всій галузі змінює можливості й виклики для кожного. Поряд з іншими перевагами потужний і узгоджений ШІ відіграватиме важливу роль у проходженні цього перехідного періоду: зміцнюватиме захист, сприятиме дослідженням з узгодження та допомагатиме людям розуміти й спрямовувати наступні етапи розвитку ШІ.
Щоб безпечно пройти цей перехідний період, дослідження з узгодження мають розвиватися в одному темпі з можливостями ШІ, аби системи, які створюємо ми та інші, залишалися узгодженими з людськими цінностями й під контролем людей. Це набуває дедалі більшого значення зі зростанням можливостей і автономності систем ШІ, зокрема коли вони беруть на себе дедалі більшу частину досліджень і розробок самого ШІ. Щоб подальший розвиток ШІ був безпечним і корисним, потрібні як успіхи в дослідженнях з узгодження, так і спільні стандарти, що спрямовуватимуть розробки в різних лабораторіях і країнах.
Автоматизовані дослідження ШІ можуть відбуватися з різним ступенем контролю з боку людини. У міру того як системи ШІ беруть на себе дедалі більшу частину роботи зі створення наступних поколінь ШІ, вони можуть дедалі більше рухати процес рекурсивного самовдосконалення (RSI), навіть якщо люди залишаються залученими. Що більш автоматизованим стає цей процес, то стрімкіше може пришвидшуватися темп розвитку ШІ.
Ми вважаємо, що автоматизовані дослідження ШІ дадуть змогу створити моделі, які безпосередньо покращуватимуть життя людей. Вони можуть знизити вартість передового інтелекту, щоб його перевагами могли скористатися люди в усьому світі. Автоматизовані дослідження також можуть допомогти нам істотно поліпшити узгодження та створити захист від дедалі потужнішого ШІ — автоматизований ШІ-дослідник може водночас бути автоматизованим дослідником безпеки ШІ. Потужніші узгоджені системи можуть допомогти захистити критичну інфраструктуру, протидіяти небезпечним ШІ-агентам і розробляти нові засоби захисту.
Цілком автономного RSI сьогодні не існує, і ми не повинні прагнути до нього, доки не зможемо забезпечити його безпечність. Рішення про те, чи варто рухатися далі та яким чином, має залежати від нашої здатності зберегти людський контроль і від поінформованого демократичного вибору(відкривається у новому вікні) щодо переваг і ризиків. Без належної обачності й обережності RSI може призвести до того, що люди фактично втратять контроль над розвитком ШІ та не зможуть наглядати за дослідницькими процесами, яких уже не розуміють. Відтак ШІ може стати небезпечнішим, менш узгодженим і загалом становити загрозу для людей. Розкритий нами інцидент із Hugging Face не був безпосереднім наслідком RSI, але він дає уявлення про ризики, які без надійних запобіжних заходів та узгодження можуть стати набагато серйознішими.
Міжнародні стандарти практик безпеки й захисту під час розроблення передового ШІ можуть бути не менш важливими для регулювання темпу розвитку передових технологій, ніж самі дослідження з узгодження. Стандарти можуть запровадити спільні визначення високоякісних доказів і погоджені базові вимоги до надійності технічних запобіжних заходів. Коротко кажучи, вони допомагають відповісти на запитання: «Який вигляд має належне зниження катастрофічних ризиків ШІ?»
Цьому можуть сприяти як наявні демократичні інституції на кшталт Центру стандартів та інновацій у сфері ШІ (CAISI), законодавство штатів і федеральна нормативна система для ШІ, так і нові форми державно-приватного партнерства(відкривається у новому вікні). Проте розроблення та впровадження ШІ відбуваються в багатьох країнах, його використовують у всьому світі, а наслідки, імовірно, у той чи інший час і спосіб відчує кожен.
Тому для розв’язання кількох ключових проблем потрібні міжнародні зусилля з розроблення стандартів:
Фрагментація — оцінювання, вимоги до звітності та визначення інцидентів у різних країнах можуть суперечити одне одному, ускладнюючи порівняння доказів, розуміння нових можливостей і реагування на транскордонні ризики.
Колективні дії — якщо кожна країна діятиме самостійно, це може призвести до результатів, яких не бажає жодна з них. RSI здатне прискорити самі дослідження ШІ — потенційно настільки, що ми колективно не встигатимемо розуміти прогрес, оцінювати ризики та зберігати дієвий людський нагляд.
Нерівномірність спроможностей — розроблення передового ШІ та відповідні фахові знання розподілені у світі нерівномірно. Це загострює обидві зазначені вище проблеми.
Ці виклики стосуються як відкритих, так і закритих моделей.
Наголосимо: будь-яка лабораторія ШІ, що проводить автоматизовані дослідження ШІ або розробляє інші передові можливості, має відповідати за безпечність цієї роботи згідно з основними принципами особистої відповідальності та чинним законодавством. Наші стандарти ґрунтуються на прагненні уникнути концентрації влади й досягти кращих практичних результатів. Стандарти дають ширшому колу зацікавлених сторін поза лабораторіями змогу впливати на розвиток цієї технології та створюють чіткий набір принципів, на які можна покладатися незалежно від конкретних практик тієї чи іншої лабораторії. Співпраця сторін у розв’язанні зазначених вище проблем, імовірно, також забезпечить кращі результати.
Саме тому ми вважаємо, що Сполучені Штати мають очолити спільну роботу з країнами світу над глобальними технічними стандартами для передового ШІ, зокрема для RSI.
Хоча ми очікуємо, що з часом ця концепція істотно змінюватиметься, два аспекти залишатимуться ключовими.
Один зі способів досягти цього — залучити мережу інститутів безпеки ШІ, що формується, зокрема вже створені установи в Австралії, Канаді, Німеччині, Франції, Кенії, Японії, Південній Кореї, Сінгапурі, Індії та Сполученому Королівстві. Вони могли б сприяти встановленню стандартів через CAISI й національні галузеві організації, зосередившись на: (1) моделях і розробниках передового ШІ, оцінених за контрольними показниками можливостей; (2) управлінні співвідношенням користі й ризику в автоматизованих дослідженнях ШІ, зокрема RSI. Сполучені Штати можуть розвинути започатковану CAISI у 2024 році Міжнародну мережу вимірювання, оцінювання та дослідження передового ШІ(відкривається у новому вікні), що об’єднує державні установи для співпраці у вимірюванні, оцінюванні та дослідженні ШІ.
Розроблені в межах цієї ініціативи стандарти створять спільну технічну основу для вимірювання й оцінювання можливостей, оцінювання ризиків і визначення достатності запобіжних заходів. Ці технічні стандарти не будуть ліцензіями, обов’язковими перевірками перед випуском або вимогами щодо схвалення моделей ШІ. Національні уряди самі вирішуватимуть, чи включати ці стандарти у власні правові системи та яким чином.
Ця робота також має підтримувати конкурентну екосистему ШІ через консультації з розробниками відкритих і закритих моделей, незалежними технічними експертами й академічною спільнотою. Спільні стандарти слід розробляти прозоро й так, щоб вони не надавали переваг окремим компаніям, країнам або бізнес-моделям, зокрема не ускладнювали конкуренцію для нових учасників ринку чи розробників моделей із відкритими вагами.
Як ми вже зазначали(відкривається у новому вікні), цей підхід може спиратися на досвід таких сфер, як авіація та фінансова стабільність, де країни розробили спільні технічні стандарти й надійні канали співпраці, не відмовляючись від національних повноважень. Також потрібна тісна співпраця з усталеними й новими організаціями зі стандартизації, як-от ISO(відкривається у новому вікні), Frontier Model Forum(відкривається у новому вікні), Agentic AI Foundation(відкривається у новому вікні) та Open Secure AI Alliance(відкривається у новому вікні), а також з організаціями, зосередженими на впровадженні, як-от Appia Foundation, що розробляє практичні специфікації для поєднання міжнародних стандартів з оцінюванням ШІ в реальних умовах.
Міжнародні стандарти ШІ матимуть особливе значення для управління зростанням автономності досліджень ШІ та рекурсивним самовдосконаленням. Зокрема, вони можуть охоплювати стандарти щодо:
Оцінювання прогресу ШІ, пов’язаного з RSI, та обсягу автономних досліджень, що проводяться в компанії ШІ. Наш нещодавній звіт про прискорення досліджень є першим внеском у цю роботу.
Людського нагляду за автоматизованими дослідженнями ШІ, зокрема визначення процесів автоматизованого дослідження ШІ, які мають негайно передаватися на перевірку людині.
Класифікації, відстеження, звітування та реагування на інциденти, пов’язані з узгодженням і автоматизованими дослідженнями ШІ, зокрема спільних рівнів серйозності інцидентів і порогів звітування. Наша система звітування про порушення узгодження є одним із перших внесків.
Окрім цих стандартів, ми вважаємо важливим, щоб оператори критичної інфраструктури й уряди в усьому світі створили захищені канали зв’язку для обміну інформацією про загрози національній безпеці, нові вразливості та небезпеки, а також найкращими практиками у сфері безпеки передового ШІ, що стрімко розвивається. Діалог між Сполученими Штатами й Китаєм у цих сферах став би позитивним кроком, а майбутні переговори відбудуться у слушний момент.
Визначення темпу розвитку ШІ — це не підтримання наперед заданої швидкості. З технічного погляду йдеться про те, щоб дослідження з узгодження та впровадження їхніх результатів випереджали розвиток можливостей ШІ. На суспільному рівні йдеться про використання стандартів, інституцій і співпраці для посилення галузевих мереж, суспільних зв’язків і ринкових сил задля досягнення взаємовигідних результатів. Нещодавній заклик до колективних дій у сфері кіберзахисту є прикладом такого підходу.
Сполучені Штати мають усі можливості стати лідером, адже їхня індустрія ШІ перебуває на передовому технологічному рубежі, а сама країна й досі посідає привілейоване місце у глобальній мережі в таких критично важливих сферах, як фінанси, торгівля, оборона, технології та інформаційні системи. Від лідерства Сполучених Штатів зараз залежить, чи формуватимуть вони глобальну систему ШІ, чи лише спостерігатимуть, як довкола них утверджується фрагментована, нерівномірна й конфліктна система. Від цього також залежить, чи зміцнить передовий ШІ вже наявні мережі Сполучених Штатів та їхніх союзників; якщо США не очолять цей процес, ці мережі можуть ослабнути.
Геополітичне суперництво стосуватиметься не лише того, хто випереджає інших технічно, а й того, хто випереджає у впровадженні та поширенні ШІ. Дедалі більшою мірою це визначатиме той, хто рухає вперед реалістичну співпрацю та розумні правила гри, яких потребуватимуть бізнес і суспільства в усьому світі, якщо вони збираються пов'язати своє майбутнє з цією технологією.
Сильне національне регулювання, поєднане з практичною міжнародною співпрацею, — це шлях до надійніших запобіжників, безперервних інновацій і широкого доступу до переваг ШІ.


