Microsoft заборонила кібератаки та обман у новому кодексі поведінки для ШІ
Компанія Microsoft опублікувала новий кодекс поведінки для штучного інтелекту, покликаний запобігти небезпечним діям ШІ-моделей. Про це пише TechCrunch.
Документ визначає цінності та «червоні лінії», якими Microsoft керується під час навчання ШІ-моделей, а також описує, як компанія підходить до безпеки штучного інтелекту та як ці ідеї впроваджують на практиці.
Документ починається з прогнозу, що протягом наступного десятиліття надрозумні ШІ-системи можуть перевершити людину у більшості завдань. Microsoft стверджує, що контроль над ними стане одним із найскладніших викликів для людства. Тому, на думку компанії, розробники повинні чітко розуміти мету створення цих систем і принципи керування ними.
У кодексі також містяться принципи, яких мають дотримуватися ШІ-моделі Microsoft. Наприклад, підтримувати людей, а не замінювати їх, та сприяти людському розвитку. Серед «абсолютних обмежень» для штучного інтелекту компанія визначила кібератаки, створення ядерної зброї та виробництво дипфейків.
У кодексі підкреслюється, що ШІ-моделі Microsoft не використовуватимуть адаптивні, оманливі та самопідсилювальні механізми або інші способи для обходу людського нагляду, внаслідок чого уповноважені люди чи системи вже не зможуть надійно керувати ними чи змінювати їх.
Новий кодекс Microsoft з’явився на тлі безпрецедентної уваги до безпеки штучного інтелекту, яку спровокували низка інцидентів з неконтрольованими ШІ-агентами, а також раптове звільнення співробітника Anthropic, який попередив про загрозу того, що швидкий розвиток ШІ може призвести до знищення людства.
Після цього виконавчий директор Anthropic Даріо Амодей, гендиректор OpenAI Сем Альтман та засновник SpaceXAI Ілон Маск закликали уповільнити розвиток передових ШІ-моделей через занепокоєння щодо їхніх потенційних небезпек.
Зокрема, вони виступили за залучення незалежних оцінювачів до лабораторій ШІ. Гендиректор Microsoft Сатья Наделла у дописі на платформі X підтримав цю концепцію, а також закликав до ширших зусиль щодо розробки механізмів, які призведуть до реальних дій.
Нагадаємо, президент США Дональд Трамп у відповідь на заклики сповільнити розвиток штучного інтелекту сказав, що вважає невтішні попередження щодо ШІ перебільшеними і що «негативні сили» роблять заяви про те, чого ніколи не станеться.
