Колишній дослідник із безпеки Google DeepMind Білал Чагтай заявив, що штучний інтелект може стати причиною загибелі людства, тоді як інший ексспівробітник лабораторії очікує серйозної шкоди вже протягом найближчих п’яти років.
Ключові факти:
- Чагтай залишив DeepMind у липні та вважає, що надрозумний ШІ може з’явитися вже за кілька років.
- На його думку, дослідження узгодження значно відстають від зростання можливостей, тому він підтримує скоординоване сповільнення, а не повну зупинку розробки ШІ.
- Колишній дослідник DeepMind Джош Енгелс оцінює ризик масштабної шкоди протягом п’яти років, тоді як представники Anthropic та OpenAI підтримують заклики стримувати темпи розвитку.
Попередження Чагтая щодо ШІ
Чагтай, колишній інженер-дослідник, який займався безпекою та узгодженням систем штучного загального інтелекту, у липні залишив DeepMind і цього тижня оприлюднив своє попередження.
Він заявив, що дослідницькі лабораторії вже за кілька років можуть створити надрозумні системи, здатні перевершити людей у більшості сфер діяльності, залишаючись при цьому вкрай складними для узгодження з людськими цілями.
За словами Чагтая, ключова проблема — саме узгодження. Він пише: «Я щиро вірю, що ШІ має потенціал убити нас усіх, і що в нас може лишатися дедалі менше часу, аби уникнути цього сценарію».
Наявні методи навчання передових моделей для надійного досягнення людських цілей він називає «надзвичайно примітивними», тоді як граничні можливості систем зростають значно швидше, ніж розуміння дослідниками проблеми узгодження. При цьому Чагтай не виступає за повну зупинку розробки ШІ. Натомість він закликає компанії координувати дії, сповільнювати гонку за можливостями та забезпечити більше прозорості щодо того, як створюються й тестуються найпотужніші системи.
Читайте також: Законопроєкт CLARITY проходить випробування 60 голосами в Сенаті на тлі зростання опозиції
Ставка Anthropic на безпеку
Попередження Чагтая пролунало після відставки Джейкоба Коксона на початку місяця — після трьох років роботи в Anthropic і OpenAI. Згодом керівник напряму узгодження в Anthropic Еван Губінгер заявив, що оцінює ймовірність того, що ШІ може «винищити все людство» протягом наступного десятиліття більш ніж у 10%.
Енгелс, який також працював у команді з безпеки DeepMind, 12 вересня повідомив, що приєднався до неприбуткової організації з оцінювання систем ШІ METR після того, як відхилив пропозиції від Anthropic та OpenAI. Він пояснив це «моторошно високими шансами» колосальної шкоди від ШІ протягом наступних п’яти років.
Гендиректор Anthropic Даріо Амодей закликає компанії стримувати приріст можливостей систем, і цю позицію підтримує CEO OpenAI Сем Альтман, що посилює дискусію між провідними лабораторіями. Ця згода має вагу, оскільки попередження надходять не лише від науковців, які звільняються з відділів безпеки, а й від керівників найбільших ШІ-лабораторій.
Нинішня хвиля тривоги відображає різкий зсув порівняно з початком 2022 року, коли Чагтай лише починав працювати над ШІ й описував тодішні системи як значно слабші за сьогоднішні граничні моделі. За чотири роки дискусія зсунулася від теоретичних міркувань про довгострокову безпеку до конкретних питань щодо автономії, узгодження та того, чи здатні дослідження з безпеки не відставати від вибухового зростання можливостей.
Читайте далі: API біржі Bitget тепер охоплює золото, форекс, індекси та нафту

