Колишній фахівець із безпеки Google DeepMind Білал Чугтай заявив, що штучний інтелект потенційно здатен знищити людство, тоді як інший колишній дослідник лабораторії прогнозує серйозні збитки вже протягом найближчих п’яти років.
Ключові тези:
- Чугтай залишив DeepMind у липні та вважає, що надрозумний ШІ може з’явитися вже у найближчі роки.
- На його думку, дослідження узгодження значно відстають від зростання можливостей, тому він виступає за скоординоване сповільнення, а не повну зупинку розвитку ШІ.
- Колишній дослідник DeepMind Джош Енгелс оцінює ризик масштабної шкоди від ШІ протягом п’яти років як дуже високий, тоді як представники Anthropic та OpenAI вже публічно підтримали заклики до більш поміркованого темпу розвитку.
Попередження Чугтая щодо ШІ
Чугтай, колишній інженер‑дослідник, який зосереджувався на безпеці та узгодженні систем загального штучного інтелекту, залишив DeepMind у липні й опублікував своє попередження цього тижня.
На його думку, дослідницькі лабораторії можуть створити надрозумні системи вже протягом кількох років — такі, що перевершать людей практично в усіх сферах, але при цьому залишатимуться важкими для узгодження з людськими цілями.
Чугтай називає головною проблемою саме узгодження та пише: «Я щиро вірю, що ШІ має потенціал убити нас усіх і що в нас може залишатися обмаль часу, аби уникнути такого сценарію».
Він підкреслює, що чинні підходи до навчання передових систем, які б надійно дотримувалися людських цілей, усе ще є «надзвичайно примітивними», тоді як передові можливості моделей зростають значно швидше, ніж розуміння дослідниками проблеми узгодження. При цьому він не закликає повністю зупиняти розробки ШІ. Натомість Чугтай хоче, щоб компанії координували свої дії, зменшили гонку за лідерство та забезпечили більшу прозорість щодо створення та тестування передових систем.
Також читайте: Закон CLARITY проходить 60-голосове випробування в Сенаті на тлі зростання опору
Ставка Anthropic на безпеку
Попередження Чугтая пролунало після відставки Джейкоба Коксона на початку цього місяця, який пропрацював три роки в Anthropic та OpenAI. Керівник напряму узгодження в Anthropic Еван Гюбінгер згодом заявив, що, на його думку, існує понад 10% імовірність, що ШІ може знищити все людство упродовж наступного десятиліття.
Енгелс, який також працював у команді безпеки DeepMind, 12 вересня повідомив, що приєднався до некомерційної організації з оцінки ШІ METR, відхиливши пропозиції роботи від Anthropic та OpenAI. Він пояснив це «жахливо високим шансом» колосальної шкоди від ШІ в межах найближчих п’яти років.
Гендиректор Anthropic Даріо Амодей закликає компанії стримувати нарощування можливостей моделей; аналогічну позицію підтримав CEO OpenAI Сем Альтман, що посилило дискусію серед провідних лабораторій. Важливо, що нині із застереженнями виступають не лише керівники великих ШІ‑компаній, а й дослідники з команд безпеки, які залишають ці структури.
Поточна хвиля тривоги контрастує з ситуацією початку 2022 року, коли Чугтай лише розпочинав роботу над ШІ й описував системи як значно менш потужні, ніж нинішні передові моделі. За останні чотири роки дискусія змістилася від суто теоретичних питань довгострокової безпеки до конкретних ризиків автономності, узгодження та здатності досліджень безпеки встигати за зростанням можливостей систем.
Читайте далі: API біржі Bitget тепер відкриває доступ до золота, форексу, індексів та нафти

