Чи може ШІ знищити людство? Лідер з безпеки Anthropic оцінює ризик понад 10%

A delayed Anthropic IPO timeline keeps a possible $2 trillion valuation in focus ahead of a mid-October launch. (Image: Shutterstock)
A delayed Anthropic IPO timeline keeps a possible $2 trillion valuation in focus ahead of a mid-October launch. (Image: Shutterstock)

Дослідник Anthropic Джейкоб Коксон цього тижня звільнився через побоювання щодо неконтрольованого ШІ, а керівник напряму вирівнювання компанії у відповідь заявив, що оцінює ризик вимирання людства через ШІ цього десятиліття більш як у 10%.

Ключові тези:

  • Джейкоб Коксон залишив Anthropic після трьох років роботи над препідготовкою моделей в Anthropic та OpenAI, заявивши, що обидві компанії ведуть перегони до систем, які не зможуть контролювати.
  • Керівник напряму alignment science в Anthropic Еван Хабінджер оцінив власну суб’єктивну ймовірність того, що ШІ знищить усе людство протягом наступних десяти років, більш як у 10%.
  • Хабінджер наголосив, що сучасні моделі несуть відносно низький ризик, а його головне занепокоєння пов’язане з рекурсивним самовдосконаленням ШІ.

Джейкоб Коксон йде з Anthropic через «перегони ШІ»

27‑річний Коксон провів три роки, займаючись дослідженнями препідготовки моделей в OpenAI та Anthropic, перш ніж він оголосив про відставку у серії дописів в X у середу вранці. На його думку, жодна з компаній не діє відповідально: обидві, за його словами, змагаються у створенні самовдосконалюваного суперінтелекту, ризикуючи людськими життями. Перший допис зібрав понад 19 млн переглядів за кілька годин.

В окремому інтерв’ю він застеріг, що найагресивніші сценарії розвитку тепер виглядають базовими, і ситуація може вийти з‑під контролю вже наприкінці наступного року. За його словами, колеги дедалі частіше використовують терміни на кшталт «crunchtime» та «endgame», описуючи поточну траєкторію.

Коксон має математичну освіту і перейшов до тренування моделей після університету. Раніше цього року він пішов з OpenAI до Anthropic саме через репутацію останньої як «безпечнішої» лабораторії. Втім, на його думку, компроміси щодо безпеки стають неминучими, щойно конкуруючі лабораторії вступають у прямі перегони. Тепер він стверджує: жодна приватна компанія не зможе відповідально створити ШІ на рівні людини без державного втручання або скоординованого уповільнення темпів усього сектору.

Читайте також: Ціна XRP націлюється на $1,46 на тлі повернення «китів» у вересні

Еван Хабінджер оцінює ризик вимирання понад 10%

Еван Хабінджер, який очолює напрям alignment science в Anthropic і відповідає за стрес‑тестування моделей компанії, відповів, що Коксон «коректно описав ситуацію». Він оцінює, що вірогідність того, що ШІ знищить усе людство, перевищує 10% протягом наступного десятиліття.

За словами Хабінджера, Anthropic «робить усе можливе», однак компанія не має чіткого плану, як розв’язати проблему вирівнювання для суперінтелекту, і наразі не виглядає так, що вона впевнено рухається до такого рішення. Водночас він уточнив, що сьогоднішні моделі несуть порівняно низькі ризики. Основний його страх пов’язаний із появою суперінтелекту через рекурсивне самовдосконалення, коли системи самі тренують власних наступників.

Ця оцінка є особистою думкою Хабінджера, а не офіційним прогнозом компанії, і подібні цифри базуються на низці спірних припущень щодо майбутніх можливостей і масштабів розгортання ШІ. Anthropic публічно заявляла, що рекурсивне самовдосконалення не є неминучим, однак може статися раніше, ніж інституції будуть до нього готові, і суттєво підвищити ризик втрати контролю над системами.

Все більше відходів із підрозділу безпеки Anthropic

Коксон — не перший дослідник безпеки, який залишає компанію. Раніше цього року Мрінанк Шарма, який очолював одну з команд із розробки запобіжників, також пішов, попередивши, що «світ у небезпеці», і заявив, що планує вивчати поезію у Британії.

Anthropic, створена у 2021 році колишніми співробітниками OpenAI, побудувала свою репутацію на дослідженнях безпеки ШІ. Станом на ранок середи компанія публічно не відреагувала на заяву Коксона про відставку.

Читайте далі: Bitget додає уроки з блокчейну до програми UNICEF, що вже охопила понад 642 000 людей

Alexey Bondarev profile photo

Alexey Bondarev

Олексій Бондарєв — керівник контенту в Yellow.com, який висвітлює криптовалютну тематику вже 10 років. Він спеціалізується на поглиблених матеріалах формату Research та Learn, зосереджених на аналітичній подачі, галузевому контексті та глобальних силах, що формують крипторинок — від епохи штучного інтелекту й технологій безпеки до фінтех-інновацій. Він переконаний, що все цифрове незабаром остаточно переважить усе аналогове, і наполегливо працює, щоб це стало реальністю.

Відмова від відповідальності та попередження про ризики: Інформація, надана в цій статті, призначена лише для освітніх та інформаційних цілей і базується на думці автора. Вона не є фінансовою, інвестиційною, правовою чи податковою консультацією. Криптоактиви є надзвичайно волатильними та піддаються високому ризику, включаючи ризик втрати всіх або значної частини ваших інвестицій. Торгівля або утримання криптоактивів може не підходити для всіх інвесторів. Думки, висловлені в цій статті, належать виключно автору(ам) і не представляють офіційну політику чи позицію Yellow, її засновників або керівників. Завжди проводьте власне ретельне дослідження (D.Y.O.R.) та консультуйтесь з ліцензованим фінансовим фахівцем перед прийняттям будь-яких інвестиційних рішень.
Останні новини
Показати всі новини
Схожі новини
Схожі дослідницькі статті
Схожі навчальні матеріали
Чи може ШІ знищити людство? Лідер з безпеки Anthropic оцінює ризик понад 10% | Yellow