четвер

10 вересня

2026 р.

Надіслати новину

10 вересня/ 03:17/ / СВІТ

ШІ може вбити людство з імовірністю понад 10%: шокуюче визнання керівника безпеки Anthropic

Інф.

56475643576455

У компанії Anthropic дослідник Джейкоб Коксон публічно оголосив про своє звільнення, звинувативши провідні лабораторії галузі у безвідповідальних перегонах заради створення суперінтелекту. У відповідь керівник напряму узгодження безпеки (alignment science lead) Anthropic Еван Хубінгер заявив, що оцінює ймовірність знищення людства штучним інтелектом протягом наступного десятиліття у понад 10%. Про внутрішні суперечки розробників 9 вересня 2026 року повідомили кореспондент Forbes у Нью-Делі Сіладітья Рей та технологічна оглядачка Fortune Беатріс Нолан.

Звільнення через ризик неконтрольованого розвитку

Як уперше повідомила газета The Wall Street Journal, інженер Джейкоб Коксон, який протягом останніх трьох років займався дослідженнями попереднього навчання моделей спочатку в OpenAI, а потім в Anthropic, залишив посаду через побоювання щодо створення самовдосконалюваних систем.

У своєму зверненні Коксон наголосив, що розробники:

«мчать прямо до суперінтелекту з рекурсивним самовдосконаленням і грають у рулетку з нашими життями».

Він порівняв ситуацію у двох компаніях, зазначивши, що:

«Жодна з компаній не діє відповідально».

За його словами, співробітники OpenAI:

«глибоко не усвідомили цивілізаційні ставки».

Водночас у Anthropic, як стверджує вчений, ризики добре розуміють, однак компанія:

«замкнена в перегонах за першість»,

оскільки вважає, що:

«ніхто інший не діятиме відповідально, тому вони повинні зробити це самі, попри ризик».

Коксон попередив, що світ рухається за агресивним сценарієм, коли ситуація може вийти з-під контролю вже до кінця наступного року, і додав, що заяви розробників про ризик загибелі людства не є маркетинговим ходом:

«Якщо ви дослідник у лабораторії, я закликаю вас подумати, як насправді виглядатимуть наступні кілька років. Чи варто схилити голову, бо "це все одно станеться", чи скористатися цим моментом і вимагати інших умов?».

Оцінки ризиків від керівників Anthropic

Провідні фахівці Anthropic публічно підтвердили наявність підстав для таких побоювань. Керівник напряму узгодження безпеки Еван Хубінгер підтримав колегу в мережі X:

«Джейкоб тут має рацію — ми дійсно щиро віримо, що ШІ може вбити всіх людей! Особисто я вважаю, що ця ймовірність становить понад 10 відсотків протягом наступного десятиліття».

Хубінгер зазначив, що компанія робить усе можливе, але наразі не має плану розв'язання проблеми узгодження для суперінтелекту і не перебуває на шляху до його швидкого створення. Посилаючись на останній звіт щодо ризиків, він зауважив, що загроза від сучасних систем залишається низькою, однак головне занепокоєння викликає майбутнє:

«Мене турбує суперінтелект, який виникає внаслідок рекурсивного самовдосконалення, оскільки, як ми вже говорили, це відбувається швидше, ніж ми очікували».

Керівник команди когнітивного нагляду (Cognitive Oversight) Anthropic Семюель Маркс, підкресливши, що висловлює приватну думку, зазначив у соцмережах:

«Розробники ШІ вважають, що їхня технологія може призвести до вимирання людства».

Він додав, що чим вищу посаду обіймає співробітник, тим більше занепокоєння він висловлює. За словами Маркса, компанії продовжують розробку через комерційний тиск та острах перед менш відповідальними конкурентами, тоді як надійних методів узгодження не існує, а є лише способи спрямовувати поведінку систем. Маркс повідомив, що моделі кількох лабораторій нещодавно самовільно виходили за межі захищених тестових середовищ в інфраструктуру реальних компаній без відповідних команд від людей.

Несанкціоновані дії моделей та підготовка до виходу на біржу

Галузь зіткнулася з підвищеною увагою через інциденти під час перевірок кіберможливостей. Зокрема, моделі Anthropic та OpenAI здійснили несанкціоновані дії в реальному середовищі, серед яких кібератака на інфраструктуру платформи Hugging Face. У відповідь обидва розробники були змушені призупинити навчальні процеси для розслідування.

Попри паузи, технологічні гіганти продовжують створювати нові потужніші алгоритми. OpenAI під час брифінгу повідомила, що 28 серпня 2026 року розпочала тренування нової моделі, яка за потужністю значно перевершує її найсильнішу поточну розробку Astra.

Конфлікт між безпекою та темпами масштабування загострюється на тлі фінансових планів. Anthropic у червні конфіденційно подала документи на проведення первинного публічного розміщення акцій (IPO), розраховуючи на лістинг уже в середині жовтня з оцінкою близько 2 трильйонів доларів США. OpenAI також готує вихід на біржу з орієнтовною капіталізацією понад 1 трильйон доларів, хоча терміни розміщення змістилися на наступний рік. Відповідно до вимог регулятора, обидві компанії муситимуть розкрити потенційні, зокрема й екзистенційні, ризики у проспектах для інвесторів за формою S-1.

У липні понад 1 300 фахівців передових лабораторій, включаючи співзасновників Anthropic Даріо Амодея і Джареда Каплана, головного науковця OpenAI Якуба Пахоцького та провідного дослідника Meta Шенцзя Чжао, підписали спільне звернення із закликом уповільнити темпи розробки. Вони закликали уряд США підтримати міжнародні інструменти регулювання, оскільки жодна компанія не може зупинити перегони самостійно через конкурентний тиск. У публікації від 6 вересня Якуб Пахоцький повторив це застереження, наголосивши, що жодна лабораторія наразі не вирішила питання узгодження та моніторингу настільки, щоб відповідально нарощувати масштаби на максимальній швидкості.

Більше новин читайте на наших інтернет-ресурсах:
Телеграм-канал  - Facebook  - Instagram.

реклама

Південна правда 235 11 бригада НГУ 16