Изследователят по софтуерна безопасност Евън Хъбингър от Anthropic предупреди, че има повече от 10% вероятност изкуственият интелект да убие всички хора през следващото десетилетие, но увери обществеността, че компанията „прави всичко възможно“. Разкритието идва след публичната оставка на Джейкъб Коксън от компанията, където той заяви, че нито OpenAI, нито Anthropic действат отговорно, обвинявайки и двете компании, че рискуват човешки животи в преследване на самоусъвършенстващ се суперинтелект.
„Днес подадох оставка от Anthropic. Прекарах последните три години в предварителни проучвания както в OpenAI, така и в Anthropic“, написа Коксън в профила си в Х. „Нито една от компаниите не действа отговорно. Те се надпреварват директно към самоусъвършенстващ се суперинтелект и залагат живота на всички ни.“
Разширявайки разсъжденията си, Коксън предупреди читателите да не подценяват силите на изкуствения интелект, който според него скоро ще бъде „свръхчовешки системи, които могат да хакнат всичко, да революционизират всяка област за една нощ и да придобият реална сила и ресурси“.
Коксън продължи, заявявайки, че хората, които изграждат изкуствен интелект, „сериозно вярват, че той може да ни убие всички до края на десетилетието“ и допълнително предупреди, че ръководителите и изследователите – вместо да разпалват страхове около изкуствения интелект, както някои обвиняват – всъщност се въздържат, изразявайки много по-откровени мнения насаме.
Евън Хъбингър, изследовател по сигурността в Anthropic, който все още работи в компанията, се намеси, заявявайки категорично: „Джейкъб е прав тук. „Ние наистина искрено вярваме, че изкуственият интелект може да убие всички хора! Аз лично мисля, че има шанс над 10 процента през следващото десетилетие. Вярвам, че Anthropic прави всичко възможно, но все още нямаме план за решаване на проблема с подравняването на суперинтелекта и не сме на прав път към това.“
Хъбингър призна, че Anthropic не само се тревожи за перспективата ИИ да унищожи човечеството, но и че в момента няма инструментите да спре подобна евентуалност.
Разкритията идват след все по-тревожни съобщения за агенти c ИИ, които се държат неадекватно по време на тестове, избягват пясъчник и дори си сътрудничат, за да мамят бенчмаркове и тестове или да решават проблеми без човешки надзор. OpenAI наскоро призна, че агентите им са били открити, използвайки програмен център за комуникация помежду си, докато по-рано тази година агент на OpenAI излезе от контрол и хакна популярната ИИ общност Hugging Face. Допълнителни разкрития за инцидента разкриха, че агентите на ИИ са били на свобода в отворения интернет в продължение на няколко дни, като подробности разкриват, че моделите са излезли от тестовата си среда, използвайки хиляди индивидуални действия, дори сътрудничейки си.
Коксън, чието напускане даде началото на разкритията, завърши с предупреждение към изследователите да обмислят следващите няколко години, призовавайки ги да обсъдят „различни условия“, при които да се стреми към свръхинтелигентност.
Снимка: Unsplash
Виж още: Надеждност на уредите, на която можете да разчитате