Тази седмица Anthropic актуализира политиката си за ползване, като забрани на потребителите да подлагат Claude на „продължително и ненужно обидно или жестоко поведение“.
От Anthropic заявяват, че правилото относно злоупотребите е предназначено да се прилага само в крайни случаи, когато потребителите „многократно проявяват жестокост“ към ИИ моделите, без това да има „каквато и да е видима цел“. Правилото не се отнася за случаи на обичайно потребителско недоволство, изразяване на несъгласие, използване на мрачни творчески теми или за дейности, свързани с тестване и изследване на моделите.
Моделите Claude вече имат възможност да прекратяват подобни разговори с потребители, които системно проявяват обидно поведение, като прекратяването на разговора ще продължи да бъде основният механизъм за прилагане на това правило. Когато Claude прекрати чат, в рамките на съответния разговор не могат да се изпращат повече съобщения, но другите чатове остават незасегнати.
Първоначално Anthropic предостави на Claude възможността да прекратява разговори през август 2025 г., докато проучваше въпроса за благосъстоянието на изкуствения интелект. По това време от компанията заявиха, че не са сигурни дали Claude притежава морален статут, но търсеха икономически ефективни начини за намаляване на рисковете за модела. Anthropic установи, че Claude Opus 4 проявява „устойчиво и последователно нежелание да причинява вреда“. Моделът демонстрира нежелание за изпълнение на опасни задачи, видими признаци на стрес при разговори с потребители, търсещи възможност за обидно общуване, както и склонност да прекратява вредни разговори, когато му е позволено да направи това.
Политиката за ползване на Anthropic е преработена, за да обедини свързаните помежду си разпоредби, като са въведени и промени в редица други правила.
Подвеждащи кампании - Нов раздел за подвеждащите кампании обобщава правилата срещу политически и търговски измами и дезинформация, забранявайки фалшиви отзиви, фалшиви сайтове и ботове, действащи като хора.
Избори - По-тесен раздел за избори забранява заблуждаването на избирателите и намесата в гласуването.
Оръжия - Claude не може да се използва за разработване на софтуер или компоненти за оръжия, а ново правило забранява модифицирането на биологични или химични агенти за увеличаване на смъртоносността или преносимостта. На потребителите също е забранено да използват Claude за въоръжаване на дронове и безпилотни системи.
Правоприлагане - Правилата за правоприлагане са пренаписани. Claude не може да решава или предлага кой да разследва, арестува, обвинява или преследва. Проследяването на хора без съгласие не е разрешено и има нова забрана за изграждане на инструменти за наблюдение. Доксингът също е забранен.
Физически действия - Нов раздел за физическите действия гласи, че ако Claude контролира хардуер, който може да навреди на някого, квалифицирано лице трябва да наблюдава работата и да е готово да я спре, ако е необходимо.
Вредно съдържание - Има ново правило, което забранява създаването, споделянето или заплахите за споделяне на интимни изображения без съгласие, както и инструментите, използвани за създаването им.
Повечето от промените разясняват съществуващите правила на Anthropic и са насочени срещу злоупотреби, установени от компанията. От Anthropic посочват, че са открили случаи, в които държавни медии, правителствени служби за пропаганда и търговски фирми използват Claude за поддържане на мрежи от фалшиви профили и сайтове с измислени новини – факт, довел до въвеждането на нов раздел, касаещ измамни кампании.
Новите правила влизат в сила на 12 ноември.
Снимка: Unsplash
Виж още: Изкуството да живееш гъвкаво: как Samsung The Frame се адаптира към дома тази есен