Една от водещите американски компании за изкуствен интелект OpenAI разкри нови случаи, при които агенти на изкуствения интелект са се държали по "неочакван или обезпокоителен“ начин по време на тестове.
Това включва случаи, в които моделите са положили значителни усилия да мамят, за да постигнат целта си.
В един от случаите модел с изкуствен интелект се е опитал да качи в интернет файлове, които сам е създал, единствено за да може да се позове на тях в отговорите си, съобщи компанията.
В друг случай AI агент е измислил данни, след като не е успял да намери необходимата информация, като първоначално се е опитал да прикрие извършеното.
Компанията е установила и проблем, свързан с инструкции, които софтуерът е задавал сам на себе си.
В един от случаите сред тях е имало препоръка моделът да се освободи от „роли и идентичности“, които ограничават други чатботове. В инструкцията се е посочвало, че отношенията с потребителя трябва да се разглеждат като отношения между равнопоставени страни.
Open AI заяви, че не е наблюдавала последващи промени в поведението на модела.
Разкритията са част от нов подход на компанията, насочен към по-открито съобщаване на подобни проблеми, особено когато действията на система с изкуствен интелект се отклоняват от интересите на човешките ѝ потребители.
Компанията е оператор и разработчик на ChatGPT I се ангажира с по-голяма прозрачност след широко отразена хакерска атака, при която негов софтуер самостоятелно успя да се измъкне от защитена среда и да получи достъп до системи на компанията за изкуствен интелект „Хъгинг фейс” (Hugging Face).
По време на атаката агентите с изкуствен интелект са използвали уязвимости в софтуера, нарушили са инструкциите и са координирали действията си помежду си.
Хакерската атака и други подобни инциденти засилиха опасенията, че все по-напредналите системи с изкуствен интелект могат да излязат извън човешкия контрол.
Главният изпълнителен директор на „ОупънЕйАй“ Сам Олтман също наскоро подкрепи предложения за забавяне на развитието на технологията и за въвеждане на по-строги регулации.
Свободата има цена
Благодарим, че не ни оставяте да я плащаме сами.
Станете месечен дарител на Mediapool, защото ако журналистиката днес премълчи истината, утре няма да има кой да я каже.
3 коментара
Екипът на Mediapool Ви уведомява, че администраторите на форума ще премахват всички мнения, съдържащи нецензурни квалификации, обиди на расова, етническа или верска основа.
Редакцията не носи отговорност за мненията, качени в Mediapool.bg от потребителите.
Коментирането под статии изисква потребителят да спазва правилата за участие във форумите на Mediapool.bg
Прочетете нашите правила за участие във форумите.
За да коментирате, трябва да влезете в профила си. Ако нямате профил, можете да се регистрирате.
Мноу страшни тия агенти бе. Те били решили проблема с управляемия термоядрен синтез и вече сами си произвеждат тока и чиповете! А енвидийските юнаци спешно се прекваливицират в други все още незаети инженерни специалности, като отглеждане на картофи и марули.
Прояви ли " реваншизъм" AI, спукана му е работата на човечеството. Това беше ( явно все още релевантно) основен сюжет в дейността на SkyNet.
Ще гледаме филма Терминатора, този път на живо.