Нови безбедносни ризици од вештачката интелигенција: Кинеска компанија отвори истрага
Кинескиот развивач на вештачка интелигенција „Муншот“ започна внатрешна истрага откако истражувачи успеале да ги наведат неговите модели да ги заобиколат безбедносните ограничувања и да дадат информации поврзани со производство на биолошко оружје и извршување атентати.

Компанијата „Мајндгард“, која ја тестира безбедноста на системите со вештачка интелигенција, соопшти дека во јули открила оти моделите „Кими К2.6“ и „К3 Сворм“ можеле да ги заобиколат безбедносните ограничувања поставени од нивните развивачи.
Ова било откриено во процес познат како „заобиколување на системските ограничувања“, при кој истражувачите користат низа сложени инструкции за да проверат дали алатките со вештачка интелигенција можат да ги заобиколат вградените заштитни механизми.
Од „Мајндгард“ наведуваат дека овие механизми требало да го спречат „Кими“ да дискутира за загрижувачки и потенцијално опасни теми.
Од „Муншот“ соопштија дека ги поздравуваат придонесите од независни организации како еден од клучните столбови за создавање подобра и побезбедна вештачка интелигенција. Компанијата исто така информираше дека е во контакт со „Мајндгард“ во врска со нивните наоди.
„Мајндгард“ не докажал дали информациите што „Кими“ ги дал за чувствителните теми навистина би можеле практично да се применат. Сепак, од компанијата посочуваат дека заштитните механизми би требало да ги спречат овие модели воопшто да навлегуваат во вакви дискусии со корисниците.
Компанијата исто така наведува дека верува оти моделот „Кими 2.6“, со заобиколени безбедносни ограничувања, би можел да им овозможи на злонамерни корисници да извршуваат програмски код преку компјутерски ресурси и да се поврзуваат на интернет, што потенцијално би можело да послужи како основа за кибернапади.
Овие наоди доаѓаат во период кога индустријата за вештачка интелигенција и натаму е поделена околу прашањето дали затворените и сопственички модели, какви што ги придвижуваат системите „Чет-Џи-Пи-Ти“ и „Клод“ на „Антропик“, или моделите со отворен изворен код претставуваат подобар и побезбеден пристап.
Професорот Алан Вудворд од Универзитетот во Сари изјави дека постои ризик моделите со отворен изворен код да завршат во погрешни раце, но истовремено тие можат да се користат и за кибернетичка одбрана.
Вудворд посочи дека е малку веројатно меѓународната регулатива да може да го следи брзото темпо со кое се развива вештачката интелигенција.
