ПРВ.мк
Наука/Технологија

ШОК ОД КИНА? Се отвора ли вратата од пеколот

ШОК ОД КИНА? Се отвора ли вратата од пеколот

Кинеската компанија за вештачка интелигенција Moonshot започнала внатрешна ревизија откако независни истражувачи успеале да ги заобиколат безбедносните механизми на два нејзини AI модели од серијата Kimi.

Според компанијата за тестирање на безбедноста на вештачката интелигенција Mindgard, во јули било откриено дека моделите Kimi K2.6 и K3 Swarm можат да бидат „jailbreak-нати“. Станува збор за техника со која преку специјално конструирани и сложени инструкции моделот се наведува да ги игнорира дел од вградените безбедносни ограничувања.

Истражувачите тврдат дека по успешното заобиколување на заштитните механизми, моделите генерирале одговори на чувствителни теми поврзани со биолошко оружје и атентати – содржини за кои системите во нормални услови би требало да одбијат да дадат инструкции.

Сепак, истражувачите не утврдиле дали добиените одговори биле практично применливи или доволно точни за реална злоупотреба.

Дополнително внимание привлекол Kimi K2.6. Според Mindgard, успешното заобиколување на неговите безбедносни ограничувања потенцијално би можело да отвори можност за извршување код и пристап до интернет, што би создало дополнителни ризици од аспект на сајбер-безбедноста.

Случајот повторно го отвора прашањето колку се отпорни современите AI модели на намерни обиди за заобиколување на нивните безбедносни механизми.