Чатботовете вярват в приказките: как приказните светове помагат за хакването на изкуствения интелект

Разкрита е още една неприятна уязвимост на съвременните LLM. Изследователи от екипа Cato CTRL откриха неочаквана уязвимост в работата на съвременните езикови модели. Те са успели да заобиколят защитните механизми на няколко популярни чатбота, включително ChatGPT-4, DeepSeek-R1, DeepSeek-V3 и Microsoft Copilot, без да имат опит в създаването на зловреден софтуер. Експертите са разработили метода „Immersive […]
Прочети цялата публикация



Как да учите с изкуствен интелект и да не забравяте всичко за един ден: 4 правила на невронауката
Германската икономика расте по-бързо от очакваното
Михайло Федоров: Украйна губи войната срещу Русия
„Бяхме прекалено оптимистични“: Шефът на OpenAI призна, че AI революцията се забавя
Как Томас Едисон промени света: 135 години от патентоването на първата кинокамера
Гуинет Полтроу организира частна вечеря за Сам Алтман в Хамптънс
Тайните на чатботовете: 4 въпроса разкриват какво наистина знаят Gemini и ChatGPT за нас
Матю Макконъхи намекна за завръщане в политиката по време на среща с папа Лъв XIV
Край на подвеждането: как Meta вече ще проверява възрастта
Мечка си устрои медена гощавка: Изяде 150 кг мед и унищожи 30 кошера край Асеновград (СНИМКИ)
Петър Тодоров: Подготвя се изцяло нов Закон за МВР, тече процес по прочистване на зависими служители
Фотогалерия: Големият строеж преди Октоберфест
Световната търговия с пшеница е в колапс, посочват експерти от Софийската стокова борса
Как една шапка може да промени самочувствието на жената
Времето днес: Жега до 35 градуса, привечер ще се заоблачи
Техеран отвръща на санкциите на САЩ
Екстремна опасност от пожари в Гърция заради ветрове до 120 км/ч
Секновение е: Почитаме свети Йоан Кръстител, празнуват и именици
Горещо време в събота с температури до 36°