Розробка науковців: чатбота навчили зламувати конкурентів 

Вчені-комп’ютерники з Наньянського технологічного університету (NTU, Сінгапур) знайшли ефективний спосіб злому чатботів зі штучним інтелектом. Для цього вони навчають одну систему створювати підказки, які дозволяють обходити захист інших чатботів. Про це пише Tech New Space.

Дослідники використовували подвійний метод злому великої мовної моделі (LLM), який отримав назву Masterkey. Насамперед вони провели реверс-інжиніринг того, як LLM виявляють шкідливі запити та захищаються від них. 

Використовуючи цю інформацію, вони навчили мовну модель автоматично вчитися та пропонувати підказки, які дозволяють обходити захист інших LLM. Таким чином, можна створити систему для злому, яка зможе автоматично адаптуватися до нових умов. При цьому вона буде здатна створювати нові запити для атаки після того, як розробники внесуть виправлення до своїх LLM.

Після проведення серії тестів на LLM як доказ, що цей метод дійсно становить реальну загрозу, вчені одразу ж повідомили провайдерам сервісів про виявлені проблеми.

Розробка дослідників NTU повинна допомогти компаніям визначити слабкі сторони та обмеження їхніх чатботів, щоб вжити заходів щодо їх захисту від хакерів.

Читайте далі

Податкові надходження від IT-галузі України у і півріччі 2026 року

За даними Державної податкової служби України, за перші шість...

Universe Group скорочує 22% штату: деталі та причини змін

Українська продуктова IT-група Universe Group оголосила про початок кадрової...

Genesis та KSE запускають безоплатне навчання з розвитку цифрових продуктів

Український IT-холдинг Genesis разом із Київською школою економіки (KSE)...

Українська MacPaw та американська Liquid AI оголосили про стратегічне партнерство

Українська технологічна компанія MacPaw уклала угоду про довгострокове стратегічне...