Codice QR

DeepSeek Under Attack: An Analysis of Jailbreak Attacks and Prompt-Level Defenses

Large Language Models (LLMs) with reasoning capabilities (e.g., DeepSeek-R1) gained substantial research and industry interest. However, their novel reasoning features may introduce vulnerabilities, especially to specific jailbreak attacks that exploit weaknesses in safety alignment. Despite growing...

Descrizione completa

Salvato in:
Dettagli Bibliografici
Autori principali: Victor Takashi Hayashi, Milton Pedro Pagliuso Neto, Charles Christian Miers, Fernando Frota Redigolo, Reginaldo Arakaki, Marcos Antonio Simplicio
Natura: Artigo
Lingua:Inglês
Pubblicazione: IEEE 2026-01-01
Serie:IEEE Access
Soggetti:
Accesso online:https://ieeexplore.ieee.org/document/11595604/
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!