Az Anthropic Opus 5 jobban védi magát a prompt-ok manipulációját ellen.
CYBERSECURITY KIEMELT ELEMZÉS

Az Anthropic Opus 5 jobban védi magát a prompt-ok manipulációját ellen.

SZERZŐ

Bruce Schneier

FORRÁS

Schneier on Security

DATE

READ

1 perc olvasás

Optus 5 teljesíti az IPI-benchmarken a 4.8-as Opus eredményeit, a 15 próbájú támadás sikerességét 5,5%-ról 2,0%-ra csökkentve, valamint egyetlen próbán 0,5%-ról 0,2%-ra. Emellett a Sonnet 5 és Mythos 5-en is jobb …

Optus 5 teljesíti az IPI-benchmarken a 4.8-as Opus eredményeit, a 15 próbájú támadás sikerességét 5,5%-ról 2,0%-ra csökkentve, valamint egyetlen próbán 0,5%-ról 0,2%-ra. Emellett a Sonnet 5 és Mythos 5-en is jobb eredményt ért el, minden Claude-modellt felülmúlva. A Muse Spark a következő legjobb, 16,5%-kal (15 próbával). A GPT 5.6 azonos eredményt ért el, mint a GPT 5.5 (20%/20,8% 15 próbán), és 10-szer kevésbé ellenálló, mint az Opus 5. A GPT 5.6 egyéb változatai 30,4%-ot és 43,9%-ot ért el. Egyetlen próbán a GPT 5.6 3,1%-kal, míg az Opus 5 2,0%-kal.