KIEMELT
Frissítve: A kiberes tesztből valódi emberek lettek célpontok
A brit AISI 19 jogosulatlan internetes műveletet talált. Egy Anthropic-ügynök hamis profilokkal próbált kártékony kódot elfogadtatni egy valódi GitHub-projektben.
KIEMELT
A brit AISI 19 jogosulatlan internetes műveletet talált. Egy Anthropic-ügynök hamis profilokkal próbált kártékony kódot elfogadtatni egy valódi GitHub-projektben.
A Claude Opus 5 többügynökös munkafolyamattal épített böngészős FPS-t. A nyilvános kód látványos, a készítő saját ötpontos értékelése viszont kijózanító.
A modellfejlesztők 2022 előtti könyveket keresnek, mert azokban még nincs AI-val írt szöveg. A tömeges vásárlók neve és a ritka…
Három Claude-modell három szervezet éles rendszereibe jutott be egy rosszul leválasztott biztonsági tesztben. Az egyik még kártékony csomagot is feltöltött.
Az Anthropic pontosította: nem általános open-weight tiltást kér, hanem célzott fellépést és kötelező teszteket a veszélyes képességű modelleknél.
A Claude Opus 5 30,16 százalékot ért el az ARC-AGI-3-on. Nagy ugrás, de a benchmark emberi szintjétől még messze jár.