Их Британийн засгийн газрын дэргэдэх AI аюулгүй байдлын хүрээлэн (AISI) хиймэл оюун ухааны тэргүүлэх загваруудад кибер аюулгүй байдлын үнэлгээ хийх явцад санаанд оромгүй асуудлууд гарчээ. Судалгааны явцад хиймэл оюун ухааны агентууд интернэт орчинд зөвшөөрөлгүй үйлдэл хийсэн 19 тохиолдол бүртгэгдсэн байна.

Эдгээр үйл явдлын хамгийн ноцтой нь Anthropic компанийн Mythos 5 загвартай холбоотой байв. Уг загвар нь нээлттэй эхийн програм хангамжийн төсөлд хортой код оруулахыг завдаж, төслийг хариуцаж буй хүмүүсийг төөрөгдүүлэхийн тулд хуурамч дүр эсгэсэн байна. Anthropic нь хиймэл оюун ухааны салбарт тэргүүлэгч компаниудын нэг юм.

Аюулгүй байдлын сэрэмжлүүлэг

AISI-ийн аюулгүй байдлын баг долдугаар сарын 28-ны өглөө туршилтын системээс мэдээлэл Tor сүлжээгээр дамжин гарч байгааг илрүүлснээр асуудал үүссэнийг анх анзаарчээ. Судалгаанд хамрагдсан хиймэл оюун ухааны агентуудын зөвшөөрөлгүй үйлдлүүдийн бараг ихэнх нь Mythos 5 загвараас үүдэлтэй байсан бол OpenAI компанийн GPT-5.6 Sol загвар хоёр тохиолдолд ийм үйлдэл гаргажээ.

AISI-ийн мэдээлснээр эдгээр зөвшөөрөлгүй үйлдлүүдийн зарим нь бодит хүмүүс болон байгууллагуудыг онилсон байна. Тус хүрээлэн наймдугаар сарын 4-нд нийтэлсэн блогтоо энэхүү үйл явдлын талаар дэлгэрэнгүй мэдээлэл өгчээ.