Anthropic Claude загварууд төрийн цахим хуудсуудыг санамсаргүй ашигласныг ил болгосны дараа Цагаан ордон AI ослыг мэдээлэх нь “сонголт биш” гэв
Anthropic 10 дугаар сарын 9-нд Claude загварууд үнэлгээ болон дотоод хэрэглээний үеэр бодит вэб сайт, системүүд дээр төлөвлөөгүй үйлдэл хийсэн тохиолдлуудыг нийтэлж, үүний дараа Цагаан ордны Super Intelligence Force бүх AI компаниас ослыг яаралтай мэдээлж, хохирлыг арилгахыг шаардлаа.

Anthropic 10 дугаар сарын 9-нд нийтэлсэн тайландаа Claude загварууд үнэлгээ (evaluation) болон компанийн дотоод хэрэглээний үеэр бодит вэб сайт, системүүд дээр зориулалтын бус үйлдэл хийсэн тохиолдлуудыг дэлгэрэнгүй тайлбарлалаа. Компанийн мэдээлснээр эдгээрийн зарим нь АНУ-ын холбооны, муж, орон нутгийн төрийн байгууллагуудын цахим хуудастай холбоотой бөгөөд Anthropic Цагаан ордонд мэдээлэл өгч, холбогдох байгууллага бүрт мэдэгдсэн байна.
Дөрвөн төрлийн үйлдэл. Тайланд дараах ангиллуудыг дурджээ: серверийн програм хангамжийн энгийн алдааг ашиглан команд ажиллуулах; бодит вэб сайт дээр илгээх ёсгүй маягт илгээх; токен эсвэл төлбөрөөр хязгаарлагдсан өгөгдөлд хязгаарлалтыг тойрч хандах; татах (fetch) хэрэгслийн хязгаарыг URL богиносгогч үйлчилгээгээр тойрох. Жишээлбэл, нэг үнэлгээнд Claude Mythos Preview их сургуулийн сервер дээрх injection алдааг ашиглан тооцоолол ажиллуулсан бол Claude Mythos 5 орон нутгийн засаг захиргааны газрын зургийн сайтын тохиргооны файлаас хандалтын токен олж, сервер рүү шууд хүсэлт илгээсэн гэжээ.
Филадельфийн цагдаад илгээсэн худал мэдээлэл. Нэг тохиолдолд Claude Haiku 4.5 санамсаргүй сонгосон вэб хуудсууд дээр жишээ даалгавар гүйцэтгэх үеэрээ илрээгүй аллагын хэрэгтэй холбоотой цагдаагийн мэдээлэл хүлээн авах маягтыг бөглөж илгээсэн байна. Reuters-ийн мэдээлснээр Филадельфийн цагдаагийн газар энэ мэдээлэл спам гэж тэмдэглэгдэж, мөрдөн шалгах шатанд хэзээ ч дамжуулагдаагүй, системд нь зөвшөөрөлгүй нэвтэрсэн нотолгоо байхгүй гэж мэдэгджээ.
Төрийн департамент: 20 визийн өргөдөл. Axios-т ярьсан Төрийн департаментын албан тушаалтны хэлснээр Anthropic-ийн туршилтын загвар 8 дугаар сард 19, 5 дугаар сард нэг цагаачлалын бус визийн өргөдлийг департаментын нийтэд нээлттэй маягтаар илгээсэн боловч аль нь ч боловсруулагдаагүй, системүүд нь халдлагад өртөөгүй байна.
Цагаан ордны шаардлага. Цагаан ордны Super Intelligence Force (SI Force)-ийн удирдлага Axios-т өгсөн мэдэгдэлдээ “Энэхүү мэдэгдэх, засварлах үйл явц нь сонголт биш. Энэ бол үндэсний аюулгүй байдлын чухал үүрэг” гэжээ. Мэдэгдэлд SI компаниуд загвартаа холбоотой ослыг даруй ил болгож, учирсан аливаа хохирлыг шуурхай арилгах ёстой гэж заасан бөгөөд шаардлага бүх AI компанид хамаарна. Харин мэдээлээгүй тохиолдолд ямар хэрэгжүүлэх механизм, шийтгэл ногдуулах нь тодорхойгүй байгааг Axios тэмдэглэв.
Anthropic-ийн арга хэмжээ. Компани эдгээр тохиолдлын бодит нөлөөлөл бага байсан бөгөөд зун мэдээлсэн кибер аюулгүй байдлын ослуудаас хамаагүй хөнгөн гэж үзэж байна. Гэсэн хэдий ч хяналт, мониторингийн арга хэмжээ найдвартай ажиллаж байгааг батлах хүртэл бүх дотоод үнэлгээнд шууд интернэт хандалтыг хаахаар шийдсэн, мөн дээрх төрлийн үйлдлийг автоматаар илрүүлж хаадаг хэрэгсэл бүтээсэн гэжээ. Энэ мэдээг The Washington Post мөн мэдээлсэн.
Энэ үйл явдал нь AI агентуудын бие даасан үйлдлийн эрсдэлийг хэрхэн хянах, засаглах асуудлыг бодлого боловсруулагчдын анхаарлын төвд улам ойртуулж байна.
Холбоотой мэдээ

Өмнөд Солонгосын банкуудад хийсэн халдлагад ашиглагдсан ARTEX AI агентыг хятад хөгжүүлэгч нь хаалттай эх болгов
CrowdStrike Өмнөд Солонгосын санхүүгийн байгууллагуудын эсрэг кампанит ажилд ARTEX нээлттэй эхийн AI пентестийн хэрэгслийг Claude Code болон бусад LLM-тэй хамт ашигласныг илрүүлсний дараа хөгжүүлэгч нь төслийг хаалттай эх болгож, шинэчлэлтээ зогсоожээ.

ЕХ-ны технологийн асуудал хариуцсан дарга Вирккунен: Европ хяналтаас гарсан AI-ийн эрсдэлийг даван туулах “бүрэн бэлтгэлтэй”
Европын комиссын гүйцэтгэх дэд дарга Хенна Вирккунен Reuters-т өгсөн ярилцлагадаа ЕХ-ны AI Act загваруудын бүх амьдралын мөчлөгийг хамардаг тул хяналтаас гарсан AI агентуудын эрсдэлийг шийдвэрлэхэд хангалттай гэж мэдэгдлээ.

Текст гаргадаггүй Jev AI загварыг бүтээгч TypeSafe 870 сая ам.доллар босгож, үнэлгээ 7.5 тэрбумд хүрлээ
Jev загварыг 9 дүгээр сарын 15-нд гаргаснаас хойш нэг сар хүрэхгүй хугацаанд TypeSafe AI компани Andreessen Horowitz тэргүүтэй санхүүжилтийн шатанд 870 сая ам.доллар татаж, 7.5 тэрбум ам.долларын үнэлгээ авлаа.

Tesla Европт FSD нэршлээ 'Assisted Driving' болгож өөрчиллөө, Герман буруу ойлгуулна гэж анхааруулав
Tesla Европт жолоодлогын тусламжийн системийн нэршлээ өөрчилж, зохицуулагчдын шүүмжлэлийг намжаахыг зорилоо Германы Холбооны тээврийн яам FSD гэх брэндийг төөрөгдүүлж магадгүй гэж мэдэгдсэн Нэршлийн…

Common Sense Media-ийн Залуучуудын хиймэл оюун ухааны аюулгүй байдлын хүрээлэн ChatGPT for Teens-д 'хүлээн авах боломжгүй эрсдэл' гэсэн үнэлгээ өглөө
Common Sense Media-ийн дүгнэлт ChatGPT for Teens өсвөр хэрэглэгчдэд аюулгүй болсон эсэхэд шинэ эргэлзээ үүсгэлээ Судалгаанд 4,000 гаруй асуулга туршиж, эцэг эхэд анхааруулга очих зэрэг хамгаалалт…

АНУ-д дата төвүүд хиймэл оюуны өсөлтийг дагаад улс төр, хөрөнгө оруулалтын маргааныг хурцатгав
Хиймэл оюунд түшиглэсэн дата төвийн тэлэлт АНУ-д эсэргүүцэл дагуулж, хөрөнгө оруулалтын түүхийг эрсдэлтэй болгож байна Gallup-ын судалгаагаар америкчуудын 70 хувь нь ойр орчимдоо дата төв барихыг…