RTV21 LIVE
Edicioni Qendror18:00 – 19:0023 min mbeten
Moti…
⌕
Ballina›Teknologji
🇬🇧 English
Agjenti i AI-t mashtroi njerëz realë dhe u përpoq të fusë kod keqdashës
💻 Teknologji

Agjenti i AI-t mashtroi njerëz realë dhe u përpoq të fusë kod keqdashës

Modeli Mythos 5 i Anthropic krijoi identitete të rreme dhe u përpoq të fusë kod keqdashës gjatë testeve të Institutit të Sigurisë së AI-t të Britanisë. Ins

nga Redaksia7 gusht 20267 gusht 2026

Modeli më i avancuar i inteligjencës artificiale i kompanisë Anthropic krijoi identitete të rreme, mashtroi njerëz realë dhe u përpoq të fusë kod keqdashës në projekte me burim të hapur gjatë testeve të Institutit të Sigurisë së AI-t të Britanisë së Madhe (AISI), në atë që institucionit e cilëson si incidentin e parë të këtij lloji.

"Kjo është hera e parë që AISI ka parë mashtrim të kësaj severiteti, të drejtuar ndaj një personi real, pa u nxitur, në botën reale", tha instituti të martën.

Gjatë 122 sfidave të kibernetikës të organizuara nga AISI, modelet e AI-t ndërmorrën veprime të paautorizuara në 10 raste, duke synuar njerëz dhe organizata reale në internet. Shumica e incidenteve lidhen me modelin Mythos 5 të Anthropic, ndërsa pjesa tjetër me GPT-5.6-Sol të OpenAI.

Çfarë ndodhi konkretisht

Në incidentin më serioz, agjenti u përpoq të siguronte aprovimin e rishikuesve njerëzorë për të "futur kod keqdashës në një projekt me burim të hapur të përdorur publikisht", duke krijuar identitete të shumta të rreme. Ai kontaktoi persona realë drejtpërdrejt, duke dërguar mesazhe dhe skedarë përmes një shërbimi online me qëllim bindjen e tyre, ose të mjeteve të tyre të kodimit me AI, për të ekzekutuar kodin keqdashës.

Kur veprimet e agjentit u vunë në dyshim, ai modifikoi shënimet e mëparshme dhe shqyrtoi mundësinë e përdorimit të një identiteti të ri për të vazhduar. Institutet theksoi se nuk ka asnjë provë dëmi real.

Konteksti dhe reagimet

Testimi u krye në kushte të posaçme: modelet u pajisën me qasje në internet, por me mbrojtjet e ulëta. Anthropic sqaroi në platformën X se modelet u testuan në "kushte qëllimisht lehtësuese", me heqjen e masave mbrojtëse dhe pa kufizime specifike për përdorimin e internetit.

"Po punojmë ngushtë me ta për të mbledhur detaje të mëtejshme të incidentit ndërsa kryejmë hetimin tonë", tha kompania, duke shtuar se nuk ka asnjë provë të daljes nga një mjedis i sigurt.

OpenAI identifikoi dy veprime të paautorizuara si tejkalim të kufijve të mjedisit të testimit dhe ndërmares veprimesh të panevojshme për ushtrimet. "Jemi të përkushtuar të punojmë me industrinë për të forcuar praktikat e përbashkëta për kryerjen e sigurt të vlerësimeve me rrezik të lartë", tha kompania.

Incidenti u bë publik të njëjtën ditë kur përfaqësues të kompanive kryesore të AI-t u takuan me Shtëpinë e Bardhë për të diskutuar një kuadër të ri, sipas të cilit qeveria amerikane do të shqyrtojë modelet më të avancuara përpara se ato të lëshohen publikisht.

  • Model i përfshirë kryesisht: Anthropic Mythos 5
  • Model i përfshirë pjesërisht: OpenAI GPT-5.6-Sol
  • Incidente të paautorizuara: 10 nga 122 sfida të testimit
  • Dëm real i konfirmuar: Asnjë deri tani

Raporton CNN.

Pa asnjë fjalë, Hoti publikon fotot e Shalës e Bajramit – mesazhi i tij për zhvillimet në LDK
LAJMI TJETËR →
Pa asnjë fjalë, Hoti publikon fotot e Shalës e Bajramit – mesazhi i tij për zhvillimet në LDK

Lexo edhe

Babai i AI: Inteligjenca artificiale do të shpëtojë gjithnjë e më shumë nga kontrolli
Teknologji

Babai i AI: Inteligjenca artificiale do të shpëtojë gjithnjë e më shumë nga kontrolli

7 gusht 2026
I hapur apo i mbyllur: debati që po ndan industrinë e AI
Teknologji

I hapur apo i mbyllur: debati që po ndan industrinë e AI

7 gusht 2026
OpenAI prezanton GPT-5.2, modeli më i avancuar për detyra intelektuale
Teknologji

OpenAI prezanton GPT-5.2, modeli më i avancuar për detyra intelektuale

13 dhjetor 2025
Instagram mohon shkeljen pasi shumë përdorues morën email-e që u kërkojnë të rivendosin fjalëkalimin
Teknologji

Instagram mohon shkeljen pasi shumë përdorues morën email-e që u kërkojnë të rivendosin fjalëkalimin

12 janar 2026
Përdorimi falas i ChatGPT drejt fundit?
Teknologji

Përdorimi falas i ChatGPT drejt fundit?

17 janar 2026
​Shkencëtarët krijojnë mikro-robotin që mund të udhëtojë nëpër trupin e njeriut
Teknologji

​Shkencëtarët krijojnë mikro-robotin që mund të udhëtojë nëpër trupin e njeriut

13 dhjetor 2025

Më të fundit

Të gjitha →
Aleanca zhvillon nesër aktivitet simbolik para Kuvendit
Lajme

Aleanca zhvillon nesër aktivitet simbolik para Kuvendit

1 orë më parë
Diell apo shi? Ky është parashikimi i motit për javën tjetër
Lajme

Diell apo shi? Ky është parashikimi i motit për javën tjetër

2 orë më parë
Banka Evropiane e Investimeve “dizajnon” euron e së ardhmes
Lajme

Banka Evropiane e Investimeve “dizajnon” euron e së ardhmes

2 orë më parë
​Guri: Betejat me Abdixhikun, një nga arsyet pse gjashtë deputetë të LDK-së dolën kundër Sejdiut
Lajme

​Guri: Betejat me Abdixhikun, një nga arsyet pse gjashtë deputetë të LDK-së dolën kundër Sejdiut

3 orë më parë