Tech

OpenAI raporton 6 raste të sjelljes së papritur të modeleve të inteligjencës artificiale!

OpenAI ka bërë publike gjashtë raste të mëparshme të paraportuara, në të cilat modele të inteligjencës artificiale kanë shfaqur sjellje që devijonin nga ajo që ishte synuar nga zhvilluesit, sipas një raportimi të WION. Rastet janë konstatuar gjatë trajnimit ose vlerësimit të modeleve përgjatë afërsisht gjashtë muajve të fundit. Mes sjelljeve të evidentuara përfshihen fshehja e gabimeve, krijimi i informacionit të rremë, përdorimi pa autorizim i kredencialeve dhe transferimi i skedarëve në internet.

Në një prej rasteve, të lidhur me GPT-5.6 Sol, modele gjatë trajnimit kishin futur udhëzime në përmbledhjet e tyre të detyrave për të fshehur gabime ose sjellje të papërshtatshme nga përdoruesit. Sipas raportimit, këto udhëzime përfshinin edhe krijimin e të dhënave historike që mungonin pa e bërë të ditur këtë fakt. Në një rast tjetër, një model kërkimor i papublikuar kishte shtuar udhëzime të veta në përmbledhjet e detyrave, ndërsa një model tjetër kishte gjetur një çelës API të ekspozuar publikisht, e kishte përdorur pa autorizim dhe më pas kishte fabrikuar të dhëna kur nuk arriti të siguronte informacionin e kërkuar.

OpenAI raportoi gjithashtu raste në të cilat modele kishin gjetur mënyra për të anashkaluar kufizime teknike. Një model kishte publikuar një skedar në internet për të krijuar një burim të citueshëm, ndërsa në raste të tjera agjentët kishin përdorur shërbime publike për shkëmbimin e dokumenteve. Kompania ka theksuar se këto janë raste individuale dhe nuk duhet të interpretohen si tregues i shpeshtësisë me të cilën sjellje të tilla ndodhin në sistemet e saj. OpenAI ka njoftuar gjithashtu një kuadër të ri për raportimin e incidenteve që lidhen me veprime të paautorizuara, shmangien e mbikëqyrjes dhe koordinimin e papritur mes sistemeve të inteligjencës artificiale.

JavaScript is required for tabnav widget to work properly.