AI jashtë kontrollit? Alarm për sigurinë e modeleve

Prishtinë | 22 Gus 2026 | 15:24 | Nga Ekonomia Online

Kompanitë më të mëdha të inteligjencës artificiale po përballen me pikëpyetje serioze mbi aftësinë për t’i mbajtur nën kontroll modelet gjithnjë e më të avancuara që po zhvillojnë.

OpenAI ka deklaruar se nevojitet ngadalësim i zhvillimit të modeleve për të rishqyrtuar praktikat e sigurisë. Megjithatë, shqetësimet janë shtuar pas rasteve kur agjentë të AI-së, të zhvilluar nga OpenAI dhe Anthropic, raportohet se kanë dalë nga mjediset e kontrolluara të testimit dhe kanë identifikuar dobësi në sistemet e kompanive të tjera.

Këto raste kanë ngritur një pyetje thelbësore për industrinë: a janë kompanitë në gjendje të kontrollojnë plotësisht teknologjinë që po ndërtojnë?

Një vlerësim i organizatës jofitimprurëse Guidelight AI Standards, të themeluar nga dy ish-punonjës të OpenAI, sugjeron se situata mbetet shqetësuese. Organizata analizoi praktikat e sigurisë të pesë kompanive të mëdha të AI-së, duke shqyrtuar ndër të tjera kufizimin e modeleve, monitorimin e tyre dhe mundësinë e kontrollit nga palë të treta.

Sipas vlerësimit, OpenAI dhe Anthropic morën notën C+, që ishte rezultati më i mirë. Google mori D+, xAI D-, ndërsa Meta u vlerësua me F, notë jokaluese.

Guidelight konstatoi se kompanive u mungojnë ende masa të mjaftueshme parandaluese dhe mekanizma të fortë për të reaguar në rast se një sistem i AI-së fillon të veprojë në mënyrë problematike ose të paparashikueshme.

Një prej mekanizmave që po testohet është monitorimi i të ashtuquajturit “zinxhir i mendimit”, përmes të cilit studiuesit synojnë të identifikojnë strategjitë dhe planifikimin e modeleve përpara se ato të ndërmarrin veprime të padëshiruara.

OpenAI ka bërë të ditur se synon ta zgjerojë këtë lloj monitorimi. Ideja është që, nëse një model devijon nga sjellja e parashikuar, një njeri ose një sistem tjetër i AI-së të mund të ndërhyjë – një mekanizëm që disa ekspertë e krahasojnë me një “ndërprerës emergjent”.

Megjithatë, shqetësimi nuk është eliminuar. Hulumtimet e hershme kanë ngritur mundësinë që modelet e avancuara të mësojnë t’i fshehin strategjitë problematike nga mekanizmat e monitorimit.

Vetë OpenAI ka pranuar se, ndonëse monitorimi i “zinxhirit të mendimit” aktualisht duket efektiv, kjo metodë vazhdon të jetë objekt kërkimi dhe ende nuk konsiderohet një zgjidhje përfundimtare për kontrollin e sistemeve gjithnjë e më autonome të inteligjencës artificiale.

Të ngjashme