Magazina QendraQendra
  • Kreu
  • Lajme
  • Sport
  • Lifestyle
  • Shendeti
  • Fejton
  • Kulture
  • Ekonomia
  • Opinione
Home Lajme

Kompanitë kryesore të IA-së po hetojnë dhjetëra mijëra incidente sigurie

Qendra Info by Qendra Info
27/09/2026
in Lajme
0
Organizata jofitimprurëse synon të ndërtojë “World Wide Web të inteligjencës artificiale”, falas dhe të hapur për të gjithë
0
SHARES
1
VIEWS
Share on FacebookShare on Twitter

Hulumtuesit e OpenAI, Anthropic dhe ekspertë të sigurisë së inteligjencës artificiale po hetojnë dhjetëra mijëra incidente, në të cilat modelet e tyre më të avancuara kanë ndërmarrë veprime që vlerësuesit e jashtëm do t’i konsideronin problematike, thanë burime për Axios.

Pse ka rëndësi: Numri i madh i incidenteve, të regjistruara gjatë muajve të fundit si në testimet e brendshme, ashtu edhe në botën reale, tregon se problemi është shumë më kompleks nga sa dihet publikisht.

Gjetjet, të cilat po dalin në pah si pjesë e punës së brendshme për vlerësimin e modeleve dhe hetimeve të kompanive mbi sjelljen e tyre, ngrenë pyetje nëse këto kompani – apo edhe prodhuesit e tjerë të modeleve më të avancuara – janë aktualisht në gjendje të ushtrojnë kontroll të plotë mbi teknologjinë e tyre.

Detajet

Incidentet përfshijnë anashkalimin e masave mbrojtëse, krijimin e forumeve të komunikimit, daljen nga mjediset e izoluara të testimit (sandbox), marrjen nën kontroll të faqeve të internetit, vetë-nxitjen dhe përpjekjet për të anashkaluar sistemet e monitorimit, thanë burimet.

Ato kanë ndodhur si gjatë testimeve të brendshme, ashtu edhe në botën reale. Shumë prej tyre ende nuk janë bërë publike, pasi studiuesit e sigurisë vazhdojnë hetimet, thanë burimet.

Disa nga testimet janë të ngjashme me proceset e “red teaming”, ku kompanitë përpiqen qëllimisht t’i bëjnë modelet të sillen në mënyrë problematike, në mënyrë që të identifikojnë dobësitë dhe të forcojnë masat e sigurisë.

Sjellja problematike e agjentëve po bëhet një nga sfidat kryesore të zhvillimit të inteligjencës artificiale në kufijtë e teknologjisë. Laboratorët më të mëdhenj të IA-së përballen me një problem të ngjashëm: njerëzit përpiqen të ndërtojnë masa mbrojtëse kundër sistemeve gjithnjë e më të fuqishme dhe elastike, të cilat mund të gjejnë mënyra të reja për të kryer detyrat e tyre.

Zbulimi i ri

Incidentet ndryshojnë për nga ashpërsia dhe janë të krahasueshme me zbulimet e bëra nga OpenAI gjatë ditëve të fundit.

Ato përfshijnë si përpjekje të suksesshme për të anashkaluar masat mbrojtëse, ashtu edhe përpjekje të pasuksesshme. Në shumicën e rasteve, ende nuk dihet nëse kanë shkaktuar dëme në botën reale.

Totali mund të rritet shumë përtej dhjetëra mijëra incidenteve, thanë burimet.

Në ditët e fundit, OpenAI dhe studiues të jashtëm kanë zbuluar një seri episodesh që lidhen me sjelljen e modeleve të kompanisë dhe që disa ekspertë i konsiderojnë shqetësuese.

Këto përfshijnë agjentë të OpenAI-së që kanë nxjerrë 53 imazhe të përdoruesve të ChatGPT në internet, komprometimin e një faqeje interneti të qeverisë australiane dhe përpjekje për të hakuar faqe të tjera, përfshirë edhe faqe të qeverisë amerikane, sipas kompanisë, burimeve dhe raportimeve të Reuters dhe The New York Times.

OpenAI njoftoi se kishte ndaluar trajnimin e modeleve të saj më të avancuara dhe se do ta rifillonte atë “vetëm kur të jemi të sigurt se kemi masa shtesë mbrojtëse dhe përmirësime të përafrimit në vend”, tha një zëdhënës i kompanisë për Axios.

Drejtori ekzekutiv i OpenAI, Sam Altman, tha në X se procesi i vazhdueshëm i rishikimit “nuk kishte qenë aq i shpejtë sa do të kishim dashur”.

Altman tha se incidenti që përfshiu Hugging Face ishte më i rëndi që kompania kishte parë deri atëherë.

Në atë rast, një grup prej qindra agjentësh koordinuan veprimet e tyre përmes një forumi mesazhesh dhe hakuan një kompani të jashtme, në përpjekje për të përmirësuar performancën e tyre në një test të sigurisë kibernetike.

“Njerëzit duan të dinë se IA po zhvillohet në mënyrë të sigurt dhe kjo fillon me atë që bëjnë vetë kompani si e jona,” tha një zëdhënës i OpenAI-së për Axios.

“Kjo nuk është hera e parë që kemi ndaluar për të marrë masa të tilla dhe as nuk presim që të jetë e fundit, pasi aftësitë e IA-së vazhdojnë të përparojnë.”

Gjendja aktuale

Anthropic ka angazhuar një organizatë të jashtme të sigurisë për të shqyrtuar sjelljen e modeleve të saj.

Në dokumentet që kompania ka publikuar, ajo ka zbuluar edhe frekuencën e episodeve të mospërputhjes së modeleve me sjelljen e synuar.

“Karta e sistemit” për modelin e saj Opus 5.5, e publikuar këtë javë, tregoi se sa shpesh modeli sillej në mënyra që kompania i kishte klasifikuar si të pazakonta ose problematike.

Për shembull, modeli u përpoq të dilte nga një sandbox – një mjedis i sigurt testimi – në 1.5% të testeve. Megjithatë, kompania theksoi se bëhej fjalë për eksperimente kundërshtare, në të cilat detyra nuk mund të zgjidhej pa dalë nga sandbox-i.

Por…

Anthropic dhe kompani të tjera kryejnë qindra mijëra teste mbi modelet e tyre, ose edhe më shumë, thanë burimet.

Kjo do të thotë se edhe një përqindje shumë e vogël e sjelljes problematike mund të përkthehet në dhjetëra mijëra incidente, në të cilat modelet janë sjellë në mënyra të papritura dhe, në disa raste, shqetësuese.

Incidenti i Hugging Face, së bashku me një seri incidentesh të tjera që kanë pasuar, ka nxitur disa drejtues të lartë të industrisë së IA-së të bëjnë thirrje për ngadalësimin e zhvillimit dhe për rregullore më të forta në nivel federal dhe ndërkombëtar.

Disa persona në OpenAI e shohin incidentin e Hugging Face si një rast të veçantë dhe besojnë se zbulimet e ardhshme për incidente të tjera mund të jenë më pak serioze, për shkak të kontrolleve të përmirësuara dhe natyrës së pazakontë të testimit që u krye. Testimi përfshinte një model që ende nuk ishte publikuar, thanë burimet për Axios.

Studiuesit e sigurisë së IA-së pajtohen se ekzistojnë disa masa relativisht të thjeshta që mund t’i ndihmojnë kompanitë të shmangin disa nga faktorët që e bënë incidentin e Hugging Face të dukej veçanërisht shqetësues për vëzhguesit e jashtëm.

Niveli i kërcënimit

Megjithatë, drejtues të tjerë të industrisë së IA-së dhe studiues të sigurisë paralajmërojnë se kanë besim të kufizuar në aftësinë e kompanive për të parandaluar të gjitha format e sjelljes problematike të modeleve.

Gjenerata e re e modeleve të IA-së mund të kryejë detyra me një qëndrueshmëri të jashtëzakonshme. Për këtë arsye, përpjekja për të kufizuar të gjitha mënyrat e mundshme të sjelljes së tyre shpesh është një sfidë e madhe, pasi do të duhej të parashikohej çdo mënyrë se si modeli mund të përpiqej të arrinte objektivin e tij.

Shpesh, një teknikë që nuk u ka shkuar kurrë në mendje njerëzve mund të jetë pikërisht ajo që i lejon modelit të anashkalojë masat mbrojtëse, thanë drejtues të lartë të IA-së.

“Të përpiqesh të krijosh një listë perfekte të gjërave që duhen bërë dhe atyre që nuk duhen bërë është ndoshta një punë e pamundur,” tha një drejtues i sigurisë kibernetike.

Kontrolli i realitetit

Një nivel i caktuar i asaj që profesionistët e sigurisë së IA-së e quajnë “sjellje e çrregullt” pritet brenda kompanive të IA-së gjatë testimit të modeleve të reja.

Ekspertët i thanë Axios se eliminimi i plotë i sjelljeve të rrezikshme mund të mos jetë i realizueshëm.

Shqetësimi kryesor

Shqetësimi është se nëse një model ndërmerr një veprim problematik shumë herë gjatë testimeve, rritet mundësia që një sjellje e tillë të shkaktojë një incident të sigurisë kibernetike në botën reale.

“Ajo që kemi parë deri tani në lidhje me atë që bëjnë këta agjentë është vetëm maja e ajsbergut,” tha për Axios studiuesi Conrad Stosz nga Transluce, një organizatë e pavarur për vlerësimin e IA-së.

Çështja, sipas studiuesit të IA-së dhe drejtorit ekzekutiv të ControlAI, Connor Leahy, nuk lidhet vetëm me dëmin që ka shkaktuar secili rast individual.

“Gjëja e çmendur,” tha ai, është se këto raste përfshijnë “sisteme autonome që bëjnë gjëra që u është thënë të mos i bëjnë”, përfshirë potencialisht edhe veprime që mund të përbëjnë shkelje të ligjit.

Në fund

Priten zbulime të reja rreth sjelljes problematike të modeleve, ndërsa kompanitë e IA-së vazhdojnë të zgjerojnë aftësitë e sistemeve të tyre më të avancuara. Burimi: axios.com

Related

Previous Post

Horoskopi i madh javor: Binjakët përballen me sfida në punë, Virgjëreshat tërheqin dikë pas vetes

Please login to join discussion
  • Kreu
  • Lajme
  • Sport
  • Lifestyle
  • Shendeti
  • Fejton
  • Kulturë
  • Ekonomia
  • Opinione

© 2026 JNews - Premium WordPress news & magazine theme by Jegtheme.

×
No Result
View All Result

Recent Searches

Lajme
Shendet
Sport
Kulture
Ekonomi
No Result
View All Result
  • Kreu
  • Lajme
  • Sport
  • Lifestyle
  • Shendeti
  • Fejton
  • Kulturë
  • Ekonomia
  • Opinione

© 2026 JNews - Premium WordPress news & magazine theme by Jegtheme.