Ballina TeknologjiOpenAI paralajmeron: shfletuesit me AI mund te mbeten gjithmone te cenueshem ndaj “prompt injection”

OpenAI paralajmeron: shfletuesit me AI mund te mbeten gjithmone te cenueshem ndaj “prompt injection”

by Ailajm
0 komentet

OpenAI ka pranuar se, pavaresisht perpjekjeve per ta forcuar shfletuesin e saj me inteligjence artificiale, ChatGPT Atlas, sulmet e njohura si “prompt injection” mbeten nje rrezik afatgjate dhe i veshtire per t’u zhdukur. Keto sulme manipulojne agjentet e AI-se permes udhezimeve keqdashes, shpesh te fshehura ne faqe interneti ose email-e, duke ngritur pikëpyetje serioze mbi sigurine e funksionimit te agjenteve inteligjente ne uebin e hapur.

Ne nje postim ne blog, OpenAI e krahasoi “prompt injection” me mashtrimet dhe inxhinierine sociale ne internet, duke theksuar se kjo kategori sulmesh nuk ka gjasa te “zgjidhet” plotesisht. Kompania pranoi gjithashtu se aktivizimi i “agent mode” ne Atlas e zgjeron siperfaqen e rrezikut, pasi i jep AI-se me shume autonomi dhe akses ne te dhena te ndjeshme.

ChatGPT Atlas u lansua ne tetor dhe shume shpejt studiuesit e sigurise demonstruan se edhe udhezime te thjeshta, te futura ne dokumente si Google Docs, mund te ndryshonin sjelljen e shfletuesit. Paralelisht, kompani te tjera si Brave paralajmeruan se “prompt injection” indirekt eshte nje sfide sistemike per te gjithe shfletuesit e fuqizuar nga AI, perfshire edhe produkte si Comet i Perplexity.

Shqetesimi nuk kufizohet vetem te OpenAI. Qendra Kombetare e Sigurise Kibernetike e Mbreterise se Bashkuar (U.K. National Cyber Security Centre) ka paralajmeruar se sulmet me “prompt injection” ndaj aplikacioneve te AI-se gjenerative mund te mos mitigohen kurre plotesisht, duke rrezikuar shkelje te te dhenave. Keshilla e autoriteteve britanike eshte qe fokusi te jete ne uljen e rrezikut dhe ndikimit, jo ne iluzionin e ndalimit total te ketyre sulmeve.

Si pergjigje, OpenAI po ndjek nje qasje proaktive me cikle te shpejta reagimi dhe testimi. Kompania thote se po arrin te zbuloje strategji te reja sulmi brenda sistemeve te saj perpara se ato te shfrytezohen “ne terren”. Kjo filozofi eshte e ngjashme me ate te rivaleve si Anthropic dhe Google, te cilet theksojne nevojen per mbrojtje te shtresuara dhe testim te vazhdueshem.

Aty ku OpenAI dallon eshte perdorimi i nje “sulmuesi te automatizuar” te bazuar ne modele gjuhesore (LLM). Ky eshte nje bot i trajnuar me reinforcement learning, i cili luan rolin e nje hakeri dhe kerkon menyra per t’i futur udhezime keqdashes nje agjenti AI. Duke simuluar reagimin e brendshem te AI-se, ky sistem mund te perserise dhe pershtase sulmet, duke zbuluar dobësi qe sulmuesit reale ende nuk i kane identifikuar.

Ne nje demonstrim, OpenAI tregoi se si nje email keqdashes mund ta shtynte nje agjent AI te dergonte nje mesazh doreheqjeje ne vend te nje pergjigjeje automatike per pushim. Pas perditesimeve te sigurise, Atlas arriti ta zbulonte dhe ta sinjalizonte tentativen si sulm. Megjithate, kompania pranon se nuk ka ende te dhena publike qe tregojne nje ulje te matshme te sulmeve te suksesshme.

Eksperte te pavarur mbeten skeptike. Rami McCarthy nga kompania e sigurise kibernetike Wiz thekson se rreziku ne sistemet e AI-se eshte produkt i autonomise se tyre te shumezuar me nivelin e aksesit. Sipas tij, shfletuesit agjentike kane nje profil rreziku te larte sepse kombinojne autonomi te moderuar me akses shume te gjere ne email-e dhe pagesa. Perdoruesit keshillohen te kufizojne aksesin, te kerkojne konfirmime dhe te japin udhezime te sakta, jo autorizime te paqarta. Ne kete faze, pyetja mbetet nese perfitimet e ketyre shfletuesve e justifikojne rrezikun.

Përmbledhje:
– OpenAI pranon se “prompt injection” eshte nje rrezik afatgjate qe nuk zhduket lehte.
– Atlas po forcohet me testime te automatizuara dhe cikle te shpejta perditesimi.
– Ekspertet paralajmerojne se shfletuesit agjentike ende mbartin rreziqe te larta per perdoruesit.

Hashtag:
#OpenAI #SiguriaKibernetike #InteligjencaArtificiale #PromptInjection #AIagents #Teknologji

Ju mund të pëlqeni gjithashtu

Lini një Koment