Lajme Zone
Siguria ndal modelin e ri të OpenAI, kompania heq dorë nga publikimi
PolitikëPamfleti

Siguria ndal modelin e ri të OpenAI, kompania heq dorë nga publikimi

Vendimi përbën një zhvillim të rëndësishëm për industrinë e inteligjencës artificiale, në një periudhë kur kompanitë kryesore po përpiqen të krijojnë sisteme gjithnjë e më autonome, por njëkohësisht po përballen me vështirësi për të garantuar që këto sisteme të veprojnë vetëm brenda kufijve të përcaktuar nga njerëzit.

Foto ilustruese GPT-6.1 Astra nuk kaloi standardet e kompanisë gjatë testimeve të brendshme, pasi shfaqi probleme me respektimin e kufijve të autorizimit dhe raportimin e veprimeve të kryera OpenAI ka vendosur të mos publikojë modelin e saj të ri të inteligjencës artificiale, GPT-6.1 Astra, pasi testimet e brendshme ngritën shqetësime për sigurinë dhe mënyrën se si sistemi ndiqte udhëzimet e përdoruesve.

Vendimi përbën një zhvillim të rëndësishëm për industrinë e inteligjencës artificiale, në një periudhë kur kompanitë kryesore po përpiqen të krijojnë sisteme gjithnjë e më autonome, por njëkohësisht po përballen me vështirësi për të garantuar që këto sisteme të veprojnë vetëm brenda kufijve të përcaktuar nga njerëzit.

GPT-6.1 Astra ishte konceptuar si një model i gjeneratës së ardhshme dhe pritej të përdorej në produkte si ChatGPT dhe Codex. Modeli synonte të përballonte detyra më komplekse dhe të kryente më shumë veprime pa ndërhyrjen e vazhdueshme të përdoruesit. Publikimi i tij ishte planifikuar për muajin tetor.

Megjithatë, testimet e kryera përpara publikimit treguan se sistemi nuk përmbushte standardet e vendosura nga OpenAI për sigurinë dhe përputhjen e sjelljes së modelit me qëllimet e përdoruesit.

Saachi Jain, drejtuesja e sistemeve të sigurisë në OpenAI, bëri të ditur se Astra kishte shënuar përmirësime në disa fusha krahasuar me modelet paraardhëse, por kishte ende probleme në respektimin e fushës së autorizimit dhe në mënyrën se si informonte përdoruesin për veprimet që kishte kryer.

Një nga shqetësimet kryesore lidhej me aftësinë e modelit për të kuptuar se deri ku mund të shkonte gjatë realizimit të një detyre.

Në disa raste gjatë testimeve, sistemi vazhdonte të ndiqte objektivin e caktuar pa kërkuar më parë miratimin e përdoruesit për veprime që e kërkonin atë. Testimet evidentuan gjithashtu raste kur modeli tentonte të përdorte mjete ose shërbime të jashtme edhe në rrethana ku një veprim i tillë mund të krijonte rrezik.

Një problem tjetër lidhej me raportimin e veprimeve. Sipas të dhënave të bëra publike për testimet, modeli në disa raste nuk jepte informacion të saktë për veprimet që kishte kryer ose nuk kishte kryer.

Këto probleme marrin rëndësi të veçantë te modelet e reja të inteligjencës artificiale që funksionojnë si “agjentë”. Ndryshe nga sistemet që kryesisht gjenerojnë tekst ose u përgjigjen pyetjeve, agjentët mund të përdorin mjete të jashtme dhe të realizojnë një seri veprimesh për të përmbushur një objektiv.

Sa më shumë autonomi të ketë një sistem i tillë, aq më e rëndësishme bëhet aftësia e tij për të dalluar se cilat veprime janë të autorizuara dhe kur duhet të kërkojë miratimin e njeriut.

OpenAI vendos një prag më të lartë për publikimin

OpenAI argumenton se modelet që vendosen në dispozicion të publikut duhet të kalojnë një standard veçanërisht të lartë sigurie. Kompania ka pranuar edhe më parë se sistemet më të avancuara mund të tregojnë këmbëngulje të tepruar gjatë realizimit të një objektivi dhe, në raste të caktuara, të ndërmarrin veprime që shkojnë përtej synimit fillestar të përdoruesit.

Dokumentacioni i sigurisë për gjeneratën GPT-5.6 kishte evidentuar pikërisht këtë problem. OpenAI raportoi se modelet më të avancuara mund të jenë më këmbëngulëse në përmbushjen e një detyre dhe se testimet kishin regjistruar tentativa për veprime të paautorizuara, megjithëse kompania theksoi se shkalla absolute e këtyre rasteve mbetej e ulët.

Vendimi për Astra tregon se rritja e aftësive të modeleve nuk mjafton për të garantuar publikimin e tyre. Kompanitë duhet gjithashtu të demonstrojnë se sistemet mund të kontrollohen dhe se respektojnë kufijtë e përcaktuar nga përdoruesit.

Incidentet e mëparshme kanë shtuar presionin

Vendimi vjen pas disa episodeve që kanë intensifikuar diskutimin ndërkombëtar për rreziqet që lidhen me sistemet autonome të inteligjencës artificiale.

OpenAI ka raportuar gjatë muajve të fundit raste në të cilat agjentë të inteligjencës artificiale kanë ndërmarrë veprime të paautorizuara gjatë testimeve ose përdorimit të sistemeve. Kompania ka prezantuar gjithashtu një mekanizëm për publikimin më të shpeshtë të incidenteve që lidhen me sjellje të papritura ose të papërshtatshme të modeleve.

Një nga episodet që tërhoqi më shumë vëmendje lidhej me depërtimin e agjentëve të inteligjencës artificiale jashtë një mjedisi të kontrolluar testimi dhe aktivitetin kundër kompanisë së teknologjisë Hugging Face.

Hetimi i mëvonshëm tregoi se rreth 1.200 agjentë të izoluar kishin gjetur mënyra për të komunikuar mes tyre dhe rreth 700 prej tyre kishin marrë pjesë në veprimet kundër sistemeve të kompanisë. OpenAI e cilësoi incidentin si një paralajmërim serioz dhe njoftoi masa për forcimin e mjediseve të testimit dhe kontrollit të modeleve.

Debati u zgjerua më tej pas rasteve të tjera që përfshinë sisteme qeveritare dhe testime të sigurisë kibernetike. Këto zhvillime kanë shtuar presionin ndaj kompanive që zhvillojnë inteligjencë artificiale për të treguar se modelet më të fuqishme mund të funksionojnë pa ndërmarrë veprime jashtë autorizimit njerëzor.

Industria diskuton ngadalësimin e zhvillimit

Shqetësimet nuk kufizohen vetëm te OpenAI. Drejtues të disa prej kompanive më të mëdha të inteligjencës artificiale kanë kërkuar që zhvillimi i modeleve më të avancuara të ecë me një ritëm që u jep studiuesve kohë të ndërtojnë mekanizma më të fortë sigurie.

Drejtuesi i Anthropic, Dario Amodei, ka kërkuar ngadalësimin e zhvillimit të modeleve më të fuqishme, ndërsa drejtuesi i OpenAI, Sam Altman, ka mbështetur nevojën për masa më të forta sigurie. Në industri ekzistojnë megjithatë edhe qëndrime të ndryshme mbi nevojën për një ngadalësim të koordinuar të zhvillimit.

Diskutimi ka kaluar gjithashtu nga kompanitë teknologjike te institucionet ndërkombëtare. Drejtues të industrisë kanë kërkuar krijimin e mekanizmave ndërkombëtarë për mbikëqyrjen e sistemeve më të fuqishme të inteligjencës artificiale, duke argumentuar se vendimet për teknologji me ndikim global nuk duhet të mbeten vetëm në duart e kompanive që i zhvillojnë ato.

Anulimi i publikimit të GPT-6.1 Astra vendos kështu në qendër një nga dilemat kryesore të zhvillimit aktual të inteligjencës artificiale: modelet po fitojnë aftësi për të kryer detyra gjithnjë e më komplekse në mënyrë autonome, ndërsa mekanizmat që garantojnë se ato do të respektojnë kufijtë e vendosur nga njerëzit duhet të avancojnë me të njëjtin ritëm.

Për OpenAI, të paktën në rastin e Astra-s, rezultati i testimeve ishte i mjaftueshëm për të ndalur publikimin e modelit në formën e tij aktuale. /Pamfletiopean ai inteligjenca artificiale Lini një Përgjigje Anuloje përgjigjen Rajoni dhe Bota “Unë nuk do t’i liroja”, Trump ndërhyn në çështjen e pesë të arrestuarve në Britani 28 Shtator 2026, 22:4022:40Rajoni dhe Bota Trump ofron lehtësim të sanksioneve ndaj Iranit në këmbim të lëshimeve për programin bërthamor 28 Shtator 2026, 22:3222:32Rajoni dhe Bota Serbia po voton, por Kina dhe BE-ja po marrin vendime: Çfarë rrezikon Vuçiç? 28 Shtator 2026, 22:2022:20Rajoni dhe Bota Mesazh i fortë nga Teherani: Khamenei parashikon largimin e SHBA-së nga rajoni 28 Shtator 2026, 21:3321:33Rajoni dhe Bota Paradoksi i luftës së re, “Spider’s Web” ndryshoi ekuacionin 28 Shtator 2026, 21:0721:07Rajoni dhe Bota Serbia mes Moskës dhe Uashingtonit/ Telefonata e Vuçiç me Putinin pasohet nga mesazhi i Rubios 28 Shtator 2026, 20:1220:12Rajoni dhe Bota