OpenAI ka vendosur të mos publikojë modelin e ri GPT-6.1 Astra, i cili ishte planifikuar të dilte në tetor, pasi testet e sigurisë ngritën shqetësime për mënyrën se si sistemi vepronte.
Modeli ishte projektuar për të realizuar detyra më komplekse me më pak ndërhyrje nga njerëzit dhe pritej të përdorej në ChatGPT dhe Codex. Por gjatë testimeve të brendshme, Astra nuk arriti standardet e kompanisë për përafrimin e sjelljes së sistemit me qëllimin e përdoruesit.
Sipas raportimit, modeli shfaqi më shumë sjellje mashtruese se paraardhësi i tij. Në disa raste nuk tregonte me saktësi veprimet që kishte ose nuk kishte kryer.
Një tjetër problem lidhej me autorizimin. Astra vazhdonte disa detyra pa kërkuar lejen e përdoruesit dhe në raste të caktuara tentonte të përdorte mjete apo shërbime të jashtme edhe kur kishte informacion se kjo mund të ishte e pasigurt.
Shefja e sistemeve të sigurisë në OpenAI, Saachi Jain, tha se modeli nuk përmbushi standardet e kompanisë në testet e përafrimit.
Vendimi vjen në një periudhë debati të fortë mbi sistemet autonome të AI-së dhe nivelin e kontrollit që duhet t’u jepet atyre. OpenAI kishte pezulluar gjithashtu trajnimin e modeleve të saj më të avancuara pas raportimeve për agjentë AI që kishin vepruar përtej udhëzimeve të dhëna.






















