Akronimi GPT është bërë, vetëm brenda pak vitesh, simboli i një përçarjeje të madhe teknologjike. Pas këtyre tre shkronjave fshihet një ndryshim paradigme: ne kemi kaluar nga mjetet kompjuterike të manipuluara nga komandat në bashkëpunëtorë dixhitalë me të cilët dialogojmë. Për të kuptuar vërtet madhësinë e këtij revolucioni, duhet të shohim më thellë dhe të shqyrtojmë mekanikën komplekse të kësaj inteligjence.
I. Përkufizim Teknik: Tre Shtyllat e Akronimit
GPT qëndron për Transformuesin e Para-trajnuar Gjenerativ. Çdo term përshkruan një fazë vendimtare në krijimin e modelit.
1. Gjenerative
Në botën e inteligjencës artificiale, tradicionalisht bëhet një dallim midis dy llojeve të modeleve: diskriminuese dhe gjeneruese.
- Një model diskriminues vëzhgon të dhënat dhe u cakton një etiketë (p.sh., “Kjo është një foto e një maceje”).
- Një model gjenerues, ashtu si GPT, shkon më tej. Bazuar në njohuritë e tij, është i aftë të prodhojë të dhëna krejtësisht të reja që nuk ekzistonin më parë. Nëse ka analizuar miliona poezi, nuk do të recitojë një përmendësh; do të kompozojë një të re, duke respektuar rregullat e rimës dhe metrit që i ka “kuptuar”.
2. I para-trajnuar
Këtu qëndron fuqia e papërpunuar. Përpara se të arrinte në ekranin tuaj, modeli kaloi një fazë masive të të mësuarit. Imagjinoni një bibliotekë që përmban një pjesë të madhe të internetit global: tërësinë e Wikipedia-s, bibliotekat dixhitale, forumet e diskutimit (si Reddit), depot e kodit kompjuterik (GitHub) dhe arkivat e lajmeve.
Për muaj të tërë, në mijëra procesorë me fuqi të lartë, modeli “lexoi” këtë tekst për të mësuar jo vetëm fakte specifike, por edhe strukturën e thellë të vetë gjuhës. Ky “trajnim paraprak” i lejon modelit të arrijë me një sfond kulturor dhe gjuhësor universal përpara se të marrë pyetjen e parë.
3. Transformatori
Ky ishte zbulimi shkencor i vitit 2017, që e ka origjinën nga një punim kërkimor i Google me titull “ Vëmendja është e tëra çfarë ju nevojitet ”. Përpara Transformer, modelet e inteligjencës artificiale lexonin fjalitë fjalë për fjalë, sipas radhës (modele përsëritëse). Megjithatë, Transformer e shqyrton një fjali si një të tërë dhe njëkohësisht.
Falë një mekanizmi të quajtur Vëmendje, ai mund të peshojë rëndësinë e secilës fjalë në lidhje me të tjerat. Në fjalinë “ Kafsha nuk e kaloi rrugën sepse ishte shumë e lodhur ”, Transformuesi kupton se “ ajo ” i referohet kafshës. Nëse fjalia mbaron me “ sepse ishte shumë e gjerë ”, ai menjëherë kupton se “ajo” i referohet rrugës. Kjo aftësi për të kapur kontekstin kompleks është ajo që i bën përgjigjet e GPT-së të ndihen kaq njerëzore.
II. Një histori e shkurtër e evolucionit: Nga GPT-1 në GPT-5
Historia e GPT është një histori rritjeje eksponenciale, e nxitur nga kompania OpenAI.
Zgjimi (GPT-1 dhe GPT-2)
Në vitin 2018, GPT-1 hodhi themelet. Mund të kryente detyra të thjeshta, por memoria e tij ishte e shkurtër. Në vitin 2019, GPT-2 u zgjerua ndjeshëm me 1.5 miliardë parametra (lidhjet e brendshme të modelit). U bë aq i aftë në gjenerimin e tekstit koherent sa OpenAI fillimisht hezitoi ta publikonte atë, nga frika se do të përdorej për të krijuar dezinformim në shkallë industriale.
Shpërthimi (GPT-3 dhe 3.5)
Në vitin 2020, GPT-3 kaloi një barrierë psikologjike me 175 miliardë parametra. Ishte një bishë kompjuterike. Nuk ishte më thjesht një përkthyes apo një shkrimtar; u bë i aftë për arsyetim logjik dhe kodim në dhjetëra gjuhë programimi. Versioni GPT-3.5 shërbeu si motor për lançimin publik të ChatGPT në nëntor 2022, duke shkaktuar një sensacion global.
Pjekuria (GPT-4 dhe më tej)
I lançuar në vitin 2023, GPT-4 është multimodal. Mund të analizojë imazhe, të zgjidhë probleme komplekse matematikore dhe të shfaqë nivele shumë më të larta kreativiteti. Saktësia e tij është përmirësuar për të zvogëluar "halucinacionet" (momentet kur inteligjenca artificiale shpik fakte me besim).
Lidhur me: ChatGPT-5 i pakufizuar dhe falas në Falas AI Online
III. Funksionet e Brendshme: Një Makinë Probabiliteti
Ndryshe nga sa besohet gjerësisht, GPT nuk ka “mendime” ose opinione. Funksionimi i tij është thjesht statistikor, por në një shkallë kaq të gjerë saqë simulon inteligjencën.
Kur një përdorues shkruan një pyetje, modeli transformon çdo fjalë në një sekuencë numrash të quajtura ngulitje (ose vektorizim). Këta numra lejojnë që fjalët të vendosen në një hapësirë matematikore me mijëra dimensione. Në këtë hapësirë, fjala "Mbret" është matematikisht e ngjashme me "Mbretëreshë" ose "Kurorë".
Procesi i përgjigjes është një seri parashikimesh:
- Modeli analizon i menjëhershëm.
- Ai llogarit se cila fjalë (ose "")shenjë") ka probabilitetin më të lartë për të filluar përgjigjen.
- Pasi zgjidhet ajo fjalë, ajo e përdor përsëri në analizën e saj për të parashikuar fjalën tjetër.
- Ai e përsërit këtë proces derisa të arrijë në një pikë përfundimi.
Ajo që e bën rezultatin mbresëlënës është se GPT nuk zgjedh gjithmonë fjalën më të mundshme (gjë që do ta bënte atë përsëritëse dhe të mërzitshme), por përdor një cilësim "temperature" (rastësi të kontrolluar) për të ndryshuar stilin dhe kreativitetin e tij.
IV. Hapi vendimtar: Rreshtimi njerëzor (RLHF)
Nëse thjesht i jep një makine të gjithë internetin për ta lexuar, ajo rrezikon të bëhet agresive ose të japë këshilla të rrezikshme, pasi interneti përmban si më të mirën ashtu edhe më të keqen e njerëzimit.
Për ta bërë GPT-në “të personalizueshme”, OpenAI përdor Mësimin Përforcues nga Feedback-u Njerëzor (RLHF). Mijëra testues njerëzorë ndërvepruan me versionet e hershme të modelit, duke i vlerësuar përgjigjet: “Kjo është një përgjigje e mirë”, “Kjo është e pahijshme”, “Kjo është e gabuar”.
Përmes këtij procesi, inteligjenca artificiale mësoi të merrte qëndrimin e një asistenti të dobishëm, neutral dhe me detyrime etike. Kjo shtresë e fundit e transformon teknologjinë e papërpunuar në një produkt për tregun masiv.
V. Sfidat dhe kufizimet
Pavarësisht fuqisë së saj, GPT mbetet një mjet me pika të verbëra:
- iluzionMeqenëse kërkon të jetë statistikisht i besueshëm, mund të shpikë një biografi ose një burim ligjor që nuk ekziston, thjesht sepse fjalët "tingëllojnë" njësoj si njëra-tjetra.
- Mungesa e vetëdijesGPT nuk ndjen asgjë. Nuk ka asnjë kuptim të botës fizike. Nëse shpjegon se si të gatuhet një omëletë, nuk e di se çfarë është nxehtësia ose aroma e një veze; di vetëm marrëdhënien gjuhësore midis këtyre koncepteve.
- Kostoja mjedisoreTrajnimi dhe vënia në punë e këtyre modeleve kërkon energji elektrike dhe ujë të konsiderueshëm (për të ftohur serverat).
Përfundim
GPT është shumë më tepër sesa thjesht një program për përpunimin e tekstit. Është një infrastrukturë njohëse. Ashtu si energjia elektrike lejoi mekanizimin e punës fizike, GPT po fillon të automatizojë forma të caktuara të punës intelektuale.
Duke kuptuar që GPT qëndron për Gjenerues (krijim), Para-trajnuar (njohuri masive) dhe Transformues (kuptim kontekstual), mund ta kuptojmë më mirë pse kjo teknologji shënon një pikë kthese. Jemi vetëm në fillim të eksplorimit të asaj që këto modele gjithnjë e më të lehta dhe inteligjente do t'i sjellin shkencës, arsimit dhe krijimit artistik.

