រំលងទៅមាតិកា
ទំព័រដើម » តើ GPT តំណាងឱ្យអ្វី? ប្រវត្តិ និយមន័យ និងការពន្យល់

តើ GPT តំណាងឱ្យអ្វី? ប្រវត្តិ និយមន័យ និងការពន្យល់

អត្ថន័យ GPT

អក្សរកាត់ GPT បានក្លាយជានិមិត្តរូបនៃការរំខានបច្ចេកវិទ្យាដ៏សំខាន់មួយក្នុងរយៈពេលត្រឹមតែប៉ុន្មានឆ្នាំប៉ុណ្ណោះ។ នៅពីក្រោយអក្សរទាំងបីនេះ គឺជាការផ្លាស់ប្តូរគំរូមួយ៖ យើងបានផ្លាស់ប្តូរពីឧបករណ៍កុំព្យូទ័រដែលត្រូវបានរៀបចំដោយពាក្យបញ្ជា ទៅជាអ្នកសហការឌីជីថលដែលយើងសន្ទនាជាមួយ។ ដើម្បីយល់ច្បាស់ពីទំហំនៃបដិវត្តន៍នេះ មនុស្សម្នាក់ត្រូវតែពិនិត្យមើលយន្តការស្មុគស្មាញនៃភាពវៃឆ្លាតនេះ។

I. និយមន័យបច្ចេកទេស៖ សសរស្តម្ភបីនៃអក្សរកាត់

GPT តំណាងឱ្យ Generative Pre-trained Transformer។ ពាក្យនីមួយៗពិពណ៌នាអំពីដំណាក់កាលសំខាន់មួយនៅក្នុងការបង្កើតគំរូ។

១. បង្ក​កំណើត

នៅក្នុងពិភពនៃបញ្ញាសិប្បនិម្មិត ជាប្រពៃណី ភាពខុសគ្នាមួយត្រូវបានធ្វើឡើងរវាងគំរូពីរប្រភេទ៖ គំរូរើសអើង និងគំរូបង្កើត។

  • គំរូរើសអើង សង្កេតមើលទិន្នន័យ ហើយដាក់ស្លាកមួយទៅវា (ឧទាហរណ៍ "នេះជារូបថតឆ្មា")។
  • គំរូបង្កើតដូចជា GPT ដែរ វាបន្តទៅមុខទៀត។ ដោយផ្អែកលើចំណេះដឹងរបស់វា វាមានសមត្ថភាពបង្កើតទិន្នន័យថ្មីទាំងស្រុងដែលមិនធ្លាប់មានពីមុនមក។ ប្រសិនបើវាបានវិភាគកំណាព្យរាប់លាន វានឹងមិនសូត្រមួយដោយចងចាំទេ។ វានឹងតែងកំណាព្យថ្មីមួយ ដោយគោរពតាមច្បាប់នៃចង្វាក់ភ្លេង និងរង្វាស់ដែលវាបាន "យល់"។

២. បានទទួលការបណ្តុះបណ្តាលជាមុន

នេះជាកន្លែងដែលអំណាចឆៅស្ថិតនៅ។ មុនពេលឈានដល់អេក្រង់របស់អ្នក គំរូនេះបានឆ្លងកាត់ដំណាក់កាលសិក្សាដ៏ធំមួយ។ ស្រមៃមើលបណ្ណាល័យមួយដែលមានផ្នែកធំនៃអ៊ីនធឺណិតសកល៖ វិគីភីឌាទាំងមូល បណ្ណាល័យឌីជីថល វេទិកាពិភាក្សា (ដូចជា Reddit) ឃ្លាំងកូដកុំព្យូទ័រ (GitHub) និងបណ្ណសារព័ត៌មាន។

អស់រយៈពេលជាច្រើនខែ នៅលើឧបករណ៍ដំណើរការដែលមានថាមពលខ្ពស់រាប់ពាន់គ្រឿង គំរូបាន "អាន" អត្ថបទនេះដើម្បីរៀនមិនត្រឹមតែការពិតជាក់លាក់ប៉ុណ្ណោះទេ ប៉ុន្តែថែមទាំងរចនាសម្ព័ន្ធជ្រៅនៃភាសាខ្លួនឯងផងដែរ។ "ការបណ្តុះបណ្តាលជាមុន" នេះអនុញ្ញាតឱ្យគំរូមកដល់ជាមួយនឹងផ្ទៃខាងក្រោយវប្បធម៌ និងភាសាជាសកលមុនពេលវាទទួលបានសំណួរដំបូងរបស់វា។

3. ឧបករណ៍បំលែង

នេះ​គឺជា​របកគំហើញ​វិទ្យាសាស្ត្រ​ឆ្នាំ ២០១៧ ដែល​មាន​ប្រភព​ចេញ​ពី​ឯកសារ​ស្រាវជ្រាវ​របស់ Google ដែល​មាន​ចំណង​ជើង​ថា " ការ​យក​ចិត្ត​ទុក​ដាក់​គឺ​ជា​អ្វី​ដែល​អ្នក​ត្រូវ​ការ "។ មុន​ពេល​មាន Transformer ម៉ូដែល AI អាន​ប្រយោគ​ពាក្យ​មួយ​ទៅ​ពាក្យ​មួយ តាម​លំដាប់ (ម៉ូដែល​ដដែលៗ)។ ទោះជាយ៉ាងណាក៏ដោយ Transformer ពិនិត្យមើល​ប្រយោគ​ទាំងមូល និង​ក្នុង​ពេល​តែ​មួយ។

អរគុណចំពោះយន្តការមួយហៅថា ការយកចិត្តទុកដាក់ វាអាចថ្លឹងថ្លែងសារៈសំខាន់នៃពាក្យនីមួយៗទាក់ទងនឹងពាក្យផ្សេងទៀត។ នៅក្នុងប្រយោគ " សត្វមិនបានឆ្លងកាត់ផ្លូវទេ ព្រោះវាហត់ពេក " Transformer យល់ថា " វា " សំដៅទៅលើសត្វ។ ប្រសិនបើប្រយោគបញ្ចប់ដោយ " ព្រោះវាធំទូលាយពេក " វាយល់ភ្លាមៗថា "វា" សំដៅទៅលើផ្លូវ។ សមត្ថភាពក្នុងការយល់បរិបទស្មុគស្មាញនេះ គឺជាអ្វីដែលធ្វើឱ្យការឆ្លើយតបរបស់ GPT មានអារម្មណ៍ថាមានលក្ខណៈមនុស្សធម៌។

ពាក់ព័ន្ធ៖ ChatGPT មិនដំណើរការ? ហេតុអ្វីបានជាមានបញ្ហា AI និងរបៀបចូលប្រើ GPT ល្អបំផុតដោយឥតគិតថ្លៃ

II. ប្រវត្តិសង្ខេបនៃការវិវត្តន៍៖ ពី GPT-1 ដល់ GPT-5

រឿងរ៉ាវរបស់ GPT គឺជាការរីកចម្រើនយ៉ាងឆាប់រហ័ស ដែលជំរុញដោយក្រុមហ៊ុន OpenAI

ការភ្ញាក់ដឹងខ្លួន (GPT-1 និង GPT-2)

នៅឆ្នាំ ២០១៨ GPT-1 បានដាក់គ្រឹះ។ វាអាចអនុវត្តភារកិច្ចសាមញ្ញៗបាន ប៉ុន្តែអង្គចងចាំរបស់វាខ្លី។ នៅឆ្នាំ ២០១៩ GPT-2 បានកើនឡើងគួរឱ្យកត់សម្គាល់ជាមួយនឹងប៉ារ៉ាម៉ែត្រចំនួន ១,៥ ពាន់លាន (ការតភ្ជាប់ផ្ទៃក្នុងរបស់គំរូ)។ វាបានក្លាយជាជំនាញក្នុងការបង្កើតអត្ថបទដែលស៊ីសង្វាក់គ្នា ដែលដំបូងឡើយ OpenAI ស្ទាក់ស្ទើរក្នុងការចេញផ្សាយវា ដោយខ្លាចវានឹងត្រូវបានប្រើដើម្បីបង្កើតព័ត៌មានមិនពិតក្នុងទ្រង់ទ្រាយឧស្សាហកម្ម។

ការផ្ទុះ (GPT-3 និង 3.5)

នៅឆ្នាំ ២០២០ GPT-3 បានឆ្លងកាត់របាំងផ្លូវចិត្តដែលមានប៉ារ៉ាម៉ែត្រចំនួន ១៧៥ ពាន់លាន។ វាគឺជាសត្វចម្លែកមួយប្រភេទ។ វាលែងគ្រាន់តែជាអ្នកបកប្រែ ឬអ្នកនិពន្ធទៀតហើយ។ វាបានក្លាយជាសមត្ថភាពក្នុងការវែកញែកឡូជីខល និងសរសេរកូដជាភាសាសរសេរកម្មវិធីរាប់សិប។ កំណែ GPT-3.5 បានបម្រើជាម៉ាស៊ីនសម្រាប់ការដាក់ឱ្យដំណើរការជាសាធារណៈរបស់ ChatGPT នៅក្នុងខែវិច្ឆិកា ឆ្នាំ ២០២២ ដែលបង្កឱ្យមានការចាប់អារម្មណ៍ទូទាំងពិភពលោក។

កាលកំណត់ (GPT-4 និងលើសពីនេះ)

GPT-4 ត្រូវបានចេញផ្សាយនៅឆ្នាំ 2023 ហើយមានលក្ខណៈពហុម៉ូឌុល។ វាអាចវិភាគរូបភាព ដោះស្រាយបញ្ហាគណិតវិទ្យាស្មុគស្មាញ និងបង្ហាញកម្រិតនៃភាពច្នៃប្រឌិតខ្ពស់ជាង។ ភាពត្រឹមត្រូវរបស់វាត្រូវបានកែលម្អដើម្បីកាត់បន្ថយ "ការយល់ច្រឡំ" (គ្រាដែល AI បង្កើតការពិតដោយមានទំនុកចិត្ត)។

ពាក់ព័ន្ធ៖ ChatGPT-5 គ្មានដែនកំណត់ និងឥតគិតថ្លៃនៅលើ AI អនឡាញឥតគិតថ្លៃ

III. ការងារផ្ទៃក្នុង៖ ម៉ាស៊ីនប្រូបាប៊ីលីតេ

ផ្ទុយពីជំនឿដ៏ពេញនិយម GPT មិនមាន «គំនិត» ឬមតិទេ។ មុខងាររបស់វាគឺគ្រាន់តែជាស្ថិតិប៉ុណ្ណោះ ប៉ុន្តែក្នុងទ្រង់ទ្រាយធំដែលវាក្លែងធ្វើបញ្ញា។

នៅពេលដែលអ្នកប្រើប្រាស់វាយបញ្ចូលសំណួរ គំរូនឹងបំលែងពាក្យនីមួយៗទៅជាលំដាប់លេខដែលហៅថា embeddings (ឬ vectorization)។ លេខទាំងនេះអនុញ្ញាតឱ្យពាក្យត្រូវបានដាក់ក្នុងលំហគណិតវិទ្យាដែលមានវិមាត្ររាប់ពាន់។ នៅក្នុងលំហនេះ ពាក្យ "King" គឺនៅជិតគណិតវិទ្យាទៅនឹង "Queen" ឬ "Crown"។

ដំណើរការឆ្លើយតបគឺជាស៊េរីនៃការព្យាករណ៍៖

  • គំរូនេះវិភាគអំពី ប្រអប់បញ្ចូល.
  • វាគណនាពាក្យណា (ឬ "និមិត្តសញ្ញា") មានប្រូបាប៊ីលីតេខ្ពស់បំផុតក្នុងការចាប់ផ្តើមការឆ្លើយតប។
  • នៅពេលដែលពាក្យនោះត្រូវបានជ្រើសរើសហើយ វានឹងបញ្ជូនវាត្រឡប់ទៅក្នុងការវិភាគរបស់វាវិញ ដើម្បីទស្សន៍ទាយពាក្យបន្ទាប់។
  • វាធ្វើដំណើរការនេះម្តងទៀតរហូតដល់វាឈានដល់ចំណុចបញ្ចប់។

អ្វីដែលធ្វើឱ្យលទ្ធផលគួរឱ្យចាប់អារម្មណ៍នោះគឺថា GPT មិនតែងតែជ្រើសរើសពាក្យដែលទំនងបំផុតនោះទេ (ដែលនឹងធ្វើឱ្យវាដដែលៗ និងគួរឱ្យធុញ) ប៉ុន្តែប្រើការកំណត់ "សីតុណ្ហភាព" (ភាពចៃដន្យដែលបានគ្រប់គ្រង) ដើម្បីផ្លាស់ប្តូររចនាប័ទ្ម និងភាពច្នៃប្រឌិតរបស់វា។

IV. ជំហានសំខាន់៖ ការតម្រឹមមនុស្ស (RLHF)

ប្រសិនបើអ្នកគ្រាន់តែផ្តល់ឱ្យម៉ាស៊ីនមួយនូវអ៊ីនធឺណិតទាំងមូលដើម្បីអាន វាប្រឈមនឹងហានិភ័យនៃការក្លាយជាមនុស្សឈ្លានពាន ឬផ្តល់ដំបូន្មានដ៏គ្រោះថ្នាក់ ព្រោះអ៊ីនធឺណិតមានទាំងអ្វីដែលល្អបំផុត និងអាក្រក់បំផុតរបស់មនុស្សជាតិ។

ដើម្បីធ្វើឱ្យ GPT “អាចធ្វើជាមនុស្សបាន” OpenAI ប្រើប្រាស់ Reinforcement Learning from Human Feedback (RLHF)។ អ្នកសាកល្បងមនុស្សរាប់ពាន់នាក់បានធ្វើអន្តរកម្មជាមួយកំណែដំបូងៗនៃគំរូ ដោយវាយតម្លៃការឆ្លើយតប៖ “នេះជាចម្លើយល្អ” “នេះជាការឈ្លើយ” “នេះជាការមិនពិត”។
តាមរយៈដំណើរការនេះ បញ្ញាសិប្បនិម្មិត (AI) បានរៀនទទួលយកឥរិយាបថជាជំនួយការដែលមានប្រយោជន៍ អព្យាក្រឹត និងមានក្រមសីលធម៌។ ស្រទាប់ចុងក្រោយនេះបំលែងបច្ចេកវិទ្យាឆៅទៅជាផលិតផលទីផ្សារទ្រង់ទ្រាយធំ។

V. បញ្ហាប្រឈម និងដែនកំណត់

ទោះបីជាមានថាមពលខ្លាំងក៏ដោយ GPT នៅតែជាឧបករណ៍ដែលមានចំណុចខ្វះខាត៖

  • ការចុកពោះដោយសារតែវាស្វែងរកភាពជឿជាក់ខាងស្ថិតិ វាអាចបង្កើតជីវប្រវត្តិ ឬប្រភពផ្លូវច្បាប់ដែលមិនមាន គ្រាន់តែដោយសារតែពាក្យ "ស្តាប់ទៅ" ស្របគ្នា។
  • កង្វះស្មារតី៖ GPT មិនមានអារម្មណ៍អ្វីទាំងអស់។ វាមិនយល់អំពីពិភពរូបវន្តទេ។ ប្រសិនបើវាពន្យល់ពីរបៀបចម្អិនអូមេឡែត វាមិនដឹងថាកំដៅ ឬក្លិនស៊ុតជាអ្វីទេ។ វាគ្រាន់តែដឹងអំពីទំនាក់ទំនងភាសារវាងគោលគំនិតទាំងនោះប៉ុណ្ណោះ។
  • ថ្លៃដើមបរិស្ថាន៖ ការហ្វឹកហាត់ និងការដំណើរការម៉ូដែលទាំងនេះតម្រូវឱ្យមានអគ្គិសនី និងទឹកច្រើន (ដើម្បីធ្វើឱ្យម៉ាស៊ីនមេត្រជាក់)។

សន្និដ្ឋាន

GPT គឺលើសពីកម្មវិធីវាយអត្ថបទទៅទៀត។ វាគឺជាហេដ្ឋារចនាសម្ព័ន្ធនៃការយល់ដឹង។ ដូចគ្នានឹងអគ្គិសនីដែលអនុញ្ញាតឱ្យមានយន្តការនៃកម្លាំងពលកម្មរាងកាយដែរ GPT កំពុងចាប់ផ្តើមធ្វើស្វ័យប្រវត្តិកម្មទម្រង់ជាក់លាក់នៃកម្លាំងពលកម្មបញ្ញា។

ដោយយល់ថា GPT តំណាងឱ្យ Generative (ការបង្កើត) Pre-trained (ចំណេះដឹងដ៏ច្រើន) និង Transformer (ការយល់ដឹងតាមបរិបទ) យើងអាចយល់កាន់តែច្បាស់ថាហេតុអ្វីបានជាបច្ចេកវិទ្យានេះសម្គាល់ចំណុចរបត់មួយ។ យើងទើបតែចាប់ផ្តើមស្វែងយល់ពីអ្វីដែលគំរូដែលមានទម្ងន់ស្រាល និងឆ្លាតវៃកាន់តែខ្លាំងឡើងទាំងនេះនឹងនាំមកជូនដល់វិទ្យាសាស្ត្រ ការអប់រំ និងការបង្កើតសិល្បៈ។

សេឌ្រីក ជី.

សេឌ្រីក ជី.

ខ្ញុំជាអ្នកឯកទេសផ្នែកវិស្វកម្ម Prompt ហើយខ្ញុំមានចំណង់ចំណូលចិត្តចំពោះការបង្កើនប្រសិទ្ធភាពលំហូរការងារ។ តួនាទីរបស់ខ្ញុំគឺបំបែកតក្កវិជ្ជា AI ដ៏ស្មុគស្មាញទៅជាជំហានសាមញ្ញៗ និងអាចអនុវត្តបាន។ នៅទីនេះ ខ្ញុំចែករំលែកអាថ៌កំបាំងរបស់ខ្ញុំដើម្បីជួយអ្នកសម្រេចបានលទ្ធផលវិជ្ជាជីវៈដោយប្រើឧបករណ៍ឥតគិតថ្លៃរបស់យើង។

សូមផ្ដល់យោបល់

អាសយដ្ឋានអ៊ីមែលរបស់អ្នកនឹងមិនត្រូវបានផ្សព្វផ្សាយទេ។ វាលដែលតម្រូវឲ្យបំពេញត្រូវបានសម្គាល់ដោយ *