Langkau ke kandungan
Rumah » Apakah yang dimaksudkan dengan GPT? Sejarah, definisi dan penjelasan

Apakah yang dimaksudkan dengan GPT? Sejarah, definisi dan penjelasan

Maksud GPT

Akronim GPT telah menjadi, dalam beberapa tahun sahaja, simbol gangguan teknologi yang besar. Di sebalik tiga huruf ini terdapat anjakan paradigma: kita telah beralih daripada alat pengkomputeran yang dimanipulasi oleh arahan kepada kolaborator digital yang kita ajak berdialog. Untuk benar-benar memahami magnitud revolusi ini, seseorang mesti melihat ke sebalik dan mengkaji mekanik kompleks kecerdasan ini.

I. Definisi Teknikal: Tiga Rukun Akronim

GPT bermaksud Transformer Pra-terlatih Generatif. Setiap istilah menggambarkan peringkat penting dalam penciptaan model.

1. Generatif

Dalam dunia kecerdasan buatan, perbezaan secara tradisinya dibuat antara dua jenis model: diskriminatif dan generatif.

  • Model diskriminatif memerhati data dan memberikan label kepadanya (cth., “Ini ialah gambar kucing”).
  • Model generatif, seperti GPT, melangkah lebih jauh. Berdasarkan pengetahuannya, ia mampu menghasilkan data baharu sepenuhnya yang tidak wujud sebelum ini. Jika ia telah menganalisis berjuta-juta puisi, ia tidak akan menghafalnya satu persatu; ia akan mengarang puisi baharu, menghormati peraturan rima dan meter yang telah "difahami"nya.

2. Pra-terlatih

Di sinilah terletaknya kuasa mentah. Sebelum sampai ke skrin anda, model tersebut telah melalui fasa pembelajaran yang besar. Bayangkan sebuah perpustakaan yang mengandungi sebahagian besar internet global: keseluruhan Wikipedia, perpustakaan digital, forum perbincangan (seperti Reddit), repositori kod komputer (GitHub) dan arkib berita.

Selama berbulan-bulan, pada beribu-ribu pemproses berkuasa tinggi, model tersebut "membaca" teks ini untuk mempelajari bukan sahaja fakta khusus, tetapi juga struktur bahasa yang mendalam itu sendiri. "Pra-latihan" ini membolehkan model tersebut tiba dengan latar belakang budaya dan linguistik universal sebelum ia menerima soalan pertamanya.

3. Transformer

Ini merupakan kejayaan saintifik pada tahun 2017, yang berasal daripada kertas penyelidikan Google bertajuk “ Perhatian Adalah Semua Yang Anda Perlukan .” Sebelum Transformer, model AI membaca ayat perkataan demi perkataan, mengikut susunan (model berulang). Walau bagaimanapun, Transformer melihat ayat secara keseluruhan dan serentak.

Terima kasih kepada mekanisme yang dipanggil Attention, ia dapat menimbang kepentingan setiap perkataan berhubung dengan perkataan lain. Dalam ayat “ Haiwan itu tidak melintas jalan kerana terlalu letih ,” Transformer memahami bahawa “ ia ” merujuk kepada haiwan tersebut. Jika ayat itu berakhir dengan “ kerana terlalu lebar ,” ia serta-merta memahami bahawa “ia” merujuk kepada jalan. Keupayaan untuk memahami konteks yang kompleks inilah yang menjadikan respons GPT terasa begitu manusiawi.

Berkaitan: ChatGPT Tergendala? Mengapa gangguan AI dan cara mengakses GPT terbaik secara percuma

II. Sejarah ringkas evolusi: Dari GPT-1 hingga GPT-5

Kisah GPT merupakan kisah pertumbuhan eksponen, didorong oleh syarikat OpenAI.

Kebangkitan (GPT-1 dan GPT-2)

Pada tahun 2018, GPT-1 telah meletakkan asasnya. Ia boleh melaksanakan tugas-tugas mudah, tetapi ingatannya pendek. Pada tahun 2019, GPT-2 telah berkembang dengan ketara dengan 1.5 bilion parameter (sambungan dalaman model). Ia menjadi begitu mahir dalam menghasilkan teks yang koheren sehingga OpenAI pada mulanya teragak-agak untuk mengeluarkannya, kerana bimbang ia akan digunakan untuk mencipta maklumat salah berskala industri.

Letupan (GPT-3 dan 3.5)

Pada tahun 2020, GPT-3 telah melepasi halangan psikologi dengan 175 bilion parameter. Ia merupakan satu raksasa pengiraan. Ia bukan lagi sekadar penterjemah atau penulis; ia berupaya membuat penaakulan logik dan pengekodan dalam berpuluh-puluh bahasa pengaturcaraan. Versi GPT-3.5 berfungsi sebagai enjin untuk pelancaran awam ChatGPT pada November 2022, yang menyebabkan sensasi global.

Kematangan (GPT-4 dan Seterusnya)

Dikeluarkan pada tahun 2023, GPT-4 bersifat multimodal. Ia boleh menganalisis imej, menyelesaikan masalah matematik yang kompleks dan memaparkan tahap kreativiti yang jauh lebih tinggi. Ketepatannya telah diperhalusi untuk mengurangkan "halusinasi" (saat-saat di mana AI dengan yakin mencipta fakta).

Berkaitan: ChatGPT-5 tanpa had dan percuma pada AI Dalam Talian Percuma

III. Kerja Dalaman: Mesin Kebarangkalian

Bertentangan dengan kepercayaan popular, GPT tidak mempunyai "pemikiran" atau pendapat. Fungsinya adalah semata-mata statistik, tetapi pada skala yang begitu luas sehingga ia mensimulasikan kecerdasan.

Apabila pengguna menaip pertanyaan, model tersebut akan mengubah setiap perkataan menjadi jujukan nombor yang dipanggil penyematan (atau vektorisasi). Nombor-nombor ini membolehkan perkataan diletakkan dalam ruang matematik dengan beribu-ribu dimensi. Dalam ruang ini, perkataan "Raja" secara matematiknya hampir dengan "Ratu" atau "Mahkota".

Proses tindak balas adalah satu siri ramalan:

  • Model tersebut menganalisis segera.
  • Ia mengira perkataan yang mana (atau "token") mempunyai kebarangkalian tertinggi untuk memulakan tindak balas.
  • Sebaik sahaja perkataan itu dipilih, ia akan memasukkannya kembali ke dalam analisisnya untuk meramalkan perkataan seterusnya.
  • Ia mengulangi proses ini sehingga mencapai titik penamatan.

Apa yang menjadikan hasilnya mengagumkan ialah GPT tidak selalunya memilih perkataan yang paling mungkin (yang akan menjadikannya berulang dan membosankan), tetapi menggunakan tetapan "suhu" (keacakan terkawal) untuk mengubah gaya dan kreativitinya.

IV. Langkah penting: Penjajaran manusia (RLHF)

Jika anda hanya memberikan mesin seluruh internet untuk dibaca, ia berisiko menjadi agresif atau memberikan nasihat yang berbahaya, kerana internet mengandungi kedua-dua sifat manusia yang terbaik dan terburuk.

Untuk menjadikan GPT “berwatak menarik”, OpenAI menggunakan Pembelajaran Pengukuhan daripada Maklum Balas Manusia (RLHF). Beribu-ribu penguji manusia berinteraksi dengan versi awal model, menilai respons: “Ini jawapan yang baik,” “Ini biadap,” “Ini salah.”
Melalui proses ini, AI belajar untuk mengambil sikap sebagai pembantu yang membantu, neutral dan terikat secara beretika. Lapisan terakhir ini mengubah teknologi mentah menjadi produk pasaran besar-besaran.

V. Cabaran dan batasan

Walaupun mempunyai kuasa, GPT kekal sebagai alat yang mempunyai titik buta:

  • HallucinationOleh kerana ia bertujuan untuk menjadi boleh dipercayai secara statistik, ia mungkin mereka-reka biografi atau sumber undang-undang yang tidak wujud, hanya kerana perkataan "bunyi" yang sepadan.
  • Kurang kesedaranGPT tidak merasa apa-apa. Ia tidak memahami dunia fizikal. Jika ia menerangkan cara memasak telur dadar, ia tidak tahu apa itu kepanasan atau bau telur; ia hanya mengetahui hubungan linguistik antara konsep-konsep tersebut.
  • Kos alam sekitarMelatih dan menjalankan model ini memerlukan elektrik dan air yang banyak (untuk menyejukkan pelayan).

Kesimpulan

GPT jauh lebih daripada sekadar perisian pemprosesan perkataan. Ia adalah infrastruktur kognitif. Sama seperti elektrik yang membolehkan mekanisasi kerja fizikal, GPT mula mengautomasikan bentuk kerja intelektual tertentu.

Dengan memahami bahawa GPT bermaksud Generatif (penciptaan), Pra-terlatih (pengetahuan besar-besaran), dan Transformer (pemahaman kontekstual), kita dapat lebih memahami mengapa teknologi ini menandakan titik perubahan. Kita baru sahaja di peringkat awal meneroka apa yang akan dibawa oleh model yang semakin ringan dan pintar ini kepada sains, pendidikan dan penciptaan artistik.

Cédric G.

Cédric G.

Saya seorang pakar Kejuruteraan Prompt dan saya berminat dengan pengoptimuman aliran kerja. Peranan saya adalah untuk memecahkan logik AI yang kompleks kepada langkah-langkah mudah dan boleh diambil tindakan. Di sini, saya berkongsi rahsia saya untuk membantu anda mencapai hasil profesional menggunakan alatan percuma kami.

Sila tinggalkan balasan anda

Alamat e-mel anda tidak akan disiarkan. Medan yang diperlukan ditanda *