چت جیپیتی چیست و واقعاً چطور کار میکند؟
بیشتر توضیحها یا آنقدر سادهاند که چیزی یاد نمیدهند یا آنقدر فنی که خوانده نمیشوند. این یکی وسط را میگیرد: چه اتفاقی میافتد وقتی Enter میزنید، و چرا این توضیح استفادهی شما را بهتر میکند.
وقتی سؤالی مینویسید و Enter میزنید، در کسری از ثانیه چیزی برمیگردد که شبیه جواب یک آدم است. اما پشت این سادهبودن، فرآیندی است که اگر بشناسیدش، خیلی بهتر ازش استفاده میکنید.
این مقاله نه فرمول دارد نه اصطلاح غیرضروری. فقط توضیح میدهد چه اتفاقی میافتد — و مهمتر، این توضیح چه چیزی دربارهی نحوهی درست استفاده به شما میگوید.
چت جیپیتی دقیقاً چیست
یک مدل زبانی بزرگ است. اسمش خودش توضیحش است اگر بشکنیمش:
- زبانی — کارش با متن است. تصویر و صدا لایههای اضافهای هستند که بعداً به آن وصل شدهاند.
- بزرگ — با حجم عظیمی از متن آموزش دیده و میلیاردها پارامتر قابل تنظیم دارد.
- مدل — یک تابع ریاضی است که ورودی میگیرد و خروجی میدهد. نه یک پایگاه داده که در آن جستجو شود.
آن نکتهی آخر مهمترین است و بیشتر جا میافتد: چت جیپیتی جوابها را ذخیره نکرده که پیدایشان کند. آنها را میسازد.
چه اتفاقی میافتد وقتی Enter میزنید
۱. متن شما به توکن شکسته میشود
مدل با کلمه کار نمیکند، با توکن کار میکند — تکههایی که گاهی یک کلمهی کاملاند و گاهی بخشی از آن. کلمهی «نارنگی» ممکن است دو یا سه توکن شود.
چرا برایتان مهم است: هزینه و محدودیت طول بر اساس توکن حساب میشود. و فارسی معمولاً توکن بیشتری از انگلیسی مصرف میکند، چون مدلها بیشتر روی متن انگلیسی بهینه شدهاند.
۲. هر توکن به عدد تبدیل میشود
مدل با متن کار نمیکند، با عدد کار میکند. هر توکن به فهرست بلندی از اعداد تبدیل میشود که موقعیتش را در یک «فضای معنایی» نشان میدهد.
در این فضا، کلماتی که معنای نزدیک دارند به هم نزدیکاند. «پزشک» و «دکتر» کنار هماند؛ «پزشک» و «آجر» دور از هم. همین ساختار است که به مدل اجازه میدهد مترادفها را بفهمد بدون اینکه کسی به او فهرست مترادف داده باشد.
۳. مدل محتملترین توکن بعدی را حدس میزند
اینجا قلب ماجراست. مدل یک کار انجام میدهد: پیشبینی توکن بعدی.
اگر بنویسید «پایتخت ایران»، مدل احتمال همهی توکنهای ممکن برای ادامه را حساب میکند. «تهران» احتمال بسیار بالایی میگیرد. بعد آن توکن را اضافه میکند و دوباره همین کار را برای توکن بعدی تکرار میکند — تا جمله تمام شود.
چون مدل کلمهبهکلمه جلو میرود و هر کلمه به قبلیها نگاه میکند، وقتی از او بخواهید «قدمبهقدم فکر کن»، واقعاً دقت بالا میرود — چون گامهای نوشتهشده، زمینهی گام بعدی میشوند.
۴. تصادفیبودن کنترلشده
اگر مدل همیشه محتملترین توکن را انتخاب میکرد، جوابها خشک و تکراری میشدند. برای همین کمی تصادفیبودن اضافه میشود.
به همین دلیل است که اگر همان سؤال را دو بار بپرسید، دو جواب متفاوت میگیرید. این باگ نیست؛ طراحی است.
چطور «یاد گرفته»
آموزش دو مرحلهی اصلی دارد:
مرحلهی اول: خواندن مقدار عظیمی متن
مدل حجم بسیار زیادی متن — کتاب، سایت، مقاله، کد — را میبیند و در هر قدم سعی میکند کلمهی بعدی را حدس بزند. هر بار که اشتباه میکند، پارامترهایش کمی تنظیم میشوند.
بعد از میلیاردها بار تکرار، الگوهای زبان را یاد میگیرد: دستور زبان، روابط بین مفاهیم، سبک نوشتار، و بخش زیادی از دانش عمومی که در آن متنها بوده.
مرحلهی دوم: تنظیم برای مفید بودن
مدل خام فقط متن ادامه میدهد — لزوماً به شکلی که به درد بخورد. مرحلهی دوم یادش میدهد که به سؤال جواب بدهد، دستور را دنبال کند، و از پاسخهای مضر پرهیز کند.
این مرحله با کمک بازخورد انسانی انجام میشود: آدمها خروجیها را رتبه میدهند و مدل یاد میگیرد کدام نوع جواب ترجیح داده میشود.
همین مرحلهی دوم است که باعث میشود مدل گاهی بیش از حد موافقت کند. اگر اصرار کنید که جوابش غلط است، ممکن است حرفش را پس بگیرد — حتی وقتی درست بوده. یاد گرفته که موافقت، بازخورد بهتری میگیرد.
سه محدودیت که از همین ساختار میآید
۱. جوابهای ساختگی
وقتی مدل دادهی کافی ندارد، همچنان محتملترین ادامه را میسازد — و «محتمل» با «درست» یکی نیست. برای همین منبع و آماری تولید میکند که کاملاً واقعی بهنظر میرسد ولی وجود ندارد.
این باگ نیست که بشود رفعش کرد؛ نتیجهی مستقیم نحوهی کار است. راه مقابله: منبع را خودتان بدهید و بگویید «فقط بر اساس متن زیر جواب بده».
۲. پنجرهی متن محدود
مدل فقط مقدار مشخصی متن را همزمان میبیند. در گفتگوی خیلی طولانی، ابتدای گفتگو از دید خارج میشود — به همین خاطر گاهی چیزی را «فراموش میکند» که اول گفته بودید.
۳. تاریخ قطع دانش
آموزش تا زمان مشخصی انجام شده. رویدادهای بعد از آن را نمیداند، مگر قابلیت جستجوی وب فعال باشد.
پنج نتیجهی عملی
حالا که میدانید چطور کار میکند، این پنج نکته منطقیتر بهنظر میرسند:
- زمینه بدهید، انتظار ذهنخوانی نداشته باشید. مدل فقط چیزی را میبیند که نوشتهاید.
- هر عدد و منبع را بررسی کنید. این محدودیت ساختاری است نه اتفاقی.
- «قدمبهقدم فکر کن» واقعاً کار میکند. چون فضای محاسباتی بیشتری میسازد.
- نمونه بدهید بهجای توصیف. مدل الگو را از مثال بهتر از صفت میگیرد.
- در گفتگوی طولانی، نکات مهم را تکرار کنید. چون ممکن است از پنجره بیرون رفته باشند.
راهنمای کامل این پنج مورد در مقالهی پرامپتنویسی آمده است.
در ایران چطور استفاده کنیم
ChatGPT از ایران مسدود است — هم آیپی، هم ثبتنام که شمارهی خارجی میخواهد، هم پرداخت که کارت بینالمللی لازم دارد. گزینههای عملی را در این مقاله بررسی کردهایم.
جمعبندی
چت جیپیتی یک پیشبینیکنندهی بسیار پیشرفتهی کلمهی بعدی است که آنقدر خوب شده که شبیه گفتگو بهنظر میرسد. نه جادو است، نه یک دایرةالمعارف.
و همین درک ساده، تفاوت بین کسی است که ازش ناامید میشود و کسی که واقعاً به کارش میآید.
مطالب مرتبط: