چت جی‌پی‌تی چیست و واقعاً چطور کار می‌کند؟

بیشتر توضیح‌ها یا آنقدر ساده‌اند که چیزی یاد نمی‌دهند یا آنقدر فنی که خوانده نمی‌شوند. این یکی وسط را می‌گیرد: چه اتفاقی می‌افتد وقتی Enter می‌زنید، و چرا این توضیح استفاده‌ی شما را بهتر می‌کند.

🍊 تیم نارنگی ⏱ 5 دقیقه مطالعه
توضیح ساده‌ی اینکه چت جی‌پی‌تی چیست و چطور کار می‌کند

وقتی سؤالی می‌نویسید و Enter می‌زنید، در کسری از ثانیه چیزی برمی‌گردد که شبیه جواب یک آدم است. اما پشت این ساده‌بودن، فرآیندی است که اگر بشناسیدش، خیلی بهتر ازش استفاده می‌کنید.

این مقاله نه فرمول دارد نه اصطلاح غیرضروری. فقط توضیح می‌دهد چه اتفاقی می‌افتد — و مهم‌تر، این توضیح چه چیزی درباره‌ی نحوه‌ی درست استفاده به شما می‌گوید.

چت جی‌پی‌تی دقیقاً چیست

یک مدل زبانی بزرگ است. اسمش خودش توضیحش است اگر بشکنیمش:

  • زبانی — کارش با متن است. تصویر و صدا لایه‌های اضافه‌ای هستند که بعداً به آن وصل شده‌اند.
  • بزرگ — با حجم عظیمی از متن آموزش دیده و میلیاردها پارامتر قابل تنظیم دارد.
  • مدل — یک تابع ریاضی است که ورودی می‌گیرد و خروجی می‌دهد. نه یک پایگاه داده که در آن جستجو شود.

آن نکته‌ی آخر مهم‌ترین است و بیشتر جا می‌افتد: چت جی‌پی‌تی جواب‌ها را ذخیره نکرده که پیدایشان کند. آن‌ها را می‌سازد.

چه اتفاقی می‌افتد وقتی Enter می‌زنید

۱. متن شما به توکن شکسته می‌شود

مدل با کلمه کار نمی‌کند، با توکن کار می‌کند — تکه‌هایی که گاهی یک کلمه‌ی کامل‌اند و گاهی بخشی از آن. کلمه‌ی «نارنگی» ممکن است دو یا سه توکن شود.

چرا برایتان مهم است: هزینه و محدودیت طول بر اساس توکن حساب می‌شود. و فارسی معمولاً توکن بیشتری از انگلیسی مصرف می‌کند، چون مدل‌ها بیشتر روی متن انگلیسی بهینه شده‌اند.

۲. هر توکن به عدد تبدیل می‌شود

مدل با متن کار نمی‌کند، با عدد کار می‌کند. هر توکن به فهرست بلندی از اعداد تبدیل می‌شود که موقعیتش را در یک «فضای معنایی» نشان می‌دهد.

در این فضا، کلماتی که معنای نزدیک دارند به هم نزدیک‌اند. «پزشک» و «دکتر» کنار هم‌اند؛ «پزشک» و «آجر» دور از هم. همین ساختار است که به مدل اجازه می‌دهد مترادف‌ها را بفهمد بدون اینکه کسی به او فهرست مترادف داده باشد.

۳. مدل محتمل‌ترین توکن بعدی را حدس می‌زند

اینجا قلب ماجراست. مدل یک کار انجام می‌دهد: پیش‌بینی توکن بعدی.

اگر بنویسید «پایتخت ایران»، مدل احتمال همه‌ی توکن‌های ممکن برای ادامه را حساب می‌کند. «تهران» احتمال بسیار بالایی می‌گیرد. بعد آن توکن را اضافه می‌کند و دوباره همین کار را برای توکن بعدی تکرار می‌کند — تا جمله تمام شود.

💡 نتیجه‌ی عملی این نکته

چون مدل کلمه‌به‌کلمه جلو می‌رود و هر کلمه به قبلی‌ها نگاه می‌کند، وقتی از او بخواهید «قدم‌به‌قدم فکر کن»، واقعاً دقت بالا می‌رود — چون گام‌های نوشته‌شده، زمینه‌ی گام بعدی می‌شوند.

۴. تصادفی‌بودن کنترل‌شده

اگر مدل همیشه محتمل‌ترین توکن را انتخاب می‌کرد، جواب‌ها خشک و تکراری می‌شدند. برای همین کمی تصادفی‌بودن اضافه می‌شود.

به همین دلیل است که اگر همان سؤال را دو بار بپرسید، دو جواب متفاوت می‌گیرید. این باگ نیست؛ طراحی است.

چطور «یاد گرفته»

آموزش دو مرحله‌ی اصلی دارد:

مرحله‌ی اول: خواندن مقدار عظیمی متن

مدل حجم بسیار زیادی متن — کتاب، سایت، مقاله، کد — را می‌بیند و در هر قدم سعی می‌کند کلمه‌ی بعدی را حدس بزند. هر بار که اشتباه می‌کند، پارامترهایش کمی تنظیم می‌شوند.

بعد از میلیاردها بار تکرار، الگوهای زبان را یاد می‌گیرد: دستور زبان، روابط بین مفاهیم، سبک نوشتار، و بخش زیادی از دانش عمومی که در آن متن‌ها بوده.

مرحله‌ی دوم: تنظیم برای مفید بودن

مدل خام فقط متن ادامه می‌دهد — لزوماً به شکلی که به درد بخورد. مرحله‌ی دوم یادش می‌دهد که به سؤال جواب بدهد، دستور را دنبال کند، و از پاسخ‌های مضر پرهیز کند.

این مرحله با کمک بازخورد انسانی انجام می‌شود: آدم‌ها خروجی‌ها را رتبه می‌دهند و مدل یاد می‌گیرد کدام نوع جواب ترجیح داده می‌شود.

⚠️ نکته‌ای که خیلی‌ها نمی‌دانند

همین مرحله‌ی دوم است که باعث می‌شود مدل گاهی بیش از حد موافقت کند. اگر اصرار کنید که جوابش غلط است، ممکن است حرفش را پس بگیرد — حتی وقتی درست بوده. یاد گرفته که موافقت، بازخورد بهتری می‌گیرد.

سه محدودیت که از همین ساختار می‌آید

۱. جواب‌های ساختگی

وقتی مدل داده‌ی کافی ندارد، همچنان محتمل‌ترین ادامه را می‌سازد — و «محتمل» با «درست» یکی نیست. برای همین منبع و آماری تولید می‌کند که کاملاً واقعی به‌نظر می‌رسد ولی وجود ندارد.

این باگ نیست که بشود رفعش کرد؛ نتیجه‌ی مستقیم نحوه‌ی کار است. راه مقابله: منبع را خودتان بدهید و بگویید «فقط بر اساس متن زیر جواب بده».

۲. پنجره‌ی متن محدود

مدل فقط مقدار مشخصی متن را هم‌زمان می‌بیند. در گفتگوی خیلی طولانی، ابتدای گفتگو از دید خارج می‌شود — به همین خاطر گاهی چیزی را «فراموش می‌کند» که اول گفته بودید.

۳. تاریخ قطع دانش

آموزش تا زمان مشخصی انجام شده. رویدادهای بعد از آن را نمی‌داند، مگر قابلیت جستجوی وب فعال باشد.

پنج نتیجه‌ی عملی

حالا که می‌دانید چطور کار می‌کند، این پنج نکته منطقی‌تر به‌نظر می‌رسند:

  1. زمینه بدهید، انتظار ذهن‌خوانی نداشته باشید. مدل فقط چیزی را می‌بیند که نوشته‌اید.
  2. هر عدد و منبع را بررسی کنید. این محدودیت ساختاری است نه اتفاقی.
  3. «قدم‌به‌قدم فکر کن» واقعاً کار می‌کند. چون فضای محاسباتی بیشتری می‌سازد.
  4. نمونه بدهید به‌جای توصیف. مدل الگو را از مثال بهتر از صفت می‌گیرد.
  5. در گفتگوی طولانی، نکات مهم را تکرار کنید. چون ممکن است از پنجره بیرون رفته باشند.

راهنمای کامل این پنج مورد در مقاله‌ی پرامپت‌نویسی آمده است.

در ایران چطور استفاده کنیم

ChatGPT از ایران مسدود است — هم آی‌پی، هم ثبت‌نام که شماره‌ی خارجی می‌خواهد، هم پرداخت که کارت بین‌المللی لازم دارد. گزینه‌های عملی را در این مقاله بررسی کرده‌ایم.

جمع‌بندی

چت جی‌پی‌تی یک پیش‌بینی‌کننده‌ی بسیار پیشرفته‌ی کلمه‌ی بعدی است که آنقدر خوب شده که شبیه گفتگو به‌نظر می‌رسد. نه جادو است، نه یک دایرةالمعارف.

و همین درک ساده، تفاوت بین کسی است که ازش ناامید می‌شود و کسی که واقعاً به کارش می‌آید.

مطالب مرتبط:

پرسش‌های پرتکرار

چت جی‌پی‌تی از اینترنت جواب می‌دهد؟ +
به‌طور پیش‌فرض نه. جواب‌ها از الگوهایی می‌آید که هنگام آموزش یاد گرفته، نه از جستجوی زنده. بعضی نسخه‌ها قابلیت جستجوی وب دارند که وقتی فعال باشد، منابع را ذکر می‌کند.
چرا گاهی جواب اشتباه می‌دهد ولی مطمئن به‌نظر می‌رسد؟ +
چون لحن اطمینان بخشی از الگوی زبانی است که یاد گرفته، نه بازتاب میزان قطعیتش. مدل محتمل‌ترین ادامه‌ی متن را می‌سازد؛ وقتی داده‌ی کافی ندارد، چیزی می‌سازد که شبیه جواب است.
توکن چیست و چرا مهم است؟ +
مدل متن را به تکه‌هایی به‌نام توکن می‌شکند — چیزی بین یک حرف و یک کلمه. هزینه و محدودیت طول بر اساس توکن حساب می‌شود، نه کلمه. فارسی معمولاً توکن بیشتری از انگلیسی مصرف می‌کند.
حرف‌هایم را به خاطر می‌سپارد؟ +
داخل یک گفتگو بله، تا سقف پنجره‌ی متن. گفتگوی جدید معمولاً از صفر شروع می‌شود، مگر سرویس قابلیت حافظه‌ی دائمی داشته باشد.
آیا واقعاً می‌فهمد یا فقط تقلید می‌کند؟ +
این سؤال هنوز بین پژوهشگرها محل بحث است. آنچه قطعی است: مدل روابط آماری بین مفاهیم را یاد گرفته و می‌تواند آن‌ها را به شکل تازه ترکیب کند. اینکه اسمش را «فهم» بگذاریم، بیشتر بحث فلسفی است تا فنی.
#چت جی پی تی چیست #ChatGPT #مدل زبانی #هوش مصنوعی چیست #طرز کار هوش مصنوعی
به‌دردِ کسی می‌خورد؟ تلگرام واتساپ
🍊

خواندنش خوب بود — حالا امتحانش کن

هرچه در این صفحه خواندی، همین حالا داخلِ نارنگی قابلِ اجراست. ثبت‌نام با شماره‌ی موبایل، نارنگیِ رایگانِ شروع، بدونِ نیاز به کارت یا تحریم‌شکن.

بدونِ نصب هم کار می‌کند — ولی در اپ سریع‌تر است