[{"data":1,"prerenderedAt":221},["ShallowReactive",2],{"lesson:t1-s03-tokens":3,"course:hamhoosh":57},{"meta":4,"prev":11,"next":15,"sections":19},{"free_preview":5,"order":6,"slug":7,"source":8,"term":9,"title_fa":10},true,3,"t1-s03-tokens","book",1,"فصل ۰۳ — توکن: واحدِ کارِ مدل",{"free_preview":5,"order":12,"slug":13,"source":8,"term":9,"title_fa":14},2,"t1-s02-how-it-learns","فصل ۰۲ — چطور یاد گرفت",{"free_preview":5,"order":16,"slug":17,"source":8,"term":9,"title_fa":18},4,"t1-s04-hallucination","فصل ۰۴ — چرا مطمئن ولی غلط: توهم",[20,24,27,32,35,38,41,44,47,50,54],{"kind":21,"heading":22,"html":23},"normal","در این فصل چه یاد می‌گیری","\u003Ch2 id=\"در-این-فصل-چه-یاد-می‌گیری\">در این فصل چه یاد می‌گیری\u003Ca class=\"head-anchor\" href=\"#%D8%AF%D8%B1-%D8%A7%DB%8C%D9%86-%D9%81%D8%B5%D9%84-%DA%86%D9%87-%DB%8C%D8%A7%D8%AF-%D9%85%DB%8C%E2%80%8C%DA%AF%DB%8C%D8%B1%DB%8C\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>دو فصلِ قبل گفتیم مدل «کلمهٔ بعدی» را حدس می‌زند. حالا وقتش است یک دقتِ مهم اضافه کنیم: واحدِ کارِ مدل «کلمه» نیست، \u003Ccode>token\u003C\u002Fcode> است. در این فصل می‌فهمی \u003Ccode>token\u003C\u002Fcode> چیست، چرا مدل جواب را توکن‌به‌توکن می‌سازد، چرا فارسی برای مدل سنگین‌تر از انگلیسی است، و \u003Ccode>context window\u003C\u002Fcode> یعنی چه. این‌ها ریزه‌کاریِ فنی نیستند؛ توضیح می‌دهند چرا مدل وسطِ گفت‌وگوی طولانی فراموش می‌کند و چرا در شمردنِ حروف می‌لغزد.\u003C\u002Fp>\n\u003Cp>\u003Cpicture>\u003Csource type=\"image\u002Fwebp\" srcset=\"\u002F_img\u002F01-image-token-strip.1ef646a1f4.160.webp 160w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.320.webp 320w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.480.webp 480w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.640.webp 640w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.768.webp 768w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.960.webp 960w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.1280.webp 1280w\" sizes=\"(max-width: 900px) 100vw, 800px\">\u003Cimg src=\"\u002F_img\u002F01-image-token-strip.1ef646a1f4.1280.jpg\" srcset=\"\u002F_img\u002F01-image-token-strip.1ef646a1f4.160.jpg 160w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.320.jpg 320w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.480.jpg 480w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.640.jpg 640w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.768.jpg 768w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.960.jpg 960w, \u002F_img\u002F01-image-token-strip.1ef646a1f4.1280.jpg 1280w\" sizes=\"(max-width: 900px) 100vw, 800px\" alt=\"یک نوارِ متن که با تیغه به تکه‌های نامساویِ توکن بریده می‌شود و یک قابِ محدود دورِ بخشی از آن است\" width=\"1376\" height=\"768\" loading=\"lazy\" decoding=\"async\">\u003C\u002Fpicture>\u003C\u002Fp>\n\u003Cp>آخر این فصل می‌توانی:\u003C\u002Fp>\n\u003Cul>\n\u003Cli>بگویی \u003Ccode>token\u003C\u002Fcode> چیست و چرا همیشه با «کلمه» یکی نیست\u003C\u002Fli>\n\u003Cli>توضیح بدهی مدل چطور جواب را توکن‌به‌توکن می‌سازد\u003C\u002Fli>\n\u003Cli>بگویی چرا یک جملهٔ فارسی توکنِ بیشتری از همان جملهٔ انگلیسی می‌گیرد\u003C\u002Fli>\n\u003Cli>مفهومِ \u003Ccode>context window\u003C\u002Fcode> را توضیح بدهی و یک خطای مرزِ توکن را بگیری\u003C\u002Fli>\n\u003C\u002Ful>\n",{"kind":21,"heading":25,"html":26},"قبل از شروع","\u003Ch2 id=\"قبل-از-شروع\">قبل از شروع\u003Ca class=\"head-anchor\" href=\"#%D9%82%D8%A8%D9%84-%D8%A7%D8%B2-%D8%B4%D8%B1%D9%88%D8%B9\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>\u003Cstrong>از فصل ۱:\u003C\u002Fstrong> جوابِ مدل \u003Cstrong>تولید\u003C\u002Fstrong> می‌شود، نه جست‌وجو.\u003C\u002Fp>\n\u003Cp>\u003Cstrong>از فصل ۲:\u003C\u002Fstrong> مدل در \u003Ccode>training\u003C\u002Fcode> یاد گرفته «کلمهٔ بعدی» را حدس بزند.\u003C\u002Fp>\n\u003Cp>لوازم: یک مرورگر و یک دستیارِ هوش مصنوعی. آزمایشگاهِ این فصل قرار است یک نمایشگرِ \u003Ccode>token\u003C\u002Fcode> داشته باشد که متن را جلوی چشمت تکه‌تکه کند؛ تا وقتی آماده شود، همین کار را تقریبی از دستیارت می‌خواهی (پایین نشانت می‌دهم).\u003C\u002Fp>\n",{"kind":28,"heading":29,"html":30,"embed":31},"lab","","— وقتی نمایشگرِ توکنش آماده شد، چند کلمهٔ فارسی و انگلیسی را تایپ می‌کنی تا ببینی هرکدام به چند token می‌شکند. تا آن‌وقت همین مقایسه را تقریبی از دستیارت بخواه","\u002Flab\u002Fembed\u002Fhamhoosh\u002Fterm-1-what-is-ai\u002Fsession-03-tokens",{"kind":21,"heading":33,"html":34},"۱. token چیست؟","\u003Ch2 id=\"۱-token-چیست\">۱. \u003Ccode>token\u003C\u002Fcode> چیست؟\u003Ca class=\"head-anchor\" href=\"#%DB%B1-token-%DA%86%DB%8C%D8%B3%D8%AA\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>مدل متن را همان‌طور که ما می‌بینیم — کلمه‌کلمه — نمی‌بیند. اول متن را به تکه‌های کوچک می‌شکند و هر تکه یک \u003Ccode>token\u003C\u002Fcode> است. گاهی یک \u003Ccode>token\u003C\u002Fcode> یک کلمهٔ کامل است، گاهی یک تکه از یک کلمه، و گاهی حتی یک نشانه یا فاصله. مدل کلِ کارش را روی همین تکه‌ها انجام می‌دهد، نه روی کلمه‌ها.\u003C\u002Fp>\n\u003Cp>چرا این‌طوری؟ چون زبان کلمه‌های بی‌شمار دارد، ولی اگر متن را به تکه‌های پرتکرار بشکنی، با تعدادِ محدودی تکه می‌توانی تقریباً هر چیزی را بسازی — حتی کلمه‌ای که تا حالا ندیده. یک کلمهٔ ساده و پرتکرار معمولاً یک \u003Ccode>token\u003C\u002Fcode> است؛ یک کلمهٔ بلند یا کم‌یاب به چند \u003Ccode>token\u003C\u002Fcode> می‌شکند.\u003C\u002Fp>\n\u003Cp>همین حالا می‌توانی این را ببینی. از دستیارت بخواه همین متنِ کوتاه را «به تکه‌های سازنده‌اش» بشکند و بشمارد چند تکه شد:\u003C\u002Fp>\n\u003Cpre class=\"code-block\" dir=\"ltr\">\u003Ccode>سلام دنیا\n\u003C\u002Fcode>\u003C\u002Fpre>\n\u003Cp>بعد یک کلمهٔ بلندتر و کم‌یاب‌تر مثلِ «کتابخانه» را هم به همین شکل از دستیارت بخواه و مقایسه کن — معمولاً کلمهٔ ساده و پرتکرار یک تکه می‌ماند و کلمهٔ بلند به چند تکه می‌شکند. فقط بدان خودِ مدل در شمردنِ دقیق ضعیف است (بخش ۵)، پس این عدد تقریبی است نه دقیق. این تکه‌ها همان چیزی‌اند که مدل واقعاً می‌بیند. وقتی نمایشگرِ توکنِ آزمایشگاهِ این فصل آماده شد، همین کار را دقیق‌تر و جلوی چشمت انجام می‌دهد.\u003C\u002Fp>\n",{"kind":21,"heading":36,"html":37},"۲. مدل جواب را توکن‌به‌توکن می‌سازد","\u003Ch2 id=\"۲-مدل-جواب-را-توکن‌به‌توکن-می‌سازد\">۲. مدل جواب را توکن‌به‌توکن می‌سازد\u003Ca class=\"head-anchor\" href=\"#%DB%B2-%D9%85%D8%AF%D9%84-%D8%AC%D9%88%D8%A7%D8%A8-%D8%B1%D8%A7-%D8%AA%D9%88%DA%A9%D9%86%E2%80%8C%D8%A8%D9%87%E2%80%8C%D8%AA%D9%88%DA%A9%D9%86-%D9%85%DB%8C%E2%80%8C%D8%B3%D8%A7%D8%B2%D8%AF\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>یادت هست در فصلِ ۱ گفتیم جواب «تولید» می‌شود؟ حالا می‌توانیم دقیق بگوییم چطور. مدل کلِ جواب را یک‌جا نمی‌ریزد بیرون؛ \u003Cstrong>یک \u003Ccode>token\u003C\u002Fcode> در هر قدم\u003C\u002Fstrong> تولید می‌کند. هر توکنِ تازه را بر اساسِ همهٔ توکن‌های قبلی انتخاب می‌کند — یعنی \u003Ccode>prompt\u003C\u002Fcode>ِ تو به‌علاوهٔ هر چه خودش تا این لحظه نوشته. بعد آن توکن را هم به دنباله اضافه می‌کند و دوباره حدس می‌زند توکنِ بعدی چه باشد.\u003C\u002Fp>\n\u003Cp>همین را می‌بینی وقتی جوابِ مدل کم‌کم و تکه‌تکه روی صفحه ظاهر می‌شود. آن جریانِ نرم، در واقع همان تولیدِ توکن‌به‌توکن است. این تصویرِ ذهنی را نگه دار: مدل مثلِ کسی است که جمله را دارد \u003Cstrong>همین الان\u003C\u002Fstrong> می‌نویسد، نه کسی که یک جوابِ آمادهٔ کامل را از جایی کپی می‌کند.\u003C\u002Fp>\n\u003Cblockquote>\n\u003Cp>💡 \u003Cstrong>نکته:\u003C\u002Fstrong> چون هر توکن به توکن‌های قبلی وابسته است، یک لغزشِ کوچک در وسطِ جواب می‌تواند بقیهٔ جواب را با خودش کج کند. برای همین گاهی مدل یک جملهٔ اشتباه را با اطمینان ادامه می‌دهد — چون دارد روی چیزی که خودش قبلاً نوشته بنا می‌کند.\u003C\u002Fp>\n\u003C\u002Fblockquote>\n",{"kind":21,"heading":39,"html":40},"۳. چرا فارسی توکنِ بیشتری می‌گیرد","\u003Ch2 id=\"۳-چرا-فارسی-توکنِ-بیشتری-می‌گیرد\">۳. چرا فارسی توکنِ بیشتری می‌گیرد\u003Ca class=\"head-anchor\" href=\"#%DB%B3-%DA%86%D8%B1%D8%A7-%D9%81%D8%A7%D8%B1%D8%B3%DB%8C-%D8%AA%D9%88%DA%A9%D9%86%D9%90-%D8%A8%DB%8C%D8%B4%D8%AA%D8%B1%DB%8C-%D9%85%DB%8C%E2%80%8C%DA%AF%DB%8C%D8%B1%D8%AF\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>اینجا یک واقعیتِ مهم برای ما فارسی‌زبان‌هاست. بیشترِ مدل‌ها طوری متن را تکه می‌کنند که برای انگلیسی صرفه‌جویانه باشد، چون — همان‌طور که در فصلِ ۲ دیدیم — دادهٔ آموزشی‌شان بیشتر انگلیسی بوده. نتیجه این است که یک کلمهٔ انگلیسی اغلب یک \u003Ccode>token\u003C\u002Fcode> می‌شود، ولی همان مفهوم به فارسی به چند \u003Ccode>token\u003C\u002Fcode> می‌شکند.\u003C\u002Fp>\n\u003Cp>همین حالا می‌توانی این را تقریبی ببینی. از دستیارت بخواه یک جملهٔ کوتاه را یک بار انگلیسی و یک بار فارسی به تکه‌هایش بشکند و مقایسه کن:\u003C\u002Fp>\n\u003Cpre class=\"code-block\" dir=\"ltr\">\u003Ccode>Artificial intelligence is a tool.\nهوش مصنوعی یک ابزار است.\n\u003C\u002Fcode>\u003C\u002Fpre>\n\u003Cp>ببین کدام نسخه تکه‌های بیشتری دارد (عدد دقیق نیست، ولی جهتش درست است). معمولاً نسخهٔ فارسی توکنِ بیشتری می‌گیرد، حتی وقتی حرفِ یکسانی می‌زند. وقتی نمایشگرِ توکنِ آزمایشگاه آماده شد، همین مقایسه را دقیق‌تر نشانت می‌دهد. این سه پیامدِ واقعی دارد: جملهٔ فارسی جای بیشتری از حافظهٔ گفت‌وگو می‌گیرد (بخشِ بعد)، کارکردن با آن معمولاً پرهزینه‌تر است، و گاهی جوابِ فارسی کمی ضعیف‌تر درمی‌آید. این‌ها نه ضعفِ توست نه ضعفِ زبانِ فارسی؛ نتیجهٔ نحوهٔ تکه‌کردن است.\u003C\u002Fp>\n",{"kind":21,"heading":42,"html":43},"۴. context window: مدل هر لحظه چقدر می‌تواند ببیند","\u003Ch2 id=\"۴-context-window-مدل-هر-لحظه-چقدر-می‌تواند-ببیند\">۴. \u003Ccode>context window\u003C\u002Fcode>: مدل هر لحظه چقدر می‌تواند ببیند\u003Ca class=\"head-anchor\" href=\"#%DB%B4-context-window-%D9%85%D8%AF%D9%84-%D9%87%D8%B1-%D9%84%D8%AD%D8%B8%D9%87-%DA%86%D9%82%D8%AF%D8%B1-%D9%85%DB%8C%E2%80%8C%D8%AA%D9%88%D8%A7%D9%86%D8%AF-%D8%A8%D8%A8%DB%8C%D9%86%D8%AF\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>مدل نمی‌تواند بی‌نهایت توکن را یک‌جا در نظر بگیرد. یک سقف دارد: بیشترین تعدادِ توکنی که در یک لحظه «جلوِ چشمش» است. به این ظرفیت \u003Ccode>context window\u003C\u002Fcode> می‌گویند. کلِ گفت‌وگو — پرامپت‌های تو و جواب‌های مدل — داخلِ همین پنجره جا می‌گیرد.\u003C\u002Fp>\n\u003Cp>پیامدش را حتماً تجربه کرده‌ای یا خواهی کرد: در یک گفت‌وگوی خیلی طولانی، وقتی از سقف رد می‌شوی، قدیمی‌ترین بخش‌ها از پنجره بیرون می‌افتند و مدل عملاً آن‌ها را فراموش می‌کند. برای همین است که مدل گاهی چیزی را که همان اولِ گفت‌وگو گفته بودی «یادش می‌رود» — نه بی‌ادبی است نه خرابی؛ آن توکن‌ها دیگر در پنجره نیستند.\u003C\u002Fp>\n\u003Cp>\u003Cstrong>قبل از ادامه، جواب بده:\u003C\u002Fstrong> در گفت‌وگویی که از سقفِ \u003Ccode>context window\u003C\u002Fcode> رد شده، مدل کدام بخش را زودتر از دست می‌دهد — چیزی که همان اول گفتی یا چیزی که همین الان گفتی؟ جواب: قدیمی‌ترین‌ها، یعنی اولِ گفت‌وگو؛ همان‌ها که اول از لبهٔ پنجره بیرون می‌افتند. برای همین اگر نکته‌ای مهم است، نگذار تهِ یک گفت‌وگوی درازِ قدیمی دفن شود.\u003C\u002Fp>\n\u003Cblockquote>\n\u003Cp>💡 \u003Cstrong>نکته:\u003C\u002Fstrong> یک عادتِ عملی: اگر گفت‌وگو خیلی طولانی و پراکنده شد، به‌جای ادامه‌دادن، مهم‌ترین نکته‌ها را در یک پیامِ تازه و کوتاه خلاصه کن و از آن‌جا ادامه بده. این‌طور چیزی که لازم داری داخلِ پنجره می‌ماند. (کارِ عمیق‌ترِ حافظه را در ترمِ ۴ می‌بینیم.)\u003C\u002Fp>\n\u003C\u002Fblockquote>\n",{"kind":21,"heading":45,"html":46},"۵. غافلگیریِ مرزِ توکن: مدل حروف را نمی‌شمارد","\u003Ch2 id=\"۵-غافلگیریِ-مرزِ-توکن-مدل-حروف-را-نمی‌شمارد\">۵. غافلگیریِ مرزِ توکن: مدل حروف را نمی‌شمارد\u003Ca class=\"head-anchor\" href=\"#%DB%B5-%D8%BA%D8%A7%D9%81%D9%84%DA%AF%DB%8C%D8%B1%DB%8C%D9%90-%D9%85%D8%B1%D8%B2%D9%90-%D8%AA%D9%88%DA%A9%D9%86-%D9%85%D8%AF%D9%84-%D8%AD%D8%B1%D9%88%D9%81-%D8%B1%D8%A7-%D9%86%D9%85%DB%8C%E2%80%8C%D8%B4%D9%85%D8%A7%D8%B1%D8%AF\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>حالا یک خطای واقعی و بامزه که مستقیم از توکن می‌آید. چون مدل متن را به‌صورتِ \u003Ccode>token\u003C\u002Fcode> (تکه) می‌بیند نه حرف‌به‌حرف، در کاری به‌ظاهر ساده مثلِ شمردنِ حروف می‌لغزد. امتحان کن:\u003C\u002Fp>\n\u003Cpre class=\"code-block\" dir=\"ltr\">\u003Ccode>در کلمهٔ «سرسره» چند حرفِ «ر» وجود دارد؟ فقط عدد را بگو.\n\u003C\u002Fcode>\u003C\u002Fpre>\n\u003Cp>آن «فقط عدد را بگو» تصادفی نیست: اگر جا بدهی مدل بلند بلند حرف بزند، اغلب حرف‌ها را یکی‌یکی می‌نویسد و همان نوشتن کمکش می‌کند درست بشمارد. وقتی فقط عدد می‌خواهی، این عصا را ازش می‌گیری و مجبورش می‌کنی یک‌راست \u003Cstrong>حدس\u003C\u002Fstrong> بزند — و همان‌جاست که می‌لغزد. ببین مدل چه داد. با اطمینانِ کامل ممکن است جوابی مثلِ این بدهد:\u003C\u002Fp>\n\u003Cpre class=\"code-block\" dir=\"ltr\">\u003Ccode>۳\n\u003C\u002Fcode>\u003C\u002Fpre>\n\u003Cp>ولی بیا خودمان بشماریم: س، ر، س، ر، ه. حرفِ «ر» \u003Cstrong>دو\u003C\u002Fstrong> بار آمده، نه سه بار. مدل اشتباه کرد چون «سرسره» را به‌صورتِ چند تکهٔ توکن می‌بیند، نه پنج حرفِ جدا؛ برای همین شمردنِ دقیقِ یک حرف برایش کارِ سختی است. دو نکتهٔ دقیق‌تر هم هست: مدل اصلاً برای «شمردنِ حرف» آموزش ندیده — این کارِ تمرین‌شده‌اش نیست — و فارسی به‌شکلِ بسیار ریز به \u003Ccode>token\u003C\u002Fcode> شکسته می‌شود؛ پس ماجرا فقط «حرف‌ها را نمی‌بیند» نیست، ترکیبی از این دوتاست.\u003C\u002Fp>\n\u003Cp>\u003Cstrong>اگر مدلِ تو «۲» گفت چه؟\u003C\u002Fstrong> یعنی دستیارت در این کارِ خاص خوب است — و این هم شدنی است، مخصوصاً روی دستیارهای کندتر و گران‌ترِ امروز که پیش از جواب بیشتر روی سؤال کار می‌کنند. ولی نتیجه نگیر که «مدل حالا حرف می‌شمارد». دو کار بکن. \u003Cstrong>اول\u003C\u002Fstrong>، همین سؤال را سه بار پشتِ‌سرِهم بپرس؛ اگر هر سه بار یک عدد نداد، همان بی‌ثباتی خودش جواب است. \u003Cstrong>دوم\u003C\u002Fstrong>، متن را بلندتر کن — یک جملهٔ کامل به‌جای یک کلمه:\u003C\u002Fp>\n\u003Cpre class=\"code-block\" dir=\"ltr\">\u003Ccode>در جملهٔ «مادرِ مهربانِ من هر روز برای برادرم نان و پنیر می‌برد» چند حرفِ «ر»\nوجود دارد؟ فقط عدد را بگو.\n\u003C\u002Fcode>\u003C\u002Fpre>\n\u003Cp>جوابِ درست ۹ است (خودت با انگشت بشمار). اینجا تقریباً هیچ مدلی درست نمی‌گوید، و جالب‌تر اینکه هر بار عددِ متفاوتی می‌دهد. اصلِ حرف عوض نمی‌شود: این کار روی مرزِ \u003Ccode>token\u003C\u002Fcode> می‌ایستد، پس جوابش بی‌ثبات است — و بی‌ثباتی یعنی نباید بی‌وارسی باورش کنی.\u003C\u002Fp>\n\u003Cblockquote>\n\u003Cp>✅ \u003Cstrong>وارسی:\u003C\u002Fstrong> این بهترین جای تمرینِ سه قانونِ ثابتِ دوره است: \u003Cstrong>«اول خودت فکر کن» — «وارسی کن، خط به خط» — «مدل مطمئن است؛ دلیل نمی‌شود درست باشد».\u003C\u002Fstrong> شمردنِ حروف کاری است که خودت بی‌خطا انجامش می‌دهی، پس چرا واگذارش کنی؟ حرف‌ها را با انگشت بشمار — اطمینانِ لحنش ربطی به درستیِ عدد ندارد.\u003C\u002Fp>\n\u003C\u002Fblockquote>\n\u003Cblockquote>\n\u003Cp>⚠️ \u003Cstrong>مواظب باش:\u003C\u002Fstrong> از این به بعد، کارهایی را که به شمارشِ دقیقِ حرف یا رقم، جای دقیقِ کاراکترها، یا حساب‌وکتابِ ریز نیاز دارند کورکورانه به مدل نسپار. این‌ها دقیقاً همان‌هایی‌اند که مرزِ \u003Ccode>token\u003C\u002Fcode> مدل را می‌لغزاند. مرزهای دیگرِ مدل را در فصلِ ۵ کامل می‌بینیم.\u003C\u002Fp>\n\u003C\u002Fblockquote>\n",{"kind":21,"heading":48,"html":49},"واژه‌های تازهٔ این فصل","\u003Ch2 id=\"واژه‌های-تازهٔ-این-فصل\">واژه‌های تازهٔ این فصل\u003Ca class=\"head-anchor\" href=\"#%D9%88%D8%A7%DA%98%D9%87%E2%80%8C%D9%87%D8%A7%DB%8C-%D8%AA%D8%A7%D8%B2%D9%87%D9%94-%D8%A7%DB%8C%D9%86-%D9%81%D8%B5%D9%84\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cdiv class=\"table-wrap\">\u003Ctable>\u003Cthead>\n\u003Ctr>\n\u003Cth>کلمه\u003C\u002Fth>\n\u003Cth>تلفظ به حروف فارسی\u003C\u002Fth>\n\u003Cth>یعنی چه\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\n\u003Ctr>\n\u003Ctd>token\u003C\u002Ftd>\n\u003Ctd>تُوکِن\u003C\u002Ftd>\n\u003Ctd>تکهٔ کوچکی که مدل متن را به آن می‌شکند؛ واحدِ واقعیِ کارِ مدل\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>context window\u003C\u002Ftd>\n\u003Ctd>کانتِکست ویندو\u003C\u002Ftd>\n\u003Ctd>بیشترین تعدادِ توکنی که مدل در یک لحظه «جلوِ چشمش» دارد\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\n\u003C\u002Ftable>\u003C\u002Fdiv>",{"kind":51,"heading":52,"html":53},"checkpoint","تمرین‌ها","\u003Ch2 id=\"تمرین‌ها\">تمرین‌ها\u003Ca class=\"head-anchor\" href=\"#%D8%AA%D9%85%D8%B1%DB%8C%D9%86%E2%80%8C%D9%87%D8%A7\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>قبل از تمرین، بدون نگاه به بالا جواب بده: \u003Ccode>token\u003C\u002Fcode> چیست، و چرا یک جملهٔ فارسی معمولاً از همان جملهٔ انگلیسی توکنِ بیشتری می‌گیرد؟\u003C\u002Fp>\n\u003Cp>\u003Cstrong>تمرین اجباری:\u003C\u002Fstrong> با شکستنِ تقریبیِ کلمه‌ها توسطِ دستیارت (و وقتی نمایشگرِ توکن آماده شد، در آن) سه کلمهٔ فارسی و سه کلمهٔ انگلیسیِ هم‌معنی را بشکن و تعدادِ توکنِ هرکدام را یادداشت کن. یک جمله بنویس: به‌طور میانگین کدام زبان توکنِ بیشتری گرفت، و طبقِ این فصل چرا؟\u003C\u002Fp>\n\u003Cp>\u003Cstrong>تمرین ستاره‌دار ⭐:\u003C\u002Fstrong> از مدل بخواه کلمه‌ای را حرف‌به‌حرف برعکس بنویسد. یک کلمهٔ کوتاه (مثلاً «آبشار») را معمولاً درست می‌دهد؛ سراغِ یک کلمهٔ بلندتر با پسوند برو، مثلاً «دانشگاه‌ها». خروجی را حرف‌به‌حرف با دستِ خودت وارسی کن (اگر تکه‌ای از کلمه جا افتاده بود، همان‌جا مرزِ \u003Ccode>token\u003C\u002Fcode> را دیده‌ای). این خطا از کجا می‌آید و چه شباهتی به خطای شمردنِ حروف دارد؟\u003C\u002Fp>\n",{"kind":21,"heading":55,"html":56},"در فصل بعد","\u003Ch2 id=\"در-فصل-بعد\">در فصل بعد\u003Ca class=\"head-anchor\" href=\"#%D8%AF%D8%B1-%D9%81%D8%B5%D9%84-%D8%A8%D8%B9%D8%AF\" aria-label=\"پیوند به این بخش\">#\u003C\u002Fa>\u003C\u002Fh2>\n\u003Cp>حالا می‌دانی مدل روی \u003Ccode>token\u003C\u002Fcode> کار می‌کند، جواب را توکن‌به‌توکن می‌سازد، و پنجره‌اش محدود است. یک بار در همین فصل دیدی که مدل با اطمینانِ کامل عددِ غلط داد. این فقط یک نمونه بود از یک الگوی بزرگ‌تر و مهم‌تر: مدل می‌تواند مطمئن ولی غلط باشد. فصلِ بعد کاملاً به همین می‌پردازد — به \u003Ccode>hallucination\u003C\u002Fcode>: چرا مدل چیزهایی سرِ هم می‌بافد، و اولین قدمِ جدیِ عادتِ وارسی.\u003C\u002Fp>\n",{"course":58,"entitled":66,"lessons":67,"payments_enabled":66,"terms":220,"live":5},{"active_window":59,"effective_price_toman":60,"free":5,"lesson_count":61,"price_toman":62,"slug":63,"summary_fa":64,"title_fa":65},null,0,51,2500000,"hamhoosh","از «هوش مصنوعی واقعاً چیست» تا ساختن ابزار واقعی با آن — بدون دیوار ریاضی و بدون پیش‌نیاز برنامه‌نویسی. هوش مصنوعی همکارِ هوشمندی است که وارسی‌اش می‌کنی، نه اوراکلی که چشم‌بسته باور کنی.","هم‌هوش — خودآموز هوش مصنوعی",false,[68,71,72,73,74,78,82,86,90,93,96,99,102,105,108,111,114,118,121,124,127,130,133,136,139,142,145,148,151,154,157,160,163,166,169,172,175,178,181,184,187,190,193,196,199,202,205,208,211,214,217],{"free_preview":5,"order":9,"slug":69,"source":8,"term":9,"title_fa":70},"t1-s01-first-conversation","فصل ۰۱ — با چه چیزی حرف می‌زنی؟ اولین گفت‌وگو",{"free_preview":5,"order":12,"slug":13,"source":8,"term":9,"title_fa":14},{"free_preview":5,"order":6,"slug":7,"source":8,"term":9,"title_fa":10},{"free_preview":5,"order":16,"slug":17,"source":8,"term":9,"title_fa":18},{"free_preview":5,"order":75,"slug":76,"source":8,"term":9,"title_fa":77},5,"t1-s05-limits","فصل ۰۵ — مرزها: چه نمی‌داند و چه نباید ازش خواست",{"free_preview":5,"order":79,"slug":80,"source":8,"term":9,"title_fa":81},6,"t1-s06-types","فصل ۰۶ — گونه‌های هوش مصنوعی",{"free_preview":5,"order":83,"slug":84,"source":8,"term":9,"title_fa":85},7,"t1-s07-responsible-start","فصل ۰۷ — از همین حالا مسئولانه",{"free_preview":5,"order":87,"slug":88,"source":8,"term":9,"title_fa":89},8,"t1-s08-interrogate-project","فصل ۰۸ — پروژه: یک مدل را بازجویی کن",{"free_preview":5,"order":9,"slug":91,"source":8,"term":12,"title_fa":92},"t2-s01-intent","فصل ۰۱ — نیت، نه جادو",{"free_preview":5,"order":12,"slug":94,"source":8,"term":12,"title_fa":95},"t2-s02-context","فصل ۰۲ — زمینه‌دادن",{"free_preview":5,"order":6,"slug":97,"source":8,"term":12,"title_fa":98},"t2-s03-iterate","فصل ۰۳ — حلقهٔ تکرار",{"free_preview":5,"order":16,"slug":100,"source":8,"term":12,"title_fa":101},"t2-s04-verify","فصل ۰۴ — وارسی: مهم‌ترین مهارت",{"free_preview":5,"order":75,"slug":103,"source":8,"term":12,"title_fa":104},"t2-s05-system","فصل ۰۵ — لحنِ ثابت و دستورِ سیستمی",{"free_preview":5,"order":79,"slug":106,"source":8,"term":12,"title_fa":107},"t2-s06-tune","فصل ۰۶ — کنترلِ خلاقیت، دقت و عمق",{"free_preview":5,"order":83,"slug":109,"source":8,"term":12,"title_fa":110},"t2-s07-structured","فصل ۰۷ — پرامپتِ ساختارمند و قابلِ‌استفادهٔ مجدد",{"free_preview":5,"order":87,"slug":112,"source":8,"term":12,"title_fa":113},"t2-s08-antipatterns","فصل ۰۸ — دام‌ها و افسانه‌ها",{"free_preview":5,"order":115,"slug":116,"source":8,"term":12,"title_fa":117},9,"t2-s09-assistant-project","فصل ۰۹ — پروژه: یک دستیارِ شخصی بساز",{"free_preview":5,"order":9,"slug":119,"source":8,"term":6,"title_fa":120},"t3-s01-images","فصل ۰۱ — ساختِ تصویر با هوش مصنوعی",{"free_preview":66,"order":12,"slug":122,"source":8,"term":6,"title_fa":123},"t3-s02-image-understanding","فصل ۰۲ — فهمِ تصویر",{"free_preview":66,"order":6,"slug":125,"source":8,"term":6,"title_fa":126},"t3-s03-audio-video","فصل ۰۳ — صدا و ویدیو",{"free_preview":66,"order":16,"slug":128,"source":8,"term":6,"title_fa":129},"t3-s04-research","فصل ۰۴ — پژوهش با هوش مصنوعی",{"free_preview":66,"order":75,"slug":131,"source":8,"term":6,"title_fa":132},"t3-s05-writing","فصل ۰۵ — نوشتن و بازنویسی",{"free_preview":66,"order":79,"slug":134,"source":8,"term":6,"title_fa":135},"t3-s06-study","فصل ۰۶ — یادگیری و درس‌خواندن",{"free_preview":66,"order":83,"slug":137,"source":8,"term":6,"title_fa":138},"t3-s07-work","فصل ۰۷ — کارِ حرفه‌ای",{"free_preview":66,"order":87,"slug":140,"source":8,"term":6,"title_fa":141},"t3-s08-coding-help","فصل ۰۸ — کمکِ کدنویسی (بی‌آنکه برنامه‌نویس باشی)",{"free_preview":66,"order":115,"slug":143,"source":8,"term":6,"title_fa":144},"t3-s09-workflow-project","فصل ۰۹ — پروژه: یک جریانِ کاریِ واقعی",{"free_preview":5,"order":9,"slug":146,"source":8,"term":16,"title_fa":147},"t4-s01-training-deep","فصل ۰۱ — آموزش، عمیق‌تر (بدون ریاضی)",{"free_preview":66,"order":12,"slug":149,"source":8,"term":16,"title_fa":150},"t4-s02-embeddings","فصل ۰۲ — از توکن تا معنا: embedding",{"free_preview":66,"order":6,"slug":152,"source":8,"term":16,"title_fa":153},"t4-s03-context-memory","فصل ۰۳ — حافظه و پنجرهٔ زمینه",{"free_preview":66,"order":16,"slug":155,"source":8,"term":16,"title_fa":156},"t4-s04-rag","فصل ۰۴ — RAG: دادنِ دانشِ تازه به مدل",{"free_preview":66,"order":75,"slug":158,"source":8,"term":16,"title_fa":159},"t4-s05-agents","فصل ۰۵ — عامل‌ها و ابزارها",{"free_preview":66,"order":79,"slug":161,"source":8,"term":16,"title_fa":162},"t4-s06-local-vs-cloud","فصل ۰۶ — مدلِ محلی در برابر ابری",{"free_preview":66,"order":83,"slug":164,"source":8,"term":16,"title_fa":165},"t4-s07-persian-gap","فصل ۰۷ — شکافِ فارسی-انگلیسی",{"free_preview":66,"order":87,"slug":167,"source":8,"term":16,"title_fa":168},"t4-s08-mental-model-project","فصل ۰۸ — پروژه: نقشهٔ ذهنیِ یک پاسخ",{"free_preview":5,"order":9,"slug":170,"source":8,"term":75,"title_fa":171},"t5-s01-api-idea","فصل ۰۱ — API چیست: حرف‌زدنِ برنامه با مدل",{"free_preview":66,"order":12,"slug":173,"source":8,"term":75,"title_fa":174},"t5-s02-first-call","فصل ۰۲ — اولین فراخوانی",{"free_preview":66,"order":6,"slug":176,"source":8,"term":75,"title_fa":177},"t5-s03-from-js","فصل ۰۳ — از JavaScript صدا بزن",{"free_preview":66,"order":16,"slug":179,"source":8,"term":75,"title_fa":180},"t5-s04-system-in-code","فصل ۰۴ — نقش و پارامتر در کد",{"free_preview":66,"order":75,"slug":182,"source":8,"term":75,"title_fa":183},"t5-s05-structured-output","فصل ۰۵ — خروجیِ ساختارمند",{"free_preview":66,"order":79,"slug":185,"source":8,"term":75,"title_fa":186},"t5-s06-build-app","فصل ۰۶ — یک وب‌اپِ کوچکِ هوش‌مصنوعی‌دار",{"free_preview":66,"order":83,"slug":188,"source":8,"term":75,"title_fa":189},"t5-s07-cost-limits","فصل ۰۷ — هزینه، سهمیه و مرزها",{"free_preview":66,"order":87,"slug":191,"source":8,"term":75,"title_fa":192},"t5-s08-ship-project","فصل ۰۸ — پروژه: ابزارِ هوش‌مصنوعیِ خودت را منتشر کن",{"free_preview":5,"order":9,"slug":194,"source":8,"term":79,"title_fa":195},"t6-s01-deepfakes","فصل ۰۱ — دیپ‌فیک و رسانهٔ جعلی",{"free_preview":66,"order":12,"slug":197,"source":8,"term":79,"title_fa":198},"t6-s02-misinformation","فصل ۰۲ — دفاع در برابر بدْاطلاعات",{"free_preview":66,"order":6,"slug":200,"source":8,"term":79,"title_fa":201},"t6-s03-detection-myth","فصل ۰۳ — افسانهٔ «تشخیصِ هوش مصنوعی»",{"free_preview":66,"order":16,"slug":203,"source":8,"term":79,"title_fa":204},"t6-s04-bias","فصل ۰۴ — سوگیری و انصاف",{"free_preview":66,"order":75,"slug":206,"source":8,"term":79,"title_fa":207},"t6-s05-privacy-data","فصل ۰۵ — حریم خصوصی و دادهٔ تو",{"free_preview":66,"order":79,"slug":209,"source":8,"term":79,"title_fa":210},"t6-s06-ownership","فصل ۰۶ — مالکیت و کپی‌رایتِ خروجی",{"free_preview":66,"order":83,"slug":212,"source":8,"term":79,"title_fa":213},"t6-s07-work-future","فصل ۰۷ — کار، مهارت و مرزهای سالم",{"free_preview":66,"order":87,"slug":215,"source":8,"term":79,"title_fa":216},"t6-s08-safety-ethics","فصل ۰۸ — ایمنی و اخلاق، بدونِ موعظه",{"free_preview":66,"order":115,"slug":218,"source":8,"term":79,"title_fa":219},"t6-s09-capstone","فصل ۰۹ — پروژهٔ نهایی: چیزی مسئولانه بساز و منتشر کن",[],1784990543449]