هوش مصنوعی چطور کلمهٔ بعدی را حدس میزند
پنج اسلاید، یک ابر از نقطهها. ببینید یک مدل زبانی چطور کلمهها را به عدد، عددها را به حدس، و حدس غلط را به حدس بهتر تبدیل میکند.
دستیارهای گفتوگو طوری جواب میدهند که انگار فکر میکنند. اما در اصل یک کار کوچک را بارها و بارها تکرار میکنند. آرام اسکرول کنید.
آنچه دیدید
امبدینگ. به فهرست عددهای هر کلمه «امبدینگ» میگویند. کسی این عددها را دستی نمینویسد. از عددهای تصادفی شروع میشوند و در طول آموزش سر جایشان مینشینند، تا جایی که فاصله در این فضا تقریباً همان تفاوت معناست.
دانش همان وزنهاست. «اندازهٔ» یک مدل یعنی تعداد وزنهایش. هر چیزی که به نظر میرسد بلد است، از دستور زبان تا واقعیتها و سبک نوشتن، فقط در همین عددها زندگی میکند.
پسانتشار. فرستادن خطا به عقب از میان لایهها را پسانتشار (backpropagation) مینامند. این روش برای تکتک وزنها حساب میکند که به کدام سمت بچرخند تا خطا کمتر شود. آموزش یعنی همین گام، روی انبوهی از متن، بارها و بارها.
هر بار یک کلمه. مدلها در واقع با «توکن» کار میکنند که اغلب تکهای از یک کلمه است. یک جواب بلند صدها حدس پشت سر هم است که هر کدام ورودی حدس بعدی میشود.