اكتشف ما هو نموذج اللغة الكبير، وكيف يُدرَّب، ولماذا يبدو وكأنه يعرف كل شيء.
افتح هذا الدرس في Kodokonربما سبق أن سمعت عن ChatGPT أو Claude أو Gemini. هذه أنظمة ذكاء اصطناعي توليدي: برامج حاسوبية قادرة على إنتاج نص جديد تمامًا (شرح، ملخّص، قصيدة، أو شيفرة برمجية) انطلاقًا من طلب مكتوب. المحرّك المختبئ خلفها يُسمّى LLM، وهو اختصار لـ *Large Language Model* (نموذج اللغة الكبير). في الحوسبة، "النموذج" هو برنامج تعلّم أنماطًا من الأمثلة، بدلًا من تطبيق قواعد كتبها إنسان واحدة تلو الأخرى.
المبدأ الأساسي بسيط بشكل مدهش: نموذج اللغة الكبير هو آلة تتنبّأ بكيفية استمرار النص. عندما تقرأ "القطة نائمة على…"، يملأ دماغك تلقائيًا الفراغ بكلمة "الأريكة" أو "السرير". يفعل نموذج اللغة الكبير الشيء نفسه تمامًا، لكن على نطاق هائل: في كل خطوة، يحسب أيّ كلمة (أو جزء من كلمة) هي الأرجح أن تأتي تاليًا، يضيفها، ثم يبدأ من جديد. وبالتالي فإن الإجابة الكاملة ليست سوى سلسلة طويلة من التنبّؤات، كلمة بعد كلمة. إنها الآلية نفسها التي تعمل بها اقتراحات الكلمات في لوحة مفاتيح هاتفك، لكنها أقوى بما لا يُقاس.
أنت معلّم صبور يشرح الحوسبة لمبتدئ تمامًا.
اشرح لي ما هو نموذج اللغة الكبير (LLM) كما لو كنت في الثانية عشرة من عمري، دون أي مصطلحات تقنية غير مُعرَّفة.
القيود:
- استخدم تشبيهًا من الحياة اليومية.
- عشر جمل كحدّ أقصى.
- اختم بسؤال للتحقّق من أنني فهمت.كيف تتعلّم هذه الآلة أن تتنبّأ بهذه البراعة؟ عبر التدريب: مرحلة (تسبق محادثتك الأولى على الإطلاق) "يقرأ" خلالها النموذج كميات هائلة من النصوص - كتبًا، ومقالات، ومواقع إلكترونية، وشيفرة برمجية. في كل جملة، يُخفى الجزء التالي ويُطلب من النموذج تخمينه. وعندما يخطئ، تُعدَّل معاملاته قليلًا - أي مليارات الإعدادات الداخلية الدقيقة الخاصة به. كرّر ذلك مليارات المرات، وينتهي النموذج إلى استيعاب القواعد النحوية، والأسلوب، وقدر هائل من المعرفة الموجودة في نصوص تدريبه.
لهذا السبب يبدو الذكاء الاصطناعي التوليدي وكأنه يعرف كل شيء: فقد "قرأ" مكتبة أكبر مما يستطيع إنسان أن يطّلع عليه في ألف حياة. لكن انتبه لتلك الكلمة: *يبدو*. لا يستشير النموذج موسوعة حين يجيب، وهو لا "يفهم" بالطريقة التي تفهم بها أنت. إنه يحسب سلسلة الكلمات الأكثر معقولية بناءً على تدريبه. في معظم الأحيان، المعقول = الصحيح. لكن ليس دائمًا، وهذا بالضبط موضوع الدرس التالي.
تعلّمت للتو أن نماذج اللغة الكبيرة تعمل عبر التنبّؤ بالنص، وأنها تُدرَّب على مدوّنات ضخمة، وأنها تنتج فقط الاستمرار الأكثر معقولية.
اطرح عليّ 3 أسئلة، واحدًا تلو الآخر، للتحقّق من أنني فهمت هذه الأفكار الثلاث فعلًا.
انتظر إجابتي بعد كل سؤال، ثم صحّح لي بلطف قبل طرح السؤال التالي.
لا تعطني الإجابة أبدًا قبل أن أحاول.