كيفاش نستعمل ChatGPT مجانا
يمكنك استخدام ChatGPT مجانًا من خلال زيارة الموقع الرسمي لـ ChatGPT أو تنزيل تطبيق الهاتف المحمول. سجّل للحصول على حساب مجاني باستخدام بريدك الإلكتروني، ويمكنك البدء فورًا في كتابة عبارات للدردشة أو الكتابة أو البحث على الإنترنت مجانًا.
البدء على الويب أو التطبيق
- انتقل إلى ChatGPT عبر متصفحك أو نزّل التطبيق الرسمي على هاتفك.
- انقر على "إنشاء حساب" لإنشاء حساب مجاني باستخدام بريدك الإلكتروني أو حساب جوجل أو حساب أبل.
- سجّل الدخول واكتب سؤالك أو طلبك في مربع النص أسفل الشاشة.
- اضغط على زر الإدخال أو انقر على سهم الإرسال لتلقّي ردّك الفوري.
ما ستحصل عليه مع المستوى المجاني
- إمكانية الوصول إلى نماذج الذكاء الاصطناعي AI القياسية للإجابة على الأسئلة وكتابة الردود.
- إمكانية تصفح الإنترنت للحصول على معلومات فورية.
- سعة محدودة لتحميل الملفات والصور لتحليلها.
- خيار حفظ ومراجعة سجل المحادثات السابقة في قائمة الشريط الجانبي.
ما ستحصل عليه مجاناً
- محادثات نصية يومية غير محدودة باستخدام نماذج قياسية.
- إمكانية البحث عبر الإنترنت للعثور على معلومات فورية.
- تحميل الملفات والصور لتلخيص المستندات أو تحليلها.
- إنشاء صور بالذكاء الاصطناعي وميزات صوتية أساسية.
حدود الخطة المجانية
قمنا بتدريب هذا النموذج باستخدام أسلوب التعلّم المعزَّز من خلال ملاحظات البشر (RLHF)، بالاعتماد على المنهجية نفسها التي استُخدمت في تدريب InstructGPT، مع وجود بعض الاختلافات البسيطة في طريقة جمع البيانات. بدأنا بتدريب نموذج أولي عبر الضبط الدقيق الخاضع للإشراف، حيث قدّم المدرّبون البشريون محادثات لعبوا فيها كلا الدورين — دور المستخدم ودور المساعد الذكي. كما أتحنا للمدرّبين الوصول إلى اقتراحات مكتوبة من النموذج نفسه لمساعدتهم في صياغة ردودهم. بعد ذلك، دمجنا مجموعة بيانات الحوار الجديدة هذه مع مجموعة بيانات InstructGPT بعد تحويلها إلى تنسيق حواري.
ولإنشاء نموذج المكافأة المستخدم في عملية التعلّم المعزّز، كان علينا جمع بيانات مقارنة تتضمّن ردّين أو أكثر من النموذج مرتّبين حسب الجودة. ولجمع هذه البيانات، استخدمنا المحادثات التي أجراها المدرّبون مع روبوت المحادثة، ثم اخترنا عشوائيًا رسالة واحدة كتبها النموذج، واستخلصنا منها عدة ردود بديلة، وطلبنا من المدرّبين ترتيبها وفقًا لجودتها. وباستخدام هذه النماذج الخاصة بالمكافأة، استطعنا إجراء الضبط الدقيق للنموذج باستخدام خوارزمية تحسين السياسات التقريبية (Proximal Policy Optimization). وقد كرّرنا هذه العملية على مراحل متعددة حتى وصلنا إلى النتيجة النهائية.






تعليقات
إرسال تعليق