ملخص المحتوى الأساسي
هذا تقرير تجريبي من مدون تقني حول النسخة الجديدة V4.1 من نموذج DeepSeek التي بدأت في التجربة الداخلية: يتميز هذا النموذج الجديد ببنية جديدة كليًا وقدرات متعددة الأنماط أصلية، وقد حاولت الشركة المطورة مباشرةً من خلال استبيانات التجربة الداخلية معرفة ما إذا كان بإمكانه استبدال النسخة السابقة V4 Pro ذات المواصفات الأعلى. قام المدون باستخدام النسخة القديمة V4 Flash كمقارنة، وأجرى 14 مجموعة من المهام، مما استهلك ما يعادل 300 مليون حرف صيني من عمليات استدعاء النموذج، ووجد في النهاية أن قدرات النموذج الجديد على تحليل الصور والتصور البصري قد تحسنت بشكل ملحوظ، لكنه يعاني أيضًا من بطء في إنجاز المهام الطويلة، وصعوبة في تذكر التفاصيل، واستهلاك موارد أكبر للمهام المعقدة، وليس بالضرورة ترقية مثالية تتفوق على النسخة القديمة في جميع الجوانب.
---
تفسير سهل للمحتوى من حيث الأبعاد المختلفة
1. أبرز تحسين: أخيرًا، حصل النموذج على “عيون حقيقية”، لا حاجة لاستخدام أدوات خارجية لتحليل الصور
كانت النسخة القديمة من Flash تعتمد بشكل كامل على النصوص؛ عندما تقدم لها صورة، لم تكن قادرة على فهمها بنفسها، بل كان عليها استدعاء أدوات خارجية لمسح النصوص ثم أدوات لتحليل الصور لاستخراج المعلومات، وقد استغرقت هذه العملية عشرات الثواني أو حتى الدقائق، وغالبًا ما كانت تفشل في التعرف بشكل صحيح على التفاصيل (مثل عدم التعرف على البائعين في الملصقات أو تفسير الكلمات الإنجليزية الموجودة في الصور بشكل خاطئ). أما النسخة الجديدة V4.1 فهي تدعم التعامل مع الصور بشكل متعدد الأنماط، مما يعني أنها قادرة على فهم المحتوى بسرعة (خلال 5-7 ثوانٍ فقط)، مما يوفر الوقت المطلوب لاستخدام أدوات خارجية، وحتى أنها قادرة على تقييم جودة الرسومات التي تنتجها. على سبيل المثال، عندما طُلب من النموذج رسم طائر البلشون وهو يركب دراجة، كان يرسم غالبًا طائرًا بريئًا، لكن النسخة الجديدة استطاعت اكتشاف الخطأ وتعديل الرسم بنفسها.
كما أن النموذج الجديد قادر على تحويل الصور إلى برامج قابلة للتشغيل؛ قدم المدون ثلاث صور كمرجع لإنشاء لعبة بسيطة حيث يقوم السمكة بدفع صندوق، وقامت النسخة القديمة بتغيير تفاصيل الخريطة وشخصية البطل بشكل كبير، بينما استطاعت النسخة الجديدة إعادة إنشاء الصورة بدقة تامة (بما في ذلك لون ملابس السمكة والحقيبة البرتقالية وعدد مربعات الخريطة).
2. السرعة ثلاثة أضعاف، لكن الوقت الإجمالي قد لا يكون أسرع… لماذا؟
تبلغ سرعة النموذج الجديد في الكتابة أكثر من 200 حرف صيني في الثانية، أي ثلاثة أضعاف سرعة النسخة القديمة، وقد بدت النتائج سريعة في البداية، لكن المدون اكتشف أن الوقت الإجمالي المستغرق لإنجاز المهام لم يتحسن كثيرًا، وفي بعض الحالات كانت الكمية الفعلية من النصوص المنتجة أقل، مما أدى إلى زيادة الوقت المستغرق. يرجع السبب إلى أن النموذج يقضي وقتًا طويلًا في التحقق من صحة الكود وإعادة العمل على الأخطاء بعد الكتابة. على سبيل المثال، بدلاً من إرسال الكود مباشرةً للمستخدم، يقوم النموذج بفحصه وتصحيح الأخطاء، مما يزيد من الوقت المطلوب. هذا يشبه موقفًا حيث يطلب من متدرب يكتب بسرعة ثلاثة أضعاف السرعة العادية إعداد عرض تقديمي (PPT)، لكنه يقضي وقتًا طويلًا في التحقق من المعلومات وطلب مساعدة الآخرين، مما يجعل الوقت الإجمالي مماثلًا لوقت شخص يكتب ببطء.
3. قدرات متفاوتة بشكل حاد: متميز في التنفيذ، لكن ضعيف في تذكر التفاصيل
تتميز النسخة الجديدة بقدرتها على تحويل الأفكار إلى برامج قابلة للتشغيل، لكنها ضعيفة جدًا في تذكر التفاصيل الطويلة؛ عندما طُلب منها إنشاء رسم بياني للأعداد الأولية، كانت تنتج رسومًا دقيقة، لكنها كانت تفشل في تذكر التفاصيل الدقيقة أثناء الكتابة. عندما طُلب منها إعداد تقرير عن أسهم الأسواق، كانت تنسى التفاصيل المهمة بسهولة. هذا يعني أن النموذج مناسب للمهام التي تتطلب تنفيذًا سريعًا وليس للمهام التي تتطلب تذكرًا دقيقًا للتفاصيل.
4. هل النموذج الجديد أغلى؟
استهلك النموذج الجديد مبلغًا أكبر من المال مقارنة بالنسخة القديمة (62 مقابل 45 دولارًا لنفس المجموعة من المهام)، بزيادة قدرها 36ً%، وبعد فحص سجلات التشغيل اكتشف المدون أن الزيادة تعود إلى استخدام النموذج لعدة أدوات وموارد إضافية أثناء تنفيذ المهام المعقدة (مثل استدعاء أدوات مساعدة لتحليل الكود). على سبيل المثال، عند إنشاء لعبة، قام النموذج بتوزيع المهام على عدة أدوات لكتابة أجزاء مختلفة من البرنامج. هذا يعني أن التكلفة الإجمالية تزيد، لكن الشركة المطورة أعلنت عن خفض في الأسعار اعتبارًا من 10 سبتمبر، حيث سيتم تخفيض تكلفة استدعاء البيانات المخزنة بنسبة 60%، مما سيجعل التكلفة أقل مقارنة بالوقت الحالي.