
老叶

الموجز
الموجز
Grok 4.6 هنا أيضا!
تم إصداره تقريبا في نفس الوقت مع DeepSeek-V4-Pro-0813!
بصراحة، رؤية مواصفات grok 4.6 جعلتني متحمسا جدا! Grok 4.5 هو بالفعل من موديلات اليومية المفضلة لدي لأنه سريع جدا، ولا يحتوي على الكثير من القيود، مما يجعله مثاليا للاستخدام اليومي.
ومع ذلك، هذه المرة يتم دفع Grok 4.6 مباشرة إلى معايير قريبة جدا من الطرازين الرئيسيين من أعلى علامتين تجاريتين، ويتميز بسرعات أعلى منهما.
غروك العجوز على الطاولة هذه المرة! أعتقد أنه يمكن أن يحل محل جيميني كلاعب جديد من 'الثلاثة الكبار'!

تم الإعلان رسميا! DeepSeek-V4-Pro-0813 قادم قريبا!
قبل قليل، كشف مستند الموقع الرسمي لموقع DeepSeek عن معرف الطراز للنسخة الرسمية من DeepSeek-V4-Pro. استنادا إلى التاريخ، من المتوقع أن يكون تاريخ الإصدار في 13 أغسطس.
بالإضافة إلى ذلك، بدأ الإصدار الرسمي من V4-Pro بدعم واجهة برمجة تطبيقات الردود، مما سمح باستخدامه مباشرة على الكودكس دون أي تحويل.

الانفجار—OpenAI قاسية حقا هذه المرة.
حزمة Pro x20 أعادت إعادة ضبط حد ائتماني، وكنت مذهولا تماما
يبدو أن الحصة الأسبوعية انخفضت إلى ثلث المبلغ السابق فقط.
ليست قطعا صغيرة، بل قطعا مباشرا في اللحم.
خلال اليومين الماضيين، كانت زيارات النماذج في OpenAI مزدحمة باستمرار، مع تأخير متكرر، وحدود عرض النطاق الترددي، وقوائم الانتظار.
لذا الآن هناك احتمالان فقط:
أو هناك خلل في تكوين الحصة،
أو أن OpenAI ببساطة لا تستطيع الصمود وتقوم بتقليل حصة مستخدمي Pro بشكل استباقي.
إذا كان الخيار الثاني، فحزمة Pro x20 يجب أن تعيد حساب نسبة التكلفة إلى الأداء.
لست متأكدا إذا كانت هذه حالة معزولة.
إخوتي مع X20، تحقق من حصتك وانظر إذا تم تقليصها أيضا.
سأل بعض مستخدمي الإنترنت، لماذا لا تستخدم العبارة المباشرة :model_provider = "OpenAI"
بهذه الطريقة، يمكنك أيضا إنشاء صور والبحث.
دعني أشرح السبب، لأن معظم التحويلات تتجنبون model_providers. يستخدم OpenAI بشكل رئيسي المضغوط عن بعد لأنه طلب متزامن، والعديد من CFs المستخدمة في المرحل تتعرض لخطر تجاوز المهلة 100 ثانية. إذا كنت تستخدم بروكسي عكسي خاص بك ولا تستخدم CF، فيمكنك اتباع هذه الطريقة دون مراجعة إضافية.
بعد المعالجة العكسية، وجدت أنه بالإضافة إلى اكتشاف model_providers، يكتشف أيضا رأس x-openai-actor-authorization.
لذلك، وفقا لخطتي، يمكنك تجنب الدمج عن بعد مع الاستمرار في تحقيق صور خام وعمليات بحث.
ثانيا، لماذا نحتاج إلى عكس ذلك؟ لأنني وجدت أن نسخة سطح المكتب في Codex تكتشف رأس openai-actor-authorization، لكن نسخة سطح المكتب حاليا ليست مفتوحة المصدر.
ظهور مفاجئ! العميل الجديد في Codex يقوم سرا ب"خفض معدل ذكاء" محطات الترحيل الخارجية.
في 11 يوليو، اكتشفت أن النسخة الجديدة من كودكس لا يمكنها توليد صور، وأطلقت الحل الكامل على الفور.
كنت أظن أن هذا مجرد قيد في ميزة الصورة الخام، لكن بعد تحليل عكسي أكثر، أدركت أن الأمور أكثر تعقيدا بكثير.
بمجرد أن يكتشف الكودكس الجديد أنك تستخدم مزودا من طرف ثالث، فإنه يقيد بشكل مباشر قدرتين رئيسيتين:
1. توليد الصور
2、بحث الويب
إذا كانت الصور الخام مقيدة، فمن السهل على الناس ملاحظة ذلك.
لكن الإغلاق الهادئ لبحث الويب هو المكان الذي تكمن فيه أهمية قدرات النموذج.
قد لا يدرك الكثير من الناس مدى أهمية البحث على الويب.
قواعد المعرفة الداخلية للنماذج الكبيرة لديها مواعيد نهائية؛ لا تعرف ما حدث اليوم، ولا يمكنها الوصول إلى أحدث الوثائق والأخبار والتغيرات التكنولوجية من العدم.
لذلك، يمنح بائعو النماذج إمكانيات بحث فوري عبر الإنترنت لإضافة النموذج، وهي البحث عبر الويب.
وهو يعادل "عيون" النموذج.
بدون البحث على الويب، يمكن للنماذج الاعتماد فقط على المعرفة القديمة للإجابة على الأسئلة؛
مع البحث على الويب، يمكنه الاستعلام عن المعلومات عبر الإنترنت بأكمله في الوقت الحقيقي، والتحقق من الحقائق، وقراءة أحدث المستندات.
لكن الآن، طالما أنك تستخدم محطة ترحيل طرف ثالث في الكودكس الجديد، حتى لو كانت الخلفية متصلة بنفس النموذج الشرعي بالضبط، قد يمنع العميل مباشرة قدرات البحث على الويب.
النموذج لم يتغير.
واجهة برمجة التطبيقات لم تتغير.
فقط لأن المزود ليس رسميا، يقوم العميل تلقائيا بقطع القدرة.
هذا هو المعنى الحقيقي ل "تقليل الذكاء من جانب العميل".
الخبر السار هو أنه بعد التحليل العكسي، وجدت طرقا لتجاوز القيود، واستعادة نسخ الصور، واستخدام البحث على الويب.
لقد نشرت بالفعل شرحا مفصلا عن التعديلات في تغريدتي السابقة:
إذا كنت تستخدم محطة ترحيل طرف ثالث من Codex، ينصح بالتحقق فورا.
تعتقد أنك تستخدم نفس النموذج، لكن في الواقع، قد يكون العميل قد قام بتقليله سرا.
يمكنك الاطلاع على المقارنة قبل وبعد التعديل في الصورة المرفقة:




يوم كامل من الخبرة المتعمقة مع GPT-5.6-sol.
موقفي مر بثلاث مراحل تقريبا:
الحماس → التساؤل → الفهم والقبول.
أولا، دعونا نتحدث عن نقطة قد تكون مربكة بسهولة:
أعلى مستوى استنتاج في GPT-5.6-sol هو في الواقع xhigh. ال Max و Ultra المعروضان في واجهة المستخدم يشيران أكثر إلى وضع سير عمل العميل، وليس فقط لجعل النموذج "أكثر ذكاء".
أكثر الجوانب التي يتعرض للانتقاد في ألترا اليوم هي أنها تفضل توزيع أعداد كبيرة من الوكلاء الفرعيين تلقائيا.
حتى مهمة بسيطة يمكن أن تجمع فورا مجموعة من البروكسيات وتستهلك عددا كبيرا من الرموز. قد تبدو العملية بأكملها كبيرة، لكن الفوائد الفعلية قد لا تتناسب مع التكلفة.
عندما بدأت استخدامه لأول مرة، كنت متشككا قليلا:
هل هذا مجرد عمل، أم مجرد عرض للرموز؟
لاحقا، بعد أن فهمت آلياتها، خفضت مستوى تفكيري إلى High وقمت ببعض المهام الحقيقية مرة أخرى، مما حسن التجربة كثيرا.
إنه أسرع من GPT-5.5 xhigh، مع قدرات واستقرار أقوى بكثير، واستهلاك الرموز فيه ليس مبالغا فيه مثل Ultra.
على الأقل من تجربتي اليوم:
GPT-5.6-sol + High قد يكون التركيبة الأنسب للاستخدام اليومي حاليا.
بالنسبة لإعادة هيكلة معقدة، ومراجعات المشاريع الكاملة، والمهام الكبرى التي تتطلب استكشافا متوازيا، يمكن النظر في Ultra أيضا.
لا حاجة لرفع مهام التطوير العادية إلى الحد الأقصى فورا.
هذا الطراز ليس غير قابل للاستخدام، ولا يجب أن يكون مضطرا بلا تفكير على أعلى سرع.
المشكلة الحقيقية هي أن الكثير من الناس لم يكتشفوا حتى الفرق بين مستويات Max وUltra وInference قبل أن يستخدموا Ultra كوضع افتراضي.
إذا استخدمت بشكل صحيح، فهي بالتأكيد أفضل بكثير من 5.5.
إذا استخدمتها بشكل خاطئ، يمكنك فقط مشاهدة الرموز تتدفق بسرعة كبيرة.
إليك نصيحة للجميع! إذا أردت استخدام 5.6 سول.
أرجوك ارموا القوى الخارقة في القمامة الآن!
وإلا، سترى النموذج يخوض ساعات من معارك الدماغ بين اليسار والأيمن! في النهاية، تستمر المشاكل في التراكم، ولا تنتهي أبدا!
آسف، كنت مهملا حقا، أرجو أن تسامحوني!
بعد استخدامه ليوم كامل، شعرت أن 5.6 سول كان بطئا جدا، وثانيا، كان متضاربا جدا. مشكلة صغيرة، كلما أصلحتها أكثر، أصبح النطاق أكبر!
آسف، ألترا مان، لا أستطيع أن أتباهى لك هذه المرة! بعد كل هذا الوقت من التفكير، هل هذا هو الأمر؟
عندما اكتشفت أن 5.6 تم تطويره فعليا باستخدام قاعدة 5.4، عرفت أنه محكوم عليه بالفشل!
آسف، كنت مهملا حقا، أرجو أن تسامحوني!
بعد استخدامه ليوم كامل، شعرت أن 5.6 سول كان بطئا جدا، وثانيا، كان متضاربا جدا. مشكلة صغيرة، كلما أصلحتها أكثر، أصبح النطاق أكبر!
آسف، ألترا مان، لا أستطيع أن أتباهى لك هذه المرة! بعد كل هذا الوقت من التفكير، هل هذا هو الأمر؟
عندما اكتشفت أن 5.6 تم تطويره فعليا باستخدام قاعدة 5.4، عرفت أنه محكوم عليه بالفشل!

