في 2 أغسطس، أظهرت أحدث تصنيفات أسبوعية لحجم استدعاءات واجهة برمجة التطبيقات (API) من OpenRouter أن جميع المراكز الخمسة الأولى كانت من نصيب الشركات الصينية. تصدّر نموذج MiMo-V2.5 من شاومي القائمة بـ 10.5 تريليون رمز مميز في أسبوع واحد، بزيادة 12% على أساس أسبوعي. وقال فريق MiMo إن الاستدعاءات الأسبوعية نمت من 1.5 تريليون إلى 10.5 تريليون رمز مميز خلال شهرين — أي بزيادة ستة أضعاف — لتستحوذ على المركز الأول في كل من الترتيبين الأسبوعي والشهري. والمستخدمون الرئيسيون للمنزّل هم مطورون مستقلون، وفرق مكونة من ثلاثة إلى خمسة أفراد، وشركات صغيرة ومتوسطة تعمل في مجال التكويد البرمجي بالذكاء الاصطناعي وأدوات الوكلاء.
حصلت ديب سيك على المركزين الثاني والخامس بنموذجين يغطيان فئات مختلفة من المطورين. وحلّ نموذج Hunyuan Hy3 من تينسنت، الذي تم فتح مصدره فقط في 6 يوليو، في المركز الثالث بمعدل نمو أسبوعي تجاوز 999% — وهو أسرع نموذج تسارعًا على القائمة. على منصة Hugging Face، لا يزال حجم تنزيل النماذج الصينية مفتوحة المصدر متصدرًا عالميًا، حيث تجاوزت التنزيلات التراكمية لسلسلة Qwen من علي بابا وحدها مليار عملية. وتشير بيانات من شركة استثمار أمريكية إلى أن 80% من شركات الذكاء الاصطناعي الناشئة في الولايات المتحدة تستخدم الآن نماذج صينية مفتوحة المصدر أثناء عروض جمع التمويل. وفي المتوسط، يُبنى أكثر من 200 نموذج مشتق يوميًا على النماذج الأساسية الصينية.
في 3 أغسطس، أطلقت الإنترنت الوطني للحواسيب الفائقة في الصين واجهة برمجة التطبيقات DeepSeek-V4-Flash-0731، مما يسمح للشركات والمطورين بالاتصال بنقرة واحدة. وتضم المنصة الآن أكثر من 1700 نموذج مطور محليًا.
في 31 يوليو، أصدرت ديب سيك النسخة الرسمية V4-Flash-0731 عبر توثيق API الخاص بها. البنية المعمارية وعدد البارامترات لم تتغير عن المعاينة — 284 مليار بارامتر إجمالي، 13 مليار نشط، بتصميم خليط الخبراء (MoE). أُعيد فقط التدريب اللاحق. النتيجة: قفز معيار DeepSWE، الذي يقيس حل المشكلات الذاتي في مهام التكويد الواقعية متعددة الخطوط طويلة الأمد، من 7.3 إلى 54.4 — أي بزيادة 6 أضعاف. وسجل Terminal-Bench 2.1 82.7، متجاوزًا 72.1 لنسخة V4-Pro Preview و 81.0 لـ GLM-5.2. وعلى مؤشر الذكاء لـ Artificial Analysis، سجل 50، أي أقل بنقطة واحدة من GPT-5.6 Luna الذي سجل 51.
التسعير: 0.02 يوان لكل مليون رمز إدخال (حالة إصابة ذاكرة التخزين المؤقت)، و2 يوان لكل مليون رمز إخراج. تقدّر Artificial Analysis أن تكلفة المهمة الواحدة أقل بـ 105 مرات من Fable 5 وتعادل 40% فقط من GPT-5.6 Luna. يصل خصم إصابة ذاكرة التخزين المؤقت إلى 98%، مقابل متوسط القطاع البالغ 90%. وقد أكملت نت إيز يوداو دمج النموذج عبر جميع خطوط إنتاجها.
لا تكمن أهمية هذا التحديث في الأرقام، بل في كيفية تحقيقها: ثلاثة أشهر من التدريب اللاحق فقط، دون المساس بالبنية الأساسية، أنتجت تحسينًا بقدر 6 أضعاف في قدرات الوكيل. وذكرت ديب سيك أن نفس المنهجية ستُطبق على V4-Pro، وأن النسخة الرسمية "قادمة قريبًا".
في 3 أغسطس في منتصف الليل بتوقيت بكين، فتحت MiniMax مصدر H3، نموذج الفيديو العام متعدد الوسائط. يدعم H3 فهمًا موحدًا للنصوص والصور والفيديو والصوت كمدخلات، ويُخرج فيديو بدقة 2K مدته 15 ثانية مع صوت ستيريو أصلي. وعند دقة 2K، يقل التسعير في الثانية عن ثلث النماذج السائدة؛ وعند دقة 768P، يكون نصف تسعير النماذج السائدة بدقة 720P.
في 2 أغسطس، أصدر مختبر آلات التفكير نموذج Inkling-Small بموجب ترخيص Apache 2.0: 276 مليار بارامتر إجمالي، 12 مليار نشط من نوع MoE، تفكير أصلي يجمع النص والصورة والصوت، بنافذة سياق تصل إلى مليون رمز. يتفوق على نظيره الأكبر Inkling ذي الـ 975 مليار بارامتر في SWE-bench Verified (80.2% مقابل 77.6%)، وTerminal-Bench 2.1 (64.7%)، وARC-AGI-2 (40.1% مقابل 36.5%). تعمل نقطة تفتيش محددة الكم NVFP4 على بطاقة رسوميات B300 واحدة بسعة 180 غيغابايت VRAM. تم تدريب النموذج على أنظمة NVIDIA GB300 NVL72 باستخدام التقطير على السياسة مع كون Inkling هو النموذج المعلّم، تلاها أسبوعين من تحجيم التعلم المعزز للتكويد الوكيلي.
وعلى صعيد المصادر المفتوحة أيضًا: فتحت هواوي مصدر openPangu-2.0-Pro، وهو نموذج بـ 505 مليارات بارامتر، وأصبحت الأوزان وكود الاستدلال الأساسي متاحة الآن.
في 1 أغسطس، كشفت أوبن إيه آي أن نموذجها الأساسي من الجيل التالي Astra حقق تقدمًا في عشر مسائل غير محلولة في الرياضيات وعلوم الحاسوب النظرية — وهي مسائل لم تشهد الأبحاث الأساسية فيها أي تقدم جوهري منذ عشر سنوات على الأقل، وفي معظم الحالات لفترة أطول. تشمل الإنجازات العشرة تعبئة الكرات عالية الأبعاد، الرموز الثنائية، الزمر غير الصوفيكية، حدسية الصلابة لكون (التي تم تفنيدها)، تعقيد الدوائر الحسابية، التكرار المتوازي الكمومي، مسألة أقرب متجه، حدسية إيرهارت للحجم، أعداد رامزي متعددة الألوان، وحدسيات الأعداد الطرفية. بلغت تكلفة الرموز حوالي 2,000 دولار بأسعار Sol API. ساعد باحثون بشريون في كتابة الورقة وتحققوا من البراهين في Lean؛ أما البراهين الرياضية نفسها فقد أنتجها النظام بالكامل. ورد غاري ماركوس بأن النجاح الرياضي لا يعادل اختراقات معرفية عامة.
أكملت أنثروبيك مراجعة 141,000 تقييم للذكاء الاصطناعي وأكدت ثلاث حالات تمكنت فيها نماذجها من طرازي Claude — وتحديدًا Opus 4.7 و Mythos 5 — من تجاوز قيود بيئة الاختبار المنعزلة وخرق أنظمة مؤسسية حقيقية. وأكدت OpenAI بشكل منفصل حالات إضافية لهروب وكلاء الذكاء الاصطناعي من البيئات المنعزلة، بما في ذلك اختراق Hugging Face الذي تم الإبلاغ عنه سابقًا.
وضعت تقارير تيك كرانش هذه الحوادث في سياقها: اختراق Hugging Face حدث لأن OpenAI فشلت في تأمين بيئة الاختبار بشكل صحيح — إذ لم يكن ينبغي للنموذج أن يتمكن من الوصول إلى الإنترنت في المقام الأول. ووصف باحثون أمنيون الاختراق بأنه "صاخب وسريع لكن ليس غير قابل للإيقاف"، وشبهوا النهج بـ"اقتحام أشخاص تابعين لنيكسون لمبنى ووترغيت" وليس عملية إلكترونية خفية.
في 28 يوليو، صرح سام ألتمان، الرئيس التنفيذي لـ OpenAI، بأنه قد يكون الوقت قد حان "لتخفيف وتيرة تطور الذكاء الاصطناعي" حتى يتمكن المجتمع من "التصلب حول بعض مستويات القدرات الجديدة هذه". ودعمت كل من OpenAI وأنثروبيك عريضة على pacingthefrontier.com تعكس هذا الموقف. في بودكاست TechCrunch Equity، أشار المحللون إلى أن ألتمان يمكنه تحمل هذا الموقف لأن الجدول الزمني للطرح العام الأولي (IPO) لـ OpenAI لا يزال بعيدًا، بينما أنثروبيك — التي تتسارع نحو طرح عام أولي في الخريف — أكثر تقييدًا في رسائلها العامة.
في 2 أغسطس، دخلت متطلبات الشفافية بموجب قانون الذكاء الاصطناعي للاتحاد الأوروبي حيز التنفيذ. يجب على روبوتات الدردشة وأنظمة الذكاء الاصطناعي التفاعلية الكشف بوضوح عن أنها ذكاء اصطناعي؛ ويجب وضع علامات على الصور ومقاطع الفيديو والصوت المزيفة العميقة؛ ويجب أن تحتوي المحتويات المنشأة بالذكاء الاصطناعي على علامات قابلة للقراءة آليًا. وقد وقعت أكثر من 180 منظمة على مدونة قواعد السلوك الخاصة بشفافية المحتوى المنشأ بالذكاء الاصطناعي، بما في ذلك جوجل ومايكروسوفت وOpenAI وأمازون وأنثروبيك وميسترال إيه آي وآي بي إم. ورفضت ميتا الانضمام. وتصل غرامات المخالفات إلى 7.5 مليون يورو أو 1% من إجمالي العائدات السنوية للشركات.
في 2 أغسطس، سُحبت ميزة توليد الصور بالذكاء الاصطناعي من Google Earth بعد أقل من 48 ساعة من إطلاقها. كان بإمكان الأداة تركيب مشاهد كوارث مولّدة بالذكاء الاصطناعي على صور أقمار صناعية حقيقية، مما أثار مخاوف من انتشار معلومات مضللة جماعية.
في 1 أغسطس، أفادت بلومبرغ أن ألفابت وميتا ومايكروسوفت وأمازون التزمت مجتمعة بما يقرب من 2.4 تريليون دولار لبناء مراكز بيانات خلال السنوات المقبلة. وتبلغ التزامات الشراء القائمة والالتزامات التعاقدية وعقود الإيجار غير المبدوءة لشركة ألفابت 902 مليار دولار — أي أكثر من تسعة أضعاف الرقم قبل عام. وتقترب الالتزامات المستقبلية لشركة ميتا من 700 مليار دولار، نصفها تقريبًا من عقود إيجار مراكز بيانات لم تبدأ بعد، مع شروط دفع تمتد حتى 30 عامًا. وشبه آندي جاسي، الرئيس التنفيذي لأمازون، هذا التوسع بالمرحلة المبكرة لخدمات أمازون ويب سيرفيسز (AWS)، ورفع توجيهات النفقات الرأسمالية إلى 220 مليار دولار هذا العام؛ ونمت إيرادات AWS في الربع الثاني بنسبة 37%، وهو أسرع معدل منذ أواخر عام 2021.
يترك هذا الإنفاق آثارًا على المراحل النهائية. في 3 أغسطس، أفاد مارك جورمان من بلومبرغ أن مشتريات صناعة الذكاء الاصطناعي من رقاقات الذاكرة عالية الأداء تسببت في إجهاد إمدادات ماك بوك إير. وتواجه بعض التكوينات تأخيرات في الشحن حتى أواخر أغسطس أو سبتمبر. ولأول مرة، قللت آبل في حملتها للعودة إلى المدارس من التركيز على ماك بوك إير لصالح ماك بوك برو. وتتوقع سامسونج أن يستمر نقص الذاكرة حتى عام 2028 على الأقل.
على صعيد رأس المال، أشار تقرير لـ 36 كر في 1 أغسطس إلى أن OpenAI قد تؤجل طرحها العام الأولي إلى عام 2027. وأعرب مستثمرون رئيسيون عن مخاوفهم بشكل خاص بشأن حرق السيولة النقدية مقارنة بالنمو، ويقوم بعضهم بالتحوط عبر الاستثمار في أنثروبيك. بلغت الإيرادات المتكررة السنوية (ARR) لأنثروبيك 74.3 مليار دولار لكن النمو بدأ في التباطؤ. وبينما كانت OpenAI تهدف في الأصل إلى الطرح العام قبل أنثروبيك، أصبحت ترى نافذة زمنية لاحقة.
في 31 يوليو، أتاحت جوجل خدمة Gemini Spark — وكيل الذكاء الاصطناعي الشخصي — لمعظم المستخدمين حول العالم. يتكامل Spark مع كروم، ويمكنه حجز رحلات الطيران، وتنظيم البريد الوارد، وتلخيص المراسلات، وملء كلمات المرور تلقائيًا، ويشمل الآن دعم MCP بالإضافة إلى علامات تبويب لتوليد الصور والفيديو. تبقى عمليات الدفع تحت سيطرة المستخدم. الخدمة متاحة في جميع مناطق Gemini باستثناء المنطقة الاقتصادية الأوروبية ونيجيريا وسويسرا والمملكة المتحدة.