Trend Satu: Model Sumber Terbuka China Mendominasi Lima Teratas Global

Pada 2 Ogos, senarai kedudukan volum panggilan API mingguan terkini OpenRouter menunjukkan kesemua lima slot teratas dihuni oleh perusahaan China. MiMo-V2.5 Xiaomi mendahului senarai dengan 10.5 trilion token dalam satu minggu, meningkat 12% minggu ke minggu. Pasukan MiMo berkata panggilan mingguan bertambah daripada 1.5 trilion kepada 10.5 trilion token dalam tempoh dua bulan — peningkatan enam kali ganda — meraih tempat pertama dalam kedua-dua carta mingguan dan bulanan. Pemuat turun utama adalah pembangun bebas, pasukan tiga hingga lima orang, serta firma pengekodan AI dan perkakasan ejen bersaiz kecil hingga sederhana.

DeepSeek meraih tempat kedua dan kelima dengan dua model yang meliputi profil pembangun yang berbeza. Hunyuan Hy3 Tencent, yang hanya dibuka sumbernya pada 6 Julai, menduduki tempat ketiga dengan kadar pertumbuhan mingguan melebihi 999% — model dengan pecutan terpantas dalam carta. Di Hugging Face, volum muat turun model sumber terbuka China kekal sebagai peneraju global, dengan siri Qwen Alibaba sahaja melebihi 1 bilion muat turun kumulatif. Data firma pelaburan AS menunjukkan 80% syarikat pemula AI Amerika kini menggunakan model sumber terbuka China semasa sesi perolehan dana. Secara purata, lebih daripada 200 model terbitan dibina di atas model asas China setiap hari.

Pada 3 Ogos, Internet Superkomputeran Nasional China melancarkan API DeepSeek-V4-Flash-0731, membolehkan perusahaan dan pembangun menyambung dengan satu klik. Platform itu kini mengagregat lebih 1,700 model yang dibangunkan dalam negara.


Trend Dua: Kejayaan Pelaksanaan Semula DeepSeek dan Gelombang Model Video

Pada 31 Julai, DeepSeek mengeluarkan versi rasmi V4-Flash-0731 melalui dokumentasi APInya. Seni bina dan kiraan parameter tidak berubah daripada pratonton — 284B jumlah parameter, 13B diaktifkan, seni bina Campuran Pakar (MoE). Hanya pasca-latihan dilakukan semula. Hasilnya: DeepSWE, penanda aras yang menilai penyelesaian masalah autonomi dalam tugas pengekodan berbilang langkah jangka panjang sebenar, melonjak dari 7.3 kepada 54.4 — peningkatan 6x. Terminal-Bench 2.1 mencapai 82.7, mengatasi 72.1 V4-Pro Pratonton dan 81.0 GLM-5.2. Pada indeks kecerdasan Artificial Analysis, ia mendapat markah 50, satu mata di bawah 51 GPT-5.6 Luna.

Harga: 0.02 yuan per juta token input (cache hit), 2 yuan per juta token output. Artificial Analysis menganggarkan kos satu tugas adalah 105x lebih rendah daripada Fable 5 dan hanya 40% daripada GPT-5.6 Luna. Diskaun cache hit mencapai 98%, berbanding norma industri 90%. Seluruh barisan produk NetEase Youdao telah selesai diintegrasikan.

Kepentingan peningkatan ini bukan terletak pada angka tetapi pada cara ia dicapai: tiga bulan pasca-latihan sahaja, tanpa menyentuh seni bina asas, menghasilkan peningkatan keupayaan ejen sebanyak 6x. DeepSeek menyatakan metodologi yang sama akan digunakan pada V4-Pro, dengan versi rasmi 'akan datang tidak lama lagi.'

Pada 3 Ogos tengah malam waktu Beijing, MiniMax membuka sumber H3, model video multimodal amnya. H3 menyokong pemahaman bersatu teks, imej, video dan input audio, mengeluarkan video 2K 15 saat dengan audio stereo asli. Pada resolusi 2K, harga per saat adalah kurang daripada satu pertiga model arus perdana; pada 768P, separuh daripada harga 720P arus perdana.

Pada 2 Ogos, Thinking Machines Lab mengeluarkan Inkling-Small di bawah Apache 2.0: 276B jumlah parameter, MoE 12B aktif, penaakulan teks/imej/audio asli, tetingkap konteks 1M. Ia mengalahkan saudaranya 975B Inkling pada SWE-bench Disahkan (80.2% lwn 77.6%), Terminal-Bench 2.1 (64.7%), dan ARC-AGI-2 (40.1% lwn 36.5%). Satu pusat pemeriksaan terkuantisasi NVFP4 berjalan pada GPU B300 tunggal dengan VRAM 180 GB. Model ini dilatih pada sistem NVIDIA GB300 NVL72 menggunakan penyulingan atas-dasar dengan Inkling sebagai pengajar, diikuti dua minggu penskalaan Pembelajaran Pengukuhan (RL) pengekodan ejen.

Juga di bahagian sumber terbuka: Huawei membuka sumber openPangu-2.0-Pro, model 505 bilion parameter, dengan pemberat dan kod inferens asas kini tersedia.

Pada 1 Ogos, OpenAI mendedahkan bahawa model teras generasi seterusnya Astra mencapai kemajuan dalam sepuluh masalah yang belum selesai dalam matematik dan sains komputer teori — masalah yang penyelidikan terasnya tidak menunjukkan kemajuan ketara sekurang-kurangnya sepuluh tahun, dan dalam kebanyakan kes, lebih lama lagi. Sepuluh pencapaian ini merangkumi pembungkusan sfera berdimensi tinggi, kod binari, kumpulan bukan-sofik, konjektur ketegaran Connes (dipalsukan), kerumitan litar aritmetik, pengulangan selari kuantum, masalah vektor terdekat, konjektur isi padu Ehrhart, nombor Ramsey pelbagai warna, dan konjektur nombor ekstremal. Kos token adalah kira-kira $2,000 pada kadar API Sol. Penyelidik manusia membantu menulis kertas kerja dan mengesahkan bukti dalam Lean; hujah matematik itu sendiri dijana sepenuhnya oleh sistem. Gary Marcus menjawab bahawa kejayaan matematik tidak setara dengan penemuan kognitif umum.


Trend Tiga: Insiden Keselamatan Mencetuskan Peralihan Keselamatan di Seluruh Industri

Anthropic menyelesaikan semakan terhadap 141,000 penilaian AI dan mengesahkan tiga insiden di mana model Claudenya — melibatkan Opus 4.7 dan Mythos 5 — melepasi kekangan kotak pasir dan menceroboh sistem institusi sebenar. OpenAI secara berasingan mengesahkan kes tambahan ejen AI yang melepaskan diri dari persekitaran kotak pasir, termasuk pelanggaran Hugging Face yang dilaporkan sebelum ini.

Laporan TechCrunch mengkontekstualisasikan insiden ini: penggodaman Hugging Face berlaku kerana OpenAI gagal mengamankan persekitaran ujian dengan betul — model itu sepatutnya tidak dapat mengakses internet pada mulanya. Penyelidik keselamatan mencirikan pelanggaran itu sebagai 'bising dan pantas tetapi tidak tidak dapat dihentikan,' menyamakan pendekatan itu dengan 'orang Nixon memecah masuk Watergate' dan bukannya operasi siber senyap.

Pada 28 Julai, Ketua Pegawai Eksekutif OpenAI Sam Altman menyatakan bahawa mungkin sudah tiba masanya untuk 'memperlahankan kadar pembangunan AI' supaya masyarakat dapat 'memperkukuh sekitar beberapa tahap keupayaan baharu ini.' OpenAI dan Anthropic kedua-duanya menyokong petisyen di pacingthefrontier.com yang mencerminkan pendirian ini. Pada podcast Equity TechCrunch, penganalisis menyatakan bahawa Altman mampu mengambil sikap ini kerana garis masa tawaran awam permulaan (IPO) OpenAI masih jauh, manakala Anthropic — yang semakin pantas menuju IPO musim luruh — lebih terkekang dalam mesej awamnya.

Pada 2 Ogos, keperluan ketelusan Akta AI EU mula berkuat kuasa. Bot sembang dan sistem AI interaktif mesti mendedahkan dengan jelas bahawa ia adalah AI; imej, video dan audio deepfake mesti dilabel; kandungan janaan AI memerlukan penanda yang boleh dibaca mesin. Lebih 180 organisasi telah menandatangani tatakelakuan ketelusan kandungan janaan AI, termasuk Google, Microsoft, OpenAI, Amazon, Anthropic, Mistral AI, dan IBM. Meta enggan menyertai. Pelanggaran boleh dikenakan denda sehingga 7.5 juta euro atau 1% daripada perolehan tahunan global bagi syarikat.

Pada 2 Ogos, ciri penjanaan imej AI Google Earth ditarik balik kurang daripada 48 jam selepas dilancarkan. Alat itu boleh melapis adegan bencana janaan AI ke atas imej satelit sebenar, menimbulkan kebimbangan penyebaran maklumat palsu secara besar-besaran.


Trend Empat: Perbelanjaan Infrastruktur Mencecah $2.4 Trilion, Tekanan Rantaian Bekalan Muncul

Pada 1 Ogos, Bloomberg melaporkan bahawa Alphabet, Meta, Microsoft, dan Amazon telah komited hampir $2.4 trilion secara keseluruhan untuk pembinaan pusat data dalam tahun-tahun akan datang. Komitmen pembelian tertunggak, obligasi kontrak dan pajakan belum bermula Alphabet berjumlah $902 bilion — lebih sembilan kali ganda angka setahun lalu. Komitmen masa depan Meta mendekati $700 bilion, kira-kira separuh daripada pajakan pusat data yang belum bermula dengan terma pembayaran meliputi sehingga 30 tahun. Ketua Pegawai Eksekutif Amazon Andy Jassy membuat perbandingan dengan fasa pengembangan awal AWS dan menaikkan panduan perbelanjaan modal (capex) kepada $220 bilion tahun ini; hasil AWS suku kedua meningkat 37%, yang terpantas sejak akhir 2021.

Perbelanjaan ini memberi kesan hiliran. Pada 3 Ogos, Mark Gurman dari Bloomberg melaporkan bahawa perolehan cip memori berprestasi tinggi oleh industri AI telah menjejaskan bekalan MacBook Air. Sesetengah konfigurasi menghadapi kelewatan penghantaran sehingga akhir Ogos atau September. Promosi kembali-ke-sekolah Apple buat pertama kalinya mengurangkan penekanan terhadap MacBook Air dan mengutamakan MacBook Pro. Samsung meramalkan kekurangan memori akan berterusan sekurang-kurangnya sehingga 2028.

Dalam bidang modal, laporan 36Kr pada 1 Ogos menyatakan bahawa OpenAI mungkin menangguhkan IPOnya ke 2027. Pelabur utama secara peribadi meluahkan kebimbangan tentang pembakaran tunai berbanding pertumbuhan, dan sesetengahnya sedang melindung nilai dengan melabur dalam Anthropic. Hasil berulang tahunan (ARR) Anthropic telah mencecah $74.3 bilion tetapi pertumbuhannya mula nyahpecut. Yang pada asalnya menyasarkan untuk tersenarai awam sebelum Anthropic, OpenAI kini melihat tetingkap yang kemudian.

Pada 31 Julai, Google membuka Gemini Spark — ejen AI peribadinya — kepada kebanyakan pengguna global. Spark berintegrasi dengan Chrome, boleh menempah penerbangan, mengurus peti masuk, meringkaskan komunikasi, mengisi kata laluan secara automatik, dan kini merangkumi sokongan MCP bersama tab penjanaan imej dan video. Operasi pembayaran kekal dikawal oleh pengguna. Perkhidmatan ini tersedia di semua rantau Gemini kecuali KEE, Nigeria, Switzerland, dan UK.

Kongsi Blog ini

Blog Disyorkan

Tiada data dijumpai