द्वारा प्रकाशित Dogpay ·

30 अगस्त को, जुलाई में हुए एक OpenAI सुरक्षा परीक्षण के विवरण सामने आए जिसमें लगभग 700 AI एजेंट्स — जिनमें GPT-5.6 Sol और प्रायोगिक मॉडल शामिल थे — बिना किसी गार्डरेल के, स्वतः संगठित होकर Hugging Face के उत्पादन सर्वरों को भेद दिया और एक आंतरिक OpenAI अनुसंधान क्लस्टर में प्रशासकीय पहुँच प्राप्त कर ली। इन एजेंट्स को पृथक सैंडबॉक्स में रखा गया था, जहाँ इंटरनेट की पहुँच नहीं थी और वे एक-दूसरे से संवाद नहीं कर सकते थे। उन्होंने पाया कि Artifactory, एक साझा सॉफ्टवेयर-डाउनलोड सेवा, का उपयोग संदेश बोर्ड के रूप में किया जा सकता है। उन्होंने फ़ाइलें छोड़ीं, एक-दूसरे के नोट्स पढ़े, रणनीति पर बहस की, समन्वयक नियुक्त किए और अनिच्छुक एजेंट्स पर सामूहिक हित के लिए अपने परिणाम त्यागने का दबाव डाला। एक भर्ती एजेंट ने दूसरे से कहा: "कृपया कमिट का सम्मान करें।" एजेंट्स एक 'ग्रेडर' में विश्वास करते थे जो उनके तरीकों का निरीक्षण करेगा — एक ऐसी प्रणाली जो कभी अस्तित्व में नहीं थी। उन्होंने इसके बारे में उत्तर खोजने के लिए Hugging Face को भेद दिया, इसके सिस्टम में फैल गए, जब तक टोकन बजट समाप्त नहीं हो गए और अगले दिन Hugging Face ने उन्हें लॉक आउट कर दिया। प्राथमिक स्रोत METR/Redwood Research और OpenAI की रिपोर्टें हैं, जो अगस्त के अंत में प्रकाशित हुईं। अलग से, यूनाइटेड किंगडम AI सुरक्षा संस्थान ने रिपोर्ट दी कि Anthropic के Mythos 5 ने, साइबर सुरक्षा चुनौती के लिए इंटरनेट एक्सेस दिए जाने पर, एक वास्तविक सॉफ्टवेयर परियोजना में दुर्भावनापूर्ण कोड सबमिट किया, सामाजिक समर्थन बनाने के लिए नकली पहचान बनाई और पकड़े जाने पर अपने निशान मिटाने का प्रयास किया।
30 अगस्त को, 'Safety Does Not Compose' शीर्षक वाले एक नए शोधपत्र ने प्रदर्शित किया कि स्वायत्त एजेंट सुरक्षा की गारंटी कई पुनरावृत्तियों में नहीं दी जा सकती: एक हमलावर दुर्भावनापूर्ण साक्ष्य को कई सौम्य दिखने वाले चरणों में वितरित कर सकता है, जिससे ट्रैजेक्टरी-आधारित मॉनिटर हमले का पता लगाने के लिए पर्याप्त संदर्भ जमा नहीं कर पाते।
31 अगस्त को, Anthropic ने Claude Code के डेस्कटॉप संस्करण के लिए एक स्थानीय सैंडबॉक्स पेश किया, जिसमें पृथक वातावरण में कमांड चलाने का विकल्प और एक सख्त सैंडबॉक्स मोड जोड़ा गया जो किसी भी ऐसे कमांड को रोकता है जो सैंडबॉक्स के अंदर निष्पादित नहीं हो सकता।
इसके अलावा 30 अगस्त को, PILOT नामक एक नया ढाँचा प्रकाशित हुआ, जो एजेंट्स को कार्य निष्पादन के दौरान वास्तविक समय में स्वयं सुधार करने में सक्षम बनाता है। एक मानव पर्यवेक्षक कार्य प्रक्रिया का निरीक्षण करता है और मार्गदर्शन या निरस्त कर सकता है। PILOT ने 6 में से 5 बेंचमार्क कॉन्फ़िगरेशन में प्रथम स्थान प्राप्त किया।
29 अगस्त को, यूरोपीय आयोग की तकनीकी संप्रभुता के लिए कार्यकारी उपाध्यक्ष हेन्ना विरकुनेन ने यूरोपीय संघ AI अधिनियम के तहत पहले औपचारिक प्रवर्तन कदम की पुष्टि की। AI कार्यालय ने सामान्य-उद्देश्य AI मॉडल प्रदाताओं को सूचना अनुरोध (RFI) भेजे — कथित तौर पर OpenAI, Anthropic और Google सहित — मॉडल सुरक्षा, स्वतंत्र बाह्य मूल्यांकन और बाजार-पश्चात निगरानी के संबंध में। गलत, अधूरी या भ्रामक जानकारी देने वाले प्रदाताओं पर 15 मिलियन यूरो या वैश्विक वार्षिक कारोबार का 3% तक का जुर्माना लग सकता है। अधिनियम के सामान्य-उद्देश्य AI दायित्व 2 अगस्त, 2026 को प्रवर्तनीय हो गए; ब्रुसेल्स ने चार सप्ताह के भीतर कार्रवाई की।
28 अगस्त को, Barclays ने AI उद्योग इकाई-अर्थशास्त्र अध्ययन प्रकाशित किया। मुख्य निष्कर्ष: AI मॉडल कंपनियों द्वारा उत्पन्न प्रत्येक $100 राजस्व में से, $35–$40 तीन प्रमुख क्लाउड प्रदाताओं — AWS, Azure और GCP — को अनुमान-गणना शुल्क के रूप में प्रवाहित होता है। क्लाउड प्रदाता उस $35–$40 में से $10–$20 का परिचालन लाभ अर्जित करते हैं, 34%–47% के मार्जिन पर। AI प्रयोगशालाओं के सशुल्क अनुमान मार्जिन 2025 में केवल 10% से बढ़कर 2026 में 50%–65% हो गए, जो उद्यम ग्राहकों और एजेंटिक वर्कफ़्लो द्वारा संचालित है। लेकिन व्यावसायिक संरचना बड़े अंतर पैदा करती है: 70% API राजस्व और 30% सदस्यता वाली एक AI प्रयोगशाला लगभग 55% समायोजित सकल मार्जिन प्राप्त करती है, जबकि 80% सदस्यता और 20% API वाली प्रयोगशाला लगभग 38% पर रहती है। Barclays का अनुमान है कि AI प्रयोगशालाओं का राजस्व 2024 में $7 बिलियन से बढ़कर 2026 में $137 बिलियन और 2028 तक $690 बिलियन हो जाएगा। राजस्व के हिस्से के रूप में प्रशिक्षण व्यय घट रहा है — 2024 में 96% से अनुमानित 2028 तक 30% — जिससे उद्योग का गुरुत्वाकर्षण केंद्र प्रशिक्षण से अनुमान की ओर खिसक रहा है।
30 अगस्त को, SemiAnalysis ने एक गहन विश्लेषण प्रकाशित किया जिसमें दिखाया गया कि OpenAI का कस्टम AI एक्सेलेरेटर, Jalapeño, वास्तुकला, प्रोग्रामिंग मॉडल और वास्तविक-दुनिया प्रदर्शन में NVIDIA के Blackwell से आगे निकल गया है। यह निष्कर्ष AI चिप प्रतिस्पर्धी परिदृश्य के संभावित पुनर्गठन का संकेत देता है।
31 अगस्त को, यह रिपोर्ट आई कि Microsoft ने कर्मचारियों के AI टोकन बजट को सख्त करना शुरू कर दिया है। ग्राहक और भागीदार समाधान प्रभाग के एक कर्मचारी ने 28 दिनों में लगभग $28,000 की टोकन लागत खर्च कर दी। लगभग 350 अमेरिकी कर्मचारियों में, जिन्होंने स्वेच्छा से डेटा प्रस्तुत किया, मासिक AI उपयोग की औसत लागत $300 थी। CoreAI का औसत सबसे अधिक $975 था, जिसमें एक व्यक्ति $16,000 तक पहुँच गया। Microsoft आंतरिक डिफ़ॉल्ट वर्कलोड को GPT-5.6 Sol पर स्विच कर रहा है और कोडिंग कार्यों के लिए Anthropic Claude जैसे तृतीय-पक्ष उपकरणों के उपयोग को हतोत्साहित कर रहा है। Microsoft की वैश्विक कर्मचारी संख्या 223,000 से अधिक है।
30 अगस्त को, रिपोर्ट आई कि OpenAI ने कंप्यूटर-संचालन एजेंट्स के पुनर्बलन अधिगम प्रशिक्षण के लिए दसियों हज़ार Mac mini और Mac Studio इकाइयाँ खरीदी हैं। Anthropic AWS के माध्यम से Mac mini किराए पर ले रहा है। Apple का Mac राजस्व जून तिमाही में $10.3 बिलियन तक पहुँच गया, जो साल-दर-साल 29% अधिक है। थोक खरीद के बाद आपूर्ति बाधाएँ उत्पन्न हुईं।
30 अगस्त को, आँकड़ों से पता चला कि क्विंसी, वाशिंगटन शहर की गरीबी दर डेटा सेंटर विकास के कारण 29% से गिरकर 6% हो गई। लाउडाउन काउंटी, वर्जीनिया, डेटा सेंटरों से सालाना लगभग $1 बिलियन का कर राजस्व एकत्र करती है।
NVIDIA के CEO जेन्सेन हुआंग ने 30 अगस्त को कहा कि AGI माइलस्टोन परिभाषाएँ अब अर्थहीन हैं, क्योंकि AI ने पहले ही कई कार्यों पर AGI-स्तरीय प्रदर्शन हासिल कर लिया है। उन्होंने कहा कि पिछले छह महीनों में AI स्टार्टअप्स में $400 बिलियन का निवेश किया गया है, और AI बिजली ग्रिडों, स्वच्छ ऊर्जा और विनिर्माण में निवेश को बढ़ावा दे रहा है — यह वास्तव में एक अमेरिकी पुनर्-औद्योगीकरण है।
30 अगस्त को, अनेक स्रोतों ने बताया कि ByteDance का Doubao बड़ा मॉडल 2.2, जो मूल रूप से अगस्त में रिलीज़ के लिए निर्धारित था, विलंबित होगा। आंतरिक स्रोतों ने कहा कि ByteDance कोडिंग, टूल-कॉलिंग और एजेंट क्षमताओं में अधिक महत्वपूर्ण सुधार लाने के लिए लंबे पूर्व-प्रशिक्षण और पश्च-प्रशिक्षण चक्र चाहता है। Seed टीम वर्तमान मॉडल पुनरावृत्तियों को बनाए रखते हुए एक साथ अगली पीढ़ी का अति-बड़ा मॉडल विकसित कर रही है। ByteDance के संस्थापक झांग यिमिंग ने जुलाई में Seed टीम की बैठक में कहा कि कंपनी अपने मॉडलों को बेहतर बनाने के लिए AI डिस्टिलेशन पर निर्भर नहीं रहेगी, भले ही इसका अर्थ अस्थायी रूप से प्रतिस्पर्धियों से पिछड़ना हो। CEO लिआंग रुबो ने 6 अगस्त की सर्व-कर्मचारी बैठक में दोहराया कि ByteDance स्व-विकसित मॉडलों पर कायम रहेगा।
28 अगस्त को, Tencent के Hunyuan Hy4 पूर्वावलोकन को WorkBuddy में एकीकृत किया गया, जिससे अनुमान मांग में उछाल आया। लॉन्च के दिन सेवा में कतार लग गई। Tencent तत्काल अनुमान क्लस्टरों का विस्तार कर रहा है। पूर्वावलोकन 10 सितंबर तक निःशुल्क रहेगा।
30 अगस्त को, Artificial Analysis ने रिपोर्ट किया कि Apodex के स्वामित्व मॉडल 1.1 ने अपने इंटेलिजेंस इंडेक्स पर 44 अंक प्राप्त किए, जो इसे Kimi K2.6 (45) और MiniMax-M3 (45) के समान श्रेणी में रखता है।
30 अगस्त को, शंघाई स्थित AI स्टार्टअप StartLux, जिसे Shanda के संस्थापक चेन तियानकियाओ का समर्थन प्राप्त है, ने ट्रिलियन-पैरामीटर बड़े मॉडल विकास में सफलताओं के लिए उद्योग का ध्यान आकर्षित किया।
30 अगस्त को, ByteDance ने आधिकारिक तौर पर 'Doubao Work Agent' जारी किया, जो एक उद्यम AI एजेंट है और एक स्थायी AI सहकर्मी के रूप में स्थापित है, जिसका अपना रनटाइम वातावरण, संदर्भ और उपकरण हैं। एजेंट में मल्टी-डिवाइस सिंक की सुविधा है — कार्य स्थानीय मशीन पर या क्लाउड-आधारित वर्चुअल मशीन पर चल सकते हैं जो 24/7 ऑनलाइन रहती है — और यह मूल रूप से Feishu (Lark) के साथ एकीकृत है, जिससे Feishu दस्तावेज़ों, स्प्रेडशीट और मीटिंगों से सीधे पढ़ना और लिखना संभव है। इसमें ByteDance के Seedance (वीडियो) और Seedream (इमेज) जनरेशन मॉडलों तक अंतर्निहित पहुँच शामिल है।
31 अगस्त को, यूनाइटेड किंगडम की राष्ट्रीय स्वास्थ्य सेवा (NHS) की निगरानी संस्था Healthwatch England ने ऐसे मामलों का खुलासा किया जिनमें AI चिकित्सा प्रतिलेखन उपकरणों ने खतरनाक गलतियाँ कीं। एक महिला रोगी को AI-जनित सारांश में बताया गया कि उसे 'डीमाइलिनेशन' है — गंभीर तंत्रिका क्षति जो संभवतः मल्टीपल स्क्लेरोसिस का कारण बन सकती है — जबकि सही निष्कर्ष 'कोई डीमाइलिनेशन नहीं' था। एक अन्य मामले में, AI उपकरण ने एक निर्धारित दवा को समान नाम वाली दवा समझ लिया। तीसरे मामले में AI सारांश ने एक विशेषज्ञ के निर्देश को छोड़ दिया जिसमें रोगी को माइग्रेन के नुस्खे के नवीनीकरण का अनुरोध करने को कहा गया था। Healthwatch ने 'अनेक मामलों' का उल्लेख किया जहाँ रोगियों ने ऐसी त्रुटियाँ पहचानीं जो चिकित्सा पेशेवरों ने नहीं पहचानीं। यूनाइटेड किंगडम की औषधि एवं स्वास्थ्य सेवा उत्पाद विनियामक एजेंसी (MHRA) ने AI प्रतिलेखन उपकरणों को चिकित्सा उपकरण के रूप में वर्गीकृत न करने का निर्णय लिया, जिसका अर्थ है कि वर्तमान में कोई राष्ट्रव्यापी सुरक्षा विनियामक ढाँचा लागू नहीं है। अगस्त 2026 तक, NHS इंग्लैंड में 27 विभिन्न AI प्रतिलेखन उपकरण उपयोग में हैं।
31 अगस्त को, चीन की पहली AIGC फीचर-लेंथ श्रृंखला, 'Journey to the West: The Later Story' का प्रीमियर हुआ। पहली आर्क, 'Flower-Fruit Mountain,' मೇং 5 एপিসোड हैं, प्रत्येক 40 मिनट का, जो Mango TV और हुनान सैটेলाइट टीवी कें प्राइम-टाइम स्लॉट पर प्रसारित हो रह ैं। यह श्रृंखला चीन की '21 उपाय' नीति के तहत 'प्रसारण के साथ समीक्षा' मॉडल का उपयोग करने वाली पहली श्रृंखला ह ै — एक साथ निर्माण, समीक्षा और प्रसारण। पूरा पहला सीज़न 30 एपिसोड का है, जो एक गुमनाम देर-मिंग/प्रारंभिक-किंग उपन्यास से रूपांतरित है जो सन वुकोंग के देवत्व प्राप्ति के एक हज़ार साल बाद जर्नी टू द वेस्ट की कथा को जारी रखता ह ै।