اتحاد استراتژیک دیپسیک و هواوی برای درهمشکستن امپراتوری انویدیا

دیپسیک (DeepSeek) و غول ارتباطات و تراشهسازی هواوی (Huawei) رسماً از ائتلافی راهبردی برای ساخت زیرساخت نرمافزاری کاملاً مستقل و متنباز پرده برداشتند. دیپسیک با بهینهسازی و متنباز کردن ابزارهای برنامهنویسی برای تراشههای هوش مصنوعی خانواده اسند (Ascend) و توسعه راهکار ابرگره ۱۲۸ تراشهای مبتنی بر چیپهای پردازشی Ascend 950، تیر خلاصی به انحصار نرمافزاری دیرپای «کودا» (CUDA) شرکت انویدیا شلیک کرد. این اقدام جسورانه، موازنه ژئوپلیتیک و فنی تراشهها و مدلهای هوش مصنوعی در جهان را وارد فاز جدیدی از استقلال سختافزاری و نرمافزاری میکند.
کالبدشکافی زلزله فنی و تجاری در دنیای هوش مصنوعی
۱. آغاز یک زلزله محاسباتی: چرا اتحاد دیپسیک و هواوی نقطه عطف تاریخ است؟
صنعت جهانی هوش مصنوعی طی سه سال اخیر با پدیدهای تکقطبی روبرو بوده است: هر شرکتی که قصد آموزش یا اجرای مدلهای زبانی حجیم (LLM) را داشت، ناگزیر باید میلیاردها دلار سرمایه خود را به حسابهای بانکی شرکت انویدیا واریز میکرد. دلیل این انحصار نه صرفاً توان پردازندههای گرافیکی انویدیا، بلکه دژ نفوذناپذیری به نام محیط توسعه و فریمورک اختصاصی CUDA بود.
اما انتشار اطلاعیه رسمی استارتاپ پیشتاز دیپسیک (DeepSeek) در شبکه اجتماعی ویچت و تأیید آن از سوی رسانههای بینالمللی از جمله رویترز، نشان از شکسته شدن این طلسم دارد. دیپسیک اعلام کرده است که با همکاری مهندسی عمیق با شرکت هواوی، کلیه کتابخانههای محاسباتی، پشتههای ارتباطی بین تراشهای و زیرساختهای نرمافزاری پردازندههای اختصاصی سری اسند (Ascend) هواوی را به شکل کاملاً متنباز (Open Source) عمومی کرده است.
این تحول، تنها یک پروژه تجاری معمولی نیست؛ بلکه نقطه تلاقی توان الگوریتمی برترین تیم توسعه هوش مصنوعی چین و توان سختافزاری غول مخابراتی تحریمشده چین است. دیپسیک که با معماریهای انقلابی نظیر DeepSeek-V3 و مدل استدلالی R1 و نوآوریهایی چون MLA (Multi-Head Latent Attention) توانست هزینه آموزش مدلهای پیشرفته هوش مصنوعی را به کسری از هزینههای سرسامآور غربیها تقلیل دهد، اکنون همان فلسفه بازدهی بالا و معماری بهینه را مستقیماً به سیلیکون بومی هواوی تزریق میکند.
۲. دیوار بلند انویدیا چگونه فرو میریزد؟ مسئله «خندق کوکبسته» CUDA
مدیران ارشد انویدیا سالها با افتخار از زنجیره ارزش «کودا» به عنوان خندق محافظتی شرکت خود یاد میکردند. اکوسیستم CUDA نزدیک به دو دهه با صدها هزار کتابخانه بهینهشده، میلیونها خط کد متنباز و تسلط مطلق در فریمورکهای مرسوم مانند PyTorch و TensorFlow، توسعهدهندگان سراسر جهان را در خود حبس کرده بود. اگر شرکتی تراشهای سریعتر از انویدیا میساخت، باز هم به دلیل نبود درایورها، ناکارآمدی کامپایلرها و نبود کدهای بهینه برای جابجایی تانسورها در حافظه، آن چیپ در عمل غیرقابل استفاده میماند.
هماکنون دیپسیک با راهحل نرمافزاری تایللنگ (TileLang) و توسعه درایورهای بهینهشده برای پلتفرم Ascend، درست به همین پاشنه آشیل ضربه زده است:
- تایللنگ (TileLang): یک زبان برنامهنویسی سطحبالا و متنباز (Domain-Specific Language) که بر پایه چارچوب کامپایلری محبوب Apache TVM و به شکل الحاقی در پایتون نوشته شده است. این زبان، پیچیدگیهای دهشتناک کدنویسی ریزمعماری و درگیری مستقیم با ریجیسترهای سختافزار را از دوش توسعهدهنده برمیدارد.
- انتزاع جریان داده از زمانبندی (Decoupling Dataflow & Scheduling): برنامهنویس هوش مصنوعی در TileLang تنها نیاز دارد عملیات ماتریسی (کاشیبندی تانسورها، فشردهسازی GEMM، ادغام توابع Softmax و FlashAttention) را تعریف کند؛ کامپایلر هوشمند به طور خودکار بهترین نقشه را برای اتصال نخهای پردازشی (Thread binding) و بهینهسازی خطوط لوله ارتباط حافظه (Pipelining) روی واحدهای NPU هواوی پیاده میکند.
- آزادی عمل و شکستن قفل وابستگی: تایللنگ نهتنها کدهای سختافزارهای هواوی را بهینهسازی میکند، بلکه به دلیل ساختار چندپلتفرمی با تراشههای گرافیکی انویدیا، چیپهای AMD (بر بستر ROCm) و پردازندههای خانواده اپل سیلیکون نیز همخوانی دارد. این یعنی توسعهدهندگان هوش مصنوعی دیگر کدهای خود را مقید به سیلیکونهای یک سازنده خاص نخواهند کرد.
💡 چرا زبان برنامهنویسی TileLang یک دستاورد انقلابی برای توسعهدهندگان هوش مصنوعی است؟
برخلاف کتابخانههای بسته که دست توسعهدهنده را در تنظیمات دقیق مقیاس بزرگ میبندند، TileLang با ارائه مفاهیم مدرن «تانسورهای قطعهبندیشده»، خطاهای تخصیص حافظه محلی را به حداقل رسانده و به کدهای پایتون این امکان را میدهد تا به سرعتی نزدیک به ۹۵ درصد توان تئوریک سیلیکون بومی دست یابند.
۳. ابرگره ۱۲۸ تراشهای و معماری پردازنده Ascend 950؛ مشخصات سختافزاری چیست؟
تنها دو هفته پیش از این اعلامیه، هوآوی در جریان کنفرانس سالانه Huawei Connect در شانگهای از نقشه راه تراشههای جدید خود رونمایی کرد. هواوی اعلام کرده بود پردازندههای نسل نوین این شرکت از اوایل سال ۲۰۲۶ بهطور گسترده برای فرآیند سنگین آموزش (Training) مدلهای بنیادین به کار گرفته خواهند شد. قلب تپنده این جهش فنی، معماری ابرگره (Supernode) و چیپهای پیشرفته اسند ۹۵۰ (Ascend 950) است:
- راهکار مشترک ابرگره ۱۲۸ تراشهای: دیپسیک و هواوی موفق شدهاند ساختاری از ۱۲۸ تراشه پرسرعت اسند ۹۵۰ را به عنوان یک گره پردازشی واحد و یکپارچه در سطح حافظه بازتعریف کنند. در آموزش مدلهای حجیم هوش مصنوعی با صدها میلیارد پارامتر، بزرگترین گلوگاه، تاخیر تبادل داده میان پردازندهها در لایههای مدل است. دیپسیک با بازنویسی کتابخانههای تجمیع جمعی (Collective Communication) و ترکیب آن با معماری شبکه بیناتصالی UnifiedBus هواوی، اتلاف توان محاسباتی را به صفر نزدیک کرده است.
- دوگانه تخصصی اسند ۹۵۰ (تراشههای 950PR و 950DT):
- Ascend 950PR: پردازندهای فوقالعاده سریع و اقتصادی که به طور تخصصی برای فاز پیشمحاسبه پرامپتها (Prefill) و سیستمهای توصیه هوشمند بهینهسازی شده و از حافظههای اختصاصی HiBL 1.0 بهره میبرد.
- Ascend 950DT: غول پردازشی هواوی با توان محاسباتی ۱ پتافلاپس در فرمتهای اعشاری FP8/HiF8 و ۲ پتافلاپس در فرمت فوق فشرده MXFP4؛ مجهز به پهنای باند حافظه فوقسریع ۴ ترابایت بر ثانیه از طریق حافظههای نسل جدید HiZQ 2.0 (با ظرفیت ۱۴۴ گیگابایت)، اختصاص یافته برای فاز رمزگشایی بلادرنگ (Decode) و آموزش خوشهای شبکههای عصبی عمیق.
- خوشه ابرمحاسباتی Atlas 950 SuperPoD: هواوی با ترکیب ۸,۱۹۲ تراشه اسند در قالب ۱۶۰ رک محاسباتی و ارتباطی، زیرساختی یکپارچه با توان پردازشی سرسامآور ۸ اگزاافلاپس (8 EFLOPS) خلق کرده است که توانایی تولید و پردازش ۴.۹۱ میلیون توکن در ثانیه را به جامعه مهندسان هوش مصنوعی هدیه میدهد؛ عددی که مستقیماً کلاسترهای DGX SuperPOD شرکت انویدیا را به مبارزه میطلبد.
۴. زلزله در والاستریت: انویدیا چگونه بازار ۵۰ میلیارد دلاری چین را از دست داد؟
همکاری عمیق دیپسیک و هواوی در خلأ شکل نگرفته است؛ این رخداد محصول مستقیم سیاستهای تنشآمیز ژئوپلیتیک میان آمریکا و چین و بازخورد معکوس تحریمهای فناوری است. دولت ایالات متحده با هدف متوقف ساختن قطار پیشرفت فناوری چین، فروش پیشرفتهترین پردازندههای گرافیکی انویدیا (مانند سریهای A100، H100 و سپس تراشههای نسل بلکول) را به پکن ممنوع کرد.
در واکنش به این محدودیتها، انویدیا نسخههایی تقلیلیافته نظیر چیپست H20 را برای بازار چین طراحی کرد؛ تراشههایی که از نظر قدرت ترانزیستوری تضعیف شده بودند اما قیمتهای گزافی داشتند. با این حال، بازی در سالهای اخیر کاملاً دگرگون شد:
- دستور نهادهای نظارتی چین (CAC): اداره نظارت بر فضای مجازی چین در سپتامبر به شرکتهای پیشروی اینترنت و هوش مصنوعی نظیر بایتدنس، علیبابا، تنسنت و بایدو دستور داد خرید تراشههای کمتوان H20 انویدیا را متوقف کرده و سفارشهای موجود را لغو کنند.
- اعتراف تلخ جنسن هوانگ: مدیرعامل افسانهای انویدیا، جنسن هوانگ، صراحتاً در نشستهای خبری و مصاحبه با نهادهای سیاستگذاری ایالات متحده اذعان کرد: «سهم انویدیا از بازار شتابدهندههای هوش مصنوعی چین از بیش از ۹۰ درصد در سالهای گذشته، عملاً به صفر رسیده است.» هوانگ تصریح کرد که از دست دادن پتانسیل بازار ۵۰ میلیارد دلاری چین نه به توقف هوش مصنوعی در این کشور، بلکه به استقلال قطعی و رشد خیرهکننده رقبایی بومی نظیر هواوی انجامیده است؛ امری که سیاستگذاران آمریکایی هرگز پیشبینی نمیکردند.
۵. مهندسی نرمافزار به سبک دیپسیک؛ معجزه الگوریتم بر بستر سیلیکون
بسیاری از تحلیلگران در ابتدا معتقد بودند شکاف لیتوگرافی (نبود ماشینهای تراشهساز پیشرفته EUV در چین به واسطه تحریمهای هلند و شرکت ASML) مانع از آن خواهد شد که تراشههای Ascend هواوی بتوانند با تراشههای ۴ نانومتری TSMC که برای انویدیا تولید میشوند رقابت کنند. اما نبوغ دیپسیک دقیقاً در همین نقطه تفاوتها را رقم زد.
دیپسیک در سالهای اخیر اثبات کرد که کمبود ترانزیستور فیزیکی را میتوان با هوش ریاضی، مهندسی نرمافزار و معماری پیشرفته الگوریتم جبران کرد. راهکارهایی که دیپسیک بر روی اسند ۹۵۰ پیاده کرده شامل موارد زیر است:
- موازیسازی چندسطحی پایپلاین (Dual-Pipe Scheduling): با همپوشانی کامل عملیات ارسال پیام بین گرهها و محاسبات لایههای ماتریسی، زمان بیکاری هستههای NPU عملاً خنثی شده است.
- معماری متخصصان ترکیبی بهینهشده (DeepSeekMoE): در مدلهای زبانی عظیم، اجرای همزمان تمامی پارامترها نیازمند پهنای باند سرسامآور حافظه است. دیپسیک با فعالسازی بخشهای کوچک و گزینششده از مدل برای هر توکن، فشار وارده به تراشههای هواوی را تا بیش از ۶۰ درصد کاهش داده است.
- پشتیبانی بومی از فرمتهای ماتریسی HiF8: دیپسیک نرمافزارها را به گونهای کالیبره کرده که بدون افت دقت ادراکی و استدلالی مدلهای زبانی، محاسبات در فضاهای هشت بیتی و چهار بیتی با کمترین تبادل رم انجام پذیرد.
۶. دموکراتیزه شدن توسعه سختافزار؛ چرا رویکرد متنباز همهچیز را تغییر میدهد؟
حرکت دیپسیک در انتشار عمومی کدهای مربوط به درایورها، کتابخانهها و زبان TileLang، هدیهای ارزشمند به جامعه جهانی مهندسان و شرکتهای نوپا محسوب میشود. در حال حاضر، استارتاپهای هوش مصنوعی در اروپا، خاورمیانه و حتی آمریکا زیر فشار سهمیهبندی پردازندههای انویدیا و قیمتهای گزاف اجاره سرورهای ابری هستند.
با ورود یک بستر متنباز که روی پردازندههای مختلف اجرا میشود و یک رقیب سختافزاری مقیاسپذیر مانند هواوی، اکوسیستم هوش مصنوعی از انحصار سیلیکونولی آزاد میشود. دانشگاهها، آزمایشگاههای مستقل تحقیقاتی و کشورهای در حال توسعه میتوانند با هزینهای به مراتب معقولتر، کلاسترهای بومی خود را برپا کرده و به جای بازنویسی چرخ، از استانداردهای آزاد معرفیشده توسط دیپسیک بهره ببرند.
⏱ تقویم زمانی چرخش بزرگ در بازار شتابدهندههای هوش مصنوعی
گام اول: اعمال تحریمهای سنگین تراشهای توسط واشنگتن
ایالات متحده صادرات کلیه تراشههای فوقپیشرفته هوش مصنوعی را به شرکتهای چینی ممنوع و انویدیا را مجبور به ساخت نسخههای ضعیفتر کرد.
گام دوم: ظهور پدیده دیپسیک با معماری مدلهای مقرونبهصرفه
دیپسیک با معرفی معماریهای MLA و مدلهای استدلالی خود اثبات کرد که با الگوریتم نوآورانه میتوان هزینههای سرور را تا ۱۰ برابر کاهش داد.
گام سوم: رونمایی هواوی از تراشههای Ascend 950 و کلاسترهای SuperPoD
هواوی چیپهای تخصصی نسل جدید را با پهنای باند ۲ ترابایت بر ثانیه و ابرگرههای مقیاسپذیر تا ۸ هزار پردازنده معرفی کرد.
نقطه عطف: انتشار متنباز زیرساخت برنامهنویسی و پلتفرم TileLang
دیپسیک و هواوی انحصار زبان CUDA را رسماً به چالش کشیده و زیرساخت کدنویسی کامل سختافزار اسند را برای سراسر جهان آزاد کردند.
۷. پیامدها برای غولهای ابری و آینده بازارهای فناوری
ائتلاف دیپسیک و هواوی معادلات تجاری بسیاری از فعالان صنعت فناوری را از نو ترسیم خواهد کرد:
- استقلال کامل دیتاسنترهای داخلی چین: شرکتهایی نظیر علیبابا کلاود، تنسنت کلاد و بایتدنس که تا پیش از این نگران قطعی دسترسی به کارتهای انویدیا بودند، اکنون یک پشته نرمافزاری و سختافزاری پایدار، بومی و بدون خطر تحریم در اختیار دارند.
- فشار رقابتی بر انویدیا برای بازنگری در سیاستها: زمانی که انویدیا متوجه شود بازاری به وسعت چین بهطور برگشتناپذیر به سمت جایگزینهای داخلی رفته و زبانهای برنامهنویسی آزاد در حال فراگیر شدن هستند، ناگزیر است حاشیه سود سرسامآور (Gross Margin) ۷۵ درصدی خود را تعدیل کند یا دست به نوآوریهای متهورانهتری بزند.
- تسریع توسعه نسلهای بعدی (اسند ۹۶۰ و ۹۷۰): بر اساس نقشه راه هواوی، سریهای بعدی یعنی Ascend 960 با توان ۲ پتافلاپس در سال ۲۰۲۷ و کلاسترهای ۳۰ اگزاافلاپسی به همراه Ascend 970 در سال ۲۰۲۸ روانه بازار خواهند شد. هماهنگی پیشین دیپسیک با این خانواده سختافزاری نشان میدهد که چین برای یک جنگ ماراتن در قلمرو فناوری برنامهریزی پنجساله دارد.
بازآفرینی نظم نوین پردازش در جهان
همکاری دیپسیک و هواوی نشاندهنده یک بلوغ استراتژیک در دنیای فناوری شرق آسیاست؛ پیامی که نشان میدهد جنگ بر سر تصاحب آینده هوش مصنوعی تنها در کارخانههای لیتوگرافی سیلیکون برنده یا بازنده نمیشود، بلکه پیوند هوشمندانه نرمافزار، جامعه متنباز و همافزایی ابرگرههای پردازشی قادر است بزرگترین غولهای سختافزاری سیلیکونولی را نیز به چالش بکشد.
دیگر دوران یکهتازی مطلق انویدیا و انحصار زنجیروار سیستمعامل پردازشی CUDA رو به پایان است. با گام بزرگ دیپسیک در متنباز کردن ابزارهای پردازشی اسند و ارائه زبان بازدهمحور TileLang، جهان رایانش پرتوان (HPC) شاهد آغاز دورانی دوقطبی، رقابتیتر و به مراتب مقرونبهصرفهتر برای ساخت و آموزش مغزهای آینده خواهد بود.




