متن کامل سخنرانی هوانگ رنشون در GTC: تا 2027، تقاضای بازار از $1T فراتر میرود؛ همه باید استراتژی OpenClaw تدوین کنند
عنوان اصلی: «متن کامل سخنرانی جنسن هوانگ در GTC: عصر استنتاج فرا رسیده است، درآمد $1T تا سال 2027، لابسترها سیستمعامل جدیدند»
نویسنده اصلی: بائو ییلونگ، والاستریت ویو
در 16/03/2026، کنفرانس NVIDIA GTC 2026 رسماً آغاز شد و جنسن هوانگ، بنیانگذار و مدیرعامل NVIDIA، سخنرانی اصلی را ایراد کرد.
در این کنفرانس که «زیارت سالانه صنعت هوش مصنوعی» خوانده میشود، جنسن هوانگ از دگرگونی NVIDIA از یک «شرکت تراشهسازی» به «شرکت زیرساخت هوش مصنوعی و کارخانه» سخن گفت. او در برابر مهمترین دغدغههای بازار درباره پایداری عملکرد و ظرفیت رشد، منطق بنیادین کسبوکارِ محرک رشد آینده را تشریح کرد: «اقتصاد کارخانه توکن».

چشمانداز عملکرد بسیار خوشبینانه است؛ «تقاضا تا 2027 به حداقل $1T میرسد»
در دو سال گذشته، تقاضای جهانی برای توان محاسباتی هوش مصنوعی بهصورت تصاعدی رشد کرده است. با تحول مدلهای بزرگ از «ادراک» و «تولید» به «استنتاج» و «اقدام (اجرای وظایف)»، مصرف توان محاسباتی بهشدت افزایش یافته است. جنسن هوانگ در پاسخ به تمرکز شدید بازار بر سفارشها و سقف درآمد، چشماندازی بسیار مستحکم ارائه کرد.
جنسن هوانگ در سخنرانی خود گفت:
در همین زمان در سال گذشته گفتم که تقاضایی با اطمینان بالا به میزان $500B میبینیم که Blackwell و Rubin را تا سال 2026 پوشش میدهد. حالا، همینجا و همین لحظه، تقاضایی به میزان حداقل $1T تا سال 2027 میبینم.

انتظار یکتریلیوندلاری جنسن هوانگ پیشتر باعث شد قیمت سهام NVIDIA بیشتر از %4.3 افزایش یابد.

او همچنین این رقم را بیشتر توضیح داد:
آیا این رقم منطقی است؟ موضوع بعدی که میخواهم دربارهاش صحبت کنم همین است. در واقع، حتی قادر نخواهیم بود پاسخگوی تقاضا باشیم. مطمئنم تقاضای واقعی برای توان محاسباتی بسیار بیشتر از این خواهد بود.
جنسن هوانگ اشاره کرد که سامانههای NVIDIA امروز ثابت کردهاند «زیرساختی با کمترین هزینه» در جهان هستند. از آنجا که NVIDIA میتواند مدلهای هوش مصنوعی را تقریباً در هر حوزهای اجرا کند، این گستردگی باعث میشود $1T سرمایهگذاری مشتریان بهطور کامل به کار گرفته شود و در چرخهای طولانی حفظ شود.
در حال حاضر، %60 از کسبوکار NVIDIA از پنج ارائهدهنده بزرگ خدمات ابریِ ابرمقیاس تأمین میشود و %40 باقیمانده میان ابرهای حاکمیتی، شرکتها، صنایع، رباتیک، رایانش لبهای و حوزههای دیگر توزیع شده است.
اقتصاد کارخانه توکن؛ موفقیت کسبوکار با عملکرد بهازای هر وات تعیین میشود
جنسن هوانگ برای توضیح منطق این تقاضای یکتریلیوندلاری، مجموعهای تازه از مفاهیم کسبوکار را برای مدیرانعامل سراسر جهان مطرح کرد. او توضیح داد که مرکز داده آینده دیگر انباری برای ذخیره فایلها نیست، بلکه «کارخانهای» است که توکنها (واحدهای پایه تولیدشده توسط هوش مصنوعی) را تولید میکند.

جنسن هوانگ تأکید کرد:
هر مرکز داده و هر کارخانه، بنا بر تعریف، با محدودیت توان برق روبهروست. کارخانهای با ظرفیت 1 گیگاوات (GW) هرگز به کارخانهای 2GW تبدیل نمیشود؛ این قانون فیزیک و اتمهاست. در سطح ثابتی از توان، هرکس توان عملیاتی توکن بیشتری بهازای هر وات داشته باشد، هزینه تولید پایینتری خواهد داشت.
جنسن هوانگ خدمات هوش مصنوعی آینده را به چهار سطح کسبوکار تقسیم کرد:
· سطح رایگان (توان عملیاتی بالا، سرعت پایین)
· سطح میانی (حدود $3 بهازای هر یک میلیون توکن)
· سطح بالا (حدود $6 بهازای هر یک میلیون توکن)
· سطح پرسرعت (حدود $45 بهازای هر یک میلیون توکن)
· سطح فوقپرسرعت (حدود $150 بهازای هر یک میلیون توکن)
او اشاره کرد که با بزرگتر شدن مدلها و طولانیتر شدن زمینه، هوش مصنوعی هوشمندتر میشود، اما سرعت تولید توکن کاهش مییابد. جنسن هوانگ گفت:
در این کارخانه توکن، توان عملیاتی و سرعت تولید توکن شما مستقیماً به درآمد دقیق شما در سال آینده تبدیل میشود.
جنسن هوانگ تأکید کرد که معماری NVIDIA به مشتریان اجازه میدهد در سطح رایگان به توان عملیاتی بسیار بالایی دست پیدا کنند و در عین حال، در سطح استنتاجی با بیشترین ارزش، افزایش عملکرد چشمگیر 35 برابری ارائه میدهد.

Vera Rubin در دو سال شتاب 350 برابری میگیرد؛ Groq شکاف استنتاج سریع را پر میکند
NVIDIA در چارچوب این محدودیت فیزیکی، پیچیدهترین سامانه محاسباتی هوش مصنوعی خود تا امروز، یعنی Vera Rubin، را معرفی میکند. هوانگ رنشون گفت:
وقتی قبلاً درباره Hopper صحبت میکردیم، تراشهای را بالا میگرفتم که بامزه بود. اما وقتی از Vera Rubin صحبت میکنیم، همه به کل سامانه فکر میکنند. در این سامانه %100 خنکشونده با مایع که کابلهای سنتی را بهکلی حذف میکند، نصب رکهایی که قبلاً دو روز طول میکشید حالا فقط دو ساعت زمان میبرد.
هوانگ رنشون اشاره کرد که Vera Rubin با طراحی مشترک سختافزار و نرمافزار از ابتدا تا انتها، جهشی خیرهکننده در دادهها در همان مرکز داده 1GW ایجاد کرده است:
در فقط دو سال، نرخ تولید توکن را از 22M به 700M افزایش دادهایم و به رشد 350 برابری رسیدهایم. در همین مدت، قانون مور فقط میتوانست به بهبودی حدود 1.5 برابری منجر شود.
NVIDIA برای رفع گلوگاه پهنای باند در شرایط استنتاج سریع (برای نمونه، 1000 توکن در ثانیه)، با ادغام شرکت Groq که آن را خریداری کرده، راهکار نهایی را پیشنهاد داده است: استنتاج با تفکیک نامتقارن.
هوانگ رنشون توضیح داد:
ویژگیهای این دو پردازنده کاملاً متفاوتاند. تراشه Groq دارای 500MB حافظه SRAM است، درحالیکه یک تراشه Rubin بهتنهایی 288GB حافظه دارد.

هوانگ رنشون گفت NVIDIA با استفاده از سامانه نرمافزاری Dynamo، مرحله «پیشپرکردن» را که به محاسبات و حافظه فراوان نیاز دارد به Vera Rubin میسپارد و مرحله «رمزگشایی» را که به تأخیر حساس است به Groq واگذار میکند. هوانگ رنشون همچنین توصیههایی درباره تخصیص توان محاسباتی در شرکتها ارائه کرد:
اگر کار شما عمدتاً به توان عملیاتی بالا نیاز دارد، از Vera Rubin %100 استفاده کنید؛ اگر نیاز زیادی به تولید توکن برنامهنویسی با ارزش بالا دارید، %25 از مقیاس مرکز داده خود را به Groq اختصاص دهید.
گزارش شده است که تراشه Groq LP30، تولیدشده توسط Samsung، هماکنون در مرحله تولید انبوه است و انتظار میرود ارسال آن در سهماهه سوم آغاز شود؛ در همین حال، نخستین رک Vera Rubin در حال حاضر روی Microsoft Azure Cloud اجرا میشود.
هوانگ رنشون همچنین درباره فناوری اتصال نوری، نخستین سوئیچ Spectrum X مبتنی بر اپتیک همبسته (CPO) تولید انبوه در جهان را به نمایش گذاشت و به بحث بازار درباره مسیر «گذار از مس به نور» پایان داد.
به ظرفیت بیشتری برای کابل مسی، تراشههای نوری و CPO نیاز داریم.
قیمت --
ایجنت به SaaS سنتی پایان میدهد؛ «حقوق سالانه + توکن» به استاندارد سیلیکونولی تبدیل میشود
هوانگ رنشون علاوه بر موانع سختافزاری، بخش زیادی از سخنرانی خود را به انقلاب نرمافزار و زیستبوم هوش مصنوعی، بهویژه رشد انفجاری ایجنتها، اختصاص داد.
او پروژه متنباز OpenClaw را «محبوبترین پروژه متنباز در تاریخ بشر» توصیف کرد و گفت این پروژه فقط در چند هفته از دستاوردهای 30 ساله Linux فراتر رفته است. هوانگ رنشون صریحاً گفت OpenClaw در اصل «سیستمعامل» رایانههای ایجنت است.
هوانگ رنشون اظهار کرد:
هر شرکت SaaS (نرمافزار بهعنوان سرویس) به شرکتی AaaS (ایجنت بهعنوان سرویس) تبدیل خواهد شد. بیتردید، برای استقرار امن این ایجنتهای هوشمند که به دادههای حساس دسترسی دارند و قادر به اجرای کد هستند، NVIDIA طراحی مرجع سازمانی NeMo Claw را عرضه کرده که یک موتور سیاستگذاری و مسیریاب حریم خصوصی به آن افزوده است.
این تحول برای متخصصان عادی نیز دستیافتنی است. هوانگ رنشون تصویری از شکل آینده محیط کار ترسیم کرد:
در آینده، هر مهندس شرکت ما به بودجه سالانه توکن نیاز خواهد داشت. حقوق پایه آنها ممکن است چند صد هزار دلار باشد و من علاوه بر آن، حدود نیمی از این مبلغ را بهعنوان بودجه توکن در اختیارشان میگذارم تا بتوانند بهرهوری خود را 10 برابر کنند. این موضوع در سیلیکونولی به مزیت تازهای برای استخدام تبدیل شده است: پیشنهاد شغلی شما شامل چند توکن است؟
هوانگ رنشون در پایان ارائه، نگاهی اجمالی به معماری محاسباتی نسل بعدی، Feynman، نیز انداخت که برای نخستین بار مقیاسپذیری افقی همزمان کابلهای مسی و CPO را ممکن میکند. نکته جالبتر اینکه NVIDIA در حال توسعه رایانه مرکز داده «Vera Rubin Space-1» برای استقرار در فضاست؛ اقدامی که چشمانداز گسترش توان پردازش هوش مصنوعی فراتر از زمین را بهطور کامل پیش روی ما میگذارد.
متن کامل سخنرانی هوانگ رنشون در GTC 2026 که با کمک یک ابزار هوش مصنوعی ترجمه شده، در ادامه آمده است:
مجری: از بنیانگذار و مدیرعامل NVIDIA، هوانگ رنشون، استقبال کنید.
هوانگ رنشون، بنیانگذار و مدیرعامل: به GTC خوش آمدید. میخواهم به همه یادآوری کنم که این یک کنفرانس فنی است. دیدن این همه آدم که از صبح زود برای ورود در صف ایستادهاند و دیدن همه شما در اینجا، بسیار خوشحالم میکند.
در GTC بر سه موضوع اصلی تمرکز میکنیم: فناوری، پلتفرم و زیستبوم.
NVIDIA در حال حاضر سه پلتفرم اصلی دارد: پلتفرم CUDA-X، پلتفرم سامانه و تازهترین پلتفرم ما، یعنی پلتفرم کارخانه هوش مصنوعی.
پیش از شروع، میخواهم از مجریان برنامه پیش از رویداد تشکر کنم: سارا گو از Conviction، آلفرد لین از Sequoia Capital (نخستین سرمایهگذار خطرپذیر NVIDIA) و گاوین بیکر، نخستین سرمایهگذار نهادی بزرگ NVIDIA. این سه نفر بینشهای فنی عمیقی دارند و در زیستبوم فناوری تأثیرگذارند. البته میخواهم از همه مهمانان ویژهای که شخصاً برای حضور امروز دعوت کردم هم تشکر کنم. از این تیم ستارهای ممنونم.
همچنین میخواهم از همه کسبوکارهایی که امروز اینجا حضور دارند تشکر کنم. NVIDIA یک شرکت پلتفرمی است و ما فناوری، پلتفرم و زیستبومی غنی داریم. کسبوکارهای حاضر تقریباً همه مشارکتکنندگان صنعت $100T را دربرمیگیرند و 450 شرکت حامی این رویداد هستند. از همه آنها بسیار سپاسگزارم.
در این کنفرانس 1,000 جلسه فنی با حضور 2,000 سخنران برگزار میشود که همه سطوح معماری «پشته کامل» هوش مصنوعی را پوشش میدهد؛ از عناصر بنیادی مانند زمین، برق و مراکز داده گرفته تا تراشهها، پلتفرمها، مدلها و طیف متنوعی از برنامههایی که کل صنعت را به پیش میرانند.
CUDA: میراث فنی دو دههای
همهچیز از همینجا شروع شد. امسال بیستمین سالگرد CUDA است.
دو دهه است که به توسعه این معماری متعهد بودهایم. CUDA اختراعی انقلابی است؛ فناوری SIMT (تکدستور، چندرشته) به توسعهدهندگان اجازه میدهد برنامهها را با کد اسکالر بنویسند و آنها را به برنامههای چندرشتهای گسترش دهند، آن هم با پیچیدگی برنامهنویسی بسیار کمتر از معماریهای SIMD پیشین. اخیراً قابلیت Tiles را اضافه کردهایم تا توسعهدهندگان بتوانند هستههای تانسوری را راحتتر برنامهریزی کنند؛ ساختار محاسباتی ریاضی که برای هوش مصنوعی امروز حیاتی است. CUDA اکنون هزاران ابزار، کامپایلر، چارچوب و کتابخانه دارد و صدها هزار پروژه متنباز در جامعه آن شکل گرفته که عمیقاً با همه زیستبومهای فناوری ادغام شدهاند.
این نمودار منطق راهبردی %100 NVIDIA را نشان میدهد؛ منطقی که از همان روز نخست دربارهاش صحبت کردهام. دشوارترین و محوریترین بخش برای تحقق، «پایگاه نصبشده» در پایین نمودار است. طی بیش از بیست سال، صدها میلیون GPU و سامانه محاسباتی سازگار با CUDA را در سراسر جهان گرد آوردهایم.
GPUهای ما همه پلتفرمهای ابری را پوشش میدهند و تقریباً به هر سازنده رایانه و صنعتی خدمات میرسانند. پایگاه نصبشده عظیم CUDA دلیل اصلی این چرخه فزاینده است. پایگاه نصبشده توسعهدهندگان را جذب میکند، توسعهدهندگان الگوریتمها و دستاوردهای تازهای میسازند، این دستاوردها بازارهای جدیدی را به حرکت درمیآورند و بازارهای جدید زیستبومهای تازهای میسازند و شرکتهای بیشتری را جذب میکنند؛ در نتیجه پایگاه نصبشده گسترش مییابد. این چرخه پیوسته شتاب میگیرد.
تعداد دانلود کتابخانههای NVIDIA با سرعتی خیرهکننده، در مقیاسی بزرگ و با شتابی فزاینده رشد میکند. این چرخه به پلتفرم محاسباتی ما امکان میدهد از برنامههای عظیم و جریان پیوستهای از دستاوردهای جدید پشتیبانی کند.
مهمتر از همه، این چرخه عمر بسیار طولانیای به این زیرساختها میدهد. دلیل روشن است: مجموعه گستردهای از برنامهها بر بستر CUDA شرکت NVIDIA اجرا میشوند و همه مراحل چرخه عمر هوش مصنوعی، پلتفرمهای گوناگون پردازش داده و حلگرهای مختلف اصول علمی را پوشش میدهند. بنابراین، پس از نصب یک GPU از NVIDIA، کاربرد واقعی آن بسیار زیاد است. به همین دلیل قیمت ابری GPUهای مبتنی بر معماری Ampere که شش سال پیش عرضه شدند افزایش یافته است.
دلیل بنیادین همه اینها عبارت است از: پایگاه نصبشده عظیم، چرخه فزاینده قدرتمند و زیستبوم گسترده توسعهدهندگان. وقتی این عوامل با هم کار میکنند و بهروزرسانیهای پیوسته نرمافزاری ما نیز به آنها میپیوندد، هزینه محاسباتی مدام کاهش مییابد. از آنجا که شتابدهی محاسباتی عملکرد برنامهها را بهشکل چشمگیری بهبود میدهد و ما نرمافزارها را در بلندمدت نگهداری و بهروزرسانی میکنیم، کاربران نهتنها در مراحل اولیه جهش عملکرد را تجربه میکنند، بلکه پیوسته از کاهش هزینههای محاسباتی نیز بهرهمند میشوند. ما حاضریم در بلندمدت از هر GPU در سراسر جهان پشتیبانی کنیم، زیرا این GPUها در سطح معماری کاملاً سازگارند.
مایلیم این کار را انجام دهیم، چون پایگاه نصبشده عظیمی داریم؛ هر بار که بهینهسازی جدیدی عرضه میکنیم، میلیونها کاربر از آن بهرهمند میشوند. این ترکیب پویا به معماری NVIDIA امکان میدهد پوشش خود را پیوسته گسترش دهد، رشد خود را شتاب ببخشد، هزینههای محاسباتی را مدام کاهش دهد و در نهایت رشد جدیدی ایجاد کند. CUDA در مرکز همه اینها قرار دارد.
از GeForce تا CUDA: 25 سال تحول
ما در واقع همکاریمان با CUDA را 25 سال پیش آغاز کردیم.
GeForce — فکر میکنم بسیاری از شما با GeForce بزرگ شدهاید. GeForce موفقترین پروژه بازاریابی NVIDIA است. زمانی شروع کردیم مشتریان آینده را جذب کنیم که هنوز توان خرید محصولات ما را نداشتید؛ این والدین شما بودند که به نخستین کاربران NVIDIA تبدیل شدند و سالبهسال محصولات ما را خریدند تا اینکه یک روز شما بزرگ شدید و به دانشمندان برجسته علوم رایانه، مشتریان واقعی و توسعهدهندگان تبدیل شدید.
این بنیانی است که GeForce 25 سال پیش بنا نهاد. 25 سال پیش، سایهزن قابل برنامهریزی را اختراع کردیم؛ اختراعی که در ظاهر بدیهی اما در عمل بسیار مهم بود و برنامهپذیری شتابدهندهها را ممکن کرد. نخستین شتابدهنده قابل برنامهریزی جهان، سایهزن پیکسلی بود. پنج سال بعد CUDA را ساختیم؛ یکی از مهمترین سرمایهگذاریهای تمام دوران ما. آن زمان منابع مالی شرکت محدود بود، اما بیشتر سودمان را روی این پروژه گذاشتیم و متعهد شدیم CUDA را از GeForce به همه رایانهها گسترش دهیم. با اطمینان کامل این کار را انجام دادیم، چون به ظرفیت آن ایمان داشتیم. با وجود دشواریهای اولیه، شرکت طی 13 نسل و در مجموع 20 سال به این باور پایبند ماند و امروز CUDA همهجا حضور دارد.
این سایهزن پیکسلی بود که انقلاب GeForce را به راه انداخت. حدود هشت سال پیش RTX را معرفی کردیم؛ بازاندیشی جامعی در معماری برای عصر نوین گرافیک رایانهای. GeForce، CUDA را به جهان آورد و بهاینترتیب به پژوهشگرانی مانند الکس کریژفسکی، ایلیا سوتسکور، جفری هینتون، اندرو اِنجی و بسیاری دیگر امکان داد کشف کنند که GPU میتواند ابزاری قدرتمند برای شتابدهی یادگیری عمیق باشد و انفجار هوش مصنوعی را در دهه گذشته رقم بزند.
ده سال پیش تصمیم گرفتیم سایهزنهای قابل برنامهریزی را با دو مفهوم جدید ترکیب کنیم: یکی رهگیری پرتو سختافزاری بود که از نظر فنی چالشبرانگیز بود؛ دیگری ایدهای آیندهنگرانه در آن زمان بود؛ حدود یک دهه پیش پیشبینی کردیم که هوش مصنوعی گرافیک رایانهای را از پایه دگرگون خواهد کرد. همانطور که GeForce هوش مصنوعی را به جهان معرفی کرد، اکنون هوش مصنوعی نیز در مقابل، کل فرایند تولید گرافیک رایانهای را از نو شکل میدهد.
امروز میخواهم آینده را به شما نشان دهم. این فناوری گرافیکی نسل بعدی ماست که آن را Neural Rendering مینامیم؛ ادغام عمیق گرافیک سهبعدی و هوش مصنوعی. این DLSS 5 است؛ لطفاً تماشا کنید.
رندرینگ عصبی: تلفیق دادههای ساختاریافته و هوش مصنوعی مولد
شگفتانگیز نیست؟ گرافیک رایانهای دوباره جان گرفته است.
چه کار کردیم؟ گرافیک سهبعدیِ کنترلپذیر، یعنی بنیاد واقعی جهان مجازی، را با دادههای ساختاریافته آن ترکیب کردیم و با هوش مصنوعی مولد و محاسبات احتمالاتی درآمیختیم. یکی کاملاً قطعی است و دیگری احتمالاتی، اما بسیار واقعگرایانه؛ این دو مفهوم را ترکیب کردیم تا ضمن امکان تولید بلادرنگ، با استفاده از دادههای ساختاریافته به کنترلپذیری دقیق برسیم. در نهایت، محتوا هم از نظر بصری خیرهکننده است و هم کاملاً کنترلپذیر.
مفهوم ادغام اطلاعات ساختاریافته با هوش مصنوعی مولد، در صنعت پس از صنعت تکرار خواهد شد. دادههای ساختاریافته سنگبنای هوش مصنوعی قابل اعتمادند.
پلتفرم شتابدهی دادههای ساختاریافته و بدون ساختار
حالا میخواهم یک نمودار معماری فنی را به شما نشان دهم.
دادههای ساختاریافته با ابزارهای آشنایی مانند SQL، Spark، Pandas و Velox و همچنین پلتفرمهای کلیدی مانند Snowflake، Databricks، Amazon EMR، Azure Fabric و Google BigQuery کار میکنند؛ همه اینها با Data Frameها سروکار دارند. این Data Frameها مانند صفحهگستردههایی عظیم عمل میکنند، همه اطلاعات جهان کسبوکار را در خود دارند و حقیقت مبنای محاسبات سازمانی را شکل میدهند.
در عصر هوش مصنوعی، باید هوش مصنوعی را با دادههای ساختاریافته به کار بگیریم و به بیشترین شتاب ممکن برسیم. در گذشته، هدف از شتابدهی پردازش دادههای ساختاریافته، افزایش بهرهوری شرکتها بود. اما در آینده، هوش مصنوعی از این دادهها با سرعتی بسیار فراتر از توانایی انسان استفاده خواهد کرد و ایجنتهای هوشمند پایگاههای داده ساختاریافته را بهطور گسترده جستوجو خواهند کرد.
در بخش دادههای بدون ساختار، پایگاههای داده برداری، PDFها، ویدئوها، فایلهای صوتی و موارد دیگر بخش بزرگی از دادههای جهان را تشکیل میدهند؛ حدود %90 از دادههایی که هر سال تولید میشوند بدون ساختارند. در گذشته، این دادهها تا حد زیادی بلااستفاده میماندند: آنها را میخواندیم، در فایلسیستمها ذخیره میکردیم و کار تمام بود. امکان جستوجوی آنها وجود نداشت و بازیابیشان دشوار بود، چون دادههای بدون ساختار روش سادهای برای نمایهسازی ندارند و باید معنا و زمینه آنها را فهمید. اکنون هوش مصنوعی میتواند این کار را انجام دهد؛ با فناوری ادراک و درک چندوجهی میتواند اسناد PDF را بخواند، معنای آنها را بفهمد و در ساختاری بزرگتر و قابل جستوجو جای دهد.
NVIDIA دو کتابخانه بنیادین برای این کار ساخته است:
· cuDF: برای شتابدهی پردازش Data Frameها و دادههای ساختاریافته
· cuVS: برای ذخیرهسازی برداری، دادههای معنایی و پردازش دادههای هوش مصنوعیِ بدون ساختار
این دو پلتفرم به یکی از مهمترین پلتفرمهای بنیادین آینده تبدیل خواهند شد.
امروز همکاری با چندین شرکت را اعلام میکنیم. IBM، مخترع زبان SQL، از cuDF برای شتابدهی پلتفرم WatsonX Data خود استفاده خواهد کرد. Dell برای ساخت Dell AI Data Platform با ما همکاری کرده و cuDF و cuVS را یکپارچه کرده است؛ این همکاری در پروژههای واقعی NTT Data به بهبود چشمگیر عملکرد انجامیده است. در بخش Google Cloud، نهتنها Vertex AI بلکه BigQuery را هم شتاب میدهیم و از طریق همکاری با Snapchat هزینههای محاسباتی آنها را تقریباً %80 کاهش دادهایم.
مزایای محاسبات شتابیافته سهگانهاند: سرعت، مقیاس و هزینه. این مزایا از منطق قانون مور پیروی میکنند؛ با محاسبات شتابیافته جهش عملکرد ایجاد میشود و در عین حال الگوریتمها پیوسته بهینه میشوند تا همه بتوانند از کاهش مداوم هزینههای محاسباتی بهرهمند شوند.
NVIDIA پلتفرمی برای محاسبات شتابیافته ساخته که کتابخانههای بسیاری مانند RTX، cuDF، cuVTS و موارد دیگر را کنار هم قرار میدهد. این کتابخانهها در سرویسهای ابری جهانی و سامانههای OEM ادغام شدهاند و در مجموع به کاربران سراسر جهان دسترسی دارند.
همکاری عمیق با ارائهدهندگان خدمات ابری
همکاری با ارائهدهندگان بزرگ خدمات ابری
Google Cloud: ما Vertex AI و BigQuery را شتاب میدهیم، با JAX/XLA یکپارچگی عمیقی داریم و عملکرد چشمگیری در PyTorch نشان میدهیم؛ NVIDIA تنها شتابدهنده جهانی است که هم در PyTorch و هم در JAX/XLA عملکردی عالی دارد. مشتریانی مانند Base10، CrowdStrike، Puma و Salesforce را وارد زیستبوم Google Cloud میکنیم.
AWS: ما EMR، SageMaker و Bedrock را شتاب میدهیم و با AWS یکپارچگی عمیقی داریم. چیزی که امسال بهویژه هیجانزدهام میکند، آوردن OpenAI به AWS است؛ اقدامی که رشد مصرف خدمات ابری AWS را بهشکل چشمگیری افزایش میدهد و به OpenAI کمک میکند استقرار منطقهای و توان محاسباتی خود را گسترش دهد.
Microsoft Azure: ابررایانه 100 PFLOPS شرکت NVIDIA نخستین ابررایانهای بود که ساختیم و نخستین موردی بود که روی Azure مستقر شد؛ این پروژه بنیانی مهم برای همکاری با OpenAI گذاشت. ما سرویسهای ابری Azure و AI Foundry را شتاب میدهیم و برای پیشبرد گسترش منطقهای Azure و همکاری عمیق در جستوجوی Bing با این شرکت همراه هستیم.
قابلیت «محاسبات محرمانه» ما شایان توجه است؛ این قابلیت تضمین میکند حتی اپراتورها هم نتوانند دادهها و مدلهای کاربران را ببینند. GPUهای NVIDIA از نخستین GPUهای جهان هستند که از محاسبات محرمانه پشتیبانی میکنند و امکان استقرار محرمانه مدلهای OpenAI و Anthropic را در محیطهای ابری سراسر جهان فراهم میآورند. برای نمونه، با Synopsys همه جریانهای کاری EDA و CAD آنها را شتاب میدهیم و روی Microsoft Azure مستقر میکنیم.
Oracle: ما نخستین مشتری هوش مصنوعی Oracle هستیم و افتخار میکنم که برای نخستین بار مفهوم AI Cloud را برای Oracle توضیح دادم. از آن زمان، آنها بهسرعت رشد کردهاند و ما نیز شرکای بسیاری مانند Cohere، Fireworks و OpenAI را به این همکاری افزودهایم.
CoreWeave: نخستین سرویس ابری بومی هوش مصنوعی جهان که برای میزبانی GPU و ارائه خدمات ابری هوش مصنوعی ایجاد شده، مشتریان برجسته و روند رشد قدرتمندی دارد.
Palantir + Dell: همکاری سهجانبهای، پلتفرم هوش مصنوعی کاملاً جدیدی بر پایه پلتفرم Ontology و پلتفرم هوش مصنوعی Palantir ایجاد کرده است. این پلتفرم میتواند هوش مصنوعی را در هر کشوری و در هر محیط ایزوله از شبکه مستقر کند و کاملاً بومیسازی شده است؛ از پردازش داده (برداری یا ساختاریافته) تا کل پشته شتابدهی هوش مصنوعی را دربرمیگیرد.
NVIDIA این مشارکت ویژه را با ارائهدهندگان جهانی خدمات ابری برقرار کرده است؛ مشتریان را به فضای ابری میآوریم و زیستبومی سودمند برای همه ایجاد میکنیم.
یکپارچگی عمودی، گشودگی افقی: راهبرد اصلی NVIDIA
NVIDIA نخستین شرکت جهان است که بهصورت عمودی یکپارچه و از نظر افقی باز است.
ضرورت این الگو ساده است: محاسبات شتابیافته مسئلهای مربوط به تراشه یا سامانه نیست؛ بهترین بیان آن، شتابدهی برنامههاست. CPU میتواند سرعت کلی رایانه را افزایش دهد، اما این مسیر به گلوگاه رسیده است. در آینده، فقط شتابدهی متناسب با برنامه یا حوزه خاص میتواند جهشهای پیوسته عملکرد و کاهش هزینه را ممکن کند.
به همین دلیل NVIDIA باید عمیقاً وارد هر کتابخانه، هر حوزه و هر صنعت عمودی شود. ما شرکتی عمودی و یکپارچه در زمینه محاسبات هستیم و راه دیگری نداریم. باید برنامهها و حوزهها را بشناسیم، الگوریتمها را عمیقاً درک کنیم و بتوانیم آنها را در هر موقعیتی به کار بگیریم؛ در مراکز داده، فضای ابری، محل شرکت، لبه شبکه و حتی سامانههای رباتیک.
در عین حال، NVIDIA همچنان از نظر افقی باز است و آماده است فناوری خود را با پلتفرم هر شریکی ادغام کند تا جهان بتواند از مزایای محاسبات شتابیافته بهرهمند شود.
ترکیب حاضران در این GTC بهخوبی این موضوع را نشان میدهد. سهم صنعت خدمات مالی در میان حاضران از همه بیشتر است؛ امیدواریم توسعهدهندگان بیایند، نه معاملهگران. زیستبوم ما کل زنجیره تأمین بالادستی و پاییندستی را پوشش میدهد. چه شرکتی 50 ساله باشد، چه 70 ساله یا 150 ساله، سال گذشته بهترین سال تاریخ آن بوده است. ما در نقطه آغاز چیزی بسیار، بسیار مهم قرار داریم.
CUDA-X: موتور محاسبات شتابیافته برای همه صنایع
NVIDIA در حوزههای عمودی گوناگون حضوری عمیق پیدا کرده است:
رانندگی خودران: تأثیری گسترده و ماندگار
خدمات مالی: سرمایهگذاری کمّی از مهندسی دستی ویژگیها به یادگیری عمیق مبتنی بر ابررایانه در حال گذار است و «لحظه ترنسفورمر» خود را آغاز میکند
سلامت: در آستانه «لحظه ChatGPT» خود قرار دارد؛ از کشف دارو با کمک هوش مصنوعی و ایجنتهای تشخیصی مبتنی بر هوش مصنوعی گرفته تا خدمات مشتریان پزشکی و موارد دیگر
صنعت: بزرگترین موج ساختوساز جهان در حال شکلگیری است و کارخانههای هوش مصنوعی، کارخانههای تولید تراشه و کارخانههای مراکز داده در حال احداثاند
سرگرمی و بازی: پلتفرمهای بلادرنگ هوش مصنوعی از ترجمه، پخش زنده، تعامل در بازی و ایجنتهای هوشمند خرید پشتیبانی میکنند
رباتیک: پس از بیش از یک دهه توسعه، سه معماری محاسباتی اصلی (رایانه آموزش، رایانه شبیهسازی و رایانه رویبرد) بهطور کامل فراهم شدهاند و در این نمایشگاه در مجموع 110 ربات به نمایش گذاشته شدهاند
مخابرات: صنعتی در مقیاس تقریبی $2T که در آن ایستگاههای پایه از یک کارکرد ارتباطی واحد به پلتفرمی زیرساختی برای هوش مصنوعی تبدیل خواهند شد. پلتفرم مرتبط Aerial نام دارد و با شرکتهایی مانند Nokia و T-Mobile همکاری نزدیکی دارد.
در مرکز همه این حوزهها، کتابخانه CUDA-X ما قرار دارد؛ جایگاه واقعی NVIDIA بهعنوان یک شرکت الگوریتمی همینجاست. این کتابخانهها از بنیادیترین داراییهای شرکت هستند و به پلتفرم محاسباتی امکان میدهند در صنایع مختلف ارزش واقعی ایجاد کند.
یکی از مهمترین کتابخانههای این مجموعه cuDNN (کتابخانه شبکه عصبی عمیق CUDA) است که هوش مصنوعی را متحول کرد و به انفجار هوش مصنوعی مدرن انجامید.
(پخش ویدئوی نمایشی CUDA-X)
همه چیزهایی که همین حالا دیدید شبیهسازی بودند؛ از جمله حلگرهای مبتنی بر فیزیک، مدلهای فیزیکی ایجنتهای هوش مصنوعی و مدلهای فیزیکی رباتهای هوشمند. همهچیز شبیهسازی شده است و هیچ پویانمایی دستی یا اتصال مفصلی در کار نیست. این توانمندی اصلی NVIDIA است: با درک عمیق الگوریتمها و ادغام طبیعی آنها با پلتفرم محاسباتی، این فرصتها را بالفعل کنیم.
شرکتهای بومی هوش مصنوعی و عصر جدید محاسبات
همین حالا غولهای صنعتی مانند Walmart، L'Oréal، JPMorgan Chase، Roche، Toyota و بسیاری دیگر را دیدید که جامعه امروز را شکل میدهند؛ همچنین تعداد زیادی شرکت که نامشان را نشنیدهاید. ما به این شرکتها، شرکتهای بومی هوش مصنوعی میگوییم. این فهرست گسترده است و OpenAI، Anthropic و بسیاری از شرکتهای نوظهور فعال در حوزههای عمودی گوناگون را دربرمیگیرد.
این صنعت طی دو سال گذشته رشد خیرهکنندهای را تجربه کرده است. سرمایهگذاری خطرپذیری که به استارتاپها سرازیر شده به $150B رسیده و این رقم در تاریخ بشر بیسابقه است. مهمتر از آن، اندازه سرمایهگذاریهای منفرد برای نخستینبار از چند میلیون دلار به صدها میلیون و حتی میلیاردها دلار جهش کرده است.
فقط یک دلیل برای این اتفاق وجود دارد: برای نخستینبار در تاریخ، هر شرکتی در این گروه به حجم عظیمی از منابع محاسباتی و تعداد زیادی توکن نیاز دارد. این صنعت در حال ساخت و تولید توکن است یا به توکنهای مؤسساتی مانند Anthropic و OpenAI ارزش میافزاید.
همانطور که انقلاب رایانههای شخصی، انقلاب اینترنت و انقلاب ابر موبایل هرکدام مجموعهای از شرکتهای تحولآفرین را به وجود آوردند، انقلاب پلتفرم محاسباتی این نسل نیز مجموعهای بسیار تأثیرگذار از شرکتها را پدید خواهد آورد که در آینده جهان نیروی مهمی خواهند بود.
سه تحول تاریخی که محرک همه اینها هستند
در دو سال گذشته دقیقاً چه اتفاقی افتاده است؟ سه رویداد بزرگ.
نخست: ChatGPT، آغازگر عصر هوش مصنوعی مولد (اواخر 2022 تا 2023)
این فناوری نهتنها میتواند ادراک و درک کند، بلکه قادر به تولید محتوای منحصربهفرد نیز هست. من تلفیق هوش مصنوعی مولد و گرافیک رایانهای را نشان دادم. هوش مصنوعی مولد ماهیت محاسبات را از پایه تغییر میدهد؛ محاسبات از بازیابیمحور به تولیدمحور تبدیل میشود و این تحول تأثیری چشمگیر بر معماری رایانه، روشهای استقرار و اهمیت کلی محاسبات دارد.
دوم: هوش مصنوعی استدلالی با نمونه شاخص o1
توانایی استدلال به هوش مصنوعی اجازه میدهد خوداندیشی کند، برنامهریزی کند و مسائل را به بخشهای کوچکتر تقسیم کند؛ یعنی مسائلی را که مستقیماً درک نمیکند به گامهای قابل مدیریت بشکند. o1 هوش مصنوعی مولد را قابل اعتماد میکند و امکان استدلال بر پایه اطلاعات واقعی را به آن میدهد. در نتیجه، تعداد توکنهای مربوط به زمینه ورودی و تفکر بهطور چشمگیری افزایش یافته و بار محاسباتی بهشدت بالا رفته است.
سوم: Claude Code، نخستین مدل ایجنت هوشمند
این مدل میتواند فایلها را بخواند، کد بنویسد، آن را کامپایل و آزمایش کند، ارزیابی انجام دهد و بهبودهای پیاپی ایجاد کند. Claude Code مهندسی نرمافزار را متحول کرده است؛ %100 از مهندسان NVIDIA از یکی یا چند مورد از Claude Code، Codex و Cursor استفاده میکنند و هیچ مهندس نرمافزاری بدون کمک هوش مصنوعی کار نمیکند.
این نقطه عطف تازهای است؛ دیگر از هوش مصنوعی نمیپرسید «چه چیزی، کجا و چگونه»، بلکه از آن میخواهید «خلق کند، اجرا کند و بسازد»؛ خودکار از ابزارها استفاده کند، فایلها را بخواند، مسائل را بشکند و دست به کار شود. هوش مصنوعی از ادراک به تولید و سپس استدلال رسیده و اکنون واقعاً کارها را انجام میدهد.
در دو سال گذشته، حجم محاسبات موردنیاز برای استدلال حدود 10,000 برابر شده و میزان استفاده تقریباً 100 برابر رشد کرده است. همیشه باور داشتهام که در دو سال گذشته تقاضای محاسباتی 1,000,000 برابر شده است؛ این برداشت مشترک همه، OpenAI و Anthropic است. محاسبات بیشتر به توکنهای بیشتر، درآمد بالاتر و هوش مصنوعی هوشمندتر منجر میشود. نقطه عطف استدلال فرا رسیده است.
عصر زیرساخت هوش مصنوعی یکتریلیوندلاری
در همین زمان در سال گذشته، همینجا گفتم که به تقاضا و سفارشهای خرید Blackwell و Rubin پیش از سال 2026 اطمینان بالایی داریم؛ رقمی در حدود $500B.
امروز، یک سال بعد و در GTC، اینجا ایستادهام تا به شما بگویم: اگر به سال 2027 نگاه کنیم، رقمی که میبینم حداقل $1T است. و مطمئنم تقاضای واقعی برای توان محاسباتی بسیار بیشتر از این خواهد بود.
2025: سال استنتاج برای NVIDIA
2025 برای NVIDIA سال استنتاج است. هدف ما این است که علاوه بر آموزش و پسآموزش، در همه مراحل چرخه عمر هوش مصنوعی عملکردی عالی حفظ شود و زیرساخت سرمایهگذاریشده همچنان کارآمد عمل کند، عمر مفید بیشتری داشته باشد و هزینه واحد آن پایینتر بیاید.
همزمان، Anthropic و Meta رسماً به پلتفرم NVIDIA پیوستهاند و در مجموع یکسوم تقاضای جهانی محاسبات هوش مصنوعی را تشکیل میدهند. مدلهای متنباز به مرز دانش نزدیک میشوند و همهجا حضور دارند.
NVIDIA در حال حاضر تنها پلتفرم جهانی است که میتواند همه حوزههای هوش مصنوعی را اجرا کند: زبان، زیستشناسی، گرافیک رایانهای، بینایی ماشین، گفتار، پروتئین و شیمی، رباتیک و موارد دیگر؛ همه مدلهای هوش مصنوعی را به هر زبانی، چه در لبه شبکه و چه در فضای ابری. معماری NVIDIA برای همه این سناریوها انعطافپذیر است و ما را به پلتفرمی با کمترین هزینه و بالاترین اطمینان تبدیل میکند.
در حال حاضر، %60 از کسبوکار NVIDIA از پنج ارائهدهنده برتر خدمات ابریِ ابرمقیاس جهان میآید و %40 باقیمانده میان ابرهای منطقهای و حاکمیتی، شرکتها، صنعت، رباتیک، رایانش لبهای و حوزههای دیگر توزیع شده است. گستردگی پوشش هوش مصنوعی بهخودیخود عامل تابآوری آن است؛ بیتردید، در عصر تازهای از تحول پلتفرمهای محاسباتی قرار داریم.
Grace Blackwell و NVLink 72: نوآوری جسورانه در معماری
در اوج دوران معماری Hopper تصمیم گرفتیم سامانه را بهطور کامل از نو طراحی کنیم؛ NVLink را از 8 مسیر به NVLink 72 گسترش دادیم و کل سامانه را از هم باز کردیم و دوباره ساختیم. Grace Blackwell NVLink 72 یک سرمایهگذاری فناورانه بزرگ بود و کار برای همه شرکا آسان نبود. صمیمانه از همه تشکر میکنم.
همزمان، NVFP4 را معرفی کردیم؛ نه صرفاً یک FP4 معمولی، بلکه نوع تازهای از هسته تانسوری و واحد محاسباتی. نشان دادهایم که NVFP4 میتواند بدون افت دقت، استنتاج را انجام دهد و در عین حال افزایش چشمگیری در عملکرد و بهرهوری ایجاد کند؛ این فناوری برای آموزش نیز به همان اندازه مناسب است.
علاوه بر این، مجموعهای از الگوریتمهای جدید مانند Dynamo و TensorRT-LLM یکی پس از دیگری معرفی شدند و حتی میلیاردها دلار برای ساخت ابررایانهای ویژه بهینهسازی کرنلها سرمایهگذاری کردیم که DGX Cloud نام دارد.
نتایج نشان دادهاند که عملکرد استنتاج ما چشمگیر است. دادههای Semi Analysis، جامعترین ارزیابی عملکرد استنتاج هوش مصنوعی تا امروز، نشان میدهد NVIDIA هم در وات بهازای هر توکن و هم در هزینه بهازای هر توکن با فاصله زیادی پیشتاز است. قانون مور شاید میتوانست برای H200 در ابتدا به بهبود عملکرد 1.5 برابری منجر شود، اما ما به 35 برابر رسیدیم. دیلن پاتل از Semi Analysis حتی گفت: «جنسن عمداً کمتر از واقعیت گفته؛ رقم واقعی 50 برابر است.» حق با اوست.
حرف او را اینجا نقل میکنم: «جنسن عمداً کمتر از واقعیت گفته است.»
هزینه هر توکن در NVIDIA در سطح جهانی از همه پایینتر است و در حال حاضر هیچکس توان رقابت با آن را ندارد. دلیل این موضوع طراحی مشترک پیشرفته است.
برای نمونه، Fireworks را در نظر بگیرید. پیش از آنکه NVIDIA مجموعه کامل نرمافزارها و الگوریتمهای خود را بهروزرسانی کند، میانگین سرعت توکن آن حدود 700 توکن در ثانیه بود؛ پس از بهروزرسانی به نزدیک 5,000 توکن در ثانیه رسید که افزایشی حدود 7 برابری است. این قدرت طراحی مشترک پیشرفته است.
کارخانه هوش مصنوعی: از مرکز داده تا کارخانه توکن
مرکز داده در گذشته مکانی برای ذخیره فایلها بود، اما حالا کارخانهای برای تولید توکن است. در آینده، هر ارائهدهنده خدمات ابری و هر شرکت هوش مصنوعی، «بهرهوری کارخانه توکن» را معیاری اصلی در عملیات خود قرار خواهد داد.
این نکته اصلی استدلال من است:
· محور عمودی: توان عملیاتی؛ تعداد توکنهای تولیدشده در هر ثانیه با توان برق ثابت
· محور افقی: سرعت توکن؛ سرعت پاسخگویی هر استنتاج. هرچه سرعت بیشتر باشد، مدلهای قابل استفاده بزرگتر، زمینه طولانیتر و هوش مصنوعی هوشمندتر خواهد بود.
توکن کالای جدیدی است و پس از رسیدن به بلوغ، قیمتگذاری آن سطحبندی خواهد شد:
· سطح رایگان (توان عملیاتی بالا، سرعت پایین)
· سطح میانی (حدود $3 بهازای هر یک میلیون توکن)
· سطح بالا (حدود $6 بهازای هر یک میلیون توکن)
· سطح پرسرعت (حدود $45 بهازای هر یک میلیون توکن)
· سطح فوقپرسرعت (حدود $150 بهازای هر یک میلیون توکن)
Grace Blackwell در مقایسه با Hopper توان عملیاتی را در گرانترین سطح قیمتی 35 برابر افزایش داده و سطح تازهای ایجاد کرده است. اگر برآورد مدل را ساده کنیم و %25 از توان را به هر یک از چهار سطح اختصاص دهیم، Grace Blackwell در مقایسه با Hopper میتواند 5 برابر درآمد بیشتری ایجاد کند.
Vera Rubin: سامانه محاسباتی هوش مصنوعی نسل بعدی
(پخش ویدئوی معرفی سامانه Vera Rubin)
Vera Rubin سامانهای کامل و بهینهشده از ابتدا تا انتهاست که بهطور ویژه برای بارهای کاری ایجنتی طراحی شده است:
· هسته محاسباتی مدل زبانی بزرگ: خوشه GPU مبتنی بر NVLink 72 برای انجام پیشپرکردن و مدیریت کش KV
· CPU کاملاً جدید Vera: طراحیشده برای عملکرد تکرشتهای بسیار بالا، دارای حافظه LPDDR5 و بهرهوری انرژی عالی؛ تنها CPU مرکز داده در جهان با LPDDR5 که برای فراخوانی ابزارها توسط ایجنتهای هوش مصنوعی مناسب است
· سامانه ذخیرهسازی: BlueField 4 + CX 9، پلتفرم ذخیرهسازی جدید عصر هوش مصنوعی؛ %100 از صنعت ذخیرهسازی جهان به سوئیچ CPO Spectrum X پیوستهاند: نخستین سوئیچ اترنت نوری با اپتیک همبسته در جهان که اکنون به تولید کامل رسیده است
· رک Kyber: سامانه رک جدیدی که از 144 GPU پشتیبانی میکند تا یک دامنه NVLink واحد بسازند؛ با محاسبات در بخش جلویی و سوئیچینگ NVLink در بخش پشتی، یک رایانه عظیم ایجاد میکند
· Rubin Ultra: گره ابررایانه نسل بعدی با طراحی نصب عمودی که در ترکیب با رک Kyber از اتصال NVLink در مقیاس بزرگتر پشتیبانی میکند
Vera Rubin اکنون %100 با مایع خنک میشود و زمان نصب را از دو روز به دو ساعت کاهش میدهد. استفاده از آب گرم 45°C برای خنکسازی نیز فشار واردشده به سامانه خنککننده مراکز داده را بهطور چشمگیری کم میکند. ساتیا (نادلا) در پستی تأیید کرده است که نخستین رک Vera Rubin اکنون روی Microsoft Azure فعال است و این موضوع مرا بسیار هیجانزده میکند.
ادغام Groq: گسترش نهایی عملکرد استنتاج
تیم Groq را خریداری کردهایم و مجوز فناوری آن را به دست آوردهایم. Groq یک پردازنده جریان داده قطعی است که از کامپایل ایستا و زمانبندی کامپایلر استفاده میکند، SRAM زیادی دارد و برای استنتاج یک بار کاری واحد بهینه شده است؛ تأخیر بسیار پایین و سرعت تولید توکن بالایی دارد.
بااینحال، حافظه داخلی Groq محدود است (500MB حافظه SRAM روی تراشه) و این موضوع مدیریت مستقل پارامترهای مدلهای بزرگ و KV Cache را دشوار میکند و کاربرد گسترده آن را محدود میسازد.
راهکار، Dynamo است؛ نرمافزاری برای زمانبندی استنتاج. با Dynamo خط لوله استنتاج را به بخشهای جداگانه تقسیم میکنیم:
· پیشپرکردن و رمزگشایی سازوکار توجه: روی Vera Rubin انجام میشود (به توان محاسباتی قابلتوجه و ذخیرهسازی KV Cache نیاز دارد)
· رمزگشایی شبکه پیشخور: بخش تولید توکن که روی Groq انجام میشود (به پهنای باند بالا و تأخیر پایین نیاز دارد)
این دو از طریق اترنت بهشکلی فشرده به هم متصلاند و با استفاده از حالت ویژهای، تأخیر را تقریباً به نصف میرسانند. تحت زمانبندی یکپارچه Dynamo، یعنی «سیستمعامل کارخانه هوش مصنوعی»، عملکرد کلی 35 برابر افزایش مییابد و سطح تازهای از عملکرد استنتاج فراهم میشود که پیشتر با NVLink 72 دستیافتنی نبود.
توصیه درباره ترکیب Groq و Vera Rubin:
اگر بار کاری به توان عملیاتی بالا نیاز دارد، از Vera Rubin %100 استفاده کنید؛ اگر بخش بزرگی از بار کاری به تولید توکن با ارزش بالا، مانند تولید کد، مربوط میشود،
Groq را اضافه کنید؛ نسبت پیشنهادی حدود %25 Groq + %75 Vera Rubin است. Groq LP30 را Samsung تولید میکند، اکنون در مرحله تولید است و انتظار میرود ارسال آن در سهماهه سوم آغاز شود. از Samsung برای همکاری کاملش سپاسگزاریم.
جهشی تاریخی در عملکرد استنتاج
برای سنجش پیشرفتهای فناورانه قبلی: در دورهای 2 ساله، نرخ تولید توکن در یک کارخانه هوش مصنوعی 1 گیگاواتی از 22M توکن در ثانیه به 7B توکن در ثانیه خواهد رسید؛ بهبودی 350 برابری. این قدرت طراحی مشترک پیشرفته است.
نقشه راه فناوری
· Blackwell: در حال حاضر در مرحله تولید؛ سامانه رک استاندارد Oberon، کابلکشی مسی توسعهیافته تا NVLink 72 و امکان توسعه نوری تا NVLink 576
· Vera Rubin (نسل کنونی): رک Kyber، NVLink 144 (کابلکشی مسی)؛ رک Oberon، NVLink 72 + نوری با گسترش تا NVLink 576؛ Spectrum 6، نخستین سوئیچ CPO جهان
· Vera Rubin Ultra (در آینده نزدیک): GPU نسل بعدی Rubin Ultra و تراشه LP35 (نخستین تراشه مجهز به NVFP4) که عملکرد را چند برابر دیگر افزایش میدهد
· Feynman (نسل بعدی): GPU کاملاً جدید و تراشه LP40 (که با همکاری NVIDIA و تیم Groq توسعه یافته و به NVFP4 مجهز است)؛ CPU کاملاً جدید Rosa (Rosalyn)؛ BlueField 5؛ CX 10؛ رک Kyber با پشتیبانی از توسعه کابلکشی مسی و CPO
نقشه راه روشن: مسیرهای توسعه مسی، گسترش نوری در مقیاس بالا و گسترش نوری در مقیاس گسترده بهصورت همزمان پیش میروند و از همه شرکا میخواهیم تولید کابل مسی، فیبر نوری و CPO را همچنان افزایش دهند.
NVIDIA DSX: پلتفرم دوقلوی دیجیتال برای کارخانههای هوش مصنوعی
کارخانه هوش مصنوعی هر روز پیچیدهتر میشود، اما تأمینکنندگان فناوری سازنده آن تا پیش از آنکه در مرکز داده «با هم روبهرو شوند»، هرگز در مرحله طراحی با یکدیگر همکاری نکردهاند؛ این وضعیت آشکارا کافی نیست.
برای حل این مشکل، Omniverse و پلتفرم NVIDIA DSX را که بر پایه آن ساخته شده ایجاد کردهایم؛ محیطی که در آن همه شرکا میتوانند کارخانههای هوش مصنوعی فرااَبَررایانهای را در جهانی مجازی بهصورت مشترک طراحی و اداره کنند. DSX امکانات زیر را ارائه میدهد:
· سامانههای شبیهسازی مکانیکی، حرارتی، الکتریکی و شبکه در سطح رک
· اتصال به شبکه برق برای زمانبندی مشارکتی و صرفهجویی در انرژی
· بهینهسازی پویای توان و خنکسازی داخل مراکز داده بر پایه Max-Q
برآوردی محافظهکارانه نشان میدهد این سامانه میتواند بهرهوری استفاده از انرژی را تقریباً 2 برابر کند؛ افزایشی چشمگیر در مقیاسی که دربارهاش صحبت میکنیم. Omniverse از دوقلوی دیجیتال زمین آغاز میشود و میزبان دوقلوهای دیجیتال در مقیاسهای گوناگون است. ما با شرکای جهانی همکاری میکنیم تا بزرگترین رایانه تاریخ بشر را بهصورت مشترک بسازیم.
علاوه بر این، NVIDIA وارد حوزه فضا شده است. تراشه Thor تأییدیه مقاومت در برابر تابش را دریافت کرده و در ماهوارهها فعالیت میکند. برای ساخت Vera Rubin Space-1 و ایجاد مراکز داده فضایی با شرکای خود همکاری میکنیم. در فضا فقط خنکسازی تابشی امکانپذیر است، بنابراین مدیریت حرارتی چالشی محوری به شمار میرود و گروهی از مهندسان برجسته را برای حل این مسئله گرد هم آوردهایم.
OpenClaw: سیستمعامل عصر ایجنتها
پیتر اشتاینبرگر نرمافزاری به نام OpenClaw ساخته است. این محبوبترین پروژه متنباز در تاریخ بشر است و تنها در چند هفته از دستاوردهای سیساله Linux فراتر رفته است.
OpenClaw در اصل یک سامانه ایجنتی است که میتواند:
· منابع را مدیریت کند و به ابزارها، فایلسیستمها و مدلهای زبانی بزرگ دسترسی داشته باشد
· زمانبندی و وظایف زماندار را اجرا کند
· مسئله را گامبهگام تجزیه کند و ایجنتهای فرعی را به کار بگیرد
· از ورودی و خروجی در هر قالبی پشتیبانی کند (صدا، ویدئو، متن، ایمیل و غیره)
در زبان سیستمعاملها، واقعاً با یک سیستمعامل روبهرو هستیم؛ سیستمعاملی برای رایانههای عاملمحور. اگر ویندوز رایانش شخصی را ممکن کرد، OpenClaw امکان عاملیت شخصی را فراهم میکند.
هر کسبوکاری باید استراتژی مخصوص به خود را برای OpenClaw تدوین کند؛ همانطور که همه ما به استراتژیهایی برای Linux، HTML و Kubernetes نیاز داریم.
دگرگونی جامع فناوری اطلاعات سازمانی
فناوری اطلاعات سازمانی پیش از OpenClaw: دادهها و فایلها وارد سیستم میشوند، از میان ابزارها و جریانهای کاری عبور میکنند و در نهایت به ابزارهایی برای استفاده انسان تبدیل میشوند. شرکتهای نرمافزاری ابزارها را میسازند و یکپارچهسازان جهانی سیستم (GSI) و شرکتهای مشاوره به سازمانها کمک میکنند از این ابزارها استفاده کنند.
فناوری اطلاعات سازمانی پس از OpenClaw: هر شرکت SaaS به یک شرکت AaaS (عاملمحور بهعنوان خدمت) تبدیل خواهد شد؛ شرکتی که نهفقط ابزار، بلکه عاملهای هوش مصنوعی تخصصی در حوزههای مشخص ارائه میکند.
اما چالشی مهم وجود دارد: عاملهای داخلی یک سازمان میتوانند به دادههای حساس دسترسی پیدا کنند، کد اجرا کنند و با بیرون ارتباط برقرار کنند. این دسترسیها باید در محیط سازمانی بهدقت کنترل شوند.
برای این کار، با پیتر همکاری کردهایم تا امنیت را در نسخه سازمانی تعبیه کنیم و موارد زیر را معرفی کردهایم:
· NeMo Claw (طرح مرجع): چارچوب مرجع سازمانی مبتنی بر OpenClaw که مجموعه کامل ابزارهای عامل هوش مصنوعی NVIDIA را یکپارچه میکند
· Open Shield (لایه امنیتی): در OpenClaw ادغام شده و برای تضمین امنیت دادههای سازمانی، موتور سیاستگذاری، حصار شبکه و مسیریابی حریم خصوصی ارائه میکند
· NeMo Cloud: برای دانلود در دسترس است و با همه موتورهای سیاستگذاری سازمانی SaaS تعاملپذیری دارد
این، رنسانس فناوری اطلاعات سازمانی است؛ صنعتی که در ابتدا ارزشی برابر با 2T دلار داشت و قرار است به دهها تریلیون دلار برسد؛ صنعتی که از ارائه ابزار بهسوی خدمات عاملهای هوش مصنوعی تخصصی حرکت میکند.
کاملاً میتوانم آینده را تصور کنم: در آینده، هر مهندس در شرکت بودجه سالانهای برای توکن خواهد داشت. ممکن است حقوق او صدها هزار دلار باشد و من علاوه بر آن، معادل نیمی از حقوقش توکن در اختیارش بگذارم تا بازده کارش ده برابر شود. «در پیشنهاد شغلی چه میزان سهمیه توکن وجود دارد؟» به موضوع داغ تازهای در استخدامهای سیلیکونولی تبدیل شده است.
در آینده، هر سازمان هم مصرفکننده توکن (برای استفاده مهندسان) و هم تولیدکننده توکن (برای ارائه خدمات به مشتریانش) خواهد بود. اهمیت OpenClaw را نمیتوان دستکم گرفت؛ این فناوری بهاندازه HTML و Linux مهم است.
ابتکار مدلهای باز NVIDIA
برای Custom Claws، مدلهای پیشرفته داخلی NVIDIA را ارائه میکنیم:
این مدلها شامل Nemotron در حوزه زبان، Cosmos بهعنوان مدل پایه جهان، GROOT برای رباتیک انساننمای عمومی، Alpamayo برای رانندگی خودران، BioNeMo برای زیستشناسی دیجیتال و Phys-AIAI برای فیزیک هستند.
ما در هر حوزه پیشتازیم و به تکرار و بهبود پیوسته متعهد هستیم؛ Nemotron 4 پس از Nemotron 3 عرضه میشود، Cosmos 2 جایگزین Cosmos 1 خواهد شد و Groq نیز به نسل دوم خواهد رسید.
Nemotron 3 در OpenClaw یکی از سه مدل برتر جهان و در خط مقدم فناوری است. Nemotron 3 Ultra قدرتمندترین مدل پایهای خواهد بود که تاکنون ساخته شده و از کشورها در ساخت هوش مصنوعی مستقل پشتیبانی میکند.
امروز تشکیل ائتلاف Nemotron را اعلام میکنیم؛ ائتلافی که میلیاردها دلار برای پیشبرد پژوهش در مدلهای پایه هوش مصنوعی سرمایهگذاری میکند. اعضای ائتلاف عبارتاند از: BlackForest Labs، Cursor، LangChain، Mistral، Perplexity، Reflection، Sarvam (هند)، Thinking Machines (آزمایشگاه میرا موراتی) و دیگران.
شرکتهای نرمافزاری سازمانی یکی پس از دیگری به ما میپیوندند و طرح مرجع NeMo Claw و جعبهابزار هوش مصنوعی عامل هوشمند NVIDIA را در محصولات خود ادغام میکنند.
هوش مصنوعی فیزیکی و رباتیک
آواتار دیجیتال در دنیای دیجیتال عمل میکند؛ کد مینویسد و دادهها را تحلیل میکند. در مقابل، هوش مصنوعی فیزیکی عاملی جسمیتیافته است؛ یعنی یک ربات.
در این رویداد GTC، در مجموع 110 ربات رونمایی شدند که تقریباً همه شرکتهای جهانی فعال در تحقیقوتوسعه رباتیک را شامل میشدند. NVIDIA سه رایانه (رایانه آموزش، رایانه شبیهسازی و رایانه نصبشده روی دستگاه) بههمراه یک پشته نرمافزاری کامل و مدلهای هوش مصنوعی ارائه کرد.
در حوزه رانندگی خودران، دوران «لحظه ChatGPT» این فناوری فرا رسیده است. امروز از پیوستن چهار شریک جدید به پلتفرم NVIDIA RoboTaxi Ready خبر دادیم: BYD، Hyundai، Nissan و Geely که مجموع تولید سالانه آنها 18M خودرو است. در کنار شرکای پیشین، یعنی Mercedes-Benz، Toyota و GM، این مجموعه قدرتمندتر شده است. همچنین از همکاری مهمی با Uber برای استقرار و یکپارچهسازی خودروهای RoboTaxi Ready در چندین شهر خبر دادیم.
در حوزه رباتیک صنعتی، شرکتهای بسیاری از جمله ABB، Universal Robotics و KUKA با ما همکاری میکنند تا مدلهای هوش مصنوعی فیزیکی را با سامانههای شبیهسازی ترکیب کنند و بهکارگیری رباتها در خطوط تولید سراسر جهان را پیش ببرند.
در بخش مخابرات نیز Caterpillar و T-Mobile از جمله این شرکتها هستند. در آینده، ایستگاههای پایه بیسیم دیگر فقط گرههای ارتباطی نخواهند بود، بلکه به NVIDIA Aerial AI RAN تبدیل میشوند؛ پلتفرمی هوشمند برای رایانش لبهای که میتواند ترافیک را بهصورت لحظهای تشخیص دهد، شکلدهی پرتو را تنظیم کند و موجب صرفهجویی در انرژی و افزایش بهرهوری شود.
بخش ویژه: رونمایی از ربات Olaf
(پخش ویدئوی نمایشی ربات Olaf دیزنی)
جنسن هوانگ: آدمبرفی اینجاست! Newton خوب کار میکند! Omniverse هم خوب کار میکند! Olaf، حالت چطور است؟
Olaf: از دیدنت خیلی خوشحالم.
جنسن هوانگ: بله، چون یک رایانه به تو دادم؛ یک Jetson!
Olaf: آن چیست؟
جنسن هوانگ: داخل شکمت است.
Olaf: جادویی است.
جنسن هوانگ: راهرفتن را در Omniverse یاد گرفتی.
Olaf: راهرفتن را دوست دارم. خیلی بهتر از سوار شدن بر گوزن شمالی رامشده و تماشای آسمان زیبای بالای سرم است.
ریچارد هوانگ: این دقیقاً به لطف شبیهسازی فیزیک ممکن شده است؛ شبیهسازیای که روی حلگر Newton مبتنی بر NVIDIA Warp اجرا میشود. ما این حلگر را با همکاری Disney و DeepMind توسعه دادیم تا بتوانی خودت را با دنیای واقعی فیزیکی سازگار کنی.
Olaf: درست در همین باره میخواستم چیزی بگویم.
ریچارد هوانگ: اینجاست که باهوشی. من آدمبرفیام، نه گلولهبرفی.
ریچارد هوانگ: میتوانی تصورش کنی؟ پارکهای دیزنی در آینده؛ همه این شخصیتهای رباتیک آزادانه در پارک میگردند. اما راستش فکر میکردم قدبلندتری. تا حالا آدمبرفیای به این کوتاهی ندیدهام.
Olaf: (پاسخ مشخصی نمیدهد)
ریچارد هوانگ: کمک میکنی ارائه امروز را جمعبندی کنم؟
Olaf: حتماً!
خلاصه سخنرانی اصلی
ریچارد هوانگ: امروز با هم موضوعات کلیدی زیر را بررسی کردیم:
1. فرارسیدن نقطه عطف استنتاج: استنتاج به مهمترین بار کاری هوش مصنوعی تبدیل شده است؛ توکنها کالای جدید هستند و عملکرد استنتاج مستقیماً درآمد را تعیین میکند.
2. عصر کارخانههای هوش مصنوعی: مراکز داده از تأسیسات ذخیرهسازی فایل به کارخانههای تولید توکن تبدیل شدهاند و در آینده هر شرکت میزان رقابتپذیری خود را با «بهرهوری کارخانه هوش مصنوعی» خواهد سنجید.
3. انقلاب عاملهای هوشمند OpenClaw: OpenClaw عصر رایانش عاملهای هوشمند را آغاز کرده است؛ فناوری اطلاعات سازمانی از عصر ابزارها به عصر عاملهای هوشمند گذر میکند و هر شرکتی باید استراتژی OpenClaw خود را تدوین کند.
4. هوش مصنوعی فیزیکی و رباتیک: هوش جسمیتیافته در حال گسترش است و رانندگی خودران، رباتهای صنعتی و رباتهای انساننما در کنار هم فرصت بزرگ بعدی را برای هوش مصنوعی فیزیکی شکل میدهند.
از همه شما سپاسگزارم؛ GTC خوش بگذرد!
این محتوا صرفاً برای اطلاعرسانی عمومی ارائه شده است و بهمنزله مشاوره مالی، سرمایهگذاری، حقوقی یا مالیاتی تلقی نمیشود. هرگونه رویداد، جایزه، کمپین آنلاین یا اطلاعات مرتبط که در اینجا ذکر شده است، نباید بهعنوان توصیه، ترغیب یا دعوت به خرید، فروش، معامله یا هرگونه دادوستد دیگر داراییهای رمزارزی تلقی شود. داراییهای رمزارزی از نوسان بالایی برخوردار هستند و ممکن است منجر به زیان شوند. دسترسی به خدمات، محصولات و رویدادهای مرتبط با WEEX ممکن است بسته به منطقه جغرافیایی متفاوت باشد. اطمینان از اینکه استفاده شما از این خدمات با قوانین و مقررات محلی مطابقت دارد، بر عهده خود شماست.
ممکن است شما نیز علاقهمند باشید

افزایش 14 برابری تقاضا برای ادغام بیتکوین در گزارش Breez

بازار وامگیری با وثیقه سهام آمریکایی راهاندازی شد

گزارش صبحگاهی وال استریت: بازار گاوی هوش مصنوعی با آزمون نرخ بهره مواجه میشود، سرمایهها به سمت داراییهای دفاعی میروند، اوراق قرضه 30 ساله آزمون بعدی است

Lightspark نسخه آزمایشی dotMoney را راهاندازی کرد، از ارسال وجوه آزمایشی از طریق لینک و فایل .money پشتیبانی میکند

گوگل پلتفرم Playground را برای تولید بازیهای قابل بازی راهاندازی کرد

عرضه RLUSD ریپل در سه ماهه سوم 765 میلیون دلار افزایش یافت

هفتهنامه RWA: دولت منطقه ویژه هنگ کنگ سپردهگذاری توکنسازی شده به دلار هنگ کنگ را معرفی کرد؛ استیبلکوین OUSD تحت رهبری Stripe بهطور رسمی راهاندازی شد

آیا بنیاد Compound "به خود سرقت میکند"؟

جام مقدس DeFi در قلب من

کیف پول Blink خدمات خود را پس از نفوذ به حسابهای امانی متوقف کرد

رشد سهام AMD برای سومین جلسه متوالی: مدیر ارشد فناوری میگوید تقاضا برای هوش مصنوعی هیچ نشانهای از کاهش ندارد
سهام AMD افت ۵.۶ درصدی ناشی از ترس هوش مصنوعی در روز دوشنبه را کاملاً جبران کرد و هفته را با ۸ درصد رشد به پایان رساند، در حالی که مدیر ارشد فناوری اعلام کرد تقاضا برای هوش مصنوعی با پشتوانه رشد ۱۰۷ درصدی دیتاسنترها، هیچ نشانهای از کاهش ندارد.

چرخه انتشار مدلهای هوش مصنوعی چین و آمریکا به ۴۴ روز کاهش یافت

گالکسی دو خزانه استیبل کوین در کامینو راه اندازی کرد

Crusoe 39 میلیارد دلار تأمین مالی دور F را تکمیل کرد و ارزش آن به 309 میلیارد دلار رسید

BitBox کیف پول Lightning را بدون عبارت پشتیبان جدید اضافه میکند

آیا SKY در سال ۲۰۲۶ به ۰.۱۰ دلار میرسد؟ استاندارد چارترد صعودی شده است

تری هاوس، گسترش بازار وام tETH به Compound V3 را دنبال میکند

گزارش روزانه Bitget UEX | قیمت نفت برنت به 107 دلار بازگشت؛ هفته تصمیمگیری فدرال رزرو در راه است؛ مذاکرات انویدیا برای سرمایهگذاری تا 10 میلیارد دلار در IPO Anthropic (14 سپتامبر 2026)

یونی سواپ پیشتازی DEX را گسترش میدهد و حجم معاملات از 70 میلیارد دلار عبور میکند

آیا بازگشت کنونی فرصتی برای خرید است تا زمانی که در چرخه افزایش نرخ بهره نیستیم؟

متا، هوش مصنوعی شخصی Muse را معرفی کرد، هزینه ماهانه حداکثر 100 دلار

فروش موتورسیکلتها در اوکراین در آگوست 2026 به میزان 15.5% کاهش یافت

پاداشهای معاملهگری رمزارز با هوش مصنوعی در برابر انسان در وییکس در سپتامبر ۲۰۲۶

معاملات هوش مصنوعی واقعی است یا تبلیغات؟ توضیح WEEX AI Wars II

انتشار مدلهای جدید توسط غولهای هوش مصنوعی و ایجاد خستگی مدلها

تکمیل نزدیک به دور تأمین مالی B XDOF با ارزش ۱۲ میلیارد دلار

نکات هفتگی | جنون میم و خطرات سهام رمزارز رابینهود در هم تنیده، انتشار جمعی مدلهای بزرگ هوش مصنوعی

گزارش صبحگاهی وال استریت: تغییر رویکرد وولر به سمت سیاستهای ملایم، تسلا، سهامهای رمزارز و نرمافزارهای هوش مصنوعی در کانون توجه

Claude Fable 5.1 با 24 امتیاز پیشتاز GPT-5.6 است و GLM-5.3 در جایگاه سوم قرار دارد











