مسیر مالی اوپنایآی به شدت به هزینههای زیرساختی وابسته است؛ واقعیتی که توسعه تراشه سفارشی جدید Jalapeño اوپنایآی را رقم زد. این مدار مجتمع خاصکاربرد (ASIC) با همکاری برادکام ساخته شده و تلاشی مستقیم برای کاهش هزینههای سرمایهای سنگین مرتبط با سختافزارهای شخص ثالث به شمار میرود.
در حالی که انویدیا حاشیه سود تقریبی ۷۵ درصدی روی پردازندههای ردهبالای خود دارد، اوپنایآی با حاشیههای محدودتر فعالیت میکند و پس از کسر هزینههای عملیاتی عظیم، حدود ۳۳ سنت سود از هر دلار درآمد خود نگه میدارد. بار مالی اجرای مدلهای زبانی بزرگ در مقیاس واقعی بسیار سنگین است.
سال گذشته، هزینه حفظ پاسخگویی سرورهای چتجیپیتی برای اوپنایآی به رقم خیرهکننده ۸.۴ میلیارد دلار رسید. اکنون که این پلتفرم ۹۰۰ میلیون کاربر هفتگی جذب کرده، هزینه عملیاتی آن برای سال جاری حدود ۱۴ میلیارد دلار پیشبینی میشود. اوپنایآی در هشت سال آینده حدود ۱.۴ تریلیون دلار به توان محاسباتی متعهد شده است؛ شرطبندی عظیمی برای شرکتی که هماکنون ۲۵ میلیارد دلار درآمد سالانه دارد.
طراحی سختافزار برای استنتاج مدلهای زبانی بزرگ
تراشه Jalapeño اوپنایآی که نخستین «پردازنده هوش» شرکت نامیده میشود، به طور خاص برای استنتاج مدلهای زبانی بزرگ (LLM) ساخته شده و نه بارهای کاری هوش مصنوعی همهمنظوره. اوپنایآی طراحی معماری اصلی را بر اساس نقشه راه مدلهای خود و سیستمهای ارائه خدمت ارائه داد، در حالی که برادکام مهندسی سیلیکون و یکپارچهسازی شبکه با کارایی بالا را بر عهده گرفت.
شرکت TSMC تولید فیزیکی را در تایوان انجام میدهد و سلستیکا مسئول ساخت برد و سیستمهای رک است. به گفته اوپنایآی، نمونههای اولیه آزمایشگاهی هماکنون بارهای کاری frontier را از جمله مدل منتشرنشده GPT-5.3-Codex-Spark را با فرکانس و توان هدف تولید اجرا میکنند.
ریچارد هو، رئیس برنامه سختافزاری اوپنایآی، خاطرنشان کرد که این معماری حرکت داده را به حداقل میرساند تا بهرهبرداری واقعی را به اوج عملکرد نظری نزدیک کند. برخلاف شتابدهندههای همهمنظوره که از بارهای کاری قدیمی هوش مصنوعی اقتباس شدهاند، این معماری به طور خاص تعادل میان محاسبه، حافظه و منابع شبکه را برای حل گلوگاههای حرکت داده بومی ارائه خدمت تعاملی مدلهای زبانی بزرگ برقرار میسازد.
برای دستیابی به این هدف در مقیاس بزرگ، پلتفرم سیلیکون شبکه Tomahawk برادکام را مستقیماً در طراحی یکپارچه کرده است و به پردازندههای سفارشی اجازه میدهد در محیطهای خوشهای عظیم مرکز داده با یکدیگر ارتباط برقرار کنند.
چرخه یکپارچهسازی عمودی
با ورود به حوزه سیلیکون سفارشی، اوپنایآی از لایه صرف نرمافزاری به شرکتی زیرساختی با یکپارچهسازی عمودی تبدیل میشود. این راهبرد تمامپشتهای کل زنجیره را در بر میگیرد: معماری تراشه، هستههای نرمافزاری، سیستمهای حافظه، زمانبندی شبکه و لایه کاربردی نهایی. مانند پیوند تنگاتنگ سختافزار اختصاصی اپل با سیستمعامل iOS، اوپنایآی اکنون میتواند زیرساخت خود را دقیقاً حول نقشه راه مدلهای داخلی بهینه کند.
این یکپارچهسازی چرخه عملیاتی پیوستهای ایجاد میکند. افزایش کارایی زیرساخت، هزینه آموزش و ارائه خدمت مدلها را کاهش میدهد. ارائه خدمت ارزانتر به محصولات بهتر و پاسخگوتر منجر میشود که حجم کاربر و درآمد را افزایش میدهد و این درآمد دوباره در نسل بعدی زیرساخت سفارشی سرمایهگذاری میشود.
غلبه بر مزیت تأخیر در ورود
با معرفی سیلیکون اختصاصی خود، اوپنایآی وارد عرصهای میشود که رقبای اصلی آن نزدیک به یک دهه صرف توسعه سختافزار اختصاصی کردهاند. گوگل از سال ۲۰۱۵ واحدهای پردازش تنسور (TPU) خود را به کار گرفت و اکنون حدود یکچهارم ظرفیت محاسباتی جهانی هوش مصنوعی خارج از زنجیره تأمین انویدیا را در اختیار دارد.
آمازون بیش از یک میلیون تراشه سفارشی خود را ارسال کرده و متا و مایکروسافت نیز به گسترش زیرساخت خود ادامه میدهند.
گرگ براکمن، رئیس و همبنیانگذار اوپنایآی، گفت: «Jalapeño بخشی از راهبرد بلندمدت زیرساخت تمامپشتهای ما برای فراوانتر کردن توان محاسباتی است. با طراحی بخش بیشتری از پشته توسط خودمان، میتوانیم هوش بیشتری را با کارایی بالاتر ارائه دهیم.»
برای جبران شکاف زمانی، اوپنایآی فاز توسعه را شتاب بخشید. تراشه Jalapeño اوپنایآی تنها در نه ماه از طراحی از صفر به مرحله tape-out — آخرین گام پیش از تولید فیزیکی — رسید. تیمهای مهندسی با بهرهگیری از مدلهای زبانی خود اوپنایآی برای خودکارسازی و بهینهسازی بخشهایی از فرآیند طراحی سختافزار، این زمانبندی را محقق کردند.
این امر حلقه بازخورد منحصربهفردی ایجاد میکند که در آن مدلهایی که به کاربران ارائه میشوند، actively برای ساخت زیرساخت فیزیکی مورد استفاده قرار میگیرند که نسخههای آینده را اجرا خواهد کرد. استقرار اولیه این سختافزار در مراکز داده تا پایان سال ۲۰۲۶ آغاز میشود.
هوک تان، مدیرعامل برادکام، تأیید کرد که rollout در کنار شرکای زیرساختی از جمله مایکروسافت برای آمادهسازی یکپارچهسازی مراکز داده در مقیاس گیگاوات گسترش خواهد یافت.


نظرات
ثبت نظر جدید
هنوز نظری ثبت نشده است. اولین نفر باشید!