[ad_1]
شرکت آمریکایی Positron AI ادعا کرده است که تراشه شتابدهندهاش با نام «اطلس» در انجام عملیات استنتاج (Inference) عملکردی بهتر از انویدیا H200 دارد و ۳۳ درصد برق کمتری مصرف میکند.
به نقل از Tom’s Hardware، شرکت Positron که در سال ۲۰۲۳ تأسیس شده، شتابدهندههای هوش مصنوعی را با تمرکز اختصاصی بر عملیات استنتاج گسترش میدهد. برخلاف پردازشگرهای گرافیکی که برای آموزش مدلهای هوش مصنوعی، انجام عملیات استنتاج، محاسبات فنی و انجام طیف وسیعی از ماموریت های طراحی شدهاند، سختافزار Positron از پایه بهطوری ساخته شده تا ماموریت های استنتاج را با کارایی بالا و مصرف انرژی زیاد پایین انجام دهد.
شتابدهنده Positron AI نسبت به انویدیا H200 قوت و کارایی بالاتری دارد
راهکار نسل اول Positron برای مدلهای ترنسفورمر در مقیاس بزرگ، اطلس نام دارد. این سامانه شامل ۸ شتابدهنده به نام Archer است و با مقصد ناکامی دادن سیستمهای مبتنی بر معماری Hopper انویدیا طراحی شده، آن هم درحالیکه تنها کسری از انرژی آنها را مصرف میکند.
مطابق گزارشها، سامانه اطلس شرکت Positron AI میتواند در مدل Llama 3.1 در محدوده مصرف ۲۰۰۰ وات، با ۸ میلیارد پارامتر و با منفعت گیری از محاسبات BF16، نزدیک به ۲۸۰ توکن در ثانیه برای هر کاربر تشکیل کند. در روبه رو، یک سرور انویدیا DGX H200 با پیکربندی ۸ کارت گرافیک تنها قادر است با مصرف ۵۹۰۰ وات توان، نزدیک به ۱۸۰ توکن در ثانیه برای هر کاربر تشکیل کند. یقیناً این قیاس توسط خود شرکت Positron AI انجام شده است.
ادعا میبشود که شتابدهنده اطلس از نظر کارکرد بهازای وات (performance-per-watt) و این چنین کارکرد نسبت به هزینه، در قیاس با سیستم DGX H200 انویدیا، نزدیک به ۳ برابر منفعتوری بالاتری دارد. یقیناً این ادعا باید توسط یک مرجع ثالث به اثبات برسد.
شرکت Positron AI سختافزار ASIC خود را با منفعت گیری از فناوری ساخت N4 یا N5 در کارخانه شماره ۲۱ شرکت TSMC در آریزونا تشکیل میکند و کارتها نیز در داخل ایالات متحده مونتاژ خواهد شد. یقیناً ازآنجاییکه این تراشهها با ۳۲ گیگابایت حافظه HBM ترکیب شدهاند، از فناوری بستهبندی پیشرفته منفعت میبرند و به همین علت، به گمان زیادً بخشی از مونتاژ در تایوان انجام شده است.
[ad_2]
دسته بندی مطالب





