انویدیا با Nemotron 3.5 Lightning وارد میدان مدل‌های متن‌باز شد

...

در میان توجه فزاینده به مدل‌های متن‌باز چینی، شرکت انویدیا (Nvidia)، یکی از بزرگ‌ترین تولیدکنندگان سخت‌افزار هوش مصنوعی، از جدیدترین مدل متن‌باز خود با نام Nemotron 3.5 Lightning رونمایی کرد. این مدل در تاریخ ۱۱ اوت منتشر شد و به‌عنوان یک مدل ترکیبی از متخصصان (Mixture-of-Experts) طراحی شده تا وظایف تخصصی را در سیستم‌های چندعامله (Multi-Agent) بزرگ‌تر انجام دهد.

به گفته انویدیا، این مدل قادر است کارهایی مانند بازبینی کد، استفاده از ابزارها، پایش هشدارهای امنیتی و پاسخ‌گویی به سؤالات مربوط به صورت‌حساب را انجام دهد. نکته قابل توجه این‌که انویدیا وزن‌های مدل، کدها، دستورالعمل‌های آموزش و همچنین داده‌های آموزشی را تحت مجوز OpenMDW 1.1 از بنیاد لینوکس منتشر کرده که این مدل را به یک مدل کاملاً متن‌باز تبدیل می‌کند.

جایگاه در خانواده Nemotron 3

Nemotron 3.5 Lightning بخشی از خانواده مدل‌های متن‌باز Nemotron 3 است که اولین بار در دسامبر سال گذشته معرفی شد. این مدل با ۳۰ میلیارد پارامتر، از نسخه Nano با ۸ میلیارد پارامتر بزرگ‌تر و از نسخه Ultra با ۵۵۰ میلیارد پارامتر کوچک‌تر است. هدف اصلی از طراحی این مدل، کمک به شرکت‌ها برای ساخت اپلیکیشن‌های عامل‌محور (Agentic) روی دستگاه‌های محلی است، از جمله رایانه‌های RTX، سیستم DGX Spark و پلتفرم Jetson. همزمان با این مدل، انویدیا کتابخانه متن‌باز دیگری به نام NeMo Switchyard را نیز منتشر کرد که به مسیریابی درخواست‌ها در اپلیکیشن‌های عامل‌محور محبوب کمک می‌کند. شرکت‌ها می‌توانند با استفاده از Switchyard، هر درخواست را به مناسب‌ترین مدل چه متن‌باز، چه اختصاصی و چه از خود انویدیا هدایت کنند.

 

مدل هوش مصنوعی انویدیا

 

رقابت با مدل‌های چینی

انتشار این مدل کمتر از یک ماه پس از آن صورت می‌گیرد که جنسن هوانگ، مدیرعامل انویدیا، اعلام کرد این شرکت به جمع گسترده‌ای از شرکت‌های فناوری پیوسته که از مدل‌های متن‌باز در برابر محدودیت‌های احتمالی دولت ترامپ بر مدل‌های چینی دفاع می‌کنند. هوانگ در پستی در شبکه X گفته بود مدل‌های متن‌باز به حاکمیت فناوری کمک کرده و امنیت سایبری را تقویت می‌کنند.

این مدل، اولین مدل متن‌باز انویدیا از زمان اوج‌گیری بحث درباره پیشرفت مدل‌های چینی است؛ زمانی که شرکت‌های علی‌بابا و مون‌شات AI مدل‌های متن‌باز ارزان و قدرتمندی را منتشر کردند. جالب اینکه انتشار Nemotron 3.5 Lightning تنها یک روز پس از انتشار جدیدترین مدل متن‌باز متا صورت گرفت. بردلی شیمین، تحلیل‌گر مؤسسه Futurum Group، این موضوع را نشانه تأثیرگذاری عمیق مدل‌های چینی دانست و گفت بسیاری مدل Qwen 3.8 Max علی‌بابا را معیار سنجش توسعه عامل‌محور محلی می‌دانند.

استراتژی تجاری انویدیا

به گفته آرون چاندراسکاران، تحلیل‌گر گارتنر، ارائه مدل‌های متن‌باز برای انویدیا تنها یک استراتژی رقابتی در برابر چین نیست، بلکه راهی برای فروش بهتر تراشه‌ها و سخت‌افزارهای این شرکت نیز محسوب می‌شود؛ چرا که اجرای هر مدلی نیازمند زیرساخت شبکه، نرم‌افزار استنتاج و آموزش داده است. شیمین همچنین انتشار داده‌های آموزشی مدل را ستود و گفت شرکت‌های معدودی مانند IBM به‌طور جدی بر اهمیت شفافیت در داده‌های آموزشی تأکید داشته‌اند. او افزود اندازه نسبتاً کوچک این مدل نشان می‌دهد شرکت‌هایی مانند انویدیا اکنون به اهمیت «اندازه مناسب» مدل‌ها پی برده‌اند، چرا که هزینه بالای استفاده از مدل‌ها بر اساس مصرف توکن، بسیاری از شرکت‌ها را به سمت اجرای محلی مدل‌ها سوق داده است.

منبع خبر: aibusiness

نظرات 0

wave

ارسال نظر

wave
برای ثبت نظر ابتدا وارد حساب کاربری خود شوید. ورود | ثبت نام

در آرتیجنس دنبال چی میگردی؟