MiniMax 2.5: مدل جدید برای عاملهای بهرهوری در SambaCloud
MiniMax 2.5 جدیدترین مدل frontier شرکت MiniMax است که برای کدگذاری، جریانهای کاری عاملمحور، جستجو و بهرهوری دنیای واقعی تخصصی شده است. این مدل کوچک MoE با 230 میلیارد پارامتر، ن…
آخرین اخبار، تحلیلها و تحولات مرتبط با MoE در Titr Tech.
MiniMax 2.5 جدیدترین مدل frontier شرکت MiniMax است که برای کدگذاری، جریانهای کاری عاملمحور، جستجو و بهرهوری دنیای واقعی تخصصی شده است. این مدل کوچک MoE با 230 میلیارد پارامتر، ن…
تنسنت مدل هیونیوان Hy3 را بهطور رسمی منتشر کرد. این مدل با معماری MoE و ۲۹۵ میلیارد پارامتر، از طول متن ۲۵۶K پشتیبانی میکند. Hy3 در مقایسه با نسخه پیشنمایش، هوشمندی، ثبات و کارا…
Moonshot AI مدل Kimi K3 را با ۲.۸ تریلیون پارامتر و معماری MoE معرفی کرد که نخستین مدل وزنی باز در کلاس ۳ تریلیون پارامتری است. این مدل با معماریهای KDA، MLA و Stable LatentMoE سا…
AMD خط لولهای برای شبیهسازی مدلهای NVFP4 بر روی شتابدهندههای MI355 معرفی کرد که امکان استقرار مستقیم این مدلها را بدون تبدیل آفلاین فراهم میکند. این خط لوله در vLLM یکپارچه …
مطالعه موردی AMD نشان میدهد که فعالسازی کش KV در فرمت FP8 روی مدل Kimi-K2.5-W4A8 و ۸ GPU مینست MI308X، علیرغم بهبود ۳۴ درصدی هسته دیکد MLA، منجر به افزایش ۰.۰۸ درصدی زمان کل GPU…
علیبابا نسخه جدید مدل ترجمه ماشینی خود، Qwen-MT، را معرفی کرد که بر پایه Qwen3 ساخته شده است. این مدل با آموزش بر روی دادههای عظیم چندزبانه، توانایی ترجمه را در ۹۲ زبان بهبود بخش…
آمازون بدراک اکنون از مدلهای بنیادین MiniMax با وزن باز پشتیبانی میکند که برای بارهای کاری تولیدی مانند دستیاران کدگذاری و تحلیل اسناد طراحی شدهاند. خانواده M2 این شرکت شامل سه …
کتابخانه ترنسفورمرز به عنوان استاندارد مدلسازی در یادگیری ماشین شناخته میشود و از بیش از ۴۵۰ معماری پشتیبانی میکند. ادغام آن به عنوان بکاند مدلسازی در vLLM امکان اجرا کردن مدله…
NVIDIA کتابخانه NeMo AutoModel را برای شتابدهی تنظیم دقیق مدلهای ترنسفورمر معرفی کرد. این کتابخانه بر پایه ترنسفورمرز نسخه ۵ ساخته شده و با افزودن موازیسازی متخصص، DeepEP و هسته…
استارتآپ مونشات آیتی مدل Kimi K3 با ۲.۸ تریلیون پارامتر را به عنوان بزرگترین مدل منبعباز جهان معرفی کرد. این مدل از معماری MoE استفاده میکند که هزینههای عملیاتی را کاهش میدهد و…
کوهر مدل North Mini Code را به عنوان نخستین مدل کدگذاری عاملمحور خود با معماری MoE و ۳۰ میلیارد پارامتر معرفی کرد. این مدل اوپنسورس تحت مجوز Apache 2.0 منتشر شده و با کارایی بالا، …
تنسنت مدل Hy3 را با معماری MoE و ۲۹۵ میلیارد پارامتر منتشر کرد. این مدل در استدلال پیچیده، تولید کد و تواناییهای Agent نسبت به Hy2 بهبود یافته است. Hy3 در خدمات مختلف تنسنت همچون …
تنسور میکسیوان Hy3 بهطور رسمی منتشر شد و تواناییهای Agent آن بهطور چشمگیری ارتقا یافته است. این مدل با ۲۹۵ میلیارد پارامتر و معماری MoE، از نظر هوش مصنوعی از مدلهای هماندازه پ…
شرکت Cohere مدل Command A+ را به صورت متنباز و تحت مجوز Apache 2.0 منتشر کرد. این مدل از معماری mixture-of-experts (MoE) استفاده میکند و برای انجام وظایف عاملمحور با کارایی بالا …