🚀 Gemma 4 روی Cerebras: انقلاب در استنتاج چندوجهی با 1800 TPS!
Cerebras موفق به اجرا کردن مدل Gemma 4 31B از Google DeepMind با سرعت رکورد ۱۸۵۱ توکن در ثانیه شده است. این مدل چندوجهی، علاوه بر متن، قادر به پردازش تصاویر مانند عکسهای صفحه نمای…
آخرین اخبار، تحلیلها و تحولات مرتبط با استنتاج سریع در Titr Tech.
Cerebras موفق به اجرا کردن مدل Gemma 4 31B از Google DeepMind با سرعت رکورد ۱۸۵۱ توکن در ثانیه شده است. این مدل چندوجهی، علاوه بر متن، قادر به پردازش تصاویر مانند عکسهای صفحه نمای…
امنیت سایبری همواره یک نبرد نامتقارن بوده است که با پیشرفت هوش مصنوعی، به نفع مهاجمین تغییر کرده است. مهاجمین از AI برای افزایش پیچیدگی و سازگاری حملات استفاده میکنند، در حالی که …
Cerebras استقرار مدل Kimi K2.6 با یک تریلیون پارامتر را برای مشتریان سازمانی آغاز کرده است. این مدل با سرعت ۹۸۱ توکن در ثانیه اجرا میشود که ۶٫۷ برابر سریعتر از ابرهای مبتنی بر GP…
در سال ۲۰۲۵، صنعت هوش مصنوعی متوجه شد که سرعت استنتاج، نه اندازه مدلها، عامل کلیدی در تعیین تواناییهای سیستمهای AI است. سربراس با اجرای مدل DeepSeek R1 Llama 70B با سرعت ۱۵۰۰ تو…
اجرای مدلهای زبانی بزرگ هزینهبر است و با رشد برنامهها، هزینههای GPU، حافظه و مالی افزایش مییابد. کوانتیزاسیون به عنوان یک تکنیک رایج، مدلها را ارزانتر و سریعتر اجرا میکند.…