چانکینگ پویا: انقلاب در بهبود کارایی سیستمهای RAG
اکثر تیمها اندازه چانکها را ثابت در نظر میگیرند و از تنظیمات استانداردی مانند ۵۱۲ توکن با ۵۰ توکن همپوشانی استفاده میکنند. با رشد دادهها و پیچیدهتر شدن پرسوجوها، این انتخاب …
آخرین اخبار، تحلیلها و تحولات مرتبط با پردازش زبان طبیعی در Titr Tech.
اکثر تیمها اندازه چانکها را ثابت در نظر میگیرند و از تنظیمات استانداردی مانند ۵۱۲ توکن با ۵۰ توکن همپوشانی استفاده میکنند. با رشد دادهها و پیچیدهتر شدن پرسوجوها، این انتخاب …
بردارهای تعمیدشده یا امبدینگها، نمایشهای عددی از دادهها هستند که به مدلهای هوش مصنوعی کمک میکنند تا روابط معنایی را درک کنند. این فناوری در جستجوی معنایی، سیستمهای توصیهگر و…
GLM 5.2 به عنوان نسخه جدید مدل زبان بزرگ، دسترسی به هوش مصنوعی پیشرفته را برای سازمانها و توسعهدهندگان آسانتر کرده است. این نسخه بهبودهای قابل توجهی در پردازش زبان طبیعی، کارایی…
Amazon همکاریهای گستردهای با دانشگاهها و موسسات علمی مانند CMU، کلمبیا، همپتون، هوارد، IIT-Bombay، JHU، ماکس پلانک، MIT، UCLA و دیگر مراکز برای پیشبرد پژوهش در حوزههای هوش مصنو…
هوش مصنوعی در انتخاب استعداد از فناوریهایی مانند یادگیری ماشین و پردازش زبان طبیعی برای خودکارسازی فرآیند استخدام استفاده میکند. این روش به شرکتها کمک میکند تا کیفیت استخدامها…
مدلهای زبانی بزرگ (LLMs) مدلهای یادگیری ماشینی هستند که بر روی حجم عظیمی از دادههای متنی آموزش دیدهاند و قادر به طبقهبندی، خلاصهسازی و تولید متن هستند. مدلهایی مانند GPT-4، …
AMD در وبلاگ خود دموی یک سیستم RAG عاملمحور را با استفاده از کتابخانه hipVS معرفی کرد. این دمو که «تحلیلگر پژوهشی سازمانی» نام دارد، توانایی پردازش پرسوجوهای پیچیده را با تجزیه آنه…
تیم Hugging Face سه ماه پیش مدل DharmaOCR را برای تشخیص نوری کاراکتر (OCR) تخصصی زبان پرتغالی برزیلی معرفی کرد. این مدل در دو مرحله آموزش دید: تنظیم دقیق نظارتشده برای همسو کردن و…
مقالهای در بلاگ Redis به بررسی تفاوتهای مهندسی زمینه و مهندسی پرامپت پرداخته است. مهندسی زمینه بر بهینهسازی دادهها و اطلاعاتی تمرکز دارد که مدلهای زبانی برای تولید پاسخ از آن…
مقالهای در بلاگ Redis به بررسی پدیدهای ضدشهری در مدلهای زبانی میپردازد که در آن، افزایش حجم توکنهای ورودی به جای بهبود پاسخها، منجر به کاهش کیفیت خروجی میشود. نویسنده توضیح …
AWS اعلام کرد که مدل Voxtral-Mini-4B-Realtime-2602 از Mistral AI اکنون در Amazon SageMaker JumpStart در دسترس است. این مدل چندزبانه برای رونویسی بلادرنگ گفتار طراحی شده و از معماری…
اینتل لبز با تحقیقات پیشگامانه خود در حال شکل دادن به آینده هوش مصنوعی است. تمرکز اصلی این شرکت بر تقویت توانمندیهای انسانی از طریق AI، از بهبود مراقبتهای بهداشتی تا شناسایی دیپف…
تنسنت مدل زبانی پیشنمایشی «هیونوان Hy3» را با ۲۹۵ میلیارد پارامتر کلی و ۲۱ میلیارد پارامتر فعال منتشر و اوپنسورس کرد. این مدل که از معماری ترکیبی متخصص بهره میبرد، تواناییهای ا…
هاگینگ فیس و PaddlePaddle نسل جدید مدلهای OCR خود، PP-OCRv6، را معرفی کردند که برای تشخیص و شناسایی متن در محیطهای مختلف طراحی شدهاند. این مدلها در سه سطح tiny، small و medium …
کوهِر مدل ترنسکریب عربی خود را به عنوان دقیقترین مدل منبعباز برای زبان عربی با نرخ خطای کلمه ۲۵.۸۷ معرفی کرد. این مدل بر اساس معماری ۲ میلیارد پارامتری ASR کوهر ساخته شده و برای گ…
اوپنایآی قابلیت ترانسکریپت بلادرنگ را در API خود معرفی کرده که امکان تبدیل گفتار به متن زنده با کمترین تأخیر را فراهم میکند. این سرویس بر پایه مدل gpt-realtime-whisper توسعه یاف…
اپل نسل بعدی هوش مصنوعی خود، Apple Intelligence، را معرفی کرد که قابلیتهای هوش مصنوعی را در آیفون، آیپد و مک یکپارچه میسازد. این فناوری تجربیات روزمره کاربران را شخصیتر و مفیدتر…