PP-OCRv6 در هاگینگ فیس: مدل OCR چندزبانه برای ۵۰ زبان با پارامترهای ۱.۵ تا ۳۴.۵ میلیون

Hugging Face BlogUnited States3 دقیقه مطالعه۱۴۰۵/۰۵/۱۶ ساعت ۱۹:۳۰

تصویر مرتبط با خبر: PP-OCRv6 on Hugging Face: 50-Language OCR from 1.5M to 34.5M Parameters
تصویر مرتبط با خبر: PP-OCRv6 on Hugging Face: 50-Language OCR from 1.5M to 34.5M Parameters
خلاصه سریع

اصل خبر در چند خط

هاگینگ فیس و PaddlePaddle نسل جدید مدل‌های OCR خود، PP-OCRv6، را معرفی کردند که برای تشخیص و شناسایی متن در محیط‌های مختلف طراحی شده‌اند. این مدل‌ها در سه سطح tiny، small و medium با پارامترهای ۱.۵ تا ۳۴.۵ میلیون عرضه می‌شوند و از ۵۰ زبان پشتیبانی می‌کنند. مدل PP-OCRv6_medium در بنچمارک‌های داخلی به دقت ۸۶.۲٪ در تشخیص و ۸۳.۲٪ در شناسایی دست یافته است. معماری‌های جدید مانند PPLCNetV4، RepLKFPN و EncoderWithLightSVTR دقت و کارایی را بهبود بخشیده‌اند. این مدل‌ها برای استقرار در محیط‌های مختلف و پردازش متن‌های چندزبانه، متراکم و پیچیده مناسب هستند.

متن خبر

شرح خبر

هاگینگ فیس و PaddlePaddle از نسل جدید مدل‌های OCR جهانی خود با نام PP-OCRv6 رونمایی کردند. این خانواده مدل‌ها که برای تشخیص و شناسایی متن در اسناد، عکس‌های صفحه نمایش، تصاویر چندزبانه، نمایشگرهای دیجیتال و متن‌های محیطی طراحی شده‌اند، در سه سطح tiny، small و medium با پارامترهای ۱.۵ تا ۳۴.۵ میلیون عرضه می‌شوند. مدل‌های medium و small از ۵۰ زبان از جمله فارسی، انگلیسی، چینی و ژاپنی پشتیبانی می‌کنند. در بنچمارک‌های داخلی، PP-OCRv6_medium به دقت ۸۶.۲٪ در تشخیص و ۸۳.۲٪ در شناسایی دست یافته است که نسبت به نسخه قبلی بهبود ۴.۶ و ۵.۱ درصدی را نشان می‌دهد. این مدل‌ها با معماری‌های نوین مانند PPLCNetV4، RepLKFPN و EncoderWithLightSVTR، کارایی و دقت بالاتری را در سناریوهای پیچیده ارائه می‌دهند. هاگینگ فیس و PaddlePaddle نسل جدید مدل‌های OCR خود، PP-OCRv6، را معرفی کردند که برای تشخیص و شناسایی متن در محیط‌های مختلف طراحی شده‌اند. این مدل‌ها در سه سطح tiny، small و medium با پارامترهای ۱.۵ تا ۳۴.۵ میلیون عرضه می‌شوند و از ۵۰ زبان پشتیبانی می‌کنند. مدل PP-OCRv6_medium در بنچمارک‌های داخلی به دقت ۸۶.۲٪ در تشخیص و ۸۳.۲٪ در شناسایی دست یافته است. معماری‌های جدید مانند PPLCNetV4، RepLKFPN و EncoderWithLightSVTR دقت و کارایی را بهبود بخشیده‌اند. این مدل‌ها برای استقرار در محیط‌های مختلف و پردازش متن‌های چندزبانه، متراکم و پیچیده مناسب هستند. رونمایی از PP-OCRv6 گامی مهم در توسعه فناوری OCR است، زیرا این مدل‌ها توانایی پردازش متن در ۵۰ زبان را با دقت بالا و اندازه‌های مختلف ارائه می‌دهند. این امر برای کسب‌وکارها و توسعه‌دهندگان که نیاز به پردازش اسناد و تصاویر چندزبانه دارند، بسیار ارزشمند است. علاوه بر این، بهبود دقت تشخیص و شناسایی متن نسبت به نسخه‌های قبلی، کارایی این مدل‌ها را در سناریوهای واقعی افزایش می‌دهد. PP-OCRv6 می‌تواند برای شرکت‌ها و استارت‌آپ‌هایی که در زمینه پردازش اسناد، استخراج اطلاعات و اتوماسیون اداری فعالیت می‌کنند، فرصت‌های جدیدی ایجاد کند. این مدل‌ها با پشتیبانی از ۵۰ زبان و دقت بالا، می‌توانند در صنایع مختلف از جمله بانکداری، بهداشت و خرده‌فروشی مورد استفاده قرار گیرند. پشتیبانی از زبان فارسی در این مدل‌ها می‌تواند برای شرکت‌ها و توسعه‌دهندگان ایرانی که به دنبال پردازش متن‌های فارسی هستند، بسیار مفید باشد. این امر می‌تواند منجر به توسعه برنامه‌های کاربردی جدید در زمینه‌های مختلف از جمله دیجیتال‌سازی اسناد و اتوماسیون اداری شود. PP-OCRv6 می‌تواند در صنعت حقوقی برای پردازش و استخراج اطلاعات از اسناد حقوقی چندزبانه مورد استفاده قرار گیرد. این امر می‌تواند فرآیندهای حقوقی را تسریع کرده و دقت را افزایش دهد. چین با معرفی مدل‌های OCR پیشرفته مانند PP-OCRv6، نقش مهمی در توسعه فناوری‌های هوش مصنوعی ایفا می‌کند. این مدل‌ها می‌توانند در سطح جهانی مورد استفاده قرار گیرند و رقابت در زمینه فناوری OCR را افزایش دهند. هاگینگ فیس و PaddlePaddle به عنوان منابع معتبر در زمینه هوش مصنوعی و پردازش زبان طبیعی شناخته می‌شوند. این خبر از طریق وبلاگ رسمی هاگینگ فیس منتشر شده است. هاگینگ فیس و PaddlePaddle مدل جدید PP-OCRv6 را معرفی کردند که برای تشخیص و شناسایی متن در ۵۰ زبان طراحی شده است. این مدل‌ها با دقت بالا و اندازه‌های مختلف، برای استقرار در محیط‌های گوناگون مناسب هستند.

این صفحه خلاصه و تحلیل فارسی خبر را نمایش می‌دهد. نسخه کامل/اصلی از طریق لینک منبع در دسترس است.

تحلیل تحریریه

ابعاد مهم خبر

چرا مهم است؟

رونمایی از PP-OCRv6 گامی مهم در توسعه فناوری OCR است، زیرا این مدل‌ها توانایی پردازش متن در ۵۰ زبان را با دقت بالا و اندازه‌های مختلف ارائه می‌دهند. این امر برای کسب‌وکارها و توسعه‌دهندگان که نیاز به پردازش اسناد و تصاویر چندزبانه دارند، بسیار ارزشمند است. علاوه بر این، بهبود دقت تشخیص و شناسایی متن نسبت به نسخه‌های قبلی، کارایی این مدل‌ها را در سناریوهای واقعی افزایش می‌دهد.

اثر کسب‌وکاری

PP-OCRv6 می‌تواند برای شرکت‌ها و استارت‌آپ‌هایی که در زمینه پردازش اسناد، استخراج اطلاعات و اتوماسیون اداری فعالیت می‌کنند، فرصت‌های جدیدی ایجاد کند. این مدل‌ها با پشتیبانی از ۵۰ زبان و دقت بالا، می‌توانند در صنایع مختلف از جمله بانکداری، بهداشت و خرده‌فروشی مورد استفاده قرار گیرند.

اثر احتمالی برای ایران

پشتیبانی از زبان فارسی در این مدل‌ها می‌تواند برای شرکت‌ها و توسعه‌دهندگان ایرانی که به دنبال پردازش متن‌های فارسی هستند، بسیار مفید باشد. این امر می‌تواند منجر به توسعه برنامه‌های کاربردی جدید در زمینه‌های مختلف از جمله دیجیتال‌سازی اسناد و اتوماسیون اداری شود.

ارتباط با LegalTech

PP-OCRv6 می‌تواند در صنعت حقوقی برای پردازش و استخراج اطلاعات از اسناد حقوقی چندزبانه مورد استفاده قرار گیرد. این امر می‌تواند فرآیندهای حقوقی را تسریع کرده و دقت را افزایش دهد.

زاویه رسانه/کشور منبع

هاگینگ فیس و PaddlePaddle به عنوان منابع معتبر در زمینه هوش مصنوعی و پردازش زبان طبیعی شناخته می‌شوند. این خبر از طریق وبلاگ رسمی هاگینگ فیس منتشر شده است.

برچسب‌ها