رمزگشایی از اسناد فارسی؛ پایان عصر بایگانی‌های خاموش! ‌ ​بسیاری از… — همیار فرهنگی دانشجو — TG.ME

📄 رمزگشایی از اسناد فارسی؛ پایان عصر بایگانی‌های خاموش!

​بسیاری از سازمان‌ها و مراکز درمانی همچنان با حجم عظیمی از اسناد کاغذی و دست‌نویس روبه‌رو هستند که دیجیتال‌سازی آن‌ها برای اتوماسیون و تحلیل داده حیاتی است. اما مشکل اصلی، ناتوانی ابزارهای موجود در تشخیص دقیق جداول پیچیده و دست‌خط‌های متنوع فارسی است.

💡 نکته فنی: هدف این پروژه، توسعه یک سامانه OCR بومی با دقت ۹۵٪ برای متون چاپی و ۸۵٪ برای دست‌خط است. در این مسیر، از مدل‌های عمیق Sequence-to-sequence و ماژول‌های پیش‌پردازش مقاوم برای حذف نویز و اصلاح زاویه تصویر استفاده می‌شود تا ساختار سلولی جداول به‌طور دقیق در خروجی‌های ساختاریافته (JSON/Excel) حفظ شود.

🚀 همکاری در پروژه:
اگر در حوزه هوش مصنوعی، یادگیری عمیق (Deep Learning) یا پردازش تصویر تخصص دارید و با مدل‌های CTC یا تحلیل ساختار اسناد آشنا هستید، برای مشارکت در توسعه این سامانه استراتژیک به ما بپیوندید:
📌 روابط عمومی :
🆔️@ACRIE_admin




📌 روابط عمومی :
🆔️@ACRIE_admin
مرکز تحقیقات امیرکبیر
🔹️@Amirkabir_RC
February 16, 2026 106