مدل جدید GLM-5.3-Flash به عنوان اولین مدل ناتیومولتیمودال در سری GLM-5 عرضه شد. این مدل با معماری بهینهشده، برای مدیریت متنهای بسیار طولانی و هزینههای عملیاتی پایین طراحی شده است.
از مهمترین ویژگیهای این مدل میتوان به موارد زیر اشاره کرد:
* استفاده از معماری هیبریدی (Sparse و Linear Attention) برای افزایش سرعت و کاهش محاسبات.
* پشتیبانی از کانتکست تا سقف ۱ میلیون توکن.
* کاهش ۴.۴۴ برابری حافظه KV-cache.
* قابلیت پردازش مستقیم تصاویر و تعامل با واسطهای کاربری (GUI).
* کارایی بالا در برنامهنویسی، کارهای اداری، تحقیقاتی و تحلیل اسناد.
در زمینه هزینهها، این مدل با مدلهای پیشرو بازار مقایسه شده است. قیمت ورودی آن ۰.۱۵ دلار و قیمت خروجی ۰.۵ دلار تعیین شده که در حال حاضر با تخفیف ۵۰ درصدی ارائه میشود. جزئیات فنی و مستندات کامل را میتوانید در Model ID: glm-5.3-flash مشاهده کنید.
📚 مطالعه با جزئیات بیشتر
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#GLM_5 #Sparse_Attention

