متا نسخهی تازهی مدل هوش مصنوعیاش را ( "Muse Spark 1.3 )معرفی کرد و میگوید اینبار روی دو چیز تمرکز کرده: کدنویسی و کارهای ایجنتی.
کارنامهی مدل در آزمونهای استاندارد: • ۷۵.۴٪ در DeepSWE v1.1 (آزمون رفع باگهای واقعی نرمافزاری) — بالاتر از GPT-5.6 Sol و Claude Opus 5 • ۸۸.۸٪ در Terminal-Bench 2.1 (آزمون کار کردن با خط فرمان)
⚡️ و همچنین • ۲۰٪ کمتر سراغ ابزارهای بیرونی میرود → کار را با مراحل کمتر و هوشمندانهتر تمام میکند • ۲۵٪ توکن کمتر مصرف میکند → یعنی سریعتر و ارزانتر
یادمان نرود این نمرهها را خودِ متا منتشر کرده؛ بهتر بودن در یک آزمون به معنی بهتر بودن در همهچیز نیست.
منبع: https://research.meta.ai/blog/introducing-muse-spark-1-3
Forwarded fromAmin

5
1September 3, 2026 1.4K 11