پلتفرم ارزیابی مدلهای زبانی ارنا (LMSYS / Text Arena) نتایج یک تحلیل آماری دقیق روی سبک نگارش مدل تازه منتشرشده Claude Opus 5.5 در مقایسه با نسخه پیشین آن (Opus 5) را در تسکهای استدلالی پیچیده منتشر کرد. طبق یافتههای این بررسی، از میان ۱۲ شاخص زبانشناختی ارزیابیشده، ۱۰ شاخص به سمت طبیعیتر شدن و خوانایی بالاتر حرکت کردهاند.
بر اساس دادههای استخراجشده، سهم واژگان محتوایی بلند از ۴۱.۷ درصد در نسخه پیشین به ۳۸.۶ درصد در Opus 5.5 کاهش یافته که پایینترین میزان در میان تمام مدلهای خانواده کلود است. همچنین میانگین طول جملات با افتی ۱۷ درصدی از ۱۲.۱۴ کلمه به ۱۰.۰۳ کلمه رسیده است که ساختار متن را صریحتر و روانتر میکند. مهمترین تحول، حذف نشانههای رفتاری کلیشهای هوش مصنوعی است؛ استفاده از خط تیره بلند (Em Dash) با کاهش ۹۵ درصدی و نقطهویرگول با کاهش ۷۳ درصدی همراه شده است.
با این حال، این کم شدن طول جملات به معنای کوتاهتر شدن کل متن نیست؛ مدل اکنون با تعداد جملات بیشتر، پاسخهای مفصلتری تولید میکند (افزایش ۶ درصدی طول کل متن) و همزمان با عبارات احتیاطی و تردیدآمیز مانند «perhaps» و «arguably» با جهشی ۹۷ درصدی از ۰.۳۹ به ۰.۷۷ در هر هزار کلمه رسیده است که تمایل بیشتر سیستم به محافظهکاری در ادعاهای علمی را نشان میدهد.
@ACCELERATIONERS



