انجمن علمی زبان‌شناسی دانشگاه علامه طباطبائی: post #5834 — TG.ME

#معرفی_مقاله | تازه‌ترین مقالات زبان‌شناسی

📄 عنوان مقاله:
Corpus linguistics in the age of generative AI: practical and theoretical considerations


✍️ نویسنده:
Tobias Bernaisch


📑 منتشرشده در نشریهٔ Linguistics Vanguard

📝 ترجمهٔ فارسی چکیده:

ابزارهای هوش مصنوعی مولد (Generative AI) از جنبه‌های عملی و نظری، پیامدهایی برای زبان‌شناسی پیکره‌ای دارند که هر دو جنبه در مقالهٔ حاضر بررسی می‌شوند. بخش نخست مقاله بررسی می‌کند که آیا و چگونه ابزارهای هوش مصنوعی مولد، در اینجا ChatGPT o3، می‌توانند در عمل از یک فرایند کار زبان‌شناسی پیکره‌ای شامل استخراج، پاک‌سازی و برچسب‌گذاری داده‌ها برای تناوب برایی (dative alternation) پشتیبانی کنند. اگرچه برخی مراحل این فرایند، مانند استخراج داده‌ها یا برچسب‌گذاری طول مفعول (object length)، در ChatGPT o3 با قابلیت اطمینان انجام‌پذیرند، فرایندهای دشوارتری مانند پاک‌سازی داده‌های استخراج‌شده برای شناسایی نمونه‌های مرتبط، تعیین مرزهای بند و عناصر بند، یا برچسب‌گذاری مفعول‌ها از نظر جانداری (animacy)، با خطاها و ناهماهنگی‌هایی همراه‌اند. حتی افزودن مراحلی با هدف تسهیل پشتیبانی هوش مصنوعی از فرایند کار زبان‌شناسی پیکره‌ای نیز نمی‌تواند این مشکلات را برطرف کند. بخش دوم مقاله به نظریهٔ زبان‌شناسی پیکره‌ای مربوط می‌شود و بررسی می‌کند که آیا و چگونه متن‌های تولیدشده به‌وسیلهٔ هوش مصنوعی باید در پیکره‌های زبانی بازنمایی شوند. مقاله استدلال می‌کند که مفاهیم اصالت (authenticity) و نمایندگی (representativeness)، که از ویژگی‌های اساسی پیکره‌های زبانی به شمار می‌روند، با گنجاندن متن‌های تولیدشده به‌وسیلهٔ هوش مصنوعی در پیکره‌های زبانی سازگارند. از آنجا که چنین ادغامی نشان‌دهندهٔ فاصله‌گرفتن از سنت زبان‌شناسی پیکره‌ای است، استدلال‌های مختلف موافق و مخالف گنجاندن متن‌های تولیدشده به‌وسیلهٔ هوش مصنوعی، و در نهایت، پیشنهادی عملی و واقع‌گرایانه برای پروژه‌های پیکره‌ای آینده ارائه می‌شود.

(🤖 ترجمه‌شده با هوش مصنوعی، GPT-5.6 Luna)



🔗 دریافت مقاله:
https://doi.org/10.1515/lingvan-2025-0207


🔹 انجمن علمی دانشجویی زبان‌شناسی دانشگاه علامه طباطبائی | @LAATU
August 22, 2026 589 12