آنتروپیک بهتازگی یک روش نوآورانه برای بررسی فرآیندهای درونی مدلهای زبانی بزرگ (LLMs) معرفی کرده که به پژوهشگران کمک میکنه دقیقتر بفهمن مدل چطور به خروجیهاش میرسه. این روش با عنوان Attribution Graphs یا «گرافهای انتساب» ارائه شده و بهصورت متنباز (open-source) در دسترس عموم قرار گرفته.
گرافهای انتساب ساختارهایی بصری هستن که نشون میدن مدل در پاسخ به یک پرامپت، چه گامهایی رو برداشته و کدوم بخشهای داخلی (مثل نورونها، لایهها یا توکنها) بیشترین نقش رو در تولید هر بخش از پاسخ داشتن.
این گرافها به شما این امکان رو میدن که:
برای ساخت و مشاهده این گرافها، میتونید از ابزار NeurON Pedia استفاده کنید. این ابزار به شما کمک میکنه گرافهای انتساب مخصوص پرامپتهای خودتون رو بسازید و تحلیل کنید.
این پروژه با اهداف زیر توسعه داده شده:
➖➖➖➖➖➖➖➖➖➖➖



