پیوست یازده: مستندات فنی موضوع ماده 53(1)، بند (a) – مستندات فنی برای ارائهدهندگان مدلهای هوش مصنوعی عمومی (General-Purpose AI Models)
بخش 1 – اطلاعاتی که باید توسط همه ارائهدهندگان مدلهای هوش مصنوعی عمومی ارائه شود
مستندات فنی موضوع ماده 53 (1)، بند (a) باید حداقل شامل اطلاعات زیر باشد، متناسب با اندازه و سطح ریسک مدل:1. یک توصیف عمومی از مدل هوش مصنوعی عمومی شامل:
(a) وظایفی که مدل برای انجام آنها طراحی شده است و نوع و ماهیت سیستمهای هوش مصنوعی که مدل میتواند در آنها ادغام شود؛
(b) سیاستهای استفاده قابل قبول (acceptable use policies) که اعمال میشوند؛
(c) تاریخ انتشار و روشهای توزیع؛
(d) معماری و تعداد پارامترها؛
(e) شیوه (modalities) (برای مثال متن، تصویر) و قالب ورودیها و خروجیها؛
(f) مجوز (licence).
2. یک توصیف تفصیلی از عناصر مدل موضوع بند 1 و اطلاعات مربوط به فرآیند توسعه، شامل عناصر زیر:
(a) ابزارهای فنی (برای مثال دستورالعملهای استفاده، زیرساخت، ابزارها) مورد نیاز برای ادغام مدل هوش مصنوعی عمومی در سیستمهای هوش مصنوعی؛
(b) مشخصات طراحی مدل و فرآیند آموزش، شامل روشها و تکنیکهای آموزشی، انتخابهای کلیدی طراحی همراه با دلایل و فرضیات مربوطه؛ اینکه مدل برای بهینهسازی چه چیزی طراحی شده و نقش پارامترهای مختلف؛ در صورت قابل اعمال بودن؛
(c) اطلاعات مربوط به دادههای مورد استفاده برای آموزش، آزمون و اعتبارسنجی، در صورت قابل اعمال بودن، شامل نوع و منشأ دادهها و روشهای آمادهسازی (مانند پاکسازی، فیلتر کردن و غیره)، تعداد نقاط داده، دامنه و ویژگیهای اصلی آنها؛ نحوه جمعآوری و انتخاب دادهها، و سایر اقدامات برای شناسایی نامناسب بودن منابع داده و روشهای تشخیص سوگیریهای قابل شناسایی، در صورت قابل اعمال بودن؛
(d) منابع محاسباتی مورد استفاده برای آموزش مدل (برای مثال تعداد عملیات ممیز شناور)، زمان آموزش، و سایر جزئیات مرتبط با آموزش؛
(e) مصرف انرژی شناختهشده یا برآوردشده مدل. در رابطه با بند (e)، در صورتی که مصرف انرژی مدل ناشناخته باشد، میتواند بر اساس اطلاعات مربوط به منابع محاسباتی استفادهشده برآورد شود.
.jpg)
بخش 2 – اطلاعات اضافی که باید توسط ارائهدهندگان مدلهای هوش مصنوعی عمومی دارای ریسک سیستمی ارائه شود
1.
توصیف تفصیلی از استراتژیهای ارزیابی، شامل نتایج ارزیابی، بر اساس پروتکلها و ابزارهای ارزیابی عمومی موجود یا سایر روشهای ارزیابی.
استراتژیهای ارزیابی باید شامل معیارهای ارزیابی، شاخصها (metrics) و روش شناسایی محدودیتها باشد.
2.
در صورت قابل اعمال بودن، توصیف تفصیلی اقدامات اتخاذشده برای انجام آزمونهای خصمانه داخلی و/یا خارجی (برای مثال red teaming)، و همچنین تغییرات مدل شامل همراستاسازی (alignment) و تنظیم دقیق (fine-tuning).
3.
در صورت قابل اعمال بودن، توصیف تفصیلی معماری سیستم که توضیح میدهد چگونه اجزای نرمافزاری ساخته شده یا به یکدیگر متصل میشوند و در پردازش کلی ادغام میگردند.
تحلیل پیوست XI (مستندات فنی مدلهای هوش مصنوعی عمومی)
پیوست XI یکی از بخشهای کلیدی در تنظیمگری «مدلهای هوش مصنوعی عمومی» (General-Purpose AI Models) در قانون هوش مصنوعی اتحادیه اروپاست، چون دقیقاً روی جایی تمرکز میکند که قدرت واقعی این فناوری شکل میگیرد: خودِ مدل پایه (foundation model). برخلاف پیوستهای مربوط به «سیستمهای پرریسک» که بیشتر به کاربرد نهایی میپردازند، اینجا تمرکز روی خود مدل، فرآیند آموزش، معماری، دادهها و منابع محاسباتی است. به بیان ساده، این پیوست میخواهد قبل از اینکه مدل وارد هر محصول یا سرویس شود، شفافیت فنی کافی درباره “چگونگی ساخته شدن آن” وجود داشته باشد.در سطح الزامات، بخش اول پیوست عملاً یک «پروفایل فنی کامل» از مدل میطلبد: از کاربردهای هدف و نوع ورودی/خروجی گرفته تا معماری، تعداد پارامترها، مجوز استفاده و حتی سیاستهای استفاده مجاز. این سطح از جزئیات نشان میدهد که قانونگذار اروپایی میخواهد مدلهای پایه مثل یک زیرساخت عمومی قابل بررسی باشند، نه جعبه سیاه. علاوه بر این، الزام به توضیح دادههای آموزشی (منشأ، پاکسازی، فیلتر کردن، سوگیریها) مستقیماً به یکی از حساسترین نقاط مدلهای بزرگ زبانی و چندوجهی اشاره دارد؛ یعنی اینکه این مدلها «با چه دادهای جهان را یاد گرفتهاند».

نکته مهم دیگر، ورود مستقیم به موضوعات منابع محاسباتی و انرژی است. الزام به اعلام مصرف انرژی و محاسبات (مثل تعداد عملیات floating point) نشان میدهد که اتحادیه اروپا فقط به ریسکهای اخلاقی نگاه نمیکند، بلکه ابعاد زیستمحیطی و مقیاسپذیری صنعتی هوش مصنوعی را هم در نظر دارد. این رویکرد در عمل شرکتها را به سمت استانداردسازی گزارشدهی و قابلمقایسه شدن مدلها سوق میدهد.
در مجموع، پیوست XI یک چارچوب «شفافیت فنی عمیق» برای مدلهای پایه ایجاد میکند که هدفش کاهش ابهام، کنترل ریسکهای سیستمی و امکان نظارت قانونی بر فناوریهایی است که میتوانند در صدها یا هزاران سیستم مختلف استفاده شوند.
منبع: ترجمه شده توسط بخش فناوری های نوین سایت راسخون