۲۸ شهریور ۱۴۰۵

اکسنچر برای استقرار ارزیابان ایمنی در آنتروپیک توافق کرد

اکسنچر برای استقرار ارزیابان ایمنی در آنتروپیک توافق کرد

اکسنچر و آنتروپیک برای استقرار تیم ارزیابی در داخل شرکت سازنده مدل توافق کردند؛ هرکدام انتظار دارند طی پنج سال دست‌کم یک میلیارد دلار برای ایمنی هوش مصنوعی سرمایه‌گذاری کنند. این برنامه، هزینه انجام‌شده یا تضمین ایمنی نیست. هم‌زمان، کالیفرنیا برای پیشنهادهای نظارت مستقل مهلت تعیین کرد و میشل بومن در بحث نظارت بانکی بر فاصله شناخت خطر و اقدام تأکید گذاشت. جدا از این تحولات، نرخ هدف جدید بانک ژاپن از ۲۴ سپتامبر اجرا می‌شود. تحلیل ژرف توضیح می‌دهد چرا دسترسی ارزیاب، اختیار تصمیم‌گیری و شواهد اقدام اصلاحی را باید جدا سنجید.


تحلیل ژرف

اکسنچر و آنتروپیک در ۱۸ سپتامبر برای تشکیل تیمی از ارزیابان در داخل آنتروپیک توافق کردند. این تیم قرار است مدل‌ها، رفتار آن‌ها و حفاظ‌های ایمنی را بررسی کند. خبر اصلی صرفاً اضافه شدن یک پیمانکار نیست؛ محل بررسی به جایی نزدیک‌تر می‌شود که مدل ساخته می‌شود. از نگاه ژرف، ارزش این تغییر به پرسشی عملی بستگی دارد: اگر ارزیاب مشکلی جدی پیدا کند، چه کسی باید واکنش نشان دهد و چه مدرکی از آن واکنش باقی می‌ماند؟ اعلام همکاری هنوز پاسخ کامل این پرسش نیست.

دو شرکت اعلام کرده‌اند که هرکدام انتظار دارند طی پنج سال دست‌کم یک میلیارد دلار برای ایمنی هوش مصنوعی سرمایه‌گذاری کنند. این ارقام، هزینه انجام‌شده یا مبلغ قرارداد فروش اکسنچر نیستند. همچنین نمی‌توان آن‌ها را درآمد تضمین‌شده یا صرفه‌جویی مشتریان دانست. برای فهم اقتصادی توافق باید بعداً روشن شود چه مقدار منابع صرف نیروی متخصص، زیرساخت آزمایش و خدمات مستمر می‌شود. اختصاص بودجه می‌تواند ظرفیت بررسی را بیشتر کند، اما تعداد کارشناسان به‌تنهایی نشان نمی‌دهد بررسی‌ها چه خطاهایی را کشف کرده‌اند یا کدام تصمیم انتشار را تغییر داده‌اند.

برای یک خریدار سازمانی، تفاوت دسترسی و اختیار در یک مثال فرضی روشن می‌شود. فرض کنید ارزیاب ببیند عامل هوش مصنوعی می‌تواند سندی خارج از پرونده مجاز مشتری را بخواند. گزارش این مسئله فقط آغاز کار است: باید نسخه مدل، مجوزهای ابزار، مسیر دسترسی و شرایط تکرار خطا مشخص باشد. سپس مسئول محصول باید درباره محدود کردن دسترسی یا تأخیر در انتشار تصمیم بگیرد. نتیجه قابل اتکا زنجیره‌ای از شواهد و تصمیم‌هاست، نه صرفاً نام یک شرکت ارزیابی در قرارداد. این مثال درباره محصول یا حادثه مشخصی در آنتروپیک نیست.

در همان روز، گوین نیوسام فرمان اجرایی N-9-26 را در کالیفرنیا امضا کرد. متن فرمان، ارائه پیشنهادهایی درباره حضور ارزیابان مستقل در آزمایشگاه‌ها و امکان توقف اضطراری مدل‌ها را تا ۱۶ نوامبر ۲۰۲۶ می‌خواهد. مهلت انتشار شرایط درخواست و معیارهای سازمان‌های راستی‌آزمایی نیز ۱ مه ۲۰۲۷ تعیین شده است. بنابراین نباید دستور تهیه پیشنهاد را با الزام فوری همه آزمایشگاه‌ها یا ساخته شدن یک کلید توقف اشتباه گرفت. بیانیه سیاسی فرمانداری بر سرعت اقدام تأکید دارد؛ برای تشخیص تعهد فعلی، متن امضاشده و مهلت‌های آن سند دقیق‌تری است.

اهمیت عملی پیشنهاد توقف اضطراری در خود واژه «توقف» پنهان است. در یک سامانه فرضی، قطع تولید پاسخ لزوماً پرداختی را که قبلاً ارسال شده یا کاری را که در صف اجرا مانده لغو نمی‌کند. بررسی جدی باید مشخص کند کدام مجوزها پس گرفته می‌شوند، چه فعالیتی ادامه می‌یابد و چه کسی بازگشت به کار را تأیید می‌کند. این‌ها پرسش‌های فنی ژرف برای ارزیابی پیشنهاد آینده‌اند، نه قابلیت‌هایی که فرمان کالیفرنیا اکنون ایجاد کرده باشد. کسب‌وکارها نباید وجود یک برنامه سیاست‌گذاری را به معنای آماده بودن ابزار مهار در محصول خریداری‌شده بگیرند.

استقلال ارزیاب هم باید در تصمیم‌های روزمره دیده شود. آیا می‌تواند موضوع آزمون را خودش انتخاب کند، نتیجه نامطلوب را ثبت کند و اختلاف نظرش را بدون حذف شدن از گزارش توضیح دهد؟ از سوی دیگر، دسترسی بی‌قید به اطلاعات مشتریان هم راه‌حل مناسبی نیست. قرارداد باید حفاظت از داده را از محدود کردن نقد فنی جدا کند. نزدیکی به تیم سازنده می‌تواند شناخت مسئله را بهتر کند، اما خطر عادت کردن به فرض‌های همان تیم را هم دارد. این دو احتمال با اعلام همکاری حل نمی‌شوند؛ باید در روش کار و گزارش‌های واقعی سنجیده شوند.

خبر مالی مرتبط با مسئله اختیار، در سخنرانی ۱۸ سپتامبر میشل بومن درباره بررسی مستقل ورشکستگی سیلیکون‌ولی‌بنک دیده می‌شود. بومن با استناد به یافته‌های مقدماتی گروه استارلینگ گفت ناظران از آسیب‌پذیری‌ها آگاه بودند یا باید می‌بودند، اما اقدام قاطع و به‌موقع نکردند؛ ابهام در اختیار تصمیم‌گیری و فرهنگ پرهیز از ریسک از عوامل مطرح‌شده بود. او گزارش‌های ماهانه برای ارجاع نگرانی‌ها به مدیران نظارت را اعلام کرد. این روایتِ بومن از بررسی مقدماتی است، نه نتیجه نهایی مورد توافق همه نهادها. ورشکستگی سال ۲۰۲۳ نیز در این گزارش به هوش مصنوعی نسبت داده نمی‌شود.

بومن در سخنرانی جداگانه‌ای همان روز، اصلاحات در دست بررسی آزمون تنش بانک‌ها را توضیح داد: شفافیت بیشتر مدل‌ها و میانگین‌گیری از دو آزمون سالانه برای تعیین حاشیه سرمایه ناشی از تنش. او همچنین آزمون‌های نظارتی آینده‌نگری را مطرح کرد که نتایجشان عمومی نمی‌شود و الزام سرمایه را تغییر نمی‌دهد. این‌ها دو کاربرد متفاوت آزمون‌اند؛ یکی در محاسبه سرمایه نقش دارد و دیگری برای یافتن آسیب‌پذیری به کار می‌رود. هیئت فدرال رزرو هنوز باید اصلاحات را بررسی کند. وعده کاهش نوسان الزام سرمایه را نباید با نتیجه اندازه‌گیری‌شده یک مقررات نهایی اشتباه گرفت.

مقایسه بانک و آزمایشگاه هوش مصنوعی از نظر ژرف فقط در همین حد مفید است: کشف خطر، تعیین مسئول تصمیم و اقدام اصلاحی سه کار جدا هستند. نمی‌توان نسبت‌های سرمایه بانکی را مستقیماً به معیار ایمنی یک مدل تبدیل کرد. برای خریدار نرم‌افزار، پرسش مناسب‌تر این است که گزارش ارزیاب دقیقاً برای چه تصمیمی تهیه شده است؛ انتخاب فروشنده، اجازه دسترسی به داده یا پذیرش یک نسخه تازه؟ ممکن است گزارشی برای یکی از این تصمیم‌ها مفید باشد و برای دیگری کافی نباشد. عنوان کلی «ارزیابی‌شده» این تفاوت را پنهان می‌کند.

در خبری مستقل از بحث نظارت، بانک ژاپن در ۱۸ سپتامبر با رأی هفت به دو نرخ هدف وام شبانه بدون وثیقه را حدود ۱٫۲۵ درصد تعیین کرد؛ اجرای آن از ۲۴ سپتامبر است. بانک، تقاضای هوش مصنوعی را هم پشتیبان رشد و هم یکی از عوامل فشار قیمت، در کنار نفت و نرخ ارز، می‌داند. این تصمیم واکنشی به توافق اکسنچر نیست و نرخ هدف بانک مرکزی نیز نرخ وام یک پروژه خاص محسوب نمی‌شود. برای مدیر مالی، رشد تقاضا و تغییر هزینه تأمین مالی باید جداگانه در بودجه دیده شوند؛ خبر تقاضای بیشتر به‌خودی‌خود وعده حاشیه سود بالاتر نیست.

اکنون باید به شواهد مشخص بعدی توجه کرد: شرح وظایف تیم اکسنچر، محدوده آزمون‌ها، نحوه ثبت اختلاف نظر و گزارش اقدام پس از کشف مشکل؛ سپس پیشنهادهای کالیفرنیا در مهلت نوامبر و تصمیم‌های رسمی فدرال رزرو. برای تیم‌های فارسی‌زبان، نتیجه کاربردی این است که از فروشنده توضیح روشن درباره زبان، داده و نسخه تحت بررسی بخواهند، نه اینکه از این توافق پشتیبانی فارسی یا دسترسی تجاری در ایران را نتیجه بگیرند. جمع‌بندی ژرف محدود اما مهم است: آوردن ارزیاب به داخل سازمان می‌تواند دید بهتری بسازد؛ اعتماد زمانی بیشتر می‌شود که اثر آن دید در تصمیم‌ها قابل پیگیری باشد.


منابع و اسناد

  1. 01Accenture and Anthropic Partner to Build Team of Embedded Evaluators at AnthropicAccenture · ۲۷ شهریور ۱۴۰۵
  2. 02Executive Order N-9-26Governor of California · ۲۷ شهریور ۱۴۰۵
  3. 03Governor Newsom issues executive order to accelerate independent oversight and advance the creation of an AI kill switchGovernor of California · ۲۷ شهریور ۱۴۰۵
  4. 04Initial Findings from Independent Review of Silicon Valley BankFederal Reserve Board · ۲۷ شهریور ۱۴۰۵
  5. 05The Final Chapter on Modernizing Bank Regulatory Stress TestingFederal Reserve Board · ۲۷ شهریور ۱۴۰۵
  6. 06Change in the Guideline for Money Market OperationsBank of Japan · ۲۷ شهریور ۱۴۰۵

برچسب‌ها

آنتروپیکاکسنچرایمنی هوش مصنوعیارزیابی مستقلنظارت بانکیسیاست پولی

اخبار مرتبط

لاما سی‌پلاس‌پلاس با ادغام محاسبات، بعضی آزمون‌های مک را سریع‌تر کرد
۲۹ شهریور ۱۴۰۵منبع: ggml-org

لاما سی‌پلاس‌پلاس با ادغام محاسبات، بعضی آزمون‌های مک را سریع‌تر کرد

توسعه‌دهندگان لاما سی‌پلاس‌پلاس در ۱۹ سپتامبر مجموعه‌ای از تغییرات اجرای مدل روی پردازنده‌های گرافیکی اپل را به کد اصلی افزودند. در آزمون گزارش‌شده برای یک مدل، سرعت تولید متن روی M2 Ultra حدود ۱۶ درصد بالا رفت؛ اما ادغامی دیگر پس از کاهش سرعت کنار گذاشته شد. پیام این تغییر، سودمند بودن ادغام‌های مشخص است، نه سریع‌تر شدن همه مدل‌ها یا اثبات کاهش هزینه. اصلاح جداگانه‌ای در مسیر کودا نیز به خطای حافظه پرداخت. در بخش اقتصاد، تولید صنعتی آمریکا در اوت ثابت ماند و انتظار تورمی یک‌ساله مصرف‌کنندگان منطقه یورو کمی افزایش یافت. فرمان تازه ویرجینیا هم دسترسی برخی مراکز داده جدید به حمایت‌های ایالتی را محدود کرد.

گوگل و انویدیا برای اتصال سریع‌تر مراکز داده، کاهش مصرف در اوج را پیشنهاد کردند
۲۶ شهریور ۱۴۰۵منبع: NVIDIA

گوگل و انویدیا برای اتصال سریع‌تر مراکز داده، کاهش مصرف در اوج را پیشنهاد کردند

گوگل، انویدیا و امرالد ای‌آی ائتلافی ساخته‌اند که می‌خواهد مراکز داده در برابر تعهد کاهش برداشت برق در زمان فشار، زودتر به شبکه وصل شوند. این اعلام هنوز به معنی برق تحویل‌شده یا قاعده الزام‌آور نیست. ژرف بررسی می‌کند چنین وعده‌ای برای موعد تحویل خدمات هوش مصنوعی چه معنایی دارد و چرا کم‌کردن برداشت از شبکه، لزوماً مصرف کل انرژی را کم نمی‌کند. رأی ۴۱۷ به ۳ مجلس نمایندگان آمریکا درباره حمایت از مشترکان، بحث پرداخت هزینه زیرساخت را جلو برده است؛ افزایش یک‌چهارم واحد درصدی نرخ بهره فدرال رزرو نیز خبر مالی مستقلی است. تصمیم تنظیم‌گر، عملکرد اندازه‌گیری‌شده و مسئولیت روشن هزینه‌ها، معیارهای بعدی‌اند؛ نه صرف حمایت شرکت‌ها.

لیکوئید کامپیوت برای ساخت بازار آتی توان پردازشی ۱۵ میلیون دلار جذب کرد
۲۵ شهریور ۱۴۰۵منبع: Liquid Compute / Business Wire

لیکوئید کامپیوت برای ساخت بازار آتی توان پردازشی ۱۵ میلیون دلار جذب کرد

لیکوئید کامپیوت روز ۱۵ سپتامبر از جذب ۱۵ میلیون دلار برای ساخت بازار توان پردازشی خبر داد؛ درخواست‌های مجوز آن نزد نهاد ناظر آمریکا هنوز در دست بررسی است. پرسش اصلی فقط تأمین سرمایه نیست: چه چیزی دو واحد ظرفیت هوش مصنوعی را آن‌قدر شبیه می‌کند که بتوان برایشان قرارداد مشترک نوشت؟ عرضه تراشه اروپای اکسلرا و نمایش اجرای نرم‌افزار AMD روی میزبان ریسک‌پنج، تفاوت دستگاه‌های پشت این بازار را نشان می‌دهد. ژرف توضیح می‌دهد چرا فرصت فروش با درآمد فرق دارد، نتیجه آزمون فروشنده معادل کاهش قبض مشتری نیست و تسویه نقدی هم دستگاهی را برای خریدار رزرو نمی‌کند. تصمیم ناظر، تعریف روشن قرارداد و شاهد معامله قابل‌اجرا، قدم‌های بعدی‌اند.

تحلیل مستقل ژرف بر پایه منابع اصلی تدوین شده است؛ برای بررسی جزئیات و زمینه کامل به پیوندهای بالا مراجعه کنید.

می‌خواهید هوش مصنوعی را در کسب‌وکار خود پیاده‌سازی کنید؟

با تیم ما تماس بگیرید و درباره راهکارهای هوش مصنوعی صحبت کنید.

تماس با ما