بلاگ

بینش‌ها، آموزش‌ها و به‌روزرسانی‌های تیم ژرف

رد شواهد: آماده‌کردن سامانه هوش مصنوعی برای حسابرسی
۲۸ تیر ۱۴۰۵۱۰ دقیقه مطالعه

رد شواهد: آماده‌کردن سامانه هوش مصنوعی برای حسابرسی

سامانه آماده حسابرسی هر خروجی مهم را به ورودی، کنترل سیاست، نسخه مدل و ابزار، تأیید، اقدام و نتیجه مشاهده‌شده پیوند می‌دهد.

توافق محاسبه و شبکه: برنامه‌ریزی مسئولانه زیرساخت هوش مصنوعی
۲۷ تیر ۱۴۰۵۱۰ دقیقه مطالعه

توافق محاسبه و شبکه: برنامه‌ریزی مسئولانه زیرساخت هوش مصنوعی

برنامه‌ریزی زیرساخت هوش مصنوعی، تقاضای محاسبه را به برق، آب، ذخیره‌سازی، شبکه، انعطاف بار و تاب‌آوری محلی پیوند می‌دهد.

اقتصاد پاسخ: جست‌وجوی هوش مصنوعی و آینده نشر
۲۶ تیر ۱۴۰۵۱۰ دقیقه مطالعه

اقتصاد پاسخ: جست‌وجوی هوش مصنوعی و آینده نشر

جست‌وجوی هوش مصنوعی کشف را کوتاه می‌کند، اما اکوسیستم سالم به ارجاع، تنوع منبع، ارزش برای ناشر و مسیر بازگشت به اثر اصلی نیاز دارد.

Kimi K3؛ از حافظه GPT-2 تا عامل باز ۲٫۸ تریلیونی
۲۵ تیر ۱۴۰۵۲۰ دقیقه مطالعه

Kimi K3؛ از حافظه GPT-2 تا عامل باز ۲٫۸ تریلیونی

انتشار وزن‌باز ۲۵ تیر Moonshot معماری هیبریدی ۲٫۸ تریلیونی را با معیار قوی کد، ابزار، پژوهش و چندوجهی ترکیب می‌کند.

خط تولید مولد: ویدیوی هوش مصنوعی فراتر از نخستین کلیپ
۲۵ تیر ۱۴۰۵۱۱ دقیقه مطالعه

خط تولید مولد: ویدیوی هوش مصنوعی فراتر از نخستین کلیپ

ویدیوی خوب یک گردش‌کار تولید است: ایده، تداوم، تدوین، صدا، حقوق، بازبینی و تحویل؛ نه نتیجه یک پرامپت خوش‌شانس.

Grok 4.5؛ معیار کدنویسی، سرعت ۸۰ TPS و بهره‌وری توکن
۲۵ تیر ۱۴۰۵۷ دقیقه مطالعه

Grok 4.5؛ معیار کدنویسی، سرعت ۸۰ TPS و بهره‌وری توکن

مدل ۲۵ تیر SpaceXAI در Terminal-Bench 2.1 امتیاز ۸۳٫۳ و SWE-bench Pro امتیاز ۶۴٫۷ را با میانگین ۱۵٬۹۵۴ توکن خروجی گزارش می‌کند.

وب خصمانه: ایمن‌سازی عامل‌های مرورگر
۲۴ تیر ۱۴۰۵۱۰ دقیقه مطالعه

وب خصمانه: ایمن‌سازی عامل‌های مرورگر

عامل مرورگر در صفحه‌ای کار می‌کند که ممکن است گمراه‌کننده، آلوده یا برای تغییر رفتارش طراحی شده باشد. وب باید داده بماند، نه مرجع اختیار.

مرز تأیید: قضاوت انسانی دقیقاً کجا لازم است
۲۳ تیر ۱۴۰۵۱۱ دقیقه مطالعه

مرز تأیید: قضاوت انسانی دقیقاً کجا لازم است

طراحی انسان در حلقه زمانی مؤثر است که تأیید برای عدم قطعیت مهم نگه داشته شود و شواهد کافی برای یک تصمیم واقعی ارائه کند.

حافظه و شخصی‌سازی هوش مصنوعی: معماری مبتنی بر کنترل
۲۲ تیر ۱۴۰۵۱۳ دقیقه مطالعه

حافظه و شخصی‌سازی هوش مصنوعی: معماری مبتنی بر کنترل

راهنمای عملی ساخت حافظه هوش مصنوعی که با تغییر انسان، مجوز و ترجیح مفید بماند و هر گفت‌وگوی قدیمی را به حقیقت دائمی تبدیل نکند.

مهندسی زمینه هوش مصنوعی: معماری، امنیت و ارزیابی
۲۱ تیر ۱۴۰۵۱۲ دقیقه مطالعه

مهندسی زمینه هوش مصنوعی: معماری، امنیت و ارزیابی

چگونه از سیاست، وضعیت کار، شواهد، حافظه و ابزار، کوچک‌ترین زمینه قابل اعتماد را بسازیم و آن را در برابر تعارض، نویز و حمله بسنجیم.

ارزیابی عامل‌های کار با رایانه فراتر از تکمیل وظیفه
۲۰ تیر ۱۴۰۵۱۲ دقیقه مطالعه

ارزیابی عامل‌های کار با رایانه فراتر از تکمیل وظیفه

چارچوب ارزیابی تولیدی برای سنجش وضعیت نهایی، اثر جانبی، بازیابی، شواهد، ایمنی و عملکرد عامل رایانه در تنوع واقعی رابط.

مهندسی تأخیر استنتاج هوش مصنوعی: معیار، بودجه و بده‌بستان
۱۹ تیر ۱۴۰۵۱۳ دقیقه مطالعه

مهندسی تأخیر استنتاج هوش مصنوعی: معیار، بودجه و بده‌بستان

راهنمای عملی سنجش و کاهش تأخیر در رابط، زمینه، بازیابی، صف، prefill، تولید توکن، ابزار و راستی‌آزمایی نهایی اثر کسب‌وکار.