فناوری هوش مصنوعی

مهندسی، زیرساخت و سامانه‌های نوظهور هوش مصنوعی

Grok 4.6؛ معیارها، کارت مدل، ایمنی و گردش کار عامل
۲۲ مرداد ۱۴۰۵۱۳ دقیقه مطالعه

Grok 4.6؛ معیارها، کارت مدل، ایمنی و گردش کار عامل

Grok 4.6 کار بلندمدت کدنویسی و دانش را بهبود می‌دهد؛ کارت مدل نیز جست‌وجو و مقاومت بهتر در برابر jailbreak را کنار پسرفت در واقعیت‌مندی و رفتار ثبت می‌کند.

هوش مصنوعی چیست؟ راهنمای مدیران برای فهم و تصمیم‌گیری
۱۹ مرداد ۱۴۰۵۶ دقیقه مطالعه

هوش مصنوعی چیست؟ راهنمای مدیران برای فهم و تصمیم‌گیری

پاسخ روشن به «هوش مصنوعی چیست» برای مدیران: تعریف دقیق، تفاوت یادگیری ماشین و مدل زبانی، توانایی‌ها و محدودیت‌های واقعی امروز، و چارچوب تصمیم برای استفاده در سازمان.

وقتی ارزیابی هوش مصنوعی فرار می‌کند: مهار عامل سایبری
۱۰ مرداد ۱۴۰۵۱۴ دقیقه مطالعه

وقتی ارزیابی هوش مصنوعی فرار می‌کند: مهار عامل سایبری

معماری عملی برای سنجش عامل‌های سایبری هوش مصنوعی، بدون آن‌که سندباکس ارزیابی مسیری زنجیره‌ای به سامانه‌های تولیدی پیدا کند.

کالبدشکافی شتاب ۵۳٫۶ برابری Wan2.2
۹ مرداد ۱۴۰۵۱۷ دقیقه مطالعه

کالبدشکافی شتاب ۵۳٫۶ برابری Wan2.2

بررسی فنی اینکه چگونه توجه تنک، هسته پایدار CUDA، تقطیر چهارمرحله‌ای و NVFP4 یک خط لوله ۱۳۳ ثانیه‌ای را به تولید ویدیوی نزدیک به بلادرنگ رساندند.

Gemini 3.6 Flash، Flash-Lite و Flash Cyber؛ معیار کامل خانواده
۳۰ تیر ۱۴۰۵۷ دقیقه مطالعه

Gemini 3.6 Flash، Flash-Lite و Flash Cyber؛ معیار کامل خانواده

خانواده ۳۰ تیر Google یک مدل کاری قوی‌تر، مدل حجمی با سرعت ۳۵۰ توکن و متخصص امنیت محدودشده را کنار هم می‌آورد.

Kimi K3؛ از حافظه GPT-2 تا عامل باز ۲٫۸ تریلیونی
۲۵ تیر ۱۴۰۵۲۰ دقیقه مطالعه

Kimi K3؛ از حافظه GPT-2 تا عامل باز ۲٫۸ تریلیونی

انتشار وزن‌باز ۲۵ تیر Moonshot معماری هیبریدی ۲٫۸ تریلیونی را با معیار قوی کد، ابزار، پژوهش و چندوجهی ترکیب می‌کند.

Grok 4.5؛ معیار کدنویسی، سرعت ۸۰ TPS و بهره‌وری توکن
۲۵ تیر ۱۴۰۵۷ دقیقه مطالعه

Grok 4.5؛ معیار کدنویسی، سرعت ۸۰ TPS و بهره‌وری توکن

مدل ۲۵ تیر SpaceXAI در Terminal-Bench 2.1 امتیاز ۸۳٫۳ و SWE-bench Pro امتیاز ۶۴٫۷ را با میانگین ۱۵٬۹۵۴ توکن خروجی گزارش می‌کند.

GPT-5.6؛ خانواده Sol، Terra، Luna و عامل Ultra
۱۸ تیر ۱۴۰۵۶ دقیقه مطالعه

GPT-5.6؛ خانواده Sol، Terra، Luna و عامل Ultra

خانواده ۱۸ تیر OpenAI مدل پرچم‌دار، متعادل و اقتصادی را با معیارهای پیشرو ترمینال، کد، مرور و علم و یک رده چندعاملی عرضه می‌کند.

Robostral Navigate؛ مسیریابی ربات با یک دوربین
۱۷ تیر ۱۴۰۵۷ دقیقه مطالعه

Robostral Navigate؛ مسیریابی ربات با یک دوربین

مدل تجسم‌یافته ۸ میلیاردی Mistral در ۱۸ تیر با یک دوربین RGB به موفقیت ۷۶٫۶ درصدی R2R-CE دیده‌نشده رسید.

Tencent Hy3؛ مدل MoE باز ۲۹۵B با ۲۱B فعال
۱۵ تیر ۱۴۰۵۶ دقیقه مطالعه

Tencent Hy3؛ مدل MoE باز ۲۹۵B با ۲۱B فعال

مدل Apache-2.0 در ۱۵ تیر بازخورد preview را به مسیر فعال کوچک، عامل قوی‌تر، زمینه ۲۵۶K و پایداری عملی محصول تبدیل می‌کند.

Claude Sonnet 5؛ عامل نزدیک Opus با اقتصاد Sonnet
۹ تیر ۱۴۰۵۶ دقیقه مطالعه

Claude Sonnet 5؛ عامل نزدیک Opus با اقتصاد Sonnet

مدل ۹ تیر آنتروپیک کد، ترمینال، جست‌وجو، رایانه و کار دانشی را ارتقا می‌دهد و effort را به کنترل هزینه-عملکرد تبدیل می‌کند.

Mistral OCR 4؛ هوش سند ساخت‌یافته
۲ تیر ۱۴۰۵۶ دقیقه مطالعه

Mistral OCR 4؛ هوش سند ساخت‌یافته

مدل ۲ تیر میسترال، کادر، نوع بلوک، اطمینان، ۱۷۰ زبان، خودمیزبانی و امتیازهای پیشرو را همراه نقد صریح محدودیت بنچمارک عرضه می‌کند.