انتشار نسخه جدید AMD ROCm 10.1 با کلی تغییرات خفن و بهبود عملکرد

کمپانی AMD بالاخره نسخه جدید پلتفرم هوش مصنوعی و پردازشهای سنگین خودش یعنی ROCm 10.1 رو بیرون داد! اگه با کارتهای گرافیک AMD کار میکنی و حوزههایی مثل هوش مصنوعی، یادگیری ماشین و پردازشهای موازی برات مهمه، این نسخه جدید کلی امکانات خفن و بهینهسازیهای اساسی داره که کارتو خیلی راحتتر میکنه.
شرکت AMD نشون داده که خیلی جدی روی چرخه انتشار سریع برنامهریزی کرده؛ یعنی دقیقاً بعد از انتشار نسخه 10.0 در اواخر ماه اوت، حالا نوبت به نسخه 10.1 رسیده تا با کلی آپدیت جدید بترکونه. توی این نسخه، تمرکز اصلی روی سرعت، پایداری و بهبود ارتباط بین سختافزار و نرمافزار بوده تا توسعهدهندهها بتونن نهایتقدرت کارتهای گرافیک رو بکشن بیرون.
نگاهی به مهمترین تغییرات و قابلیتهای ROCm 10.1
توی این آپدیت جدید، بخشهای مختلفی دستخوش تغییر شدن که مهمترین اونها رو خیلی ساده و خودمونی با هم مرور میکنیم:
- بهبودهای hipFILE: کار با فضای ذخیرهسازی سرعت بالاتری گرفته و با داشتن یک بکاند async fast-path، یک API جدید برای I/O گروهی (batch) و آمارهای چندلایه، همهچیز خیلی روونتر اجرا میشه.
- مدیریت حافظه هوشمندتر: حالا حافظه میزبان (host memory) با استفاده از HIP کاملاً به صورت NUMA-aware تخصیص داده میشه که تأثیر مستقیمی روی کاهش تاخیر و افزایش سرعت داره.
- ابزارهای جدید CLI و مهارتهای AMD: مدیریت سیستم و کار با خط فرمان برای توسعهدهندهها خیلی مدرنتر و جذابتر شده.
- پشتیبانی از kernel replay: این قابلیت جذاب فعلاً به صورت نسخه بتا (beta) توی ابزار ROCprofiler اضافه شده تا دیباگ کردن و تحلیل عملکرد کدها راحتتر بشه.
- مهاجرت به LLVM 24: استفاده از کامپایلر بهروزتر به معنی Build سریعتر و اجرای بهینهتر کدهاست.
- بهبودهای WSL2: دوستانی که دارن روی ویندوز و از طریق لینوکسِ زیرسیستم کار میکنن، باز هم شاهد بهینهسازیهای جدیدی توی این نسخه خواهند بود.
- معرفی hipThreads: یک قابلیت فوقالعاده برای شتابدهی تدریجی به کدهای دارای Thread روی GPU.
اگر دوست داری جزئیات فنی دقیقتر، مستندات رسمی و کدهای مربوط به این نسخه رو زیر و رو کنی، میتونی به وبلاگ رسمی ROCm و همچنین صفحه مستندات AMD ROCm سر بزنی.


