
یه نکته جالب توی وبلاگ Together AI دیدم. خیلیها فکر میکنن آینده AI یعنی مدلهای بزرگتر و باهوشتر. ولی چیزی که شرکتهایی مثل Together دارن روش کار میکنن، بیشتر اینه: اجرای سریعتر و ارزانتر مدلها. تحقیقهایی مثل: FlashAttention DeepCoder DeepSWE همه روی یه مسئله تمرکز دارن: چطور مدلها رو در مقیاس واقعی اجرا کنیم ⚡ چون در عمل مشکل خیلی از پروژههای AI این نیست که مدل جواب بده… مشکل اینه که اجرای اون جواب چقدر هزینه و زمان میبره. به زبان ساده: 🧠 هوش مدل مهمه ⚙️ ولی زیرساخت اجرا تعیین میکنه که اون هوش واقعاً قابل استفاده هست یا نه. منبع: Together AI Blog کنجکاوم بدونم نظر شما چیه 👀 بزرگترین گلوگاه AI الان خود مدلهاست یا زیرساخت اجرا (Inference)؟




