از هوش مصنوعی Sana رونمایی شد ، تولید عکس در سریع ترین زمان
انویدیا و MIT از هوش مصنوعی Sana رونمایی کردند؛ تولید تصویر با وضوح بالا در چند ثانیه
محققان انویدیا، دانشگاه MIT و «دانشگاه چینهوا» چین مدل هوش مصنوعی جدیدی با نام Sana معرفی کردهاند که میتواند در چند ثانیه تصاویری با وضوح ۴۰۹۶ در ۴۰۹۶ پیکسل تولید کند.
محققان در صفحه گیتهاب Sana توضیح میدهند برخلاف مدلهای هوش مصنوعی قدیمی که تصاویر را ۸ برابر فشرده میکنند، Sana میتواند تصاویر را ۳۲ برابر فشرده کند و تعداد توکنهای موردنیاز را کاهش بدهد.
علاوهبراین، Sana از مدل زبانی Gemma بهجای رمزگذار متن خود برای بهبود عملکرد درک و استنتاج سریع استفاده میکند. محققان همچنین برای کاهش مراحل نمونهگیری آن از مکانیزمی با نام «Flow-DPM-Solver» استفاده کردهاند که اساساً تعداد مراحل نمونهگیری را از ۲۸-۵۰ به ۱۴-۲۰ کاهش میدهد.

