Muse Image من Meta يصل إلى الواجهة البرمجية: يفكّر قبل أن يرسم، بسنت واحد للصورة
كل استدعاء يبحث في الويب ويحسّن المخرجات عبر تمريرات متكرّرة، مع تقييم إضافي للطلب في العناصر الدقيقة مثل الرسوم البيانية ورموز QR. التوليد والتحرير في نموذج واحد.
أتاحت Meta نموذجها لتوليد الصور Muse Image للمطوّرين عبر Meta Model API. ويبدأ السعر من 0.01 دولار للصورة عند أحجام الإنتاج.
وادّعاء النموذج أنه لا يأخذ الطلب ويرسم مباشرةً. فبحسب رواية Meta، يتصرّف Muse Image كوكيل: يبحث في الويب عند كل استدعاء، ويحسّن المخرجات عبر تمريرات متكرّرة، ويقيّم الطلب على حدة في العناصر التي لا تحتمل الخطأ مثل الرسوم البيانية ورموز QR. وهذه بالضبط نقطة الضعف المعروفة في توليد الصور، إذ تخرج النصوص والجداول والرموز غير مقروءة في معظم النماذج.
والنقطة الثانية أنه نموذج واحد. فتحويل النصّ إلى صورة، وتحرير صورة مفردة، وتحرير صور متعدّدة، والتأليف من مراجع متعدّدة، كلّها مجموعة في مكان واحد. وتصوغ Meta ذلك هكذا: لا حاجة إلى مسار متعدّد الخطوات يجمع هذه القدرات.
وصدر الإعلان عن حساب Meta for Developers وشاركته AI at Meta.
التفاصيل على Meta for Developers.