مقالات واضحة عن النماذج، مع روابط للمصادر وبطاقات النماذج والمستودعات والمواد البصرية.
يحلل هذا المقال SFC-Locoformer بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Boogu-Image 0.1 بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال SenseNova-U1 Infographic V2 بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال LongCat-AudioDiT 3.5B بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال AudioSep-Hive بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال BandIt and TIGER-DnR بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال MossFormer2 and TIGER-speech بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Specialist audio-to-MIDI بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال MuScriptor-large بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Qwen-Image, Z-Image and FLUX.2 Klein بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال BiRefNet, Moebius, VOSR and DDColor بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال dots.tts بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال SoulX-Singer and YingMusic-Singer-Plus بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال HQ-SVC and YingMusic-SVC بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Beat This! بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Demucs v3 for saxophone بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Qwen3-TTS, Fish S2 Pro, MOSS-TTS and VoxCPM2 بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
يحلل هذا المقال Vevo2 بالرجوع إلى البنية والمواد المنشورة والنتائج المعلنة وحدود المقارنة.
تستخدم أداة TelkNet الحالية لأربعة مسارات Huge-SCNet-4stems V1.2 لتقسيم المكس الكامل إلى أصوات وطبول وباس ومسارات أخرى. يشرح المقال الاختيار عبر تاريخ MSS وحدود Mel-Band RoFormer ونمذجة SCNet حسب النطاقات الفرعية والنتائج العامة.
أصدرت Krea AI نموذجي Krea 2 Raw وKrea 2 Turbo كأوزان مفتوحة. يصف التقرير التقني Krea 2 كنموذج انتشار نص-إلى-صورة بحجم 12B دُرّب من الصفر، ويعرض تفاصيل ترشيح البيانات، ومسار caption، وما بعد التدريب، والتعلم المعزز، وحدود السلامة والترخيص.
ChordEdit ورقة CVPR 2026 Oral / Best Student Paper Honorable Mention. تعالج تحرير الصور الموجه بالنص في خطوة واحدة كمشكلة نقل أمثل ديناميكي بين source prompt وtarget prompt، ثم تستخدم Chord Control Field لتقليل انجراف عالي الطاقة قد يشوه الأجسام والخلفيات. يعرض المقال الطريقة كسطح تحرير صور مع source_prompt وtarget_prompt وseed وsample count وtime-window وstep-scale من العرض الرسمي.
أصدرت Zyphra نموذج ZONOS2 بترخيص Apache-2.0: إجمالي 8B مع نحو 900M نشطة في MoE TTS وأكثر من 6M ساعة كلام. يعرضه TelkNet كأداة ZONOS2 Voice Cloning TTS.
موجز محدث مع رسوم Google الرسمية حول زمن الاستجابة المنخفض، وتحكم MIDI/النص/الصوت، وبنية 2.4B/230M، ومتطلبات العتاد وحدود MRT2.