VIDEO·CODEC
الفيديو · العقدة 10
↩ البوابة

القمّة + الجسرالفلسفة المشتركة

الفلسفة المشتركة والجسر

أنت في القمّة. الفيديو ليس وحشاً جديداً — هو صورة + بُعد الزمن، يطيع القوانين نفسها التي تحكم الصور والصوت، مع لبنةٍ واحدة عبقرية يضيفها: التنبّؤ عبر الزمن.

فيديو = نموذج × مرمّز × حاوية — مع بُعد الزمن

الطبقةالصورةالفيديو (= صورة + زمن)
النموذج (يخفض الإنتروبي)تنبّؤ مكاني (Paeth/intra) + DCT+ تنبّؤ زمنيّ (تعويض حركة)
المرمّز (يبلغ H)Huffman/CABAC/ANSCABAC (نفسه)
الحاويةchunks/boxesISOBMFF/MP4 (+ GOP، توقيتات، تزامن صوت)
استغلال الحاسّةعمى العين المكاني+ عمى العين الزمنيّ (الحركة تخفي التفاصيل)
اللبنة الوحيدة الجديدة فعلاً

كل شيء في الفيديو إمّا مستعار من الصورة (DCT، تكميم، intra، CABAC، الحاوية) أو من نظرية المعلومات (الإنتروبي، RD). الإضافة الوحيدة الجوهرية هي التنبّؤ عبر الزمن (تعويض الحركة) — لكنه بنيوياً نفس "التنبّؤ من السياق" (Paeth مكانياً، LPC زمنياً في الصوت)، فقط السياق هنا = إطار آخر. لا وحش جديد، بُعدٌ جديد للبنة قديمة.

القوانين الخمسة — تصمد عبر الوسائط الثلاث

  1. وسيط = نموذج × مرمّز × حاوية، فوق سقف الإنتروبي.
  2. الخسارة = استغلال عمى الحاسّة (العين مكانياً وزمنياً، الأذن طيفياً).
  3. الإنتروبي سقفٌ، والنموذج ساحة المعركة. المرمّز بلغ حدّه (CABAC/ANS)؛ المكاسب في النموذج (تنبّؤ أذكى، عصبيّ).
  4. القانون والسياسة يصمّمان الصيغ. HEVC المثقل بالبراءات ↔ AV1 الحرّ — في الفيديو والصور (AVIF) معاً.
  5. المقايضات لا تختفي، تنتقل. GOP، البحث عن الحركة، RD، الترميز البطيء مقابل الفكّ السريع.

الجسر الكبير — الوسائط الثلاث أداةٌ واحدة

FIG 1 الأدوات المشتركة عبر الصورة والصوت والفيديو
الأداةصورةصوتفيديو التحويل الترددياستغلال الحاسّة التنبّؤ من السياقترميز الإنتروبي التكميمالنموذج العصبيّ DCTFFT/MDCTDCT للباقي العين (Y/C,gamma)الأذن (masking)العين+الزمن Paeth/intraLPCتعويض الحركة Huffman/ANSHuffman/RiceCABAC جدول Qلكل نطاقQP + RD صيغ مُتعلَّمةEnCodec/RVQكوديك عصبيّ صفٌّ واحد = أداة واحدة بثلاثة تجسيدات. تعلّمها مرّة، تستعملها ثلاثاً.
الأدوات هي ذاتها. الفرق في الحاسّة المُستغَلّة (عين/أذن) والأبعاد (مكان/زمن/طيف). من أتقن واحدةً يشتقّ البقية.
العدسة الموحّدة — استعملها على أي وسيط جديد

أمام أي صيغة/كوديك (3D، نقاط سحابية، إشارات حيوية…) اسأل: ما "الهواء" (التكرار)؟ مكانيّ؟ زمنيّ؟ طيفيّ؟ ما النموذج؟ ما المرمّز؟ ما الحاسّة المُستغَلّة؟ أين دفعت المقايضة؟ هذه العدسة بنيتها عبر ثلاثة مسارات — وهي تعمل على ما لم تره بعد. استعرض المسارات: الصور · الصوت · الفيديو.

  1. فكّك كوديكاً لم ندرسه: VP9 أو VVC أو Theora. فكّكه لـ(نموذج زمنيّ + نموذج مكانيّ + مرمّز + حاوية). أين يقع في الجدول؟
  2. صمّم كوديكاً: لحالة "مكالمة فيديو بنطاق ضيّق وزمن استجابة منخفض". اختر: طول GOP؟ B-frames؟ مستوى البحث؟ معدّل ثابت أم متغيّر؟ برّر كلاً بالمقايضات.
  3. اربط الوسائط الثلاث: اكتب صفحة تملأ جدول FIG 1 من ذاكرتك، وتشرح بُعد كل وسيط (مكان/+طيف/+زمن). إن استطعت، فقد اكتملت العدسة فيك.
  4. المشروع الكبير: ركّب كوديك فيديو مصغّراً كاملاً من تمارينك (I/P + حركة + DCT للباقي + حلقة + RD + deblock). اضغط مقطعاً، فكّه، وقِس معدّل البِت والجودة. صنعت كوديكاً من الصفر.
الخلاصة — اكتمل المسار والجسر

الفيديو = صورة + زمن، يطيع القوانين الخمسة، ويضيف لبنةً واحدة (التنبّؤ الزمنيّ). الأدوات مشتركة عبر الوسائط الثلاث؛ الفرق في الحاسّة والأبعاد. تملك الآن عدسةً تفكّك بها أي وسيط، وتبني فلاتر، وتدرّب نماذج، وتصمّم كوديكات. عُد للبوابة لترى الصورة الكاملة.