أعلنت شركة أدوبي عن دخولها مجال توليد الفيديو بالذكاء الاصطناعي من خلال إطلاق نموذج Firefly Video الجديد، وذلك خلال مؤتمر “Adobe Max”. يقدم هذا النموذج مجموعة من الأدوات المبتكرة التي تتيح للمستخدمين إنشاء مقاطع فيديو بسهولة وفاعلية.
أدوبي تطلق نموذج Firefly Video لتوليد الفيديو بالذكاء الاصطناعي
تتيح أدوبي للمستخدمين استخدام نموذج Firefly Video عبر مجموعة من الأدوات الجديدة، بما في ذلك أدوات ضمن برنامج تحرير الفيديو الشهير “بريميير برو”. من خلال هذه الأدوات، يمكن للمستخدمين تمديد مقاطع الفيديو الحالية وإنشاء لقطات جديدة بناءً على الصور الثابتة والوصف النصي.
أدوبي تطلق نموذج Firefly Video لتوليد الفيديو بالذكاء الاصطناعي
أداة التمديد التوليدي
تقدم أدوبي أداة جديدة تُعرف باسم “التمديد التوليدي Generative Extend” في إصدار تجريبي داخل برنامج “بريميير برو”. تتيح هذه الأداة للمستخدمين تمديد بداية أو نهاية مقطع فيديو قصير، كما يمكن استخدامها لإجراء تعديلات على حركة العينين أو التصحيح للحركة غير المتوقعة. ومع ذلك، تقتصر هذه الأداة على تمديد المقاطع حتى ثانيتين كحد أقصى، مما يجعلها مناسبة للتعديلات البسيطة فقط.
تحسين الصوت وإمكانيات الفيديو
يمكن للأداة إنتاج مقاطع بدقة 720 أو 1080 بكسل وبسرعة 24 إطارًا في الثانية. كما يمكن استخدامها لتحسين الصوت من خلال تمديد المؤثرات الصوتية والأصوات المحيطة حتى عشر ثوانٍ، لكن لا تدعم الأداة تمديد الحوار أو الموسيقى.
طرحت أدوبي أيضًا أداتي “تحويل النص إلى فيديو Text-to-Video” و”تحويل الصورة إلى فيديو Image-to-Video” في إصدار تجريبي. تعمل أداة تحويل النص إلى فيديو عن طريق إدخال وصف نصي لما يرغب المستخدم في إنشائه، مع إمكانية اختيار أنماط متنوعة، مثل الأفلام الواقعية والرسوم المتحركة الثلاثية الأبعاد. يمكن تخصيص المخرجات باستخدام أدوات تحكم الكاميرا لمحاكاة زوايا متنوعة وحركات تصوير مختلفة.
فيما تتيح أداة تحويل الصورة إلى فيديو إدخال صورة مرجعية بجانب الوصف النصي، مما يوفر مزيدًا من التحكم في النتائج ويعزز إمكانية إنشاء لقطات إضافية من الصور أو تصور مشاهد جديدة.
حدود زمنية وجودة المقاطع
حالياً، تصل مدة المقاطع التي يمكن توليدها باستخدام أدوات Firefly إلى 5 ثوانٍ فقط، مع جودة قصوى تبلغ 720 بكسل وسرعة 24 إطارًا في الثانية. بالمقارنة، يتمكن نموذج توليد الفيديو Sora من OpenAI من إنتاج مقاطع تصل مدتها إلى دقيقة، لكن هذا النموذج لا يزال غير متاح للجمهور.
سرعة الإنتاج والسلامة التجارية
تستغرق أدوات أدوبي نحو 90 ثانية لإنتاج الفيديو، وتعمل الشركة على تسريع هذه العملية. وقد ذكرت أدوبي أن أدواتها “آمنة تجاريًا” لأنها مدربة على محتوى مرخص ومصرح به، مما يجعلها جذابة للمستخدمين في ظل التدقيق في بعض النماذج الأخرى.
أعلنت أدوبي أيضًا أنه سيتم وضع علامات على مقاطع الفيديو التي يتم إنشاؤها أو تعديلها باستخدام نموذج Firefly، تشير إلى استخدام الذكاء الاصطناعي، مع الحفاظ على حقوق الملكية عند نشر هذه المقاطع عبر الإنترنت.
تتجه شراكة أوبن إيه آي وسامسونغ إلى مرحلة جديدة تتجاوز تشغيل تقنيات الذكاء الاصطناعي، مع تعاون الشركتين في تطوير وإنتاج رقائق مخصصة لهذه التقنيات، ضمن مساعي أوبن إيه آي لبناء منظومة تقنية أكثر تكاملًا وتقليل اعتمادها على البنية التحتية الخارجية.
شراكة أوبن إيه آي وسامسونغ تدخل مجال الرقائق
حققت الشركتان تقدمًا في التعاون بمجالي الإنتاج المشترك والبحث والتطوير، خصوصًا في الرقائق التي تعمل أوبن إيه آي على تطويرها للجيل المقبل من أنظمة الذكاء الاصطناعي.
ولا تقتصر شراكة أوبن إيه آي وسامسونغ على المعالجات، إذ تشمل أيضًا رقائق الذاكرة المتقدمة ومراكز البيانات المخصصة لتشغيل أنظمة الذكاء الاصطناعي على نطاق واسع.
أوبن إيه آي تطور معالجاتها الخاصة
تزامن التعاون مع تحرك أوبن إيه آي نحو تطوير معالجات مخصصة لخدماتها. وكشفت الشركة بالتعاون مع Broadcom عن معالج ذكاء اصطناعي باسم “جالابينو”، صمم لتسريع عمليات الاستدلال داخل مراكز البيانات.
وتسعى أوبن إيه آي من خلال هذه الخطوة إلى التحكم بشكل أكبر في الأداء والتكلفة واستهلاك الطاقة، بدلًا من الاعتماد الكامل على الحلول الجاهزة من الشركات الأخرى.
شراكة أوبن إيه آي وسامسونغ.. من الذكاء الاصطناعي إلى تصنيع الرقائق
لماذا تحتاج أوبن إيه آي إلى سامسونغ؟
تمثل سامسونغ عنصرًا مهمًا في استراتيجية أوبن إيه آي بسبب خبرتها الكبيرة في تصنيع أشباه الموصلات وذاكرة الحوسبة عالية الأداء.
وتحتاج نماذج الذكاء الاصطناعي المتطورة إلى كميات ضخمة من الذاكرة لتشغيل عمليات التدريب والاستدلال، ما يجعل شركات تصنيع الذاكرة جزءًا أساسيًا من البنية التحتية الجديدة.
وتمنح شراكة أوبن إيه آي وسامسونغ الطرفين فوائد متبادلة، إذ تحصل أوبن إيه آي على مكونات أساسية لأنظمتها، بينما تعزز سامسونغ حضورها في سوق الذكاء الاصطناعي سريع النمو.
في المقابل، تستخدم سامسونغ تقنيات أوبن إيه آي داخل عدد كبير من عملياتها، بما يشمل البحث والتطوير وتصميم المنتجات والتسويق والمبيعات.
وتشير هذه الخطوة إلى أن شراكة أوبن إيه آي وسامسونغ لا تسير في اتجاه واحد، بل تجمع بين استخدام تقنيات الذكاء الاصطناعي وتطوير البنية التحتية اللازمة لتشغيلها.
كوريا الجنوبية تصبح سوقًا مهمة
تزداد أهمية كوريا الجنوبية في استراتيجية أوبن إيه آي مع توسع استخدام تشات جي بي تي داخل الشركات والمؤسسات هناك.
وتشير هذه التطورات إلى تحول المنافسة في قطاع الذكاء الاصطناعي من سباق لتطوير النماذج فقط إلى منافسة أوسع تشمل الرقائق والذاكرة ومراكز البيانات.
وقد تمثل شراكة أوبن إيه آي وسامسونغ نموذجًا لهذا التحول، مع سعي الطرفين إلى امتلاك دور أكبر في سلسلة التقنيات التي تدعم الجيل المقبل من الذكاء الاصطناعي.
أطلقت شركة ميتا وكيل ميوز للذكاء الاصطناعي، في خطوة جديدة تهدف إلى منح المستخدمين مساعدًا قادرًا على تنفيذ مجموعة واسعة من المهام نيابة عنهم، مثل إرسال رسائل البريد الإلكتروني، وحجز رحلات السفر، وإجراء عمليات شراء ومدفوعات، دون الحاجة إلى تدخل بشري مستمر.
ويأتي إطلاق الوكيل ضمن خطة الرئيس التنفيذي مارك زوكربيرغ لتطوير ما تصفه الشركة بـ”الذكاء الشخصي الفائق”، بحيث يستطيع مليارات المستخدمين الاستفادة من أدوات ذكاء اصطناعي تتعامل مع مهامهم اليومية بصورة أكثر استقلالية.
وكيل ميوز يصل إلى التطبيقات والبيانات الشخصية
يتوفر وكيل ميوز في البداية داخل الولايات المتحدة من خلال تطبيق مخصص، إلى جانب تطبيق المراسلة واتساب التابع لشركة ميتا.
وتخطط الشركة لإضافة الوكيل إلى مجموعة النظارات الذكية التي تنتجها قريبًا، لكنها لم تكشف حتى الآن تفاصيل إضافية حول طريقة دمج هذه التقنية في أجهزتها القابلة للارتداء.
ويستطيع الوكيل الوصول إلى التطبيقات التي يختارها المستخدم، بما يشمل البريد الإلكتروني والتقويم والمدفوعات والصحة والتسوق وأجهزة المنزل الذكي.
المستخدم يتحكم في التطبيقات التي يصل إليها الوكيل
تمنح ميتا المستخدم إمكانية تحديد التطبيقات التي يستطيع الوكيل الوصول إليها، كما يمكنه إلغاء هذا الوصول في أي وقت.
وتحاول الشركة من خلال هذا النظام تحقيق توازن بين قدرات الوكيل الواسعة وخصوصية المستخدم، خاصة أن تنفيذ بعض المهام يتطلب الوصول إلى بيانات شخصية أو حسابات تحتوي على معلومات حساسة.
وتزداد أهمية هذه الضوابط مع انتقال وكلاء الذكاء الاصطناعي من مجرد تقديم الإجابات إلى تنفيذ المهام الفعلية نيابة عن المستخدم.
وكيل ميوز يعمل من خلال جهاز افتراضي
يعمل وكيل ميوز على جهاز افتراضي خاص به، وهو عبارة عن محاكاة لجهاز كمبيوتر شخصي تعمل عبر الخدمات السحابية.
وتتيح هذه البيئة للوكيل تنفيذ المهام في الخلفية، حتى عندما لا يكون المستخدم يتفاعل معه بشكل مباشر.
ويمنح هذا الأسلوب الوكيل قدرة أكبر على التعامل مع المهام التي تحتاج إلى عدة خطوات، مثل البحث عن رحلة مناسبة أو متابعة توافر تذاكر أو تنظيم تفاصيل السفر.
يوفر ربط الوكيل بتطبيقات المستخدم التي تحتوي على بيانات حقيقية فائدة كبيرة، لكنه في الوقت نفسه يرفع مستوى المخاطر المرتبطة بالأمان والخصوصية والموثوقية.
فأي خطأ في تنفيذ الأوامر قد يؤدي إلى نتائج غير مرغوبة، خاصة عندما يتعامل الوكيل مع البريد الإلكتروني أو المدفوعات أو المعلومات الصحية أو حسابات التسوق.
كما أن قدرة الوكيل على تنفيذ إجراءات نيابة عن المستخدم تفرض تحديات إضافية تتعلق بالتأكد من أن النظام فهم الطلب بصورة صحيحة قبل اتخاذ أي إجراء قد يصعب التراجع عنه.
موظفو ميتا يكشفون مشكلات أثناء اختبار الوكيل
أظهرت منشورات داخلية اطلعت عليها رويترز أن بعض موظفي ميتا الذين يختبرون الأداة أبلغوا عن حالات واجه فيها الوكيل مشكلات أثناء تنفيذ المهام.
وشملت الحالات التي أبلغ عنها الموظفون ترتيب تفاصيل رحلات السفر، إلى جانب حالات أخرى تضمنت انقطاع الاتصال أو تحميل معلومات حساسة دون الحصول على الإذن المطلوب.
وكتب أحد الموظفين أن الوكيل كان مفيدًا بدرجة كبيرة في ترتيب مسارات الرحلات ووسائل النقل، لدرجة أنه وصفه بأنه أصبح بمثابة “المشارك الثالث” في شهر العسل الذي قضاه لمدة ثلاثة أسابيع في إندونيسيا.
في المقابل، أشار موظف آخر إلى مشكلات تتعلق بقدرة وكيل ميوز على مراقبة التذاكر وغيرها من العناصر التي تنفد بسرعة.
وقال الموظف إن الأداة واجهت حالات فشل متعددة جعلتها غير موثوقة في بعض المهام، مشيرًا إلى أنها توقفت عن تحديث الصفحة بعد نحو 15 دقيقة.
كما أوضح أن الوكيل تجاهل بعض الأخطاء دون تقديم تفسير واضح، وفي حالات أخرى توقف عن عملية المراقبة نفسها دون سبب مفهوم.
وتكشف هذه التجارب عن التحدي الذي تواجهه ميتا في تحويل الوكيل من تجربة واعدة إلى أداة يمكن للمستخدمين الاعتماد عليها في المهام الحساسة والمستمرة.
ميتا تراهن على الوكلاء في مستقبل الذكاء الاصطناعي
يمثل إطلاق وكيل ميوز جزءًا من توجه أوسع لدى شركات التكنولوجيا نحو تطوير وكلاء ذكاء اصطناعي قادرين على تنفيذ المهام بدلًا من الاكتفاء بالإجابة عن الأسئلة.
وتراهن ميتا على أن وصول الوكيل إلى مجموعة واسعة من التطبيقات والخدمات يمكن أن يجعله جزءًا أساسيًا من الاستخدام اليومي للذكاء الاصطناعي، خصوصًا مع خطط دمجه مستقبلًا في النظارات الذكية.
لكن نجاح هذه التجربة سيعتمد إلى حد كبير على قدرة الشركة على تحسين دقة الوكيل وموثوقيته، إلى جانب وضع ضوابط قوية تمنع الوصول غير المصرح به إلى البيانات أو تنفيذ إجراءات لم يطلبها المستخدم.
أطلقت OpenAI إصدارها الأحدث من نموذج توليد الصور ChatGPT Images 2.5، مع مجموعة من التحسينات التي تجمع بين سرعة التوليد وجودة النتائج، بهدف جعل إنشاء الصور بالذكاء الاصطناعي أكثر دقة وسلاسة، مع تقليل المشكلات التي تواجه المستخدمين أثناء تنفيذ أفكارهم.
وتقول OpenAI إن المستخدمين يولدون أكثر من 3 مليارات صورة أسبوعيًا عبر ChatGPT وواجهة برمجة التطبيقات (API)، لذلك يركز الإصدار الجديد على تسريع عملية إنشاء الصور وتحسين دقتها، إلى جانب منح المستخدم تحكمًا أكبر في النتيجة النهائية.
ChatGPT Images 2.5 يقدم صورًا أكثر واقعية
يركز الإصدار الجديد على تحسين التفاصيل والإضاءة والخامات، ما يساعد على إنتاج صور تبدو أكثر واقعية وأقل اصطناعية، خصوصًا في العناصر التي كانت تظهر سابقًا بمظهر بلاستيكي أو غير طبيعي.
كما أصبح النموذج أكثر قدرة على الالتزام بالصور المرجعية التي يقدمها المستخدم، ما يساعده على الحفاظ على ملامح الوجه والخصائص الأساسية للشخص عند تحويل الصورة إلى مشهد أو أسلوب بصري مختلف.
وتشمل أبرز التحسينات:
توليد الصور بسرعة أكبر للحفاظ على تدفق الأفكار والإبداع.
تحسين دقة التفاصيل للحصول على صور أكثر طبيعية.
زيادة ثبات العناصر عند إجراء تعديلات متعددة.
تنفيذ تعديلات أكثر دقة من خلال التعليقات المباشرة.
الحفاظ على العناصر الأساسية في الصورة عند إجراء تغييرات جديدة.
وبحسب OpenAI، أصبح ChatGPT Images 2.5 أسرع بنسبة تصل إلى 50% مقارنة بالإصدار السابق Images 2.0، ما يمنح المستخدم تجربة أكثر سرعة أثناء إنشاء الصور وتعديلها.
ومن أبرز الإضافات الجديدة ميزة Sketch، التي تتيح للمستخدم رسم فكرة سريعة داخل ChatGPT بدلًا من محاولة وصفها بالتفصيل باستخدام الكلمات.
ويمكن للمستخدم، على سبيل المثال، رسم مخطط أولي لغرفة أو تصور لملابس معينة، ثم تحويل هذا الرسم البسيط إلى صورة نهائية أكثر احترافية باستخدام الذكاء الاصطناعي.
وتأتي هذه الميزة إلى جانب قوالب جاهزة لإنشاء الملصقات والمنشورات الدعائية وصور المنتجات، فضلًا عن إمكانية إضافة تعليقات مباشرة على الصور لتحديد التعديلات المطلوبة بدقة أكبر.
وتمنح هذه الأدوات المستخدم تحكمًا أكبر في النتائج، حتى دون امتلاك خبرة متقدمة في التصميم أو استخدام برامج تحرير الصور.
ChatGPT Images 2.5.. ارسم فكرتك ودع الذكاء الاصطناعي يحولها إلى صورة
تعديلات أكثر ذكاءً دون إفساد الصورة الأصلية
حسّنت OpenAI أيضًا قدرات تحرير الصور في ChatGPT Images 2.5، بحيث يستطيع المستخدم طلب تعديل عنصر محدد، مثل استبدال الخلفية أو تغيير منتج، مع الحفاظ على بقية عناصر الصورة قدر الإمكان.
وتستمر هذه القدرة عبر جولات متعددة من التعديلات، ما يقلل احتمالات فقدان التغييرات السابقة أو ظهور تغييرات عشوائية في عناصر لم يطلب المستخدم تعديلها.
ويمنح هذا الأمر المستخدم تجربة أكثر استقرارًا عند تطوير الصورة خطوة بخطوة، بدلًا من الاضطرار إلى إعادة إنشاء الصورة من البداية بعد كل تعديل كبير.
أضافت OpenAI أيضًا إمكانية مشاركة الأمر النصي (Prompt) المستخدم لإنشاء الصورة، ما يسمح للمستخدمين بإعادة إنتاج فكرة أعجبتهم مع استخدام صورهم وتفاصيلهم الخاصة.
وتساعد هذه الميزة على مشاركة طرق إنشاء الصور بسهولة أكبر، كما تمنح المستخدمين فرصة لفهم الطريقة التي أدت إلى الحصول على نتيجة معينة وتعديلها بما يناسب احتياجاتهم.
وعلى مستوى المطورين، تطلق OpenAI نماذج GPT-Image-2.5 Flare وSunburst عبر واجهة API، لتوفير التحسينات الجديدة في السرعة وجودة الصور داخل التطبيقات والمنتجات التي تعتمد على تقنيات الشركة.
الذكاء الاصطناعي يقترب أكثر من أدوات التصميم
يعكس ChatGPT Images 2.5 توجهًا واضحًا نحو جعل إنشاء الصور بالذكاء الاصطناعي أكثر سهولة للمستخدم العادي، خصوصًا مع الاعتماد على الرسم والتعليقات المباشرة إلى جانب الأوامر النصية.
وبدلًا من كتابة وصف طويل للحصول على النتيجة المطلوبة، يستطيع المستخدم الجمع بين النص والصورة المرجعية والرسم السريع والتعديلات المباشرة للوصول إلى تصور أقرب لما يريده.
وتشير هذه الإمكانات إلى تحول أدوات توليد الصور من مجرد أنظمة تنفذ أوامر نصية إلى أدوات إبداعية تمنح المستخدم مساحة أكبر للتفاعل مع الصورة أثناء إنشائها وتطويرها.
ChatGPT Images 2.5 متاح لمستخدمي ChatGPT
أوضحت OpenAI أن ChatGPT Images 2.5 متاح لمستخدمي ChatGPT وChatGPT Work وCodex عبر أجهزة الكمبيوتر والهواتف المحمولة والويب.
ومع الجمع بين سرعة التوليد وتحسين جودة التفاصيل والقدرة على تعديل الصور بصورة أكثر دقة، يسعى الإصدار الجديد إلى جعل تجربة إنشاء الصور أكثر مرونة، سواء للمستخدمين العاديين أو للمبدعين والمطورين الذين يعتمدون على أدوات الذكاء الاصطناعي في أعمالهم.