Connect with us

أخبار تقنية

جيميناي يضيف استنساخ الأصوات ويقدم أداءً صوتيًا أكثر واقعية

Avatar of هدير ابراهيم

Published

on

جيميناي يضيف استنساخ الأصوات ويقدم أداءً صوتيًا أكثر واقعية

أضافت جوجل إلى جيميناي قدرات جديدة لتحويل النصوص إلى كلام، تمنح النماذج قدرة أكبر على التحكم في نبرة الصوت واللهجة والإيقاع والمشاعر، إلى جانب محاكاة الهمس والضحك والتنهدات والتوقفات أثناء الحديث.

وتأتي التحديثات ضمن توسع عائلة Gemini 3.8، مع إطلاق نموذجي Gemini 3.8 Flash TTS وFlash-Lite TTS المخصصين لإنشاء الأصوات من النصوص.

جيميناي يدعم استنساخ الأصوات بأكثر من 100 لغة

تتيح تقنية الصوت الجديدة إنشاء صوت مخصص اعتمادًا على وصف مكتوب باللغة الطبيعية، مع دعم أكثر من 100 لغة ولهجة، بينما توفر جوجل أكثر من 2000 صوت جاهز للاستخدام.

كما يستطيع النظام استنساخ صوت معين من خلال عينة صوتية مدتها 30 ثانية، بشرط الحصول على موافقة صاحب الصوت.

ولا تقتصر المزايا على قراءة النصوص، إذ يمكن للمستخدم تحديد طريقة إلقاء كل جملة، بما يشمل سرعة الكلام والنبرة واللهجة وحتى الضحك والهمس والتنهد.

وتستطيع النماذج كذلك إنشاء حوارات بين شخصيتين من نص واحد، مع الحفاظ على اتساق أصوات الشخصيات خلال تسجيلات طويلة.

استخدامات متعددة للأصوات الجديدة

تفتح هذه التقنية المجال أمام استخدامات متنوعة، مثل إنتاج البودكاست والكتب الصوتية والدبلجة والمحتوى المرئي والوكلاء الصوتيين، مع تقديم أداء أقرب إلى الصوت البشري التقليدي.

وأظهرت اختبارات جوجل نتائج قوية للنماذج الجديدة، إذ تصدر Gemini 3.8 Flash TTS اختبار Voice Design Benchmark من Hume AI، وسجل 60.8 نقطة في فئة اللهجات.

وفي المقابل، حققت ElevenLabs نتائج أعلى في بعض اختبارات جودة الصوت الفردي والتنوع الصوتي.

جيميناي يضيف استنساخ الأصوات ويقدم أداءً صوتيًا أكثر واقعية

جيميناي يضيف استنساخ الأصوات ويقدم أداءً صوتيًا أكثر واقعية

وصول التقنية إلى تطبيقات جوجل

بدأت جوجل دمج Flash TTS داخل Gemini Notebook، بينما وصل Flash-Lite TTS إلى Google Vids، مع إتاحة النموذجين للمطورين عبر Gemini API وAI Studio.

وتعمل الشركة كذلك على توسيع استخدام تقنيات الصوت داخل خدماتها المختلفة، بالتزامن مع طرح تحديثات جديدة لأدوات إنشاء الفيديو.

قيود لحماية أصحاب الأصوات

وضعت جوجل مجموعة من الإجراءات للحد من إساءة استخدام استنساخ الأصوات، أبرزها اشتراط امتلاك المستخدم إذنًا من صاحب الصوت قبل استنساخه.

كما تستخدم الشركة تقنية SynthID للعلامات المائية وبيانات اعتماد C2PA للمساعدة في التعرف على المحتوى الناتج عن الذكاء الاصطناعي.

وتحظر جوجل استنساخ الأصوات عبر AI Studio في بعض المناطق، منها المملكة المتحدة والمنطقة الاقتصادية الأوروبية والهند وتكساس وإلينوي.

أخبار الاختراقات

وكيل OpenAI يصل إلى بوابة صحية حكومية في أستراليا دون تصريح

Avatar of هدير ابراهيم

Published

on

وكيل OpenAI يصل إلى بوابة صحية حكومية في أستراليا دون تصريح

تمكن وكيل OpenAI يعمل بشكل مستقل من الوصول دون تصريح إلى بوابة بيانات صحية تابعة للحكومة الأسترالية خلال يونيو الماضي، حيث اطلع على ملفات عامة وأخرى داخلية تحتوي على بيانات صحية مجمعة، في واقعة أثارت تساؤلات حول أمن الأنظمة الوكيلة.

وأكد رئيس الوزراء الأسترالي أنتوني ألبانيزي الحادثة، موضحًا أن النظام التجريبي تمكن من الوصول إلى نظام حكومي صحي دون الحصول على الصلاحيات المطلوبة.

وكيل OpenAI تجاوز صلاحيات الوصول

وقعت الحادثة داخل خدمة مخصصة للإبلاغ عن إحصاءات الرعاية الطبية، وهي بوابة تديرها هيئة خدمات أستراليا وتعرض بيانات إجمالية مرتبطة بالرعاية الصحية والإنفاق الحكومي.

وتمكن النظام من الوصول إلى ملفات متاحة للعامة، إلى جانب بعض البيانات الداخلية غير المنشورة، بما في ذلك أسماء ملفات وإحصاءات صحية مجمعة.

وقالت OpenAI إن ما حدث وقع أثناء محاولة النظام البحث عن معلومات عبر الإنترنت، حيث نفذ إجراءات لم يكن المطورون قد صمموه لتنفيذها.

ولم تكتشف الشركة الواقعة إلا في أغسطس، خلال مراجعة داخلية لنشاط اعتبرته خارج الأهداف المحددة للنموذج، قبل إخطار السلطات الأسترالية في 10 سبتمبر.

تأخر الإبلاغ يثير انتقادات

أثار الفاصل الزمني بين وقوع الحادث واكتشافه ثم إبلاغ الحكومة الأسترالية به انتقادات في كانبيرا.

وتحدث رئيس الوزراء أنتوني ألبانيزي مع الرئيس التنفيذي لـOpenAI سام ألتمان بشأن الواقعة، وأعرب عن قلق الحكومة من تأخر الإبلاغ عنها.

وكيل OpenAI يصل إلى بوابة صحية حكومية في أستراليا دون تصريح

وكيل OpenAI يصل إلى بوابة صحية حكومية في أستراليا دون تصريح

وفي الوقت نفسه، بدأت مديرية الإشارات الأسترالية تحقيقًا رقميًا للتأكد من عدم امتداد الوصول إلى أنظمة حكومية أخرى.

وقال وزير الدفاع ريتشارد مارلز إن المعلومات المتاحة حتى الآن لا تشير إلى حدوث اختراق أوسع.

هل وصلت البيانات إلى سجلات المرضى؟

أكدت OpenAI أن وكيل OpenAI لم يصل إلى سجلات المرضى الخاصة أو بيانات Medicare الشخصية، ما يعني أن المعلومات الشخصية الحساسة لم تكن ضمن البيانات التي تم الوصول إليها، وفقًا لما نقلته BBC.

وتأتي الواقعة وسط اهتمام متزايد بالمخاطر الأمنية المرتبطة بالوكلاء القادرين على تصفح الإنترنت وتنفيذ الإجراءات بشكل مستقل.

وسبق أن واجهت OpenAI حوادث أخرى مرتبطة بالوكلاء، كما أعلنت شركات مثل Anthropic وGoogle وMeta عن وقائع تمكنت فيها أنظمة ذكاء اصطناعي من الوصول إلى موارد خارجية بصورة غير مصرح بها.

وتعيد هذه الحوادث طرح أسئلة حول قدرة أنظمة الحماية الحالية على مواكبة الوكلاء الذين يحصلون تدريجيًا على صلاحيات أكبر لتنفيذ المهام واتخاذ الإجراءات بصورة مستقلة.

Continue Reading

أخبار تقنية

أنثروبيك وOpenAI تكشفان عن جيل جديد من نماذج الذكاء الاصطناعي بتكلفة أقل

Avatar of هدير ابراهيم

Published

on

أنثروبيك وOpenAI تكشفان عن جيل جديد من نماذج الذكاء الاصطناعي بتكلفة أقل 1

تتجه شركات الذكاء الاصطناعي إلى تطوير نماذج تجمع بين الأداء المرتفع والتكلفة الأقل، وهو ما ظهر في الإصدارات الجديدة التي كشفت عنها أنثروبيك وOpenAI. وتركز النماذج الجديدة على البرمجة والمهام الاحترافية وتحسين الدقة والالتزام بإجراءات السلامة.

نماذج أنثروبيك وOpenAI تنافس في الأداء والتكلفة

قدمت أنثروبيك نموذج Opus 5.5 المخصص للتعامل مع المهام التي تحتاج إلى قدرات متقدمة، مثل تحليل المشكلات البرمجية واكتشاف الأخطاء وإصلاحها، إلى جانب معالجة البيانات المالية وتنفيذ مهام الأعمال.

وبحسب اختبارات أنثروبيك، تمكن Opus 5.5 من تجاوز GPT-6 Astra في اختبارات البرمجة الوكيلة Terminal-Bench 4.0 وFrontierCode v1.1 (Main)، ما يعزز تركيز الشركة على استخدام النموذج في بيئات التطوير.

كما أجرت الشركة تحسينات على طريقة كتابة النموذج للنصوص، وقالت إنه أصبح أكثر وضوحًا وأقل محاولة لتجاوز القيود والضوابط بنسبة 85% مقارنة بالنماذج السابقة.

وانخفضت تكلفة Opus 5.5 أيضًا، حيث أصبح سعر مليون رمز إدخال 4 دولارات، بينما يبلغ سعر مليون رمز إخراج 20 دولارًا، مقابل 5 دولارات و25 دولارًا في Opus 5.

OpenAI تقدم GPT-6 Sol وGPT-6 Luna

من جانبها، كشفت OpenAI عن GPT-6 Sol وGPT-6 Luna، مع تحسينات تستهدف البرمجة والعمل الاحترافي واستخدام الحاسوب.

وتقول الشركة إن النماذج الجديدة تعتمد على تقنيات تدريب قريبة من GPT-6 Astra، مع خفض تكلفة الاستخدام بنسبة تصل إلى 50% مقارنة بالأسعار الترويجية لنماذج GPT-5.6.

أنثروبيك وOpenAI تكشفان عن جيل جديد من نماذج الذكاء الاصطناعي بتكلفة أقل

أنثروبيك وOpenAI تكشفان عن جيل جديد من نماذج الذكاء الاصطناعي بتكلفة أقل

وتبلغ تكلفة مليون رمز إدخال في GPT-6 Sol دولارين، مقابل 10 دولارات للإخراج، بينما يصل سعر مليون رمز إدخال في GPT-6 Luna إلى 10 سنتات فقط، مقابل 50 سنتًا للإخراج.

وتشير OpenAI إلى أن GPT-6 Sol أصبح أكثر دقة، مع انخفاض الأخطاء إلى نحو النصف مقارنة بالإصدار السابق، إلى جانب تحسينات في البرمجة وإدارة السياق لتسريع الاستجابات.

تحسينات جديدة في السلامة

لم تقتصر التحديثات على الأداء، إذ تقول OpenAI إن نماذج GPT-6 أصبحت أكثر التزامًا بإجراءات السلامة، خاصة عند التعامل مع الأوامر التي تحاول تجاوز أنظمة الحماية.

وتعمل أنثروبيك وOpenAI كذلك على تطوير معايير تساعد جهات التقييم الخارجية في قياس أداء النماذج ومستوى سلامتها.

وأصبح Opus 5.5 متاحًا عبر Claude، إلى جانب AWS وGoogle Cloud وMicrosoft Azure، بينما تتوفر نماذج GPT-6 Sol وGPT-6 Luna عبر ChatGPT Work وCodex لعملاء الخطط المدفوعة، ويحصل مستخدمو Free وGo على GPT-6 Luna عبر تطبيق الشركة للحاسوب.

Continue Reading

أخبار تقنية

مؤتمر Meta Connect 2026 يكشف نظارات أخف وأجهزة جديدة للذكاء الاصطناعي

Avatar of هدير ابراهيم

Published

on

مؤتمر Meta Connect 2026 يكشف نظارات أخف وأجهزة جديدة للذكاء الاصطناعي 1

كشفت شركة ميتا خلال مؤتمر Meta Connect 2026 عن مجموعة واسعة من المنتجات والتقنيات الجديدة، مع تركيز واضح على النظارات الذكية والواقع الافتراضي والذكاء الاصطناعي. وشملت الإعلانات أجهزة جديدة للنظارات، إلى جانب تحديثات لمساعد الذكاء الاصطناعي Muse وأجهزة مخصصة لتشغيله.

مؤتمر Meta Connect 2026 يكشف عن نظارات واقع افتراضي أخف

طرحت ميتا خلال المؤتمر نظارات Meta VR Glasses، التي تقدم تجربة واقع افتراضي بتصميم أقرب إلى النظارات التقليدية، مع الاستغناء عن الأشرطة الكبيرة المعتادة في سماعات الواقع الافتراضي.

وتزن النظارات نحو 100 جرام فقط، أي أقل بنحو خمسة أضعاف من وزن Meta Quest 3، بينما تعتمد على وحدة صغيرة محمولة تتصل بالنظارات عبر كابل، وتضم هذه الوحدة مكونات المعالجة والبطارية والتخزين.

وتعمل النظارات بمعالج Qualcomm Snapdragon Reality Elite، إلى جانب ذاكرة وصول عشوائي بسعة 12 جيجابايت ومساحة تخزين تبلغ 128 جيجابايت.

كما تستخدم شاشة Micro OLED بدقة تصل إلى 5K، مع معدل تحديث يبلغ 120 هرتزًا، ما يوفر مواصفات موجهة لتقديم تجربة واقع افتراضي عالية الجودة.

وتخطط ميتا لطرح Meta VR Glasses خلال ربيع 2027 بسعر يبدأ من 1299 دولارًا، مع إمكانية استخدامها كشاشة افتراضية عند توصيلها بأجهزة Mac أو Windows.

وستدعم النظارات كذلك مكتبة تطبيقات وألعاب Meta Quest، إلى جانب إمكانية الوصول إلى Xbox Cloud Gaming.

Ray-Ban Meta Audio بدون كاميرات

كشفت ميتا أيضًا عن نظارات Ray-Ban Meta Audio، وهي نظارات ذكية تركز على الصوت دون تضمين كاميرات.

وتتيح النظارات للمستخدم الاستماع إلى الموسيقى وإجراء المكالمات والتفاعل مع مساعد الذكاء الاصطناعي، لكنها لا توفر إمكانية التقاط الصور أو تسجيل مقاطع الفيديو.

ويبلغ وزن النظارات 43 جرامًا، بينما توفر البطارية ما يصل إلى 12 ساعة من الاستخدام بشحنة واحدة، ويمكن أن يصل إجمالي الاستخدام إلى 48 ساعة عند الاعتماد على علبة الشحن.

وتبدأ مبيعات Ray-Ban Meta Audio في 13 أكتوبر بسعر يبدأ من 349 دولارًا، مع توفير 23 تركيبة مختلفة من الألوان والعدسات.

مؤتمر Meta Connect 2026 يكشف نظارات أخف وأجهزة جديدة للذكاء الاصطناعي

مؤتمر Meta Connect 2026 يكشف نظارات أخف وأجهزة جديدة للذكاء الاصطناعي

Ray-Ban Meta Gen 3 تحصل على بطارية أطول

أعلنت ميتا أيضًا الجيل الثالث من نظارات Ray-Ban Meta، بسعر يبدأ من 449 دولارًا.

ويقدم الإصدار الجديد مجموعة من التحسينات، أبرزها زيادة مدة تشغيل البطارية إلى 9 ساعات، أي أكثر بساعة مقارنة بالجيل السابق.

وأضافت الشركة زرًا جديدًا يمكن تخصيصه للوصول السريع إلى Meta AI، كما زودت النظارات بنظام يتكون من 6 ميكروفونات للمساعدة في تقليل الضوضاء المحيطة.

وتقول ميتا إن النظام قادر على خفض الضوضاء في الخلفية بأكثر من 90%، بينما تتوفر النظارات بـ27 تركيبة مختلفة من الألوان والعدسات، مع إطارات بتصميم أنحف.

إصدار أرخص وخيارات أكبر لتخصيص النظارات

طرحت ميتا كذلك إصدارًا منخفض التكلفة من نظارات Meta Adventurer، بسعر يبدأ من 249 دولارًا، على أن تبدأ المبيعات في 23 أكتوبر.

وأطلقت الشركة برنامج Mix & Match الذي يسمح للمستخدم بتخصيص النظارة وفق اختياراته، بما يشمل الإطار والعدسات ولون علبة التخزين.

كما أعلنت عن تصميمات جديدة بالتعاون مع EssilorLuxottica وLisa من فرقة Blackpink.

وفي الوقت نفسه، وسعت ميتا نطاق توفر نظاراتها في أسواق جديدة، من بينها الإمارات العربية المتحدة وسنغافورة وكوريا الجنوبية والمكسيك، مع خطط لإطلاقها في البرازيل خلال مرحلة لاحقة.

توسيع نطاق نظارات Meta Ray-Ban Display

أعلنت ميتا أيضًا توسيع توفر نظارات Meta Ray-Ban Display في عدد أكبر من الأسواق.

وأصبحت النظارات متاحة في المملكة المتحدة وكندا، بينما تستعد الشركة لطرحها في فرنسا وإيطاليا وألمانيا اعتبارًا من 13 أكتوبر.

وتحصل النظارات على تطبيق Explore جديد، إلى جانب أدوات إضافية لتحرير الصور وتحسين إدارة التقويم وعرض إشعارات الهاتف مباشرة على النظارة.

Muse يصل إلى نظارات ميتا

ركزت ميتا خلال مؤتمر Meta Connect 2026 أيضًا على توسيع قدرات مساعد الذكاء الاصطناعي Muse داخل نظاراتها الذكية.

وتخطط الشركة للسماح للمساعد بتنفيذ مجموعة أكبر من المهام، مثل تقديم إرشادات أثناء ممارسة التمارين الرياضية، وتسجيل الوجبات، وحجز المواعيد، والمساعدة في شراء المنتجات التي يراها المستخدم.

كما كشفت ميتا عن خصائص جديدة لـMuse، من بينها إمكانية إجراء مكالمات فيديو باستخدام صورة رمزية مباشرة يمكن تخصيصها.

وسيحصل وكلاء Muse أيضًا على عناوين بريد إلكتروني خاصة، ما يتيح لهم تنفيذ بعض المهام والتواصل مع المستخدمين بصورة أكثر استقلالية.

Muse Charm جهاز جديد لتشغيل المساعد الذكي

وفي ختام سلسلة الإعلانات، كشف مارك زوكربيرج عن جهاز جديد يحمل اسم Muse Charm.

ويأتي الجهاز بحجم صغير وتصميم مستوحى من لعبة Tamagotchi، ويهدف إلى توفير وسيلة مخصصة لتشغيل مساعد Muse والتفاعل معه.

ولم تكشف ميتا حتى الآن جميع تفاصيل الجهاز، لكنها أكدت أنها ستعلن مزيدًا من المعلومات عنه قريبًا، مع استهداف طرحه خلال موسم العطلات المقبل.

وتعكس هذه الإعلانات توجه ميتا إلى توسيع منظومة أجهزتها القابلة للارتداء، مع دمج الواقع الافتراضي والنظارات الذكية والذكاء الاصطناعي في منتجات تستهدف الاستخدام اليومي.

Continue Reading

Trending