سواء كنت متعلمًا بصريًا أو سمعيًا أو شخصًا يمزج بين الاثنين، يجب أن يتكيف تطبيق القراءة الخاص بك معك. اكتشف كيف توفر بنية TTS المزدوجة من GemReader أصوات نظام خفيفة وذكاء اصطناعي عصبي فائق الواقعية.
القراءة بعينيك، بأذنيك، أو بكليهما
يمتص كل عقل المعرفة بشكل مختلف. بعضنا متعلمون بصريون يحتاجون إلى رؤية البنية الدقيقة للجملة وعلامات الترقيم وتخطيط الصفحة لفهم المفهوم حقًا.
البعض الآخر متعلمون سمعيون يمتصون المعلومات بشكل أفضل عندما يتمكنون من سماع إيقاع ونبرة الصوت البشري. لكن التعلم ليس ثنائيًا صارمًا. أحيانًا تريد مزج كلا الأسلوبين - المتابعة بصريًا بينما يقرأ الراوي بصوت عالٍ لترسيخ المفاهيم في ذاكرتك.
لدعم هذا المزيج السلس، يحتاج الملاذ الرقمي إلى محرك صوتي قوي بشكل لا يصدق. ومع ذلك، تفرض معظم التطبيقات حلاً وسطًا: إما المعاناة من أصوات النظام الآلية، أو التخلي عن عادات القراءة الشخصية لخوادم الذكاء الاصطناعي السحابية الغازية للخصوصية.
حل المحرك المزدوج
يتخذ GemReader مسارًا مختلفًا تمامًا. لقد قمنا ببناء بنية محرك مزدوج تعمل دون اتصال بالإنترنت تمامًا وتمنحك أفضل ما في العالمين دون المساومة أبدًا على حقك الأساسي في الخصوصية.
من خلال الجمع بين محركات الأجهزة الأصلية المتوفرة عالميًا مع نموذج ذكاء اصطناعي عصبي محلي مدمج، ستحصل على تحكم كامل في كيفية صوت كتبك.
المحرك 1: إطار الجهاز الأصلي
طبقتنا الأولى هي محرك TTS الأصلي للجهاز. تم بناؤه مباشرة فوق إطار العمل الأصلي لنظام التشغيل الخاص بك، ويوفر توليد كلام فوري وبدون تأخير عبر 12 لغة دولية.
إنه لا يتطلب تنزيلات إضافية ويعمل باستهلاك ذاكرة منخفض للغاية. قمنا أيضًا بتصميم بوابات أحداث غير متزامنة مخصصة للحماية من مقاطعات النظام - بحيث يتوقف كتابك بأناقة عند ورود مكالمة هاتفية بدلاً من تخطي الفصول عن طريق الخطأ.
هذا المحرك مثالي للاستماع الخفيف والفوري بدون استخدام اليدين.
المحرك 2: الذكاء الاصطناعي العصبي المحلي
للقراء الذين يريدون الدفء والنبرة الطبيعية لراوٍ بشري، قمنا بدمج بيئة تشغيل Sherpa-onnx التي تشغل النموذج العصبي Piper LibriTTS-R.
هنا يحدث السحر حقًا. يمنحك الوصول إلى أكثر من 900 ملف صوتي مختلف، مما يسمح لك باختيار النغمة والنبرة الدقيقة لجلسة دراستك. ولأنه يستخدم خط أنابيب تدفق محسن ومنخفض الاستجابة، يبدأ الصوت على الفور تقريبًا.
الأهم من ذلك، هذا الذكاء الاصطناعي العصبي غير متصل بالإنترنت بنسبة 100٪. يحدث توليد الكلام بالكامل على معالج هاتفك. لا يتم نقل أي بيانات نصية أو عادات استماع إلى خوادم خارجية أبدًا.
تعلم بنبرة مثالية بأي سرعة
سواء كنت تقرأ بسرعة 2.0x أو تبطئ إلى 0.75x لإتقان صوتيات لغة جديدة معقدة، يتكيف كلا المحركين ديناميكيًا. يتميز الذكاء الاصطناعي العصبي المحلي لدينا بتصحيح النبرة في الوقت الفعلي، بحيث لا يؤدي تغيير السرعة أبدًا إلى تشويه صوت الراوي الطبيعي.
مع هذا الأساس المزدوج المحرك، يمكنك الانتقال بسلاسة بين القراءة البصرية، أو الاستماع السمعي الخالص، أو مزيج متزامن قوي من كليهما - كل ذلك من أمان مكتبتك الخاصة غير المتصلة بالإنترنت.
Try it yourself
Related guides