الوصف
تقدم AssemblyAI منصة شاملة للمطورين لبناء تطبيقات تمكين الصوت باستخدام نماذج ذكاء اصطناعي متقدمة. توفر المنصة قدرات رائدة في الصناعة للنسخ من الكلام إلى نص وفهم الصوت، مما يمكّن الشركات من استخلاص رؤى قيمة من بيانات الصوت. يمكن للمطورين دمج واجهات برمجة التطبيقات القوية هذه في أي منتج أو مكدس، بغض النظر عن التكنولوجيا المستخدمة.
تشمل العروض الأساسية لـ AssemblyAI واجهة برمجة تطبيقات النسخ من الكلام إلى نص للملفات المُسجلة مسبقًا لتوليد نصوص دقيقة من الملفات الصوتية بـ 99 لغة، وواجهة برمجة تطبيقات النسخ من الكلام إلى نص في الوقت الفعلي لبث الصوت المباشر بزمن استجابة منخفض. بخلاف النسخ، تستخلص واجهة برمجة تطبيقات فهم الصوت معلومات حاسمة مثل تحديد المتحدث، وتحليل المشاعر، واكتشاف الفصول، والتلخيص من استدعاء واجهة برمجة تطبيقات واحد. تسهل واجهة برمجة تطبيقات وكيل الصوت إنشاء وكلاء صوت جاهزين للإنتاج مع اكتشاف الأدوار المدمج ومعالجة المقاطعات.
لتعزيز أمن البيانات والامتثال، تقدم AssemblyAI أدوات Guardrails لإزالة المعلومات الشخصية التعريفية (PII) والإشراف على المحتوى بشكل مباشر. يبسط LLM Gateway التوجيه إلى نماذج لغوية كبيرة (LLMs) مختلفة مع آليات احتياطية، مما يضمن المرونة. تم بناء المنصة على بنية تحتية قوية، توفر تكرارًا عالميًا ووقت تشغيل على مستوى المؤسسات، وتعالج ملايين الساعات من الصوت يوميًا. تم تصميم التسعير للتوسع دون تكاليف خفية، مما يوفر المرونة للشركات بجميع الأحجام.
تثق بملايين المطورين وتستخدمها شركات رائدة مثل Zoom وSiro. تمتد حالات الاستخدام لتشمل مسؤولي الذكاء الاصطناعي، ومدوّني الملاحظات بالذكاء الاصطناعي، ومساعدي الوكلاء، وتحليلات المكالمات، وذكاء المحادثات، والنسخ الطبي. تهدف المنصة إلى تقليل الوقت الذي يقضيه المطورون في تكوين الأدوات، مما يسمح لهم بالتركيز على شحن حلول ذكاء اصطناعي صوتية مبتكرة بشكل أسرع. تتوفر أيضًا ساحة لعب بدون كود لاختبار نماذجهم.
الميزات الأساسية لـ AssemblyAI
واجهة برمجة تطبيقات النسخ من الكلام إلى نص للصوت المُسجل مسبقًا
واجهة برمجة تطبيقات النسخ من الكلام إلى نص في الوقت الفعلي لتدفقات الصوت المباشرة
واجهة برمجة تطبيقات فهم الصوت لاستخلاص الرؤى (معرف المتحدث، المشاعر، الفصول، الملخصات)
واجهة برمجة تطبيقات وكيل الصوت لبناء وكلاء صوت مع اكتشاف الأدوار ومعالجة المقاطعات
أدوات Guardrails لإزالة المعلومات الشخصية التعريفية والإشراف على المحتوى
LLM Gateway للتوجيه والاحتياطي
نموذج Universal-3.5 Pro للنسخ من الكلام إلى نص
دعم 99 لغة في النسخ
بنية تحتية قابلة للتوسع مع تكرار عالمي
تسعير مرن بدون حدود تزامن أو اختناقات
ساحة لعب بدون كود لاختبار النماذج
كيفية استخدام AssemblyAI؟
تكوين الوصول إلى واجهة برمجة التطبيقات: الحصول على مفاتيح واجهة برمجة التطبيقات وإعداد حزم تطوير البرامج (SDKs) اللازمة.
دمج واجهات برمجة التطبيقات: تضمين وظائف النسخ من الكلام إلى نص أو فهم الصوت في تطبيقك.
معالجة الصوت: إرسال الملفات المُسجلة مسبقًا أو بث الصوت في الوقت الفعلي للنسخ والتحليل.
استخلاص الرؤى: استخدام واجهة برمجة تطبيقات فهم الصوت لاستخلاص معنى أعمق من بيانات الصوت.
بناء وكلاء صوت: تطوير وكلاء صوت تفاعليين باستخدام واجهة برمجة تطبيقات وكيل الصوت المخصصة.
النشر والتوسع: الاستفادة من بنية AssemblyAI التحتية للتطبيقات الجاهزة للإنتاج بأي حجم.
حالات استخدام AssemblyAI
- مسؤولو الذكاء الاصطناعي
- مدوّنو الملاحظات بالذكاء الاصطناعي
- مساعدو الوكلاء
- تحليلات المكالمات
- ذكاء المحادثات
- النسخ الطبي
- وكلاء الصوت
- تلخيص المحتوى



