هوش مصنوعی و یادگیری ماشین

تحولی در تجربه شنیداری: معرفی سه قابلیت مبتنی بر هوش مصنوعی در پلتفرم Audible

پلتفرم Audible به عنوان پیشرو در دنیای کتاب‌های صوتی، با رونمایی از سه ویژگی جدیدِ مبتنی بر هوش مصنوعی، مرزهای تجربه شنیداری را گسترش داده است. این قابلیت‌ها که با هدف افزایش تعامل و درک عمیق‌تر مخاطب از محتوا طراحی شده‌اند، شامل «راهنمای شخصیت‌ها»، «داستان تعاملی» و «کاوشگر بصری» هستند که در پاییز ۱۴۰۳ به صورت محدود عرضه می‌شوند.

۱. راهنمای شخصیت‌ها (Character Guide): مدیریت هوشمند کاراکترها

یکی از چالش‌های رایج در رمان‌های کلاسیک و درام‌های صوتی پیچیده، دنبال کردن لیست بلندبالای شخصیت‌ها و تشخیص هویت گوینده در هر لحظه است. قابلیت Character Guide با بهره‌گیری از پردازش هوش مصنوعی، در لحظه نشان می‌دهد که کدام کاراکتر در حال صحبت است. این سیستم از «کارت‌های بدون اسپویلر» استفاده می‌کند که نه‌تنها نقش هر کاراکتر، بلکه اطلاعاتی پیرامون صداپیشه (Performer) و بیوگرافی او را نیز در اختیار شنونده قرار می‌دهد. در حال حاضر این ویژگی برای اثر کلاسیک «۱۹۸۴» جورج اورول در دسترس است و در تاریخ ۱۰ مهر ۱۴۰۳ برای اثر «دراکولا» برام استوکر نیز فعال خواهد شد.

۲. داستان تعاملی (Interactive Story): گذار از شنونده به بازیگر

Audible با معرفی Interactive Story، مفهوم کتاب صوتی را به یک تجربه بازی‌گونه تبدیل کرده است. در این ساختار، شنونده تنها یک مصرف‌کننده غیرفعال نیست، بلکه نقشی در روایت پیدا می‌کند. برای نمونه در نسخه تعاملی «دراکولا»، شخصیت «رنفیلد» مستقیماً با شنونده صحبت کرده، به او هدف و نقش می‌دهد و نسبت به پاسخ‌های کاربر به صورت بلادرنگ واکنش نشان می‌دهد. معماری این سیستم به گونه‌ای طراحی شده که علی‌رغم تعاملی بودن، همچنان به دیدگاه هنری نویسنده اصلی وفادار بماند.

۳. کاوشگر بصری (Visual Explorer): ابعاد جدید در درک محتوا

ویژگی Visual Explorer با هدف غنای بصری طراحی شده است. در لحظات کلیدیِ روایت، تصاویری مرتبط، نقشه‌ها یا اطلاعات تکمیلی پیرامون مکان‌ها و وقایع برای شنونده به نمایش در می‌آید. این ابزار به ویژه برای کتاب‌های آموزشی یا تاریخی کاربرد فراوانی دارد. برای مثال در کتاب «تور بزرگ: داستان اروپا در شش شهر»، مخاطب هنگام شنیدن توضیحات درباره یک بنای تاریخی، تصویر آن را نیز مشاهده می‌کند که منجر به یکپارچگی ادراک سمعی و بصری می‌شود.

مشخصات فنی و محدودیت‌های عرضه

  • تکنولوژی زیربنایی: مدل‌های پیشرفته هوش مصنوعی مولد برای پردازش متن، تحلیل صوت و بازتولید تعاملی.
  • وضعیت عرضه: نسخه بتا (محدود).
  • مناطق جغرافیایی: ایالات متحده و بریتانیا.
  • پشتیبانی از محتوا: در حال حاضر محدود به عناوین خاص و انتخاب‌شده توسط تیم محتوای Audible.
  • مقیاس‌پذیری: برنامه‌ریزی برای گسترش ابزار به منظور پرسش و پاسخ تخصصی پیرامون فرآیند تولید کتاب‌های صوتی در آینده.

جمع‌بندی

حرکت Audible به سوی ادغام AI در زیرساخت پخش صوتی، نشان‌دهنده تغییر پارادایم از «گوش دادنِ صرف» به «تجربه چندرسانه‌ایِ هوشمند» است. اگرچه این قابلیت‌ها در حال حاضر در فاز آزمایشی هستند، اما پتانسیل بالایی برای بازتعریف صنعت کتاب‌های صوتی دارند. کاربران باید منتظر باشند تا در ماه‌های آینده، این ابزارها با طیف وسیع‌تری از آثار هماهنگ شوند.

📌 منبع و مطالعه بیشتر: Audible’s New AI Features Explained – Android Authority
حامد

حامد

مسئول مجله فناوری آسمان نقره‌ای