اپل همزمان با معرفی اپل واچ سری ۱۲ و اپل واچ اولترا ۴ مجموعه جدیدی از قابلیت های Apple Intelligence را با نام Audio Intelligence معرفی کرده است. این فناوری با استفاده از میکروفونهای اپل واچ، تراشه اختصاصی اپل و مدلهای هوش مصنوعی روی دستگاه و ابری، قابلیتهایی مانند تشخیص صدا، شناسایی خودکار موسیقی، Live Rewind و Siri Recap را ارائه میکند.
🔷 قابلیت Audio Intelligence با اپل واچ سری ۱۲ و اپل واچ اولترا ۴ معرفی شده و در ابتدا چهار ویژگی اصلی دارد.
🔷 قابلیت Live Rewind میتواند با دو بار فشردن Digital Crown، متن مربوط به ۱۵ ثانیه اخیر مکالمه را روی ساعت نمایش دهد.
🔷 قابلیت Siri Recap به انتخاب کاربر فعال میشود و امکان تعیین زمان یا مکان فعالیت آن وجود دارد.
🔷 اپل میگوید Audio Intelligence اختیاری است و برای حفاظت از حریم خصوصی از پردازش روی دستگاه و Secure Exclave تراشه S11 استفاده میکند.
🔷 قابلیتهای Live Rewind و Siri Recap اواخر ۲۰۲۶ بهصورت بتا و با پشتیبانی از زبان انگلیسی عرضه خواهند شد.
اپل Audio Intelligence را دسته کاملاً جدیدی از قابلیتهای Apple Intelligence توصیف میکند که از میکروفونهای اپل واچ، توان پردازشی تراشههای اختصاصی اپل و ترکیبی از مدلهای هوش مصنوعی روی دستگاه و مبتنی بر فضای ابری استفاده میکند.
هدف این فناوری کمک به تشخیص صداها، شناسایی موسیقی و ارائه قابلیتهایی است که کاربر بتواند بدون نیاز به تعامل مداوم با ساعت، اطلاعات موردنیاز خود را دریافت کند. اپل تأکید دارد که حفاظت از حریم خصوصی در تمام مراحل عملکرد این سیستم در نظر گرفته شده است.
مجموعه Audio Intelligence در زمان آغاز کار شامل چهار قابلیت Sound Recognition، شناسایی خودکار موسیقی با Shazam ،Live Rewind و Siri Recap خواهد بود.
اپل اعلام کرده است که دو قابلیت Live Rewind و Siri Recap اواخر سال ۲۰۲۶ بهصورت بتا و با پشتیبانی از زبان انگلیسی ارائه میشوند. جزئیات بیشتر درباره این دو ویژگی نیز هنگام عرضه منتشر خواهد شد.
تمام قابلیتهای Audio Intelligence بهصورت اختیاری یا Opt-in ارائه میشوند؛ بنابراین کاربر باید شخصاً آنها را فعال کند. امکان فعال یا غیرفعال کردن Live Rewind و Siri Recap نیز در اختیار کاربران قرار دارد.
یکی از ویژگیهای جالب Audio Intelligence قابلیت Live Rewind است که با دو بار فشردن عمدی Digital Crown فعال میشود. پس از فعالسازی، ساعت میتواند متن مربوط به ۱۵ ثانیه آخر گفتار را روی نمایشگر نشان دهد.
اپل تأکید میکند که Live Rewind پس از آن به رونویسی مکالمه در پسزمینه ادامه نمیدهد. متن ایجادشده نیز ذخیره نخواهد شد، مگر اینکه کاربر تصمیم بگیرد درباره محتوای آن از Siri سؤال کند یا آن را در اپلیکیشن Siri ذخیره کند.
برای فعالسازی این قابلیت، کاربر باید در اپلیکیشن Watch آیفون وارد بخش Siri و سپس Live Rewind شود و گزینه مربوط به دو بار فشردن Digital Crown را فعال کند.
اپل همچنین میگوید هنگام استفاده از Live Rewind، افراد نزدیک به کاربر از طریق صدای هشدار و نشانگرهای بصری از فعال شدن این قابلیت مطلع میشوند.
ویژگی دیگر این مجموعه با نام Siri Recap تنها زمانی اجرا میشود که خود کاربر آن را فعال کرده باشد. این قابلیت نیز از طریق اپلیکیشن Watch روی آیفون قابل فعالسازی است.
کاربر پس از فعال کردن Siri Recap میتواند برای عملکرد آن برنامهای براساس زمان، مکان یا ترکیبی از هر دو تعریف کند. برای مثال، امکان تنظیم قابلیت بهگونهای وجود دارد که فقط در محل کار فعال باشد یا در ساعات شب فعالیت نکند.
امکان کنترل دستی نیز وجود دارد و کاربر میتواند Siri Recap را در هر زمان از طریق Control Center فعال یا غیرفعال کند.
اپل میگوید Audio Intelligence گفتار را به افراد مختلف نسبت نمیدهد. قابلیت Siri Recap نیز بهگونهای طراحی شده است که محتوای بالقوه مضر و اطلاعات حساس را از خروجی خود حذف کند.
اپل برای تشریح جزئیات حریم خصوصی قابلیتهای جدید، یک سند ۱۱ صفحهای منتشر کرده است. بخشی از این سند به نحوه پردازش صوت در Live Rewind و Siri Recap و نقش Secure Exclave در تراشه S11 اختصاص دارد.
در قابلیت Live Rewind، صدای دریافتشده از میکروفون وارد یک بافر صوتی در Secure Exclave تراشه S11 میشود. دادههای صوتی قدیمی بهطور مداوم با دادههای جدید جایگزین میشوند؛ در نتیجه، صدا به شکل پیوسته روی دستگاه انباشته نمیشود.
طبق توضیح اپل، صدای خام خارج از این بافر محافظتشده قابل دسترسی نیست. این سازوکار به Live Rewind اجازه میدهد در صورت درخواست کاربر به چند ثانیه قبل بازگردد، بدون اینکه یک آرشیو دائمی از صدای محیط ایجاد شود.
در قابلیت Siri Recap، تراشه S11 ابتدا از یک مدل هوش مصنوعی سبک برای تشخیص وجود گفتار در محیط اطراف استفاده میکند. این مدل در این مرحله هیچ محتوایی را رونویسی یا ضبط نمیکند و صرفاً تشخیص میدهد که آیا مکالمهای آغاز شده است یا خیر.
اگر سیستم وجود مکالمه را تشخیص دهد، صدا وارد یک بافر محافظتشده در Secure Exclave تراشه S11 میشود. اپل میگوید این بخش در سطح سختافزاری ایزوله شده است؛ بهگونهای که کاربر، سیستمعامل، اپلیکیشنها و حتی خود اپل نمیتوانند مستقیماً به محتوای این بافر دسترسی داشته باشند.
قابلیتهای Sound Recognition و شناسایی خودکار موسیقی با Shazam بخشی از مجموعه اولیه Audio Intelligence هستند. اپل اعلام کرده است که Live Rewind و Siri Recap اواخر سال ۲۰۲۶ بهصورت آزمایشی و با پشتیبانی اولیه از زبان انگلیسی ارائه خواهند شد.
این شرکت وعده داده است جزئیات بیشتری درباره این دو قابلیت همزمان با عرضه آنها منتشر کند.
مجموعه Audio Intelligence قابلیتهای صوتی اپل واچ را با استفاده از هوش مصنوعی گسترش میدهد و ویژگیهایی مانند تشخیص صدا، شناسایی خودکار موسیقی، مشاهده متن ۱۵ ثانیه اخیر گفتار و خلاصهسازی با Siri را در اختیار کاربران قرار میدهد. بخش مهم رویکرد اپل نیز به پردازش محافظتشده صوت در تراشه S11 و اختیاری بودن فعالسازی قابلیتها مربوط میشود.
به نظر شما قابلیت Live Rewind برای مشاهده متن ۱۵ ثانیه اخیر مکالمه میتواند به یکی از ویژگیهای کاربردی روزمره اپل واچ تبدیل شود؟