رشد اپل در بازار ساعت هوشمند؛ هواوی همچنان در صدر فروش جهانی

بازار جهانی ساعت‌های هوشمند پس از یک سال رشد، در سه‌ماهه دوم ۲۰۲۶ با کاهش مواجه شده است. بر اساس داده‌های Counterpoint Research، میزان عرضه ساعت‌های هوشمند در این دوره نسبت به مدت مشابه سال قبل ۴ درصد کاهش یافته و در همین حال، اپل سریع‌ترین رشد را میان پنج برند بزرگ بازار تجربه کرده است؛ هرچند هواوی همچنان بیشترین سهم از عرضه جهانی را در اختیار دارد.

چرا بازار ساعت‌های هوشمند کند شده است؟

کاهش عرضه لزوماً به معنای کاهش علاقه کاربران به ساعت‌های هوشمند نیست. یکی از عوامل مهم، طولانی‌تر شدن چرخه تعویض این محصولات است. بسیاری از ساعت‌های هوشمند موجود همچنان قابلیت‌های کافی برای نیازهای روزمره کاربران دارند و مدل‌های جدید نیز در برخی موارد امکاناتی ارائه نمی‌کنند که به‌تنهایی خرید یک دستگاه جدید را توجیه کند.

ساعت هوشمند

این موضوع در هر دو بخش اقتصادی و گران‌قیمت بازار دیده می‌شود. در بخش مدل‌های ارزان‌تر، ارتقای قابلیت‌های پایش سلامت چندان چشمگیر نیست و کاربران انگیزه کمتری برای تعویض دستگاه خود دارند. در بخش محصولات پریمیوم نیز برخی مصرف‌کنندگان ترجیح می‌دهند تا معرفی نسل‌های جدید صبر کنند.

در نتیجه، بازار با شرایطی مواجه شده که محصولات موجود به اندازه‌ای بالغ شده‌اند که کاربران برای تعویض آن‌ها عجله ندارند.

اپل سریع‌ترین رشد را در میان برندهای بزرگ ثبت کرد

اپل در سه‌ماهه دوم ۲۰۲۶ عملکرد قابل‌توجهی داشت و بیشترین نرخ رشد سالانه را در میان پنج برند برتر بازار ساعت‌های هوشمند به ثبت رساند. عرضه محصولات این شرکت در تمامی مناطق افزایش پیدا کرده است.

بیش از ۸۰ درصد ساعت‌های هوشمند عرضه‌شده توسط اپل در این دوره مربوط به Apple Watch Series 11 و Apple Watch SE 3 بوده است. این آمار نشان می‌دهد مدل‌های جدید این شرکت نقش اصلی را در رشد فروش آن ایفا کرده‌اند.

عملکرد اپل در بازار چین نیز اهمیت ویژه‌ای دارد؛ چراکه این شرکت در سه‌ماهه دوم سال گذشته با کاهش عرضه در این کشور مواجه شده بود و اکنون بخشی از این افت را جبران کرده است.

هواوی همچنان بیشترین ساعت هوشمند را عرضه می‌کند

با وجود رشد سریع اپل، هواوی در مجموع بیشترین میزان عرضه جهانی ساعت‌های هوشمند را در سه‌ماهه دوم ۲۰۲۶ به خود اختصاص داده است.

با این حال، وابستگی هواوی به بازار چین بسیار بالاست. حدود ۸۰ درصد از کل ساعت‌های هوشمند عرضه‌شده توسط این شرکت در سراسر جهان، در بازار چین به فروش رسیده‌اند.

نقش چین در بازار جهانی ساعت‌های هوشمند نیز در حال افزایش است. مصرف‌کنندگان چینی در سه‌ماهه دوم ۲۰۲۶ حدود ۳۸ درصد از کل عرضه جهانی این محصولات را به خود اختصاص دادند؛ رقمی که بالاترین سهم ثبت‌شده این کشور تاکنون محسوب می‌شود.

ساعت هوشمند

به بیان دیگر، تقریباً چهار دستگاه از هر ۱۰ ساعت هوشمند عرضه‌شده در جهان در این دوره راهی بازار چین شده است.

بازار داخلی چین نیز در همین بازه زمانی ۷ درصد رشد سالانه داشته است. افزایش تقاضا برای برندهای داخلی از جمله هواوی و اجرای یارانه‌های دولتی برای خرید محصولات مصرفی، از عوامل مؤثر بر این رشد عنوان شده‌اند.

آینده بازار به قابلیت‌های جدید وابسته است

Counterpoint Research پیش‌بینی می‌کند بازار جهانی ساعت‌های هوشمند در مجموع سال ۲۰۲۶ تنها حدود یک درصد رشد کند. این رقم نشان می‌دهد این بازار که زمانی یکی از سریع‌ترین حوزه‌های رشد تجهیزات الکترونیکی محسوب می‌شد، اکنون وارد مرحله‌ای بالغ‌تر شده است.

با این حال، ورود قابلیت‌های جدید می‌تواند دوباره چرخه تعویض دستگاه‌ها را فعال کند. هوش مصنوعی پیشرفته‌تر روی خود دستگاه، قابلیت اندازه‌گیری فشار خون و در آینده فناوری‌های قابل‌اعتماد برای اندازه‌گیری غیرتهاجمی قند خون، از جمله امکاناتی هستند که می‌توانند کاربران را به خرید نسل جدید ساعت‌های هوشمند ترغیب کنند.

در شرایط فعلی، به نظر می‌رسد چالش اصلی بازار دیگر متقاعد کردن کاربران برای خرید نخستین ساعت هوشمند نیست؛ بلکه ارائه قابلیت‌هایی است که بتواند مالک یک ساعت فعلی را به تعویض دستگاه خود قانع کند.

نوشته رشد اپل در بازار ساعت هوشمند؛ هواوی همچنان در صدر فروش جهانی اولین بار در آی‌ تی‌ رسان منتشر شد.

OriginOS ۷ با اندروید ۱۷ معرفی شد؛ تمرکز vivo بر سرعت، هوش مصنوعی و اتصال به دستگاه‌های اپل

vivo هم‌زمان با معرفی سری X500 در چین، نسخه جدید رابط کاربری خود را با نام OriginOS 7 معرفی کرد. این نسخه که بر پایه اندروید 17 توسعه یافته، علاوه بر بهینه‌سازی عملکرد و انیمیشن‌های رابط کاربری، امکانات بیشتری برای اتصال گوشی‌های vivo به دستگاه‌های اپل و رایانه‌های شخصی ارائه می‌دهد.

vivo در طراحی OriginOS 7 تمرکز ویژه‌ای بر حفظ روانی سیستم در استفاده طولانی‌مدت داشته است. این شرکت می‌گوید رابط کاربری جدید حتی پس از حدود ۶ سال استفاده روزمره نیز باید عملکرد روان خود را حفظ کند.

افزایش سرعت اجرای برنامه‌ها و مدیریت حافظه

یکی از بخش‌های اصلی OriginOS 7، نسل جدید موتور Origin Smooth Engine است. این موتور با بازطراحی معماری بخش‌هایی مانند پردازش گرافیکی، مدیریت حافظه و زمان‌بندی وظایف سیستم، منابع سخت‌افزاری را با توجه به شرایط استفاده مدیریت می‌کند.

قابلیت Ultra-Core Computing نیز وظیفه تخصیص پویای منابع پردازشی را بر عهده دارد تا در زمان اجرای برنامه‌های سنگین، پاسخ‌گویی سیستم کاهش پیدا نکند.

بر اساس اعلام vivo، زمان اجرای اولیه برنامه‌ها نسبت به نسل قبل ۱۰ درصد کاهش یافته و جابه‌جایی میان صفحات برنامه‌ها نیز ۱۱ درصد سریع‌تر شده است. فناوری Memory Fusion هم مدیریت تخصیص و آزادسازی حافظه را بهبود داده و طبق ادعای شرکت، میزان بازیابی حافظه را تا ۶۰ درصد افزایش می‌دهد.

OriginOS 7

vivo همچنین اعلام کرده که این فناوری می‌تواند روی یک گوشی با ۲۵۶ گیگابایت حافظه ذخیره‌سازی، تا ۲۵ گیگابایت فضای بیشتری آزاد کند. به‌روزرسانی خط لوله رندر نیز موجب افزایش ۱۴.۴ درصدی بهره‌وری پردازش گرافیکی شده است.

انیمیشن‌های طبیعی‌تر در OriginOS 7

vivo در نسخه جدید رابط کاربری خود، حرکت عناصر روی نمایشگر را بر اساس رفتارهای طبیعی طراحی کرده است. در نتیجه، حرکاتی مانند لمس، کشیدن و جابه‌جایی بین صفحات باید واکنش روان‌تری داشته باشند.

قابلیت Fluid Motion نیز از حرکات الهام‌گرفته از مایعات استفاده می‌کند؛ به این ترتیب عناصر رابط کاربری هنگام لمس و کشیدن می‌توانند متناسب با سرعت و جهت حرکت انگشت کشیده، فشرده یا جابه‌جا شوند.

سازگاری بیشتر با اپل واچ و ایرپاد

یکی از تغییرات قابل‌توجه OriginOS 7، افزایش سازگاری گوشی‌های vivo با برخی محصولات اپل است. کاربران می‌توانند اپل واچ را به گوشی متصل کنند و اعلان‌ها را روی گوشی دریافت کنند. اطلاعات ضروری مربوط به فعالیت‌های ورزشی و سلامت نیز می‌تواند با اپلیکیشن Origin Health همگام شود.

OriginOS 7 همچنین میزان شارژ ایرپادها را در Origin Island نمایش می‌دهد و از صدای فضایی یا Spatial Audio پشتیبانی می‌کند.

قابلیت vivo Office Kit نیز همچنان برای اتصال گوشی به آیپد، مک و رایانه‌های ویندوزی در دسترس است. علاوه بر این، کاربران می‌توانند فایل‌های ذخیره‌شده در iCloud را مستقیماً از طریق فایل‌منیجر vivo مشاهده کنند.

Jovi به‌عنوان دستیار هوشمند بین دستگاه‌ها

دستیار هوشمند Jovi بخش دیگری از تجربه جدید OriginOS 7 است. این دستیار که قابلیت فعالیت میان چند دستگاه را دارد، می‌تواند برخی وظایف را میان گوشی و رایانه هماهنگ کند و حتی اجرای کارهای زمان‌بندی‌شده را بر عهده بگیرد.

vivo برای اقدامات خودکار Jovi نیز روی شفافیت تأکید کرده است. طبق اعلام شرکت، فعالیت‌های مستقل این دستیار ثبت می‌شوند و برای مراحل مهم، اجازه مستقیم کاربر مورد نیاز خواهد بود.

تم‌های تعاملی جدید

OriginOS 7 مجموعه‌ای از تم‌ها و قابلیت‌های شخصی‌سازی جدید را نیز در اختیار کاربران قرار می‌دهد. برای مثال، Wiggle Theme تصاویر را به سطوحی شبیه مایع تبدیل می‌کند که هنگام لمس واکنش نشان می‌دهند.

Glint Theme نیز از ژیروسکوپ گوشی برای ایجاد جلوه‌های نور و سایه روی تصاویر پس‌زمینه استفاده می‌کند. در این حالت، با تغییر زاویه گوشی، نحوه تابش نور روی تصویر نیز تغییر می‌کند.

قابلیت StickIt امکان ساخت کلاژهای چندلایه و پویا از تصاویر و Live Photos را برای صفحه قفل، صفحه اصلی و نمایشگر همیشه‌روشن فراهم می‌کند.

Pet Pals نیز حیوانات تعاملی را روی نمایشگر قرار می‌دهد که می‌توانند نسبت به حرکت گوشی، اتصال دستگاه به شارژر، پخش موسیقی و حتی تغییر زمان روز از روز به شب واکنش نشان دهند.

نسخه آزمایشی OriginOS 7 از امروز منتشر می‌شود

vivo اعلام کرده است که OriginOS 7 از امروز در قالب Preview Program یا همان نسخه بتای عمومی در دسترس قرار می‌گیرد. نخستین دستگاه‌های واجد شرایط شامل vivo X300 Pro و برخی مدل‌های منتخب iQOO هستند.

این برنامه آزمایشی فعلاً در هند، تایلند و مالزی ارائه می‌شود و انتظار می‌رود vivo در ادامه، جزئیات بیشتری درباره زمان انتشار نسخه پایدار OriginOS 7 و فهرست دستگاه‌های دریافت‌کننده آن اعلام کند.

نوشته OriginOS ۷ با اندروید ۱۷ معرفی شد؛ تمرکز vivo بر سرعت، هوش مصنوعی و اتصال به دستگاه‌های اپل اولین بار در آی‌ تی‌ رسان منتشر شد.

ماشین ظرف‌شویی جدید شیائومی با فشار آب ۵۲ هزار پاسکال و خشک‌کن ۱۱۵ درجه‌ای معرفی شد

شیائومی از ماشین ظرف‌شویی توکار جدیدی در سری Mijia رونمایی کرده است که با ظرفیت بالا، فشار آب چشمگیر و سیستم خشک‌کن مبتنی بر بخار، خانواده‌های پرجمعیت را هدف قرار می‌دهد. این محصول با نام Mijia Smart Dishwasher Built-in 20-Set به محفظه‌ای ۱۵۶ لیتری مجهز شده و می‌تواند حجم زیادی از ظروف را در یک چرخه شست‌وشو تمیز کند.

ظرفیت بالا برای خانواده‌های پرجمعیت

محفظه داخلی این ماشین ظرف‌شویی امکان شست‌وشوی هم‌زمان حدود ۱۴۴ قطعه ظرف را فراهم می‌کند. طراحی دستگاه کاملاً توکار است و پس از نصب، با سطح کابینت هم‌تراز می‌شود. شیائومی این مدل را در دو رنگ مشکی و سفید عرضه می‌کند و برای آن چراغ وضعیت روی زمین و نور داخلی هنگام باز شدن در نظر گرفته است.

ماشین ظرف‌شویی شیائومی

یکی از ویژگی‌های مهم دستگاه، موتور اینورتر BLDC است که می‌تواند فشار آب را به ۵۲ هزار پاسکال برساند. بازوهای آب‌پاش ماهواره‌ای چرخان نیز در کنار سیستم سه‌گانه پاشش آب، آب را به بخش‌های مختلف محفظه می‌رسانند تا نقاط دشوارتر نیز تحت پوشش قرار بگیرند.

شست‌وشو با آب ۷۵ درجه و خشک‌کن بخار ۱۱۵ درجه

دمای آب در فرایند شست‌وشو به ۷۵ درجه سانتی‌گراد می‌رسد. پس از پایان شست‌وشو نیز سیستم خشک‌کن دستگاه با استفاده از بخار ۱۱۵ درجه‌ای، به ازبین‌بردن لکه‌های سرسخت کمک می‌کند.

ماشین ظرف‌شویی شیائومی

ماشین ظرف‌شویی جدید میجیا به حسگر تشخیص میزان آلودگی ظروف نیز مجهز شده است. این حسگر می‌تواند بر اساس میزان کثیفی، برنامه شست‌وشوی مناسب را انتخاب کند. سریع‌ترین چرخه شست‌وشوی دستگاه نیز در مدت ۷۰ دقیقه کامل می‌شود.

شیائومی همچنین اعلام کرده است که این محصول استاندارد استریل هفت‌ستاره را دریافت کرده و قادر است تا ۹۹٫۹۹۹۹۹ درصد باکتری‌ها را از بین ببرد.

ماشین ظرف‌شویی شیائومی

نگهداری ظروف تمیز تا ۱۰ روز بدون ایجاد بو

یکی دیگر از قابلیت‌های این ماشین ظرف‌شویی، سیستم هوای تازه است. این فناوری اجازه می‌دهد ظروف شسته‌شده تا ۲۴۰ ساعت، معادل ۱۰ روز، داخل دستگاه باقی بمانند و در شرایط بدون بو نگهداری شوند.

ماشین ظرف‌شویی شیائومی

کاربران می‌توانند عملکردهای مختلف دستگاه را از طریق اپلیکیشن Mi Home کنترل کنند. این محصول همچنین با اکوسیستم هوشمند شیائومی سازگار است و امکان مدیریت امکانات دستگاه از طریق تجهیزات و خدمات این اکوسیستم را فراهم می‌کند.

قیمت Mijia Smart Dishwasher Built-in 20-Set حدود ۴۶۰۰ یوان، معادل تقریبی ۶۵۸ دلار، اعلام شده است.

ماشین ظرف‌شویی شیائومی

نوشته ماشین ظرف‌شویی جدید شیائومی با فشار آب ۵۲ هزار پاسکال و خشک‌کن ۱۱۵ درجه‌ای معرفی شد اولین بار در آی‌ تی‌ رسان منتشر شد.

آیا صنعت هوش مصنوعی واقعا آماده کاهش سرعت توسعه است؟

بحث بر سر ایمنی هوش مصنوعی و احتمال کاهش سرعت توسعه مدل‌های پیشرفته دوباره بالا گرفته است. از یک سو، داریو آمودی، مدیرعامل Anthropic، طرحی برای «تنظیم سرعت توسعه» مدل‌های مرزی مطرح کرده و از سوی دیگر، جنسن هوانگ، مدیرعامل Nvidia، با ایده کاهش سرعت صنعت هوش مصنوعی مخالفت کرده است.

این اختلاف دیدگاه در تازه‌ترین قسمت پادکست Equity از TechCrunch نیز مورد بررسی قرار گرفت. آنتونی ها، کریستن کوروسک و شان اوکان درباره این پرسش گفت‌وگو کردند که آیا مدیرانی مانند آمودی و سم آلتمن واقعاً به‌دنبال کاهش سرعت توسعه هوش مصنوعی هستند یا پیشنهادهای اخیر بیشتر به ایجاد چارچوب‌های ایمنی مربوط می‌شود.

طرح Anthropic برای کنترل سرعت توسعه هوش مصنوعی چیست؟

شان اوکان معتقد است هنوز جزئیات کافی درباره معنای دقیق «کاهش سرعت» ارائه نشده است. او با اشاره به پیشنهاد آمودی گفت این طرح، باوجود حمایت برخی مدیران صنعت، همچنان درباره چگونگی اجرای ایده‌های مطرح‌شده ابهام دارد.

هوش مصنوعی

آنتونی ها نیز به نکته مشابهی اشاره کرد و گفت سرعت حمایت فعالان حوزه هوش مصنوعی از این ایده قابل توجه بوده است. به گفته او، بخش‌هایی از این پیشنهادها پیش از انتشار مطلب آمودی نیز در جامعه فعالان ایمنی هوش مصنوعی مطرح شده بود و ایده‌های جدیدی محسوب نمی‌شوند.

بااین‌حال، این حمایت گسترده لزوماً به معنای حرکت صنعت به سمت یک کاهش سرعت واقعی نیست و مشخص نیست شرکت‌ها در عمل چه محدودیت‌هایی را خواهند پذیرفت.

کریستن کوروسک نیز تأکید کرد که بحث فعلی مشخصاً درباره آزمایشگاه‌های توسعه‌دهنده هوش مصنوعی پیشرفته یا Frontier AI Labs است. یکی از پیشنهادهای مطرح‌شده، استفاده از ارزیابان مستقل شخص ثالث برای نظارت بر اقدامات ایمنی و حوادث مرتبط با هوش مصنوعی در شرکت‌هایی مانند Anthropic و OpenAI است.

پیشنهاد دیگر به هماهنگی شرکت‌های بزرگ هوش مصنوعی در کشورهای دموکراتیک برای تعیین استانداردها و محدودیت‌های ایمنی مربوط می‌شود. در سطح بین‌المللی نیز ایده همکاری میان کشورها برای هماهنگ‌سازی اقدامات ایمنی مطرح شده است.

چرا Nvidia با کاهش سرعت هوش مصنوعی مخالف است؟

در مقابل این دیدگاه، جنسن هوانگ موضع متفاوتی گرفته است. مدیرعامل Nvidia در اظهارات اخیر خود از ایده ادامه حرکت صنعت هوش مصنوعی حمایت کرده و در جریان حضورش در کنفرانس All-In Summit نیز در گفت‌وگویی با دونالد ترامپ بر مخالفت با کاهش سرعت توسعه این صنعت تأکید کرد.

شان اوکان معتقد است هوانگ در سال‌های اخیر به نوعی به یکی از چهره‌های رابط میان صنعت هوش مصنوعی و دولت آمریکا تبدیل شده است. او همچنین نقش هوانگ را با جایگاهی که پیش‌تر برای مدیرعامل Microsoft، یعنی ساتیا نادلا، در نظر گرفته می‌شد مقایسه کرد.

از نگاه کریستن کوروسک، موقعیت Nvidia در این بحث اهمیت ویژه‌ای دارد؛ زیرا این شرکت از گسترش زیرساخت‌ها و توسعه سریع هوش مصنوعی سود اقتصادی می‌برد. بنابراین، او حضور هوانگ در این بحث را از منظر منافع تجاری Nvidia نیز قابل بررسی می‌داند.

هوش مصنوعی

در مقابل، در این گفت‌وگو تأکید شد که هوانگ صرفاً از واژه «کاهش سرعت» استفاده نمی‌کند و اختلاف اصلی تا حدی به نحوه تعریف این مفهوم برمی‌گردد.

آیا «تنظیم سرعت» با «کاهش سرعت» تفاوت دارد؟

یکی از نکات مهم بحث، تفاوت میان واژه‌های «Slowdown» و «Pace» است. آمودی و آلتمن در اظهارات خود بیشتر از مفهوم تنظیم یا مدیریت سرعت توسعه استفاده کرده‌اند و لزوماً به معنای توقف یا کاهش مستقیم سرعت پیشرفت فناوری صحبت نکرده‌اند.

سه محور اصلی پیشنهادهای مطرح‌شده نیز الزاماً به‌معنای کندشدن توسعه مدل‌ها نیستند. نظارت مستقل بر ایمنی، تعیین استانداردهای مشترک و همکاری بین‌المللی می‌توانند چارچوب‌های نظارتی ایجاد کنند، اما مشخص نیست این اقدامات تا چه اندازه سرعت توسعه مدل‌های جدید را کاهش خواهند داد.

به همین دلیل، بخشی از اختلاف فعلی میان فعالان صنعت ممکن است نه درباره اصل ایمنی، بلکه درباره میزان محدودیتی باشد که باید برای توسعه هوش مصنوعی در نظر گرفته شود.

آیا بازار آزاد می‌تواند صنعت هوش مصنوعی را کنترل کند؟

یکی دیگر از محورهای گفت‌وگو این بود که آیا اصلاً به مقررات جدید نیاز است یا سازوکار بازار و قوانین فعلی می‌توانند در برابر رفتارهای پرریسک شرکت‌های هوش مصنوعی نقش حفاظتی ایفا کنند.

کوروسک این پرسش را مطرح کرد که اگر شرکتی محصولی ناامن عرضه کند، آیا قوانین موجود و واکنش مشتریان نمی‌توانند آن شرکت را تحت فشار قرار دهند؟

اوکان پاسخ داد که در شرایط ایده‌آل، بازار آزاد می‌تواند چنین نقشی داشته باشد، اما معتقد است شرایط فعلی صنعت هوش مصنوعی با چنین بازاری فاصله دارد.

هوش مصنوعی

به گفته او، یکی از مشکلات این است که شرکت‌های هوش مصنوعی بخش قابل توجهی از درآمد خود را از مشتریان سازمانی به دست می‌آورند. در چنین شرایطی، واکنش مصرف‌کنندگان عادی تأثیر کمتری بر تصمیمات شرکت‌ها دارد.

برای مثال، یک شرکت بزرگ لزوماً صرفاً به دلیل اختلاف بر سر یک موضوع اخلاقی یا ایمنی، سرویس مورد استفاده خود را از یک ارائه‌دهنده به رقیب آن منتقل نمی‌کند؛ زیرا چنین تغییری می‌تواند هزینه و پیچیدگی زیادی داشته باشد.

از سوی دیگر، سرمایه‌گذاری گسترده در شرکت‌های هوش مصنوعی می‌تواند توانایی آنها برای تحمل زیان‌های کوتاه‌مدت را افزایش دهد. بنابراین، حتی اگر یک شرکت به دلیل تصمیمی بحث‌برانگیز با بخشی از مشتریان خود مواجه شود، ممکن است منابع مالی کافی برای ادامه فعالیت داشته باشد.

آینده ایمنی هوش مصنوعی به کدام سمت می‌رود؟

بحث اخیر نشان می‌دهد که میان فعالان صنعت درباره نحوه مدیریت ریسک‌های هوش مصنوعی اجماع کاملی وجود ندارد. برخی مدیران از ایجاد سازوکارهای نظارتی و هماهنگی بیشتر صحبت می‌کنند، درحالی‌که برخی دیگر بر ادامه سرعت فعلی توسعه تأکید دارند.

در حال حاضر، پیشنهادهایی مانند ارزیابی مستقل، استانداردهای مشترک و همکاری بین‌المللی مطرح شده‌اند، اما جزئیات اجرایی و میزان الزام‌آوربودن آنها همچنان محل بحث است.

در نتیجه، سؤال اصلی فقط این نیست که آیا صنعت هوش مصنوعی باید «کندتر» شود؛ بلکه مسئله مهم‌تر این است که چه سطحی از نظارت و کنترل می‌تواند هم‌زمان با ادامه توسعه فناوری، ریسک‌های آن را مدیریت کند.

نوشته آیا صنعت هوش مصنوعی واقعا آماده کاهش سرعت توسعه است؟ اولین بار در آی‌ تی‌ رسان منتشر شد.

ریش‌تراش جدید شیائومی با تیغه‌های طرح ابر و شارژدهی ۶۰ روزه معرفی شد

شیائومی مدل جدیدی از ریش‌تراش‌های اقتصادی خود را معرفی کرده است که در کنار قیمت پایین، از طراحی ویژه تیغه، استاندارد ضدآب IPX7 و باتری با شارژدهی طولانی بهره می‌برد. Mijia Electric Shaver S101 Cloud Pattern Blade Edition دومین محصول این شرکت با تیغه‌های موسوم به «طرح ابر» محسوب می‌شود.

این ریش‌تراش در مرحله پیش‌فروش با قیمت ۱۰۵ یوان، معادل حدود ۱۵ دلار، عرضه می‌شود؛ اما پس از پایان این دوره، قیمت آن به ۱۴۹ یوان، حدود ۲۲ دلار، افزایش خواهد یافت.

تیغه‌های طرح ابر برای اصلاح سریع‌تر

شیائومی برای تیغه این مدل از فرایند قالب‌گیری تزریقی فلز استفاده کرده است. ساختار حلقه‌ای و دوگانه تیغه‌های طرح ابر، سطح بیشتری را هنگام اصلاح پوشش می‌دهد و در مقایسه با شیارهای مستقیم معمول، می‌تواند بازدهی اصلاح را افزایش دهد.

ریش‌تراش شیائومی

در بخش برش نیز از فولاد ضدزنگ با ساختار مقعر استفاده شده است. این طراحی به ورود سریع موها به بخش برش کمک می‌کند و با کاهش کشیده‌شدن مو، فشار واردشده به پوست را کاهش می‌دهد.

سه تیغه شناور مستقل نیز در ساختار دستگاه قرار گرفته‌اند. این تیغه‌ها می‌توانند در شش جهت حرکت کنند تا تماس بیشتری با انحنای صورت داشته باشند. سری اصلاح نیز به‌سادگی از بدنه جدا می‌شود و امکان شست‌وشوی آن را فراهم می‌کند.

ضدآب و مجهز به کنترل هوشمند سرعت

Mijia S101 به لطف برخورداری از گواهی IPX7 در برابر آب مقاوم است و می‌توان آن را برای شست‌وشوی راحت‌تر استفاده کرد.

یکی دیگر از قابلیت‌های این مدل، سیستم کنترل هوشمند سرعت موتور است. این سیستم هنگام کاهش سطح شارژ باتری تلاش می‌کند توان موتور را حفظ کند تا عملکرد دستگاه در طول استفاده افت محسوسی نداشته باشد.

ریش‌تراش شیائومی

شارژ کامل در ۱.۵ ساعت و دوام ۶۰ روزه

شیائومی برای شارژ این ریش‌تراش از درگاه USB Type-C استفاده کرده است. شارژ کامل باتری حدود یک ساعت و نیم زمان می‌برد.

طبق اعلام شرکت، با یک بار شارژ می‌توان تا ۶۰ روز از دستگاه استفاده کرد؛ البته این رقم بر اساس استفاده روزانه یک دقیقه محاسبه شده است.

Mijia Electric Shaver S101 Cloud Pattern Blade Edition در دو رنگ آبی گرگ‌وتاب و خاکستری عرضه می‌شود و با قیمت پایه حدود ۱۵ دلار، یکی از گزینه‌های اقتصادی شیائومی در بازار ریش‌تراش‌های برقی به شمار می‌رود.

نوشته ریش‌تراش جدید شیائومی با تیغه‌های طرح ابر و شارژدهی ۶۰ روزه معرفی شد اولین بار در آی‌ تی‌ رسان منتشر شد.

حلقه هوشمند Vocci برای یادداشت‌برداری از جلسات معرفی شد؛ ضبط صدا با یک لمس

بازار ابزارهای هوشمند برای ثبت محتوای جلسات حالا یک فرم‌فکتور جدید دارد. Vocci حلقه‌ای هوشمند ساخته است که با هدف ضبط مکالمات و تبدیل آنها به متن طراحی شده و می‌تواند بدون نیاز به در دست گرفتن گوشی، محتوای جلسه را ثبت کند.

در سال‌های اخیر ابزارهای مختلفی برای یادداشت‌برداری خودکار از جلسات معرفی شده‌اند؛ از پین و گردنبند گرفته تا گجت‌هایی با ظاهر کارت بانکی. Vocci اکنون با محصولی انگشتری‌شکل وارد همین بازار شده است؛ محصولی که از نظر سهولت استفاده جذاب به‌نظر می‌رسد، اما شکل ظاهری آن پرسش‌هایی درباره حریم خصوصی ایجاد می‌کند.

حلقه Vocci چگونه کار می‌کند؟

روی این حلقه یک دکمه فیزیکی قرار گرفته است. با دو بار ضربه‌زدن روی دکمه، ضبط صدا آغاز می‌شود و با دو ضربه دیگر می‌توان آن را متوقف کرد. کاربر همچنین می‌تواند دکمه را نگه دارد تا از هوش مصنوعی Vocci سؤال بپرسد؛ البته برای استفاده از این قابلیت باید اپلیکیشن مربوطه باز باشد.

حلقه هوشمند Vocci

یک چراغ نشانگر وضعیت ضبط را نمایش می‌دهد و موتور لرزشی نیز بازخورد لمسی ارائه می‌کند. وزن حلقه کمتر از ۶ گرم است و سطوح داخلی و خارجی آن از تیتانیوم ساخته شده‌اند؛ هرچند به نظر می‌رسد منظور شرکت، استفاده از پوشش تیتانیومی باشد.

Vocci اعلام کرده است که باتری این حلقه با یک بار شارژ تا ۸ ساعت امکان ضبط دارد. کیس پلاستیکی نسبتاً بزرگی نیز همراه محصول عرضه می‌شود که می‌تواند باتری حلقه را تا سه مرتبه شارژ کند.

عملکرد خوب در جلسات طولانی، اما نه برای یادداشت‌های کوتاه

حلقه Vocci در ضبط مکالمات طولانی عملکرد قابل‌قبولی دارد. حتی در محیط‌های شلوغ مانند کافه، مکالمات بیش از یک ساعت توسط دستگاه ضبط شده و بخش عمده گفت‌وگو نیز با دقت مناسبی به متن تبدیل شده است.

بااین‌حال، همین شیوه برای ثبت یادداشت‌های بسیار کوتاه چندان ایده‌آل نیست. مشکل اصلی در این بخش بیشتر به نرم‌افزار مربوط می‌شود تا سخت‌افزار.

اپلیکیشن Vocci رابط کاربری کاملاً ساده‌ای ندارد و بعضی از قابلیت‌های آن می‌توانند گیج‌کننده باشند. برای نمونه، هنگام ثبت یادداشت‌های کوتاه، بخش مربوط به تحلیل هوش مصنوعی گاهی خلاصه‌ای طولانی‌تر از خود یادداشت تولید می‌کند.

هر ضبط در برنامه به سه بخش تقسیم می‌شود: Chat که متن اصلی مکالمه را ارائه می‌دهد، Highlights که امکان ذخیره بخش‌های کوتاه از گفت‌وگو را هنگام ضبط فراهم می‌کند و Notes که خلاصه و تحلیل کلی مکالمه را در اختیار کاربر می‌گذارد.

بخش دیگری با نام Base نیز برای دسترسی به متن‌های پیاده‌سازی‌شده، فایل‌های ضبط‌شده و محتوای تولیدشده توسط هوش مصنوعی در نظر گرفته شده است. بااین‌حال، وجود بخش‌های مشابه باعث شده ساختار نرم‌افزار تا حدی تکراری به نظر برسد و امکان شروع مستقیم گفت‌وگو با هوش مصنوعی درباره متن یک جلسه نیز به‌سادگی در دسترس نیست.

حلقه هوشمند Vocci

مشکل یک حلقه هوشمند در یادآوری و اتوماسیون

فرم‌فکتور حلقه می‌تواند برای ثبت سریع یادداشت‌ها و یادآوری‌ها بسیار کاربردی باشد، اما نرم‌افزار Vocci هنوز از این ظرفیت به‌طور کامل استفاده نمی‌کند.

برای مثال، اپلیکیشن به‌صورت مستقیم با برنامه‌های مدیریت یادآوری یکپارچه نمی‌شود. قابلیت‌های نرم‌افزاری نیز با سرعت زیادی توسعه پیدا نکرده‌اند. شرکت اعلام کرده است که کاربران می‌توانند از Model Context Protocol یا MCP برای اتصال Vocci به دستیارهای دیگر استفاده کنند، اما این قابلیت تا همین اواخر در اپلیکیشن ظاهر نشده بود.

در حالی که برخی رقبای این محصول تلاش می‌کنند پلتفرم خود را به بستری برای خودکارسازی فرایندهای کاری و استخراج بینش از جلسات تبدیل کنند، اکوسیستم نرم‌افزاری Vocci هنوز در چنین سطحی توسعه پیدا نکرده است.

طراحی نامحسوس Vocci نگرانی‌هایی درباره حریم خصوصی ایجاد می‌کند

شکل ظاهری این محصول یکی از مهم‌ترین تفاوت‌های آن با بسیاری از ضبط‌کننده‌های صوتی است. حلقه Vocci در نگاه اول می‌تواند شبیه یک قطعه زیورآلات معمولی به نظر برسد و تنها با توجه دقیق می‌توان دکمه روی آن را تشخیص داد.

این موضوع از منظر حریم خصوصی اهمیت زیادی دارد. چراغ نشانگر ضبط روی حلقه وجود دارد، اما این چراغ به سمت کاربر قرار گرفته و لزوماً برای فرد مقابل قابل مشاهده نیست.

به‌طور معمول توصیه می‌شود پیش از ضبط مکالمه، طرف مقابل از این موضوع مطلع شود و در برخی کشورها و مناطق نیز قوانین مشخصی درباره ضبط مکالمات بدون اطلاع افراد وجود دارد. بنابراین، فرم‌فکتور نامحسوس Vocci می‌تواند امکان ضبط بدون اطلاع دیگران را افزایش دهد.

Vocci اعلام کرده است که کاربران را به اطلاع‌رسانی درباره ضبط مکالمه تشویق می‌کند؛ بااین‌حال، وجود این توصیه به‌تنهایی نگرانی‌های مربوط به حریم خصوصی را برطرف نمی‌کند.

قیمت ۲۴۹ دلاری Vocci

Vocci Ring با قیمت ۲۴۹ دلار عرضه می‌شود؛ رقمی که آن را نسبت به برخی ابزارهای هوشمند یادداشت‌برداری جلسه، از جمله محصولات Plaud و Pocket، در جایگاه گران‌تری قرار می‌دهد.

بخش قابل‌توجهی از قیمت این محصول را می‌توان به طراحی حلقه‌ای و وزن پایین آن نسبت داد. این دستگاه برای کاربرانی ساخته شده که نمی‌خواهند یک گجت را پشت گوشی خود قرار دهند یا از دستبند و گردنبند هوشمند استفاده کنند.

در نهایت، بسیاری از ابزارهای یادداشت‌برداری هوشمند از نظر سخت‌افزاری ساختار مشابهی دارند و ترکیبی از میکروفون، باتری و اتصال به گوشی هستند. به همین دلیل احتمالاً در سال‌های آینده شاهد فرم‌های متفاوت‌تری از این محصولات خواهیم بود تا کاربران بتوانند بر اساس شیوه استفاده خود، شکل مناسب را انتخاب کنند.

نوشته حلقه هوشمند Vocci برای یادداشت‌برداری از جلسات معرفی شد؛ ضبط صدا با یک لمس اولین بار در آی‌ تی‌ رسان منتشر شد.

ساعت‌های اقتصادی کاسیو با طراحی چندصفحه‌ای و قیمت ۵۲ دلاری معرفی شدند

کاسیو سه ساعت آنالوگ جدید را به خانواده مدل‌های کلاسیک خود اضافه کرده است؛ محصولاتی که با قیمت حدود ۵۲ دلار، طراحی چندعقربه‌ای و امکاناتی مانند نمایش روز هفته، تاریخ و زمان ۲۴ ساعته را در اختیار کاربران قرار می‌دهند.

مدل‌های MTP-SN4KD-1A، MTP-SN4KD-2A و MTP-SN4KD-7A اکنون در وب‌سایت رسمی کاسیو عرضه شده‌اند. قیمت هر سه مدل در بازار هند ۴,۹۹۵ روپیه تعیین شده که معادل تقریبی ۵۲ دلار است و آنها را در گروه ساعت‌های اقتصادی این برند قرار می‌دهد.

طراحی کلاسیک و بدنه مقاوم

هر سه ساعت جدید کاسیو از طراحی و ابعاد یکسانی بهره می‌برند. طول قاب به ۵۰.۵ میلی‌متر، عرض آن به ۴۱.۲ میلی‌متر و ضخامت بدنه به ۸.۱۵ میلی‌متر می‌رسد. وزن ۱۰۵ گرمی نیز باعث شده این مدل‌ها برای استفاده روزمره گزینه‌ای نسبتاً سبک باشند.

کاسیو

کاسیو برای قاب و حاشیه ساعت‌ها از پوشش آبکاری یونی استفاده کرده و بند آنها را از فولاد ضدزنگ ساخته است. این بند به قفل سه‌تکه تک‌فشاری مجهز شده و امکان تنظیم آن برای مچ‌هایی با اندازه ۱۴۵ تا ۲۱۵ میلی‌متر وجود دارد.

محافظ صفحه از نوع شیشه معدنی است؛ گزینه‌ای متداول در ساعت‌های اقتصادی که مقاومت مناسبی در برابر خط‌وخش‌های روزمره ارائه می‌کند.

سه صفحه فرعی برای نمایش اطلاعات مختلف

مهم‌ترین ویژگی ظاهری سری MTP-SN4KD به صفحه چندعقربه‌ای آن مربوط می‌شود. در کنار عقربه‌های اصلی، سه صفحه فرعی روی صفحه ساعت قرار گرفته‌اند که اطلاعات متفاوتی را نمایش می‌دهند.

یکی از این بخش‌ها برای نمایش تاریخ، دیگری برای نشان‌دادن روز هفته و صفحه سوم برای نمایش زمان در قالب ۲۴ ساعته استفاده می‌شود. ظاهر این ترکیب تا حدی یادآور ساعت‌های کرنوگراف است، اما نباید آن را با کرنوگراف واقعی اشتباه گرفت؛ چرا که این مدل‌ها قابلیت زمان‌سنجی یا استاپ‌واچ ندارند.

باتری دوساله و مقاومت در برابر آب

انرژی MTP-SN4KD از طریق یک موتور کوارتز تأمین می‌شود که با باتری SR621SW کار می‌کند. طبق اعلام کاسیو، عمر باتری این ساعت‌ها حدود دو سال است و دقت عملکرد موتور نیز در محدوده مثبت یا منفی ۲۰ ثانیه در ماه قرار دارد.

این ساعت‌ها تا عمق ۳۰ متری در برابر آب مقاوم هستند. بااین‌حال، این میزان مقاومت برای فعالیت‌هایی مانند شنا یا استحمام در نظر گرفته نشده و بیشتر برای مواجهه با باران یا پاشش‌های سطحی آب مناسب است.

کاسیو

مشخصات اصلی Casio MTP-SN4KD

  • مدل‌ها: MTP-SN4KD-1A، MTP-SN4KD-2A و MTP-SN4KD-7A
  • قیمت: ۴,۹۹۵ روپیه، حدود ۵۲ دلار
  • ابعاد: ۵۰.۵ × ۴۱.۲ × ۸.۱۵ میلی‌متر
  • وزن: ۱۰۵ گرم
  • جنس بند: فولاد ضدزنگ
  • شیشه: معدنی
  • موتور: کوارتز
  • باتری: SR621SW
  • عمر باتری: حدود ۲ سال
  • مقاومت در برابر آب: ۳۰ متر
  • نمایشگرهای فرعی: تاریخ، روز هفته و زمان ۲۴ ساعته

نوشته ساعت‌های اقتصادی کاسیو با طراحی چندصفحه‌ای و قیمت ۵۲ دلاری معرفی شدند اولین بار در آی‌ تی‌ رسان منتشر شد.

ScrollEd می‌خواهد کتاب‌های درسی را شبیه تیک‌تاک کند

اگر دانش‌آموزان و دانشجویان دیگر حوصله بازکردن کتاب‌های درسی را ندارند، شاید راه‌حل حذف کتاب نباشد؛ بلکه باید شکل ارائه محتوای آموزشی تغییر کند. استارتاپ ScrollEd دقیقاً روی همین ایده کار می‌کند و می‌خواهد مطالعه کتاب‌ها و فایل‌های آموزشی را به تجربه‌ای شبیه اسکرول‌کردن در تیک‌تاک و اینستاگرام تبدیل کند.

این استارتاپ مستقر در پالو آلتو با حضور در رقابت TechCrunch Disrupt Startup Battlefield 200، پلتفرمی را معرفی کرده که می‌تواند فایل‌های متنی مختلف، از PDFهای آموزشی گرفته تا کتاب‌های درسی، را به یک فید عمودی تبدیل کند.

تبدیل کتاب درسی به فید ویدیویی

ScrollEd به کاربران اجازه می‌دهد محتوای یک فایل متنی را در قالب فیدی شبیه شبکه‌های اجتماعی کوتاه‌ویدیو مشاهده کنند. محتوای هر بخش می‌تواند با کمک هوش مصنوعی به شکل ویدیو، صوت، متن یا حتی آزمون تعاملی نمایش داده شود.

نحوه تعامل با محتوا نیز مشابه اپلیکیشن‌هایی مانند TikTok طراحی شده است. کشیدن صفحه به سمت بالا کاربر را به موضوع جدیدی می‌برد، درحالی‌که حرکت افقی امکان عمیق‌ترشدن در موضوع فعلی را فراهم می‌کند. پس از پایان هر بخش نیز یک آزمون برای ارزیابی یادگیری نمایش داده می‌شود.

به این ترتیب، ScrollEd تلاش دارد فاصله میان محتوای کوتاه و جذاب شبکه‌های اجتماعی و مطالعه عمیق را کاهش دهد.

ScrollEd

ScrollEd نمی‌خواهد فقط زمان کاربر را افزایش دهد

اوتساو گوپتا، هم‌بنیان‌گذار ScrollEd، می‌گوید نسل جوان بیش از گذشته به محتوای کوتاه و فیدهای عمودی گرایش پیدا کرده است؛ موضوعی که برای رسانه‌هایی مانند کتاب که به تمرکز طولانی‌مدت نیاز دارند، چالش ایجاد می‌کند.

بااین‌حال، هدف این استارتاپ صرفاً بازسازی سازوکار شبکه‌های اجتماعی برای افزایش زمان حضور کاربران نیست. گوپتا تأکید کرده است که ScrollEd نمی‌خواهد برای بیشینه‌کردن تعامل کاربران طراحی شود.

ایده اصلی این است که یک محتوای کوتاه بتواند حس کنجکاوی ایجاد کند و کاربر را به سمت توضیحات بیشتر هدایت کند. در این پلتفرم، رفتن به لایه عمیق‌تر یک موضوع باید تقریباً به آسانی رفتن به ویدیوی بعدی باشد.

ایده ScrollEd از تجربه شخصی بنیان‌گذاران شکل گرفت

گوپتا و ربکا نف، هم‌بنیان‌گذاران و زوج مؤسس ScrollEd، این استارتاپ را در سال جاری و با سرمایه شخصی راه‌اندازی کردند. هر دو نیز در حال تحصیل هستند؛ گوپتا در دانشگاه استنفورد روی هوش مصنوعی و هدفمندی انسان مطالعه می‌کند و نف دانشجوی علوم کامپیوتر دانشگاه پنسیلوانیا است.

آن‌ها پس از تجربه شخصی استفاده از شبکه‌های اجتماعی و احساس نارضایتی ناشی از شب‌گردی در فیدهای بی‌پایان، به فکر ساخت بستری افتادند که تجربه اسکرول را به سمت محتوای مفیدتر هدایت کند.

مدل درآمدی ScrollEd چگونه است؟

ScrollEd سه گروه اصلی را هدف قرار داده است: مؤسسات آموزشی، برنامه‌های آموزش سازمانی و کاربرانی که به‌دنبال محتوای مفیدتری برای اسکرول‌کردن هستند.

این شرکت از مدل فریمیوم استفاده می‌کند. کاربران به یک فید رایگان دسترسی خواهند داشت و در کنار آن، اشتراک پولی ScrollEd Pro نیز ارائه می‌شود. برای سازمان‌ها و مؤسسات آموزشی نیز مجوزهای سالانه در نظر گرفته شده است.

مؤسسات می‌توانند محتوای آموزشی خود را از طریق این پلتفرم در اختیار کاربران قرار دهند و در مقابل، گزارش‌هایی درباره میزان تعامل، پیشرفت دروس و سایر داده‌های مرتبط با یادگیری دریافت کنند.

هوش مصنوعی قرار است آموزش را شخصی‌سازی کند

ScrollEd در مرحله بعدی توسعه خود قصد دارد زیرساختی ایجاد کند که به معلمان و مربیان اجازه دهد وضعیت هر دانش‌آموز را به‌صورت جداگانه ارزیابی کنند.

این سیستم در نهایت می‌تواند بر اساس عملکرد و نیازهای هر یادگیرنده، محتوای آموزشی را با شرایط او تطبیق دهد. بنابراین، ایده ScrollEd فقط تبدیل کتاب به ویدیوهای کوتاه نیست و این شرکت در بلندمدت به‌دنبال ساخت یک سیستم آموزشی شخصی‌سازی‌شده است.

تمرکز اولیه روی عرضه عمومی

ScrollEd در ماه‌های آینده قصد دارد ابتدا روی عرضه نسخه مصرف‌کننده تمرکز کند، کتابخانه درس‌های خود را گسترش دهد و فرایند بررسی صحت منابع را توسعه دهد. این شرکت همچنین در حال آماده‌سازی برنامه‌های آزمایشی برای همکاری با مؤسسات آموزشی است.

نسخه مصرف‌کننده ScrollEd قرار است هم‌زمان با حضور این شرکت در رویداد TechCrunch Disrupt عرضه شود.

گوپتا چشم‌انداز نهایی شرکت را ایجاد نوعی شبکه اجتماعی می‌داند که به‌جای تشویق کاربران به اسکرول بی‌هدف، تجربه‌ای مفیدتر و سازنده‌تر ارائه کند.

نوشته ScrollEd می‌خواهد کتاب‌های درسی را شبیه تیک‌تاک کند اولین بار در آی‌ تی‌ رسان منتشر شد.

گراک Voice Transcribe ۲.۰ معرفی شد؛ دقت تبدیل گفتار به متن بهبود یافت

شرکت xAI از مدل جدید هوش مصنوعی خود برای تبدیل گفتار به متن با نام Voice Transcribe 2.0 رونمایی کرد. این مدل با تمرکز بر پردازش مکالمات واقعی، صداهای پرنویز و محتوای چندزبانه توسعه یافته و طبق اعلام xAI، نسبت به نسل قبلی یعنی Grok Voice Transcribe 1.0 دقت بالاتری دارد.

با وجود ارتقای عملکرد، قیمت استفاده از این سرویس برای پردازش دسته‌ای تغییری نکرده و همچنان هر ساعت پردازش صوت ۰٫۱۰ دلار هزینه دارد. نرخ استفاده از حالت بلادرنگ نیز ۰٫۲۰ دلار به ازای هر ساعت اعلام شده است.

Voice Transcribe 2.0 چگونه آموزش دیده است؟

مدل جدید بر پایه فناوری صوتی به‌کاررفته در Grok Voice ساخته شده است. xAI می‌گوید این فناوری اکنون در روز برای ده‌ها هزار تماس پشتیبانی مشتری مورد استفاده قرار می‌گیرد و در پروژه‌هایی مانند رونویسی میلیون‌ها ساعت محتوای ویدیویی و اجرای قابلیت‌های صوتی در محصولات مختلف نیز به کار گرفته شده است.

دستیار صوتی Grok در خودروهای تسلا یکی از نمونه‌های استفاده از این فناوری محسوب می‌شود.

برای آموزش Voice Transcribe 2.0، مجموعه‌ای از فایل‌های صوتی واقعی در محیط‌های گوناگون مورد استفاده قرار گرفته است. این داده‌ها علاوه بر چندزبانه بودن، شامل صداهای ضبط‌شده در شرایط پرنویز نیز بوده‌اند. xAI همچنین پس از آموزش اولیه، مراحل دیگری را برای بهینه‌سازی مدل و افزایش عملکرد آن در سناریوهای واقعی انجام داده است.

ادعای xAI درباره دقت Voice Transcribe 2.0

xAI اعلام کرده است که Voice Transcribe 2.0 در میان ۳۲ مدل استریمینگ موجود در جدول عمومی Artificial Analysis، بالاترین دقت را به دست آورده است.

این شرکت برای ارزیابی عملکرد مدل تنها به بنچمارک‌های عمومی اکتفا نکرده و آن را روی چهار مجموعه آزمایشی داخلی نیز بررسی کرده است. این داده‌ها از ترافیک واقعی به دست آمده‌اند و مواردی مانند تماس‌های پشتیبانی تلفنی، مکالمات کاربران با Grok، اطلاعات حساب و ایمیل و فرمان‌های صوتی کوتاه به زبان‌های مختلف را شامل می‌شوند.

طبق نتایج منتشرشده از سوی xAI، Voice Transcribe 2.0 در هر چهار آزمایش عملکرد بهتری نسبت به نسل قبلی داشته است. در آزمایش مربوط به تماس‌های پشتیبانی انگلیسی با کیفیت ۸ کیلوهرتز نیز xAI اعلام کرده مدل جدید در مقایسه با سایر مدل‌های بررسی‌شده عملکرد بهتری داشته است.

گراک Voice Transcribe 2.0

xAI برای مقایسه عملکرد مدل خود، نمونه‌هایی مانند Gemini 3.5 Transcribe، MAI-Transcribe-2، ElevenLabs Scribe v2، Deepgram Nova-3 و Whisper Large v3 را نیز در نمودارهای آزمایشی خود قرار داده است.

کاهش چشمگیر خطای رونویسی در چند زبان

یکی از بخش‌هایی که xAI روی آن تأکید ویژه‌ای دارد، بهبود عملکرد Voice Transcribe 2.0 در تشخیص گفتار چندزبانه است. این مدل می‌تواند زبان صحبت‌کردن را به‌صورت خودکار تشخیص دهد و در صورت تغییر زبان در میانه فایل صوتی، بدون آنکه فایل به بخش‌های جداگانه تقسیم شود، فرایند رونویسی را ادامه دهد.

این قابلیت در تشخیص فرمان‌های کوتاه صوتی اهمیت بیشتری دارد؛ زیرا در چنین شرایطی مدل اطلاعات متنی و زمینه محدودی برای شناسایی زبان در اختیار دارد.

در یکی از آزمایش‌های xAI، عملکرد مدل روی فرمان‌های صوتی دستیار هوشمند در ۱۹ زبان بررسی شده است. بر اساس نتایج اعلام‌شده، نرخ خطای کلمه یا WER در این آزمایش از ۲۰٫۶ درصد در نسل قبلی به ۶٫۸ درصد در Voice Transcribe 2.0 رسیده است.

امکانات Speech-to-Text API گراک

Voice Transcribe 2.0 از طریق Speech-to-Text API در اختیار توسعه‌دهندگان قرار گرفته و امکان تبدیل فایل‌های صوتی و URLها به متن را به‌صورت دسته‌ای یا بلادرنگ فراهم می‌کند.

از جمله قابلیت‌های این API می‌توان به موارد زیر اشاره کرد:

  • ارائه زمان دقیق هر کلمه به همراه امتیاز اطمینان
  • شناسایی و تفکیک گویندگان بدون دریافت هزینه اضافی
  • پشتیبانی از رونویسی چندکاناله تا هشت کانال
  • امکان تعریف حداکثر ۱۰۰ عبارت تخصصی برای افزایش دقت تشخیص کلمات کلیدی
  • قالب‌بندی خودکار اعداد، تاریخ، ارز، شماره تلفن و ایمیل
  • حذف کلمات پرکننده از متن نهایی
  • تشخیص خودکار پایان صحبت برای استفاده در عامل‌های صوتی

یکی از نکات مهم برای توسعه‌دهندگان این است که سرویس‌هایی که پیش‌تر به Speech-to-Text API متصل شده‌اند، می‌توانند از بهبودهای مدل جدید استفاده کنند و طبق اعلام xAI نیازی به تغییر کد نخواهند داشت.

پشتیبانی از ۱۲ فرمت صوتی و فایل‌های ۵۰۰ مگابایتی

مستندات API نشان می‌دهد Voice Transcribe 2.0 از ۱۲ فرمت صوتی پشتیبانی می‌کند و حداکثر حجم فایل قابل پردازش در آن ۵۰۰ مگابایت است.

این سرویس همچنین از نرخ‌های نمونه‌برداری ۸۰۰۰، ۱۶۰۰۰، ۲۲۰۵۰، ۲۴۰۰۰، ۴۴۱۰۰ و ۴۸۰۰۰ هرتز پشتیبانی می‌کند.

از نظر زبان نیز پارامتر زبان API امکان قالب‌بندی خروجی را در ۲۵ زبان فراهم می‌کند. انگلیسی، اسپانیایی، فرانسوی، آلمانی، هندی، ژاپنی و کره‌ای از جمله زبان‌های پشتیبانی‌شده هستند.

قیمت Voice Transcribe 2.0

xAI قیمت مدل جدید را نسبت به Voice Transcribe 1.0 تغییر نداده است. هزینه استفاده از این سرویس بر اساس نوع پردازش به شکل زیر تعیین می‌شود:

نوع پردازش قیمت به ازای هر ساعت صوت
پردازش دسته‌ای (Batch) ۰٫۱۰ دلار
پردازش بلادرنگ (Streaming) ۰٫۲۰ دلار

امکاناتی مانند تشخیص گوینده، تعیین زمان کلمات و استفاده از عبارت‌های تخصصی نیز بدون هزینه جداگانه در اختیار کاربران قرار می‌گیرند.

Voice Transcribe 1.0 به‌زودی بازنشسته می‌شود

xAI قصد دارد Voice Transcribe 2.0 را به مدل پیش‌فرض Speech-to-Text API تبدیل کند. نسخه 1.0 نیز طبق اعلام این شرکت طی هفته‌های آینده از چرخه پشتیبانی خارج خواهد شد.

کاربرانی که در دوره انتقال همچنان به نسخه قدیمی نیاز داشته باشند، می‌توانند نام Voice Transcribe 1.0 را به‌صورت دستی در درخواست‌های API مشخص کنند. در حال حاضر مستندات xAI در صورت مشخص‌نشدن مدل، نسخه 1.0 را به‌عنوان مدل پیش‌فرض نشان می‌دهند؛ بااین‌حال نسخه 2.0 نیز از طریق رابط‌های REST و WebSocket قابل استفاده است.

جمع‌بندی

Voice Transcribe 2.0 تلاش xAI برای رقابت جدی‌تر در بازار تبدیل گفتار به متن است؛ مدلی که تمرکز آن تنها روی رونویسی عمومی نیست و سناریوهایی مانند تماس‌های پشتیبانی، فرمان‌های صوتی کوتاه، مکالمات چندزبانه و محیط‌های پرنویز را نیز هدف قرار می‌دهد. کاهش اعلام‌شده نرخ خطای کلمه در آزمایش فرمان‌های صوتی ۱۹ زبانه، یکی از مهم‌ترین نتایج منتشرشده درباره این مدل است.

نوشته گراک Voice Transcribe ۲.۰ معرفی شد؛ دقت تبدیل گفتار به متن بهبود یافت اولین بار در آی‌ تی‌ رسان منتشر شد.

گراک Voice Transcribe ۲.۰ معرفی شد؛ دقت تبدیل گفتار به متن بهبود یافت

شرکت xAI از مدل جدید هوش مصنوعی خود برای تبدیل گفتار به متن با نام Voice Transcribe 2.0 رونمایی کرد. این مدل با تمرکز بر پردازش مکالمات واقعی، صداهای پرنویز و محتوای چندزبانه توسعه یافته و طبق اعلام xAI، نسبت به نسل قبلی یعنی Grok Voice Transcribe 1.0 دقت بالاتری دارد.

با وجود ارتقای عملکرد، قیمت استفاده از این سرویس برای پردازش دسته‌ای تغییری نکرده و همچنان هر ساعت پردازش صوت ۰٫۱۰ دلار هزینه دارد. نرخ استفاده از حالت بلادرنگ نیز ۰٫۲۰ دلار به ازای هر ساعت اعلام شده است.

Voice Transcribe 2.0 چگونه آموزش دیده است؟

مدل جدید بر پایه فناوری صوتی به‌کاررفته در Grok Voice ساخته شده است. xAI می‌گوید این فناوری اکنون در روز برای ده‌ها هزار تماس پشتیبانی مشتری مورد استفاده قرار می‌گیرد و در پروژه‌هایی مانند رونویسی میلیون‌ها ساعت محتوای ویدیویی و اجرای قابلیت‌های صوتی در محصولات مختلف نیز به کار گرفته شده است.

دستیار صوتی Grok در خودروهای تسلا یکی از نمونه‌های استفاده از این فناوری محسوب می‌شود.

برای آموزش Voice Transcribe 2.0، مجموعه‌ای از فایل‌های صوتی واقعی در محیط‌های گوناگون مورد استفاده قرار گرفته است. این داده‌ها علاوه بر چندزبانه بودن، شامل صداهای ضبط‌شده در شرایط پرنویز نیز بوده‌اند. xAI همچنین پس از آموزش اولیه، مراحل دیگری را برای بهینه‌سازی مدل و افزایش عملکرد آن در سناریوهای واقعی انجام داده است.

ادعای xAI درباره دقت Voice Transcribe 2.0

xAI اعلام کرده است که Voice Transcribe 2.0 در میان ۳۲ مدل استریمینگ موجود در جدول عمومی Artificial Analysis، بالاترین دقت را به دست آورده است.

این شرکت برای ارزیابی عملکرد مدل تنها به بنچمارک‌های عمومی اکتفا نکرده و آن را روی چهار مجموعه آزمایشی داخلی نیز بررسی کرده است. این داده‌ها از ترافیک واقعی به دست آمده‌اند و مواردی مانند تماس‌های پشتیبانی تلفنی، مکالمات کاربران با Grok، اطلاعات حساب و ایمیل و فرمان‌های صوتی کوتاه به زبان‌های مختلف را شامل می‌شوند.

طبق نتایج منتشرشده از سوی xAI، Voice Transcribe 2.0 در هر چهار آزمایش عملکرد بهتری نسبت به نسل قبلی داشته است. در آزمایش مربوط به تماس‌های پشتیبانی انگلیسی با کیفیت ۸ کیلوهرتز نیز xAI اعلام کرده مدل جدید در مقایسه با سایر مدل‌های بررسی‌شده عملکرد بهتری داشته است.

گراک Voice Transcribe 2.0

xAI برای مقایسه عملکرد مدل خود، نمونه‌هایی مانند Gemini 3.5 Transcribe، MAI-Transcribe-2، ElevenLabs Scribe v2، Deepgram Nova-3 و Whisper Large v3 را نیز در نمودارهای آزمایشی خود قرار داده است.

کاهش چشمگیر خطای رونویسی در چند زبان

یکی از بخش‌هایی که xAI روی آن تأکید ویژه‌ای دارد، بهبود عملکرد Voice Transcribe 2.0 در تشخیص گفتار چندزبانه است. این مدل می‌تواند زبان صحبت‌کردن را به‌صورت خودکار تشخیص دهد و در صورت تغییر زبان در میانه فایل صوتی، بدون آنکه فایل به بخش‌های جداگانه تقسیم شود، فرایند رونویسی را ادامه دهد.

این قابلیت در تشخیص فرمان‌های کوتاه صوتی اهمیت بیشتری دارد؛ زیرا در چنین شرایطی مدل اطلاعات متنی و زمینه محدودی برای شناسایی زبان در اختیار دارد.

در یکی از آزمایش‌های xAI، عملکرد مدل روی فرمان‌های صوتی دستیار هوشمند در ۱۹ زبان بررسی شده است. بر اساس نتایج اعلام‌شده، نرخ خطای کلمه یا WER در این آزمایش از ۲۰٫۶ درصد در نسل قبلی به ۶٫۸ درصد در Voice Transcribe 2.0 رسیده است.

امکانات Speech-to-Text API گراک

Voice Transcribe 2.0 از طریق Speech-to-Text API در اختیار توسعه‌دهندگان قرار گرفته و امکان تبدیل فایل‌های صوتی و URLها به متن را به‌صورت دسته‌ای یا بلادرنگ فراهم می‌کند.

از جمله قابلیت‌های این API می‌توان به موارد زیر اشاره کرد:

  • ارائه زمان دقیق هر کلمه به همراه امتیاز اطمینان
  • شناسایی و تفکیک گویندگان بدون دریافت هزینه اضافی
  • پشتیبانی از رونویسی چندکاناله تا هشت کانال
  • امکان تعریف حداکثر ۱۰۰ عبارت تخصصی برای افزایش دقت تشخیص کلمات کلیدی
  • قالب‌بندی خودکار اعداد، تاریخ، ارز، شماره تلفن و ایمیل
  • حذف کلمات پرکننده از متن نهایی
  • تشخیص خودکار پایان صحبت برای استفاده در عامل‌های صوتی

یکی از نکات مهم برای توسعه‌دهندگان این است که سرویس‌هایی که پیش‌تر به Speech-to-Text API متصل شده‌اند، می‌توانند از بهبودهای مدل جدید استفاده کنند و طبق اعلام xAI نیازی به تغییر کد نخواهند داشت.

پشتیبانی از ۱۲ فرمت صوتی و فایل‌های ۵۰۰ مگابایتی

مستندات API نشان می‌دهد Voice Transcribe 2.0 از ۱۲ فرمت صوتی پشتیبانی می‌کند و حداکثر حجم فایل قابل پردازش در آن ۵۰۰ مگابایت است.

این سرویس همچنین از نرخ‌های نمونه‌برداری ۸۰۰۰، ۱۶۰۰۰، ۲۲۰۵۰، ۲۴۰۰۰، ۴۴۱۰۰ و ۴۸۰۰۰ هرتز پشتیبانی می‌کند.

از نظر زبان نیز پارامتر زبان API امکان قالب‌بندی خروجی را در ۲۵ زبان فراهم می‌کند. انگلیسی، اسپانیایی، فرانسوی، آلمانی، هندی، ژاپنی و کره‌ای از جمله زبان‌های پشتیبانی‌شده هستند.

قیمت Voice Transcribe 2.0

xAI قیمت مدل جدید را نسبت به Voice Transcribe 1.0 تغییر نداده است. هزینه استفاده از این سرویس بر اساس نوع پردازش به شکل زیر تعیین می‌شود:

نوع پردازش قیمت به ازای هر ساعت صوت
پردازش دسته‌ای (Batch) ۰٫۱۰ دلار
پردازش بلادرنگ (Streaming) ۰٫۲۰ دلار

امکاناتی مانند تشخیص گوینده، تعیین زمان کلمات و استفاده از عبارت‌های تخصصی نیز بدون هزینه جداگانه در اختیار کاربران قرار می‌گیرند.

Voice Transcribe 1.0 به‌زودی بازنشسته می‌شود

xAI قصد دارد Voice Transcribe 2.0 را به مدل پیش‌فرض Speech-to-Text API تبدیل کند. نسخه 1.0 نیز طبق اعلام این شرکت طی هفته‌های آینده از چرخه پشتیبانی خارج خواهد شد.

کاربرانی که در دوره انتقال همچنان به نسخه قدیمی نیاز داشته باشند، می‌توانند نام Voice Transcribe 1.0 را به‌صورت دستی در درخواست‌های API مشخص کنند. در حال حاضر مستندات xAI در صورت مشخص‌نشدن مدل، نسخه 1.0 را به‌عنوان مدل پیش‌فرض نشان می‌دهند؛ بااین‌حال نسخه 2.0 نیز از طریق رابط‌های REST و WebSocket قابل استفاده است.

جمع‌بندی

Voice Transcribe 2.0 تلاش xAI برای رقابت جدی‌تر در بازار تبدیل گفتار به متن است؛ مدلی که تمرکز آن تنها روی رونویسی عمومی نیست و سناریوهایی مانند تماس‌های پشتیبانی، فرمان‌های صوتی کوتاه، مکالمات چندزبانه و محیط‌های پرنویز را نیز هدف قرار می‌دهد. کاهش اعلام‌شده نرخ خطای کلمه در آزمایش فرمان‌های صوتی ۱۹ زبانه، یکی از مهم‌ترین نتایج منتشرشده درباره این مدل است.

نوشته گراک Voice Transcribe ۲.۰ معرفی شد؛ دقت تبدیل گفتار به متن بهبود یافت اولین بار در آی‌ تی‌ رسان منتشر شد.