جنگ اینستاگرام با هوش مصنوعی‌؛ کاهش شدید بازدید در انتظار اینفلوئنسرهای مجازی بدون برچسب!

رشد قارچ‌گونه کاراکترها و اینفلوئنسرهای ساخته‌شده با هوش مصنوعی (AI Influencers) در شبکه‌های اجتماعی، کمپانی متا را به اتخاذ سیاست‌های سخت‌گیرانه‌تری برای حفظ شفافیت و اعتماد کاربران وادار کرده است. در همین راستا، اینستاگرام دستورالعمل‌های جدیدی را برای صفحات و شخصیت‌های مجازی که هویت غیرواقعی خود را پنهان می‌کنند، صادر کرد. بر این اساس، عدم افشای ماهیت مصنوعی یک پروفایل می‌تواند به قیمت جریمه الگوریتمی و کاهش شدید بازدید آن تمام شود.

تغییر برچسب هویتی و جریمه پنهان متخلفان

اینستاگرام برای شفاف‌سازی هرچه بیشتر، عنوان برچسب قبلی خود یعنی «AI creator» را به عبارت صریح‌تر «AI-generated profile» (پروفایل ساخته‌شده با هوش مصنوعی) تغییر داده است. این عبارت جدید با وضوح بالایی به مخاطب یادآوری می‌کند که تصویر یا شخصیت پیش رو، یک انسان واقعی نیست.

اینستاگرام

تغییر کلیدی دیگر، برخورد جدی با صفحاتی است که از این کاراکترهای مجازی برای تولید محتوا استفاده می‌کنند اما مایل به افشای آن نیستند. اینستاگرام اعلام کرده است که در صورت شناسایی چنین صفحاتی، الگوریتم به طور خودکار نمایش محتوای آن‌ها را در بخش‌های پیشنهادی پلتفرم — به‌ویژه صفحه «برای شما» (For You) و اکسپلور — محدود خواهد کرد؛ جریمه‌ای که عملاً شانس جذب مخاطب جدید را برای این صفحات به صفر می‌رساند.

سازوکار فعال‌سازی برچسب و فرآیند ثبت اعتراض

توسعه‌دهندگان و ادمین‌های این صفحات می‌توانند با مراجعه به بخش ویرایش پروفایل، گزینه «پروفایل ساخته‌شده با هوش مصنوعی» را به صورت دستی فعال کنند. با این اقدام، برچسب مذکور به طور دائم در کنار بیوگرافی و محتوای انتخابی صفحه نمایش داده می‌شود. طبق بیانیه اینستاگرام، صفحاتی که به طور داوطلبانه این قانون را رعایت کنند، با هیچ‌گونه افت بازدید یا جریمه‌ای مواجه نخواهند شد.

همچنین، برای جلوگیری از خطاهای احتمالی سیستمِ تشخیص خودکار اینستاگرام، امکان ثبت اعتراض پیش‌بینی شده است. اگر کاربری به اشتباه مشمول این محدودیت‌ها شود، می‌تواند با ارسال درخواست بازبینی، دسترسی عادی و نرخ تعامل صفحه خود را بازگرداند.

اینستاگرام

تلاش برای بقای واقعیت در دنیای الگوریتم‌ها

این اقدامات واکنشی مستقیم به اشباع شبکه‌های اجتماعی از محتواهای فوق‌واقع‌گرایانه (Deepfake) و اینفلوئنسرهای مجازی است که تشخیص آن‌ها از انسان‌های واقعی برای کاربران عادی دشوار شده است. متا با اعمال این فیلترهای نظارتی تلاش می‌کند تا ضمن حمایت از نوآوری‌های تکنولوژیک، مرز میان واقعیت و شبیه‌سازی را در پلتفرم‌های خود زنده نگه دارد.

جنگ اینستاگرام با هوش مصنوعی‌؛ کاهش شدید بازدید در انتظار اینفلوئنسرهای مجازی بدون برچسب!

رشد قارچ‌گونه کاراکترها و اینفلوئنسرهای ساخته‌شده با هوش مصنوعی (AI Influencers) در شبکه‌های اجتماعی، کمپانی متا را به اتخاذ سیاست‌های سخت‌گیرانه‌تری برای حفظ شفافیت و اعتماد کاربران وادار کرده است. در همین راستا، اینستاگرام دستورالعمل‌های جدیدی را برای صفحات و شخصیت‌های مجازی که هویت غیرواقعی خود را پنهان می‌کنند، صادر کرد. بر این اساس، عدم افشای ماهیت مصنوعی یک پروفایل می‌تواند به قیمت جریمه الگوریتمی و کاهش شدید بازدید آن تمام شود.

تغییر برچسب هویتی و جریمه پنهان متخلفان

اینستاگرام برای شفاف‌سازی هرچه بیشتر، عنوان برچسب قبلی خود یعنی «AI creator» را به عبارت صریح‌تر «AI-generated profile» (پروفایل ساخته‌شده با هوش مصنوعی) تغییر داده است. این عبارت جدید با وضوح بالایی به مخاطب یادآوری می‌کند که تصویر یا شخصیت پیش رو، یک انسان واقعی نیست.

اینستاگرام

تغییر کلیدی دیگر، برخورد جدی با صفحاتی است که از این کاراکترهای مجازی برای تولید محتوا استفاده می‌کنند اما مایل به افشای آن نیستند. اینستاگرام اعلام کرده است که در صورت شناسایی چنین صفحاتی، الگوریتم به طور خودکار نمایش محتوای آن‌ها را در بخش‌های پیشنهادی پلتفرم — به‌ویژه صفحه «برای شما» (For You) و اکسپلور — محدود خواهد کرد؛ جریمه‌ای که عملاً شانس جذب مخاطب جدید را برای این صفحات به صفر می‌رساند.

سازوکار فعال‌سازی برچسب و فرآیند ثبت اعتراض

توسعه‌دهندگان و ادمین‌های این صفحات می‌توانند با مراجعه به بخش ویرایش پروفایل، گزینه «پروفایل ساخته‌شده با هوش مصنوعی» را به صورت دستی فعال کنند. با این اقدام، برچسب مذکور به طور دائم در کنار بیوگرافی و محتوای انتخابی صفحه نمایش داده می‌شود. طبق بیانیه اینستاگرام، صفحاتی که به طور داوطلبانه این قانون را رعایت کنند، با هیچ‌گونه افت بازدید یا جریمه‌ای مواجه نخواهند شد.

همچنین، برای جلوگیری از خطاهای احتمالی سیستمِ تشخیص خودکار اینستاگرام، امکان ثبت اعتراض پیش‌بینی شده است. اگر کاربری به اشتباه مشمول این محدودیت‌ها شود، می‌تواند با ارسال درخواست بازبینی، دسترسی عادی و نرخ تعامل صفحه خود را بازگرداند.

اینستاگرام

تلاش برای بقای واقعیت در دنیای الگوریتم‌ها

این اقدامات واکنشی مستقیم به اشباع شبکه‌های اجتماعی از محتواهای فوق‌واقع‌گرایانه (Deepfake) و اینفلوئنسرهای مجازی است که تشخیص آن‌ها از انسان‌های واقعی برای کاربران عادی دشوار شده است. متا با اعمال این فیلترهای نظارتی تلاش می‌کند تا ضمن حمایت از نوآوری‌های تکنولوژیک، مرز میان واقعیت و شبیه‌سازی را در پلتفرم‌های خود زنده نگه دارد.

تحول تاریخی در علم پزشکی؛ موفقیت نخستین جراحی مغز جهان با دستیار هوش مصنوعی هم‌زمان

مرزهای دانش پزشکی بار دیگر جابه‌جا شد. جراحان بریتانیایی برای نخستین‌بار در تاریخ، موفق شدند با بهره‌گیری از یک سیستم هوش مصنوعی پویا و هم‌زمان (Real-time)، تومور مغزی یک بیمار را با موفقیت خارج کرده و بینایی او را از نابودی حتمی نجات دهند. این دستاورد بی‌نظیر، آغازگر عصری نو در افزایش ضریب ایمنی جراحی‌های فوق‌حساس اعصاب به شمار می‌رود.

چالش تومور غده هیپوفیز؛ وقتی بینایی بیمار در تاریکی فرو رفت

بیمار این جراحی پیشگامانه، مردی ۴۸ ساله به نام «ریس هیبرت» اهل بدفوردشر انگلستان بود. تومور او که در سال ۱۴۰۳ تشخیص داده شد، بر روی غده هیپوفیز – ساختاری به اندازه یک تیله در قاعده مغز – رشد کرده بود. حساسیت فوق‌العاده این ناحیه به دلیل هم‌جواری با عصب‌های بینایی و رگ‌های حیاتی نظیر سرخرگ کاروتید، هرگونه مداخله پزشکی را به راه رفتن روی لبه تیغ شبیه می‌کرد.

فشار ناشی از این تومور غیرسرطانی، بخش عمده‌ای از دید محیطی هیبرت را از بین برده بود؛ به‌طوری‌که وی برای ساده‌ترین کارهای روزمره مانند راه رفتن به همراه نیاز داشت. در متدهای سنتی، کوچک‌ترین انحراف ابزار جراحی می‌توانست به قیمت نابینایی دائمی یا سکته مغزی بیمار تمام شود.

جراحی مغز

مغز متفکر دیجیتال در اتاق عمل؛ سازوکار دستیار هوشمند زنده

در این عمل جراحی پیچیده، کادر پزشکی از یک سامانه نوین هوش مصنوعی استفاده کردند که توسط دانشمندان مؤسسه هاکس در کالج دانشگاهی لندن (UCL) توسعه یافته است. برخلاف روش‌های مرسوم که جراح پیش از آغاز کار تنها به بررسی تصاویر ثابت اسکن‌های قبلی متکی است، این سیستم هوشمند جریان ویدیویی زنده درون مغز را در لحظه تحلیل می‌کند.

«سوفیا بانو»، دانشیار رباتیک و سرپرست فنی این پروژه، توضیح می‌دهد که الگوریتم‌های این فناوری با تماشای صدها ساعت ویدیوی جراحی واقعی آموزش دیده‌اند؛ تجربیاتی گران‌بها که معادل سال‌ها کار بالینی یک جراح متخصص است. این سیستم با شناسایی دقیق بافت‌ها، ابزارها و رگ‌های خونی در زمان واقعی، مانند یک ناظر خستگی‌ناپذیر جراح را در مسیریابی ایمن هدایت می‌کند.

بازگشت بینایی ۳۶۰ درجه و آینده جراحی‌های رباتیک

نتیجه این هم‌پیمانی انسان و هوش مصنوعی شگفت‌انگیز بود. ریس هیبرت بلافاصله پس از به هوش آمدن، از بهبود فوری بینایی خود خبر داد و آن را به یک «دید پانورامای ۳۶۰ درجه و واضح» تشبیه کرد. وی تنها یک هفته پس از عمل توانست بدون عینک و عصا، به‌طور مستقل قدم بزند.

با وجود این موفقیت خیره‌کننده، تیم مهندسی تأکید دارد که این فناوری هرگز جایگزین جراح نخواهد شد؛ بلکه به عنوان یک لایه حفاظتی هوشمند، خطاهای انسانی را در هدایت ابزارها به حداقل می‌رساند. این سامانه که پیش از این تنها کاربردی آموزشی و پژوهشی داشت، با موفقیت در این عمل، مهر تأیید بالینی را برای ورود به بیمارستان‌های جهان دریافت کرد.

هوش مصنوعی در خدمت روایت‌های روزمره؛ دسترسی به اپلیکیشن «گوگل دریم‌بینز» رایگان شد

گوگل در راستای گسترش ابزارهای آزمایشی مبتنی بر هوش مصنوعی، دسترسی به اپلیکیشن خلاقانه دریم‌بینز (Dreambins) را برای تمامی کاربران دارای حساب کاربری رایگان در ایالات متحده آزاد کرد. این پروژه که پیش از این در انحصار مشترکان سرویس‌های پولی این غول فناوری قرار داشت، یکی از جدیدترین دستاوردهای واحد نوآوری «گوگل لبز» (Google Labs) به شمار می‌رود.

بازآفرینی تجربه «گوگل ناو» با چاشنی هوش مصنوعی مولد

اپلیکیشن دریم‌بینز در عمل نسخه‌ای بسیار پیشرفته‌تر و شخصی‌سازی‌شده‌تر از سرویس‌های محبوبی چون گوگل دیسکاور و گوگل ناو است. این نرم‌افزار با بهره‌گیری از مدل‌های تحلیل داده، ردپای دیجیتال کاربر را در سرویس‌های مختلف تحلیل کرده و روایتی اختصاصی از علایق و برنامه‌های او ارائه می‌دهد. البته برای حفظ حریم خصوصی، کاربران در ابتدای راه‌اندازی این امکان را دارند که سطح دسترسی ابزار به حساب‌های مختلف خود را کاملاً کنترل کنند.

گوگل دریم‌بینز

الگوریتم‌های هوشمند دریم‌بینز داده‌های ورودی را به شکلی هدفمند دسته‌بندی می‌کنند:

  • گوگل ورک‌اسپیس و جیمیل: رصد اطلاعات کاربردی و تراکنش‌ها مانند رزرو بلیت پروازها و صورت‌حساب‌ها
  • گوگل فوتوز: بازخوانی خاطرات تصویری و یادآوری پیوندهای فردی مهم در زندگی کاربر
  • یوتیوب: شناسایی سرگرمی‌های فعال، علایق هنری و موضوعات مورد توجه
  • تاریخچه جست‌وجو: پایش ترندها و موضوعات نوظهوری که به‌تازگی توجه فرد را جلب کرده‌اند

استوری‌های مصور صبحگاهی با مدل تصویری نانو بنانا ۲

حاصل هم‌افزایی این داده‌ها، خلق یک مجله تصویری کاملاً اختصاصی است که هر روز صبح به کاربر نمایش داده می‌شود. جلوه‌های بصری این استوری‌ها با استفاده از مدل پردازش تصویر نانو بنانا ۲ (Nano Banana 2) به سبک تصویرسازی هنری طراحی می‌شوند. محتوای تولیدشده علاوه‌بر مرور برنامه‌ها، شامل پیشنهاد مکان‌های دیدنی، رویدادهای جذاب پیرامون فرد و موضوعات متناسب با سلیقه اوست.

این اپلیکیشن که هم‌اکنون برای کاربران پلتفرم‌های اندروید و iOS در دسترس قرار دارد، قابلیت‌هایی نظیر چت تعاملی برای گفتگو پیرامون محتوا، امتیازدهی به خروجی‌ها و شخصی‌سازی دقیق فید علایق را در اختیار کاربران می‌گذارد.

هوش مصنوعی در خدمت روایت‌های روزمره؛ دسترسی به اپلیکیشن «گوگل دریم‌بینز» رایگان شد

گوگل در راستای گسترش ابزارهای آزمایشی مبتنی بر هوش مصنوعی، دسترسی به اپلیکیشن خلاقانه دریم‌بینز (Dreambins) را برای تمامی کاربران دارای حساب کاربری رایگان در ایالات متحده آزاد کرد. این پروژه که پیش از این در انحصار مشترکان سرویس‌های پولی این غول فناوری قرار داشت، یکی از جدیدترین دستاوردهای واحد نوآوری «گوگل لبز» (Google Labs) به شمار می‌رود.

بازآفرینی تجربه «گوگل ناو» با چاشنی هوش مصنوعی مولد

اپلیکیشن دریم‌بینز در عمل نسخه‌ای بسیار پیشرفته‌تر و شخصی‌سازی‌شده‌تر از سرویس‌های محبوبی چون گوگل دیسکاور و گوگل ناو است. این نرم‌افزار با بهره‌گیری از مدل‌های تحلیل داده، ردپای دیجیتال کاربر را در سرویس‌های مختلف تحلیل کرده و روایتی اختصاصی از علایق و برنامه‌های او ارائه می‌دهد. البته برای حفظ حریم خصوصی، کاربران در ابتدای راه‌اندازی این امکان را دارند که سطح دسترسی ابزار به حساب‌های مختلف خود را کاملاً کنترل کنند.

گوگل دریم‌بینز

الگوریتم‌های هوشمند دریم‌بینز داده‌های ورودی را به شکلی هدفمند دسته‌بندی می‌کنند:

  • گوگل ورک‌اسپیس و جیمیل: رصد اطلاعات کاربردی و تراکنش‌ها مانند رزرو بلیت پروازها و صورت‌حساب‌ها
  • گوگل فوتوز: بازخوانی خاطرات تصویری و یادآوری پیوندهای فردی مهم در زندگی کاربر
  • یوتیوب: شناسایی سرگرمی‌های فعال، علایق هنری و موضوعات مورد توجه
  • تاریخچه جست‌وجو: پایش ترندها و موضوعات نوظهوری که به‌تازگی توجه فرد را جلب کرده‌اند

استوری‌های مصور صبحگاهی با مدل تصویری نانو بنانا ۲

حاصل هم‌افزایی این داده‌ها، خلق یک مجله تصویری کاملاً اختصاصی است که هر روز صبح به کاربر نمایش داده می‌شود. جلوه‌های بصری این استوری‌ها با استفاده از مدل پردازش تصویر نانو بنانا ۲ (Nano Banana 2) به سبک تصویرسازی هنری طراحی می‌شوند. محتوای تولیدشده علاوه‌بر مرور برنامه‌ها، شامل پیشنهاد مکان‌های دیدنی، رویدادهای جذاب پیرامون فرد و موضوعات متناسب با سلیقه اوست.

این اپلیکیشن که هم‌اکنون برای کاربران پلتفرم‌های اندروید و iOS در دسترس قرار دارد، قابلیت‌هایی نظیر چت تعاملی برای گفتگو پیرامون محتوا، امتیازدهی به خروجی‌ها و شخصی‌سازی دقیق فید علایق را در اختیار کاربران می‌گذارد.

هوش مصنوعی در خدمت روایت‌های روزمره؛ دسترسی به اپلیکیشن «گوگل دریم‌بینز» رایگان شد

گوگل در راستای گسترش ابزارهای آزمایشی مبتنی بر هوش مصنوعی، دسترسی به اپلیکیشن خلاقانه دریم‌بینز (Dreambins) را برای تمامی کاربران دارای حساب کاربری رایگان در ایالات متحده آزاد کرد. این پروژه که پیش از این در انحصار مشترکان سرویس‌های پولی این غول فناوری قرار داشت، یکی از جدیدترین دستاوردهای واحد نوآوری «گوگل لبز» (Google Labs) به شمار می‌رود.

بازآفرینی تجربه «گوگل ناو» با چاشنی هوش مصنوعی مولد

اپلیکیشن دریم‌بینز در عمل نسخه‌ای بسیار پیشرفته‌تر و شخصی‌سازی‌شده‌تر از سرویس‌های محبوبی چون گوگل دیسکاور و گوگل ناو است. این نرم‌افزار با بهره‌گیری از مدل‌های تحلیل داده، ردپای دیجیتال کاربر را در سرویس‌های مختلف تحلیل کرده و روایتی اختصاصی از علایق و برنامه‌های او ارائه می‌دهد. البته برای حفظ حریم خصوصی، کاربران در ابتدای راه‌اندازی این امکان را دارند که سطح دسترسی ابزار به حساب‌های مختلف خود را کاملاً کنترل کنند.

گوگل دریم‌بینز

الگوریتم‌های هوشمند دریم‌بینز داده‌های ورودی را به شکلی هدفمند دسته‌بندی می‌کنند:

  • گوگل ورک‌اسپیس و جیمیل: رصد اطلاعات کاربردی و تراکنش‌ها مانند رزرو بلیت پروازها و صورت‌حساب‌ها
  • گوگل فوتوز: بازخوانی خاطرات تصویری و یادآوری پیوندهای فردی مهم در زندگی کاربر
  • یوتیوب: شناسایی سرگرمی‌های فعال، علایق هنری و موضوعات مورد توجه
  • تاریخچه جست‌وجو: پایش ترندها و موضوعات نوظهوری که به‌تازگی توجه فرد را جلب کرده‌اند

استوری‌های مصور صبحگاهی با مدل تصویری نانو بنانا ۲

حاصل هم‌افزایی این داده‌ها، خلق یک مجله تصویری کاملاً اختصاصی است که هر روز صبح به کاربر نمایش داده می‌شود. جلوه‌های بصری این استوری‌ها با استفاده از مدل پردازش تصویر نانو بنانا ۲ (Nano Banana 2) به سبک تصویرسازی هنری طراحی می‌شوند. محتوای تولیدشده علاوه‌بر مرور برنامه‌ها، شامل پیشنهاد مکان‌های دیدنی، رویدادهای جذاب پیرامون فرد و موضوعات متناسب با سلیقه اوست.

این اپلیکیشن که هم‌اکنون برای کاربران پلتفرم‌های اندروید و iOS در دسترس قرار دارد، قابلیت‌هایی نظیر چت تعاملی برای گفتگو پیرامون محتوا، امتیازدهی به خروجی‌ها و شخصی‌سازی دقیق فید علایق را در اختیار کاربران می‌گذارد.

هوش مصنوعی در خدمت روایت‌های روزمره؛ دسترسی به اپلیکیشن «گوگل دریم‌بینز» رایگان شد

گوگل در راستای گسترش ابزارهای آزمایشی مبتنی بر هوش مصنوعی، دسترسی به اپلیکیشن خلاقانه دریم‌بینز (Dreambins) را برای تمامی کاربران دارای حساب کاربری رایگان در ایالات متحده آزاد کرد. این پروژه که پیش از این در انحصار مشترکان سرویس‌های پولی این غول فناوری قرار داشت، یکی از جدیدترین دستاوردهای واحد نوآوری «گوگل لبز» (Google Labs) به شمار می‌رود.

بازآفرینی تجربه «گوگل ناو» با چاشنی هوش مصنوعی مولد

اپلیکیشن دریم‌بینز در عمل نسخه‌ای بسیار پیشرفته‌تر و شخصی‌سازی‌شده‌تر از سرویس‌های محبوبی چون گوگل دیسکاور و گوگل ناو است. این نرم‌افزار با بهره‌گیری از مدل‌های تحلیل داده، ردپای دیجیتال کاربر را در سرویس‌های مختلف تحلیل کرده و روایتی اختصاصی از علایق و برنامه‌های او ارائه می‌دهد. البته برای حفظ حریم خصوصی، کاربران در ابتدای راه‌اندازی این امکان را دارند که سطح دسترسی ابزار به حساب‌های مختلف خود را کاملاً کنترل کنند.

گوگل دریم‌بینز

الگوریتم‌های هوشمند دریم‌بینز داده‌های ورودی را به شکلی هدفمند دسته‌بندی می‌کنند:

  • گوگل ورک‌اسپیس و جیمیل: رصد اطلاعات کاربردی و تراکنش‌ها مانند رزرو بلیت پروازها و صورت‌حساب‌ها
  • گوگل فوتوز: بازخوانی خاطرات تصویری و یادآوری پیوندهای فردی مهم در زندگی کاربر
  • یوتیوب: شناسایی سرگرمی‌های فعال، علایق هنری و موضوعات مورد توجه
  • تاریخچه جست‌وجو: پایش ترندها و موضوعات نوظهوری که به‌تازگی توجه فرد را جلب کرده‌اند

استوری‌های مصور صبحگاهی با مدل تصویری نانو بنانا ۲

حاصل هم‌افزایی این داده‌ها، خلق یک مجله تصویری کاملاً اختصاصی است که هر روز صبح به کاربر نمایش داده می‌شود. جلوه‌های بصری این استوری‌ها با استفاده از مدل پردازش تصویر نانو بنانا ۲ (Nano Banana 2) به سبک تصویرسازی هنری طراحی می‌شوند. محتوای تولیدشده علاوه‌بر مرور برنامه‌ها، شامل پیشنهاد مکان‌های دیدنی، رویدادهای جذاب پیرامون فرد و موضوعات متناسب با سلیقه اوست.

این اپلیکیشن که هم‌اکنون برای کاربران پلتفرم‌های اندروید و iOS در دسترس قرار دارد، قابلیت‌هایی نظیر چت تعاملی برای گفتگو پیرامون محتوا، امتیازدهی به خروجی‌ها و شخصی‌سازی دقیق فید علایق را در اختیار کاربران می‌گذارد.

انقلاب پخت‌وپز خودکار در چین؛ وقتی هوش مصنوعی طعم استاندارد غذا را فرموله می‌کند

صنعت رباتیک چین گام بلندی به‌سوی تجاری‌سازی و حل یکی از پیچیده‌ترین چالش‌های فناوری کاربردی، یعنی آشپزی کاملاً خودکار برداشته است. در جریان رویدادهای اخیر فناوری در پکن، غول‌های رباتیک این کشور نشان دادند که چگونه تلفیق هوش مصنوعی و سخت‌افزارهای پیشرفته می‌تواند نه‌تنها فرآیند پخت‌وپز را مکانیزه کند، بلکه استانداردی یکنواخت و دیجیتالی برای طعم و کیفیت غذاها تعریف نماید.

ورود سرآشپزهای مکانیکی به زنجیره رستوران‌های چین

شرکت نیمه‌دولتی «اوک دیر رباتیکس» (Oak Deer Robotics) با معرفی سه محصول نوآورانه از جمله مدل هوش مصنوعی چندوجهی CookingMuse، توجه کارشناسان را به خود جلب کرده است. ربات سرآشپز این شرکت با بهره‌گیری از یک دیگ تفت‌دهی (ووک) پیشرفته با توان حرارتی ۳۰۰ درجه سانتی‌گراد، سامانه توزیع هوشمند مواد اولیه و الگوریتم‌های حرکتی بهینه‌سازی‌شده، قادر است غذاهای سنتی را با دقتی بالا طبخ کند. فناوری‌های پخت‌وپز این کمپانی هم‌اکنون در بیش از ۴ هزار فروشگاه در سراسر چین به‌طور عملیاتی به کار گرفته شده‌اند.

هم‌زمان، شرکت «هایک‌رباتس» (Hikrobots) با نمایش ربات‌های انسان‌نمای خود که در نقش پرسنل رستوران‌های فست‌فود ظاهر شدند، چشم‌انداز جدیدی از خدمات رفاهی را به تصویر کشید. این ماشین‌های مجهز به پیش‌بند، وظایفی چون جابه‌جایی دقیق مواد غذایی و چیدمان سینی‌های سرو را با ظرافتی تحسین‌برانگیز انجام می‌دهند.

ربات

نخستین رستوران نودل تمام‌رباتیک در پایتخت چین

نمونه عینی این تحول مدرن را می‌توان در رستوران نوپای «یوجیان ویلای» (Yujian Weilai) در جنوب‌غربی پکن مشاهده کرد. این واحد صنفی که به‌عنوان اولین رستوران نودل مجهز به سیستم‌های تمام‌رباتیک شناخته می‌شود، طبخ نودل، افزودن چاشنی‌ها و انتقال ظرف غذا به بخش دلیوری را کاملاً از طریق بازوهای مکانیکی و ربات‌های جابه‌جاگر انجام می‌دهد. اگرچه فرآیند آماده‌سازی اولیه مواد اولیه همچنان به عهده نیروی انسانی است، اما زنجیره پخت عملاً بی‌نیاز از دخالت دست پیش می‌رود.

دیجیتالی‌شدن هنر آشپزی؛ طعم‌ها فرموله می‌شوند

لی پنگژن، مدیرعامل این رستوران هدف اصلی از این پروژه را تبدیل پارامترهای حسی آشپزی به داده‌های عددی دقیق می‌داند تا هر کاسه غذا بدون کوچک‌ترین تفاوتی با نسخه قبلی، با کیفیتی کاملاً یکسان سرو شود. با اینکه تا حذف کامل انسان از آشپزخانه‌ها هنوز راه درازی در پیش است، اما شتاب چین در این حوزه، از نزدیک بودن یک تحول ساختاری در صنعت رستوران‌داری جهانی حکایت دارد.

مدل متن‌باز Hy۴ Preview تنسنت؛ رقیبی قدرتمند برای Kimi K۳

شرکت چینی تنسنت از نسخه پیش‌نمایش جدیدترین مدل هوش مصنوعی متن‌باز خود با نام Hy4 Preview رونمایی کرد. این مدل که برای انجام وظایف پیچیده‌ای همچون مهندسی نرم‌افزار، امور پژوهشی، تحلیل‌های مالی و توسعه بازی طراحی شده، هم‌اکنون روی مخزن هاگینگ فیس و پلتفرم تنسنت کلاد در دسترس قرار گرفته است.

معماری و مشخصات فنی

مدل Hy4 Preview بر پایه معماری ترکیب متخصصان (Mixture of Experts) توسعه یافته و در مجموع دارای ۷۷۰ میلیارد پارامتر است. با این حال، در هر درخواست متنی، حدود ۴۹ میلیارد پارامتر به‌صورت فعال به کار گرفته می‌شوند که بهره‌وری محاسباتی را افزایش می‌دهد.
این مدل از پنجره زمینه یک میلیون توکنی پشتیبانی می‌کند که آن را برای پردازش اسناد بلند و پروژه‌های پیچیده مناسب می‌سازد.

Hy4 Preview

به گفته تنسنت، توسعه این مدل با ارتقای هم‌زمان ابعاد مدل، طول بافت و داده‌های آموزشی انجام شده و در فرایند پیش‌آموزش و پس‌آموزش، بزرگ‌ترین جهش عملکردی نسل به نسل در میان مدل‌های این شرکت به ثبت رسیده است.

داده‌های آموزشی و عملکرد

تنسنت تأکید دارد که داده‌های آموزشی این مدل با همکاری متخصصان داخلی در حوزه‌های مهندسی نرم‌افزار، توسعه بازی، تحلیل مالی و امنیت اطلاعات آماده شده تا مدل در محیط‌های کاری واقعی عملکرد دقیق‌تری ارائه دهد.

در یک ارزیابی توسط ۱۶۳ متخصص داخلی روی ۲۰۳ وظیفه مهندسی، مدل Hy4 Preview در مقایسه با دو مدل مطرح دیگر امتیازهای بالاتری کسب کرده است:

مدل میانگین امتیاز
Hy4 Preview ۲٫۹۹
GLM 5.3 ۲٫۹۲
Kimi K3 ۲٫۹۴

دسترسی و قیمت‌گذاری

مدل Hy4 Preview علاوه بر هاگینگ فیس و تنسنت کلاد، در پلتفرم اوپن‌روتر و ابزارهای داخلی تنسنت مانند CodeBuddy نیز ادغام شده است.
قیمت‌گذاری API این مدل به ازای هر ۱ میلیون توکن به شرح زیر است:

  • ورودی: ۰٫۸۳۴ دلار

  • خروجی: ۲٫۵۰۱ دلار

نقاط قوت و چالش‌ها

تنسنت با اشاره به متن‌باز بودن این مدل، تأکید کرده که Hy4 Preview یک نسخه اولیه است و در مراحل پیش‌آموزش و پس‌آموزش همچنان ظرفیت ارتقا دارد. با این حال، این شرکت به برخی اشکالات شناخته‌شده نیز اشاره کرده است:

  • صرف زمان بیش‌ازحد برای استدلال در کارهای پیچیده

  • تمایل مدل به راست‌آزمایی بیش‌ازحد پاسخ‌های خود

تنسنت اعلام کرده است که روند ارتقای مستمر این مدل ادامه خواهد داشت و نسخه‌های بهبودیافته‌تری در آینده منتشر خواهد شد.

جمینای Omni ۱.۱؛ هوش مصنوعی جدید گوگل برای تولید ویدئو!

گوگل به‌تازگی نسخه به‌روزرسانی‌شده مدل تولید ویدئوی خود با نام Gemini Omni 1.1 Flash را معرفی کرده است. این مدل که از طریق Gemini API در Google AI Studio در دسترس قرار گرفته، با افزودن قابلیت‌هایی چون گسترش صحنه، کنترل فریم اول و آخر، تولید سریع با وضوح ۳۶۰p، خروجی با کیفیت ۱۰۸۰p و ۴K و همچنین پشتیبانی از ویدئوی مرجع، گام بلندی در جهت توانمندسازی کاربران در تولید محتوای تصویری برداشته است.

قابلیت‌های کلیدی Gemini Omni 1.1 Flash

گسترش هوشمند صحنه (Scene Extension)

یکی از برجسته‌ترین ویژگی‌های نسخه جدید، امکان ادامه‌دادن یک ویدئوی موجود از نقطه پایان آن است. مدل جدید می‌تواند تا ۱۰ ثانیه از ویدئوی قبلی را تحلیل کند (در حالی که نسخه‌های پیشین تنها یک ثانیه انتهایی را در نظر می‌گرفتند) و این زمینه بیشتر، به حفظ پیوستگی بصری و روایی در توالی صحنه‌ها کمک می‌کند. کاربران می‌توانند ویدئو را در بازه‌های ۱۰ ثانیه‌ای گسترش دهند تا طول نهایی به ۴۰ ثانیه برسد.

جمینای Omni 1.1

کنترل فریم ابتدایی و پایانی (First & Last Frame Control)

این قابلیت به کاربران اجازه می‌دهد فریم شروع و پایان یک نما را مشخص کنند و مدل، ویدئوی میانی را بین این دو فریم کلیدی تولید کند. این ویژگی برای ایجاد حرکات دوربین نظیر چرخش، زوم، ساخت ویدئوهای حلقه‌ای و سایر انتقال‌های بصری کاربرد گسترده‌ای دارد.

تولید سریع با وضوح ۳۶۰p برای نمونه‌سازی

گوگل با افزودن گزینه تولید ویدئو با وضوح ۳۶۰p، سرعت و صرفه‌جویی در هزینه را هدف گرفته است. بر اساس اعلام این شرکت، تولید ویدئو در این وضوح تا ۶۰ درصد سریع‌تر از وضوح ۷۲۰p انجام می‌شود و هزینه آن نیز یک‌سوم برآورد شده است. این حالت برای نمونه‌سازی سریع، اصلاح استوری‌برد و رندر سریع در محیط‌های توسعه بسیار کارآمد است.

خروجی با کیفیت ۱۰۸۰p و ۴K

مدل جدید امکان ارائه خروجی با وضوح ۱۰۸۰p و ۴K را از طریق فرایند Upscaling (افزایش وضوح) برای ویدئوهای تولیدشده فراهم کرده است که کیفیت بصری بالایی را برای کاربران حرفه‌ای به ارمغان می‌آورد.

پشتیبانی از ویدئوی مرجع (Reference Video)

کاربران می‌توانند یک ویدئوی مرجع با حداکثر طول ۳ ثانیه در اختیار مدل قرار دهند تا زمینه بصری بیشتری برای تولید صحنه جدید فراهم شود. این قابلیت به حفظ ثبات شخصیت‌ها و پیوستگی بصری در تولیدات کمک شایانی می‌کند.

قیمت و دسترسی

مدل Gemini Omni 1.1 Flash از امروز از طریق Gemini API در Google AI Studio و همچنین پلتفرم Gemini Enterprise Agent Platform در اختیار شرکت‌ها قرار گرفته است. گوگل برای این مدل، مستندات توسعه‌دهندگان، Cookbook و راهنماهای پرامپت‌نویسی برای قابلیت‌هایی نظیر گسترش صحنه، استفاده از ویدئوی مرجع و Upscaling را ارائه داده است.

همچنین این مدل به‌صورت جهانی در سرویس Google Flow برای مشترکان Google AI Plus، Pro و Ultra فعال شده و قابلیت گسترش صحنه نیز برای همین گروه از کاربران در اپلیکیشن Gemini در دسترس است.