پشتیبانی از فایل صوتی بالاخره به Gemini اضافه شد!
تا حالا چند بار پیش اومده که خواستی یک ویس یا بخشی از یک پادکست رو بدی به هوش مصنوعی تا خلاصه کنه یا برات تحلیل کنه، اما نشد؟ خب خبر خوب اینجاست: گوگل بالاخره قابلیت آپلود فایل صوتی رو به Gemini اضافه کرد؛ قابلیتی که مدتها کاربران دنبالش بودن.
چه فرمتهایی پشتیبانی میشوند؟
از همین امروز روی اندروید، iOS و نسخه وب میتونی فایلهای MP3، WAV و اکثر فرمتهای رایج صوتی رو با همون گزینهی آشنای «Upload files» آپلود کنی.
البته یک نکته مهم هست:
-
کاربران نسخه رایگان میتونن حداکثر ۱۰ فایل صوتی با مجموع زمان ۱۰ دقیقه آپلود کنن.
-
کاربران نسخه پولی (Gemini Advanced) این محدودیت رو خیلی راحتتر دارن: آپلود تا ۳ ساعت صدا.
چرا این قابلیت مهمه؟
وقتی صحبت از کاربرد میشه، صدا شاید حتی از ویدیو هم مهمتر باشه. فکر کن:
-
ضبط سریع یک یادداشت صوتی و گرفتن خلاصه یا تحلیل
-
تبدیل جلسهها به متن قابل جستجو
-
بریدن بخشی از یک پادکست یا سخنرانی برای استخراج نکات کلیدی
جالب اینجاست که گوگل برای ویدیو هنوز محدودیت بیشتری گذاشته (۵ دقیقه برای رایگان، یک ساعت برای پولی)، اما صدا رو عمداً دو برابر باز گذاشته.

رقابت با ChatGPT
واقعیت اینه که ChatGPT مدتهاست پشتیبانی از صدا رو فعال کرده و حتی در تبدیل گفتار به متن هم دست بالا رو داشته. حالا با این آپدیت، Gemini یک قدم دیگه به رقابت نزدیکتر شده.
حالا سوال اینجاست: ۱۰ دقیقه برای استفاده عادی کافیه یا نه؟ شاید همین محدودیت باعث بشه خیلیها به سراغ نسخه پولی برن.
بههرحال، اگر منتظر بودی ویسهات رو بسپری دست هوش مصنوعی، وقتشه امتحان کنی. نظر تو چیه؟ این قابلیت واقعاً به کارت میاد؟



