برند گوگل با قابلیت تازه Gemini؛ اسناد را با صدای هوش مصنوعی بخوانید

برند گوگل با افزودن قابلیت خواندن اسناد بهصورت صوتی در Google Docs، تجربه کار با این سرویس را متحول کرد. کاربران اکنون میتوانند با کمک Gemini، اسناد خود را با صدا و سرعت پخش دلخواه گوش دهند، حتی اگر خودشان نویسنده آن نباشند.
به گزارش توسعه برند، برند گوگل یک گام تازه در ترکیب هوش مصنوعی با ابزارهای اداری برداشت و قابلیت خواندن اسناد بهصورت صوتی را به سرویس Google Docs اضافه کرد. این ویژگی که توسط هوش مصنوعی Gemini پشتیبانی میشود، به کاربران این امکان را میدهد متنهای خود را به فایلهای صوتی هوشمند تبدیل کنند و آنها را با صدای انتخابی و سرعت پخش دلخواه بشنوند.
قابلیت جدید نهتنها برای نویسنده یا صاحب سند کاربرد دارد، بلکه هر کسی که به سند دسترسی دارد میتواند از آن بهره ببرد. به گفته گوگل، کاربران میتوانند از منوی Tools در Google Docs، گزینه Audio و سپس Listen to this tab را انتخاب کنند تا متن سند با صدای هوش مصنوعی برایشان خوانده شود. علاوه بر این، نویسندگان امکان اضافه کردن یک دکمه صوتی درون سند را دارند تا هر خوانندهای تنها با یک کلیک، شنیدن محتوای آن را آغاز کند.
این ویژگی در ادامه برنامهای معرفی شده که گوگل در ماه آوریل رونمایی کرد؛ همان زمانی که وعده داده بود اسناد متنی میتوانند به پادکستهای هوش مصنوعی تبدیل شوند. اما قابلیت تازه، کارکرد عملیتر و سریعتری دارد زیرا به کاربران اجازه میدهد در همان محیط Google Docs، بدون نیاز به تبدیل یا انتشار جداگانه، متن را به صدا تبدیل کنند.
در حال حاضر این قابلیت تنها برای اسنادی که به زبان انگلیسی نوشته شدهاند و بر روی نسخه دسکتاپ Google Docs در دسترس است. گوگل اعلام کرده که این سرویس به تدریج برای مشترکان Google Workspace در پلنهای بیزینسی، سازمانی و آموزشی فعال میشود. همچنین افرادی که اشتراک AI Pro یا Ultra داشته باشند نیز به این قابلیت دسترسی پیدا خواهند کرد.
یکی از جذابترین نکات این ویژگی، قابلیت شخصیسازی صدا و سرعت پخش است. کاربران میتوانند از میان چندین صدای مختلف Gemini انتخاب کنند و بسته به نیاز خود سرعت پخش را کاهش یا افزایش دهند. این قابلیت میتواند برای افرادی که محتوای طولانی مطالعه میکنند یا قصد مرور سریع مطالب را دارند، بسیار مفید باشد. همچنین برای کسانی که در حال یادگیری زبان هستند یا با ضعف بینایی مواجهاند، این امکان میتواند تجربهای جدید و کارآمد ایجاد کند.
بدون شک این بهروزرسانی بخشی از استراتژی بزرگتر برند گوگل برای یکپارچهسازی هوش مصنوعی Gemini با محصولات پرکاربرد خود است. ترکیب قدرت پردازش زبانی Gemini و زیرساخت ابری گوگل، بستری فراهم کرده تا کاربران نهتنها محتوای متنی تولید کنند بلکه روشهای تازهای برای تعامل با اسناد خود در اختیار داشته باشند.
گوگل پیشتر Gemini را وارد Gmail، Slides و Sheets کرده بود، اما ورود این مدل به Google Docs با قابلیت صوتی، کاربرد آن را یک گام فراتر میبرد. حالا تصور کنید که یک مدیر پروژه بتواند بدون باز کردن مرورگر یا صرف زمان برای خواندن دهها صفحه، تنها با استفاده از هدفون خود گزارش هفتگی تیم را بشنود. یا یک دانشجو بتواند مقالهاش را در مسیر دانشگاه مرور کند.
“”توسعه برند را در اینستاگرام و تلگرام و لینکدین دنبال کنید””
این اقدام همچنین میتواند رقابت را با ابزارهای مشابه در مایکروسافت و دیگر پلتفرمهای اداری آنلاین داغتر کند. مایکروسافت پیشتر قابلیتهای خواندن متن با صدای رباتیک را در Word و Outlook معرفی کرده بود، اما ترکیب انتخاب صدا، کنترل سرعت و توانایی ادغام این ویژگی در سند به شکل یک دکمه اختصاصی، برگ برنده برند گوگل محسوب میشود.
گرچه این قابلیت در فاز فعلی محدود به کاربران انگلیسیزبان و نسخه دسکتاپ است، انتظار میرود گوگل در آینده نزدیک پشتیبانی از زبانهای دیگر و نسخه موبایلی را هم اضافه کند. چنین توسعهای میتواند دامنه استفاده از Google Docs را به شکل چشمگیری گسترش دهد و نقش آن را بهعنوان یک پلتفرم جهانی ایجاد، مدیریت و مصرف محتوا تثبیت کند.
با این نوآوری، برند گوگل بار دیگر نشان میدهد که ترکیب هوش مصنوعی با خدمات روزمره نه یک روند موقتی، بلکه بخشی از آینده قطعی تعامل دیجیتال است.
منبع: ورج



