قابلیت جدید ChatGPT Voice؛ امکان آپلود فایل هنگام مکالمه صوتی
OpenAI قابلیت جدیدی را به ChatGPT Voice اضافه کرده که میتواند نحوه تعامل کاربران با فایلها و اسناد را تغییر دهد. در نسخه جدید Voice، کاربران میتوانند فایل را مستقیماً به مکالمه صوتی اضافه کنند، درباره محتوای آن سؤال بپرسند و تحلیل را بدون نیاز به تایپ کردن ادامه دهند.
این قابلیت بهخصوص برای کاربران حرفهای اهمیت دارد. تصور کنید یک گزارش چندصفحهای، فایل تحقیقاتی یا سند پروژه را به ChatGPT میدهید و بهجای نوشتن چندین پرامپت، درباره اطلاعات آن با هوش مصنوعی صحبت میکنید؛ سؤالهای تکمیلی میپرسید، روی بخش خاصی تمرکز میکنید و مرحلهبهمرحله تحلیل را عمیقتر میکنید.
در واقع، ترکیب Voice + File Upload + قابلیتهای تحلیلی ChatGPT میتواند Voice را از یک ابزار ساده برای مکالمه با هوش مصنوعی به یک رابط کاربردی برای کار با اطلاعات و اسناد تبدیل کند.
قابلیت جدید ChatGPT Voice چیست؟
ChatGPT Voice به کاربران اجازه میدهد بهجای تایپ کردن، مستقیماً با ChatGPT صحبت کنند و پاسخ را نیز بهصورت صوتی دریافت کنند.
OpenAI در آپدیت جدید، قابلیت Voice در ChatGPT را یک مرحله جلوتر برده است. این شرکت طبق اطلاعات رسمی منتشرشده درباره این آپدیت، پشتیبانی از آپلود فایل و Projects را نیز به مکالمات صوتی اضافه کرده است. در نتیجه، کاربر میتواند هنگام مکالمه فایل اضافه کند و سپس درباره محتوای آن سؤال بپرسد یا از ChatGPT بخواهد اطلاعات موجود در فایل را تحلیل کند.
Voice جدید همچنین داخل محیط اصلی ChatGPT فعالیت میکند و پاسخ صوتی را در کنار متن نمایش میدهد. این موضوع باعث میشود مرز میان تعامل متنی و صوتی کمتر شود و کاربر بتواند متناسب با نوع کار خود میان روشهای مختلف تعامل جابهجا شود.
آپلود فایل هنگام مکالمه صوتی چگونه کار میکند؟
اهمیت این قابلیت زمانی مشخص میشود که Voice را نه صرفاً جایگزین تایپ، بلکه راهی برای تعامل مستقیم با اطلاعات در نظر بگیریم. برای مثال، فرض کنید یک گزارش ۳۰ صفحهای درباره عملکرد یک کسبوکار دارید؛ میتوانید فایل را به مکالمه اضافه کنید و از ChatGPT بپرسید «سه یافته مهم این گزارش چیست؟». سپس بدون نوشتن پرامپت جدید، گفتگو را با سؤالهایی مانند «مورد دوم را بیشتر توضیح بده» یا «براساس همین گزارش، مهمترین ریسک سه ماه آینده چیست؟» ادامه دهید.
در این حالت، فایل Context اولیه را در اختیار ChatGPT قرار میدهد و Voice امکان ادامه تعامل با همان اطلاعات را فراهم میکند. در نتیجه، کاربر به یک سؤال صوتی محدود نیست و میتواند مجموعهای از سؤالهای مرتبط را درباره یک سند مطرح کند و تحلیل را مرحلهبهمرحله عمیقتر کند.
چرا ترکیب Voice و File Upload برای کاربران حرفهای مهم است؟
ارزش اصلی این قابلیت الزاماً در حذف تایپ کردن نیست؛ بلکه در کاهش اصطکاک هنگام بررسی اطلاعات است.
در بسیاری از Workflowهای حرفهای، کاربر ابتدا یک سند یا مجموعهای از اطلاعات را بررسی میکند و سپس چندین سؤال مرتبط درباره آن مطرح میکند. در رابط متنی، هر مرحله نیازمند نوشتن درخواست جدید است، اما Voice میتواند این فرآیند را به یک گفتوگوی پیوسته تبدیل کند.
برای مثال، یک مدیر میتواند قبل از جلسه گزارش عملکرد را به ChatGPT بدهد و درباره نقاط مهم آن سؤال کند. یک تحلیلگر میتواند یافتههای یک گزارش بازار را بررسی کرده و فرضیههای مختلف را به چالش بکشد. یک تولیدکننده محتوا نیز میتواند فایلهای تحقیقاتی را وارد کند و درباره زاویه مقاله، دادههای مهم یا خلأهای موجود در محتوا با ChatGPT گفتگو کند.
بنابراین Voice در چنین سناریوهایی بیشتر از اینکه ابزار «تبدیل صدا به پرامپت» باشد، به یک لایه تعاملی برای تحلیل اطلاعات تبدیل میشود.
چه فایلهایی را میتوان در ChatGPT تحلیل کرد؟
قابلیت File Upload در ChatGPT از بسیاری از فرمتهای رایج اسناد، فایلهای متنی، صفحات گسترده و ارائهها پشتیبانی میکند.
فرمتهایی مانند PDF، DOCX، PPTX، XLSX، XLS، CSV، TSV و TXT از جمله فایلهایی هستند که ChatGPT میتواند با آنها کار کند.
نوع تحلیل نیز به محتوای فایل بستگی دارد. در اسناد متنی میتوان از ChatGPT برای خلاصهسازی، استخراج اطلاعات، مقایسه بخشها و پاسخ به سؤالهای مشخص استفاده کرد. در فایلهای داده مانند CSV و Excel نیز میتوان دادهها را بررسی و الگوها یا اطلاعات مهم را استخراج کرد.
محدودیت حجم، تعداد فایل و ظرفیت استفاده از File Upload نیز میتواند براساس پلن و شرایط حساب متفاوت باشد.
پشتیبانی از Projects؛ بخش مهم دیگر آپدیت Voice
آپلود فایل تنها تغییر جدید Voice نیست. OpenAI پشتیبانی از Projects را نیز به قابلیت Voice اضافه کرده است.
این قابلیت برای کاربران حرفهای اهمیت زیادی دارد؛ زیرا Projects برای سازماندهی فایلها، گفتگوها و دستورالعملهای مرتبط با یک پروژه طراحی شده است.
با پشتیبانی Voice از Projects، کاربر میتواند در یک پروژه با ChatGPT صحبت کند و Voice به گفتگوهای اخیر پروژه، منابع و Project Instructions آن دسترسی داشته باشد.
برای مثال، اگر یک پروژه برای تحقیقات بازار ایجاد کرده باشید و فایلها و گفتگوهای مربوط به آن را داخل Project قرار داده باشید، میتوانید مکالمه صوتی را نیز در همان Context ادامه دهید.
این قابلیت Voice را برای پروژههای طولانی و Workflowهایی که به چندین منبع وابسته هستند کاربردیتر میکند.
تفاوت Workflow قدیمی و جدید چیست؟

در روش معمول، کاربر پس از آپلود فایل باید درخواستها و سؤالهای بعدی را بهصورت متنی وارد کند؛ اما ترکیب File Upload و Voice این فرآیند را به یک مکالمه پیوسته تبدیل میکند. کاربر میتواند فایل را در اختیار ChatGPT قرار دهد، سؤال اولیه را مطرح کند و سپس بدون نوشتن پرامپتهای متعدد، با سؤالهای صوتی تحلیل را ادامه دهد. این تفاوت بهخصوص هنگام مرور گزارشها، آماده شدن برای جلسات و تحلیل چندمرحلهای اطلاعات میتواند تجربه سریعتر و طبیعیتری ایجاد کند.
آیا Voice جای پرامپتنویسی حرفهای را میگیرد؟
احتمالاً نه.
Voice برای تعامل سریع، ایدهپردازی و پرسیدن سؤالهای متوالی مناسب است، اما در وظایفی که نیازمند دستورالعمل دقیق هستند، پرامپت متنی همچنان مزیت مهمی دارد.
اگر بخواهید یک تحلیل با ساختار مشخص، معیارهای دقیق، فرمت خروجی ثابت و چندین محدودیت انجام شود، نوشتن دستورالعمل متنی کنترل بیشتری در اختیار شما قرار میدهد.
به همین دلیل یکی از Workflowهای کاربردی برای کاربران حرفهای میتواند ترکیبی باشد:
File برای Context + Text برای دستورالعمل دقیق + Voice برای Follow-up
به این ترتیب دستور اصلی به شکل دقیق و قابل کنترل نوشته میشود و پس از دریافت نتیجه، کاربر میتواند از Voice برای بررسی خروجی، پرسیدن سؤالهای تکمیلی و عمیقتر کردن تحلیل استفاده کند.
نقش Context در قابلیت جدید Voice چیست؟
یکی از مفاهیم مهم در استفاده حرفهای از این قابلیت، Context است. زمانی که یک فایل در اختیار ChatGPT قرار میگیرد، مدل میتواند اطلاعات مرتبط با آن را در ادامه گفتگو در نظر بگیرد؛ بنابراین کاربر مجبور نیست در هر درخواست، اطلاعات قبلی را دوباره توضیح دهد. برای مثال، پس از تحلیل یک گزارش میتوانید از ChatGPT بخواهید «فقط بخش مربوط به بازار اروپا را بررسی کند» و سپس در ادامه همان مکالمه بپرسید «این بخش چه تفاوتی با نتایج فروش قبلی دارد؟».
حفظ ارتباط میان فایل، پاسخهای قبلی و سؤالهای جدید باعث میشود Voice برای تحلیلهای چندمرحلهای و گفتگو درباره اسناد کاربردیتر باشد. البته Context نامحدود نیست و هنگام کار با اسناد بسیار بزرگ، چندین فایل یا تحلیلهای حساس، بهتر است بررسی شود که پاسخ ChatGPT واقعاً بر اطلاعات و بخش درست سند متکی است.
محدودیتهایی که کاربران حرفهای باید بدانند
اضافه شدن Voice به فرآیند تحلیل فایل به این معنا نیست که خروجی ChatGPT همیشه بدون خطاست. مدل ممکن است بخشی از اطلاعات را اشتباه تفسیر کند، ارتباط نادرستی میان دادهها ایجاد کند یا نتیجهای ارائه دهد که مستقیماً از سند قابل استنتاج نیست؛ موضوعی که هنگام بررسی گزارشهای مالی، حقوقی، علمی و سایر اطلاعات حساس اهمیت بیشتری پیدا میکند. برای کاهش این ریسک، بهتر است سؤالها دقیق باشند و در تحلیلهای مهم از ChatGPT خواسته شود مشخص کند نتیجه خود را براساس کدام بخش یا داده فایل ارائه کرده است.
در استفاده حرفهای همچنین باید میان Exploration و Verification تفاوت قائل شد. ChatGPT Voice میتواند برای بررسی سریع اطلاعات، کشف نکات مهم، ایجاد فرضیه و ادامه تحلیل بسیار کاربردی باشد، اما زمانی که نتیجه قرار است مبنای یک تصمیم مهم قرار گیرد، اطلاعات باید با فایل اصلی یا منابع معتبر دیگر تأیید شوند.
چگونه به قابلیتهای پیشرفته ChatGPT دسترسی داشته باشیم؟
کاربرانی که میخواهند بهصورت حرفهایتر از ChatGPT استفاده کنند، میتوانند متناسب با میزان استفاده و نیاز خود یکی از اشتراکهای پولی این سرویس را انتخاب کنند. پلنهای Go، Plus و Pro ظرفیتها و سطوح دسترسی متفاوتی دارند و برای استفاده روزمره تا Workflowهای حرفهای و سنگین طراحی شدهاند.
برای مثال، کاربران حرفهای که علاوه بر Voice از قابلیتهایی مانند تحلیل فایل، تحقیق، برنامهنویسی و ابزارهای پیشرفته ChatGPT بهصورت مستمر استفاده میکنند، معمولاً به ظرفیت بیشتری نسبت به استفاده سبک نیاز خواهند داشت.
اگر قصد تهیه اشتراک دارید، میتوانید در صفحه خرید اکانت ChatGPT تفاوت پلنهای Go، Plus و Pro را بررسی کرده و متناسب با نوع استفاده خود گزینه مناسب را انتخاب کنید.
توجه داشته باشید که ظرفیت استفاده و دسترسی به برخی قابلیتهای جدید ChatGPT میتواند براساس پلن، حساب و روند انتشار ویژگیهای جدید متفاوت باشد.
این آپدیت چه چیزی درباره آینده ChatGPT نشان میدهد؟
اضافه شدن File Upload و Projects به Voice نشان میدهد OpenAI در حال یکپارچهتر کردن روشهای مختلف تعامل با ChatGPT است. ترکیب متن، صدا، فایل، جستوجوی وب و سایر قابلیتها در یک محیط میتواند ChatGPT را از یک چتبات متنی به دستیار هوش مصنوعی چندوجهی نزدیکتر کند؛ سیستمی که کاربر میتواند اطلاعات را در اختیار آن قرار دهد و بدون تغییر ابزار یا شروع یک فرآیند جدید، تعامل و تحلیل خود را ادامه دهد.
جمعبندی
پشتیبانی از File Upload و Projects نشان میدهد ChatGPT Voice در حال تبدیل شدن از یک قابلیت ساده برای مکالمه صوتی به رابطی کاربردیتر برای تعامل با اطلاعات است. کاربران میتوانند فایل را وارد گفتگو کنند، درباره محتوای آن سؤال بپرسند و تحلیل را بهصورت صوتی ادامه دهند.
برای کاربران حرفهای نیز ترکیب File + Text + Voice میتواند Workflow انعطافپذیری ایجاد کند؛ فایل برای ارائه اطلاعات، متن برای دستورالعملهای دقیق و Voice برای سؤالهای تکمیلی و ادامه تحلیل. اگر OpenAI این مسیر را ادامه دهد، مکالمه صوتی احتمالاً نقش مهمتری در نحوه کار کاربران با ChatGPT خواهد داشت.




نظرات (0)
در حال بارگذاری نظرات...