بیایید جمنای یاد بگیریم - Gemini 101 - قسمت اول: آشنایی اولیه با جمنای و امکانات کلی آن

بهروز فیض
0

 برای شروع کار با هوش مصنوعی، لازم نیست از همان ابتدا با مفاهیم پیچیده یا ابزارهای حرفه‌ای درگیر شوید. در این مجموعه آموزشی قرار است کار با جمنای گوگل (Google Gemini) را از کاملاً ابتدایی‌ترین سطح شروع کنیم و قدم‌به‌قدم به سراغ قابلیت‌ها و کاربردهای مختلف آن برویم.



هدف این مجموعه صرفاً معرفی امکانات جمنای نیست؛ بلکه می‌خواهیم به‌صورت عملی و کاربردی یاد بگیریم چگونه از آن برای کارهای روزمره، تولید محتوا، تحقیق، نوشتن و ویرایش متن، ایده‌پردازی، تحلیل اطلاعات و دیگر کارهایی که می‌توان با کمک هوش مصنوعی انجام داد استفاده کنیم.

این آموزش‌ها به‌صورت سریالی و رایگان در بلاگ منتشر خواهند شد. در طول این مجموعه، ابتدا قابلیت‌هایی را بررسی می‌کنیم که کاربران می‌توانند به‌صورت رایگان از آن‌ها استفاده کنند و در ادامه، سراغ امکانات پیشرفته‌تر و قابلیت‌های پولی جمنای نیز خواهیم رفت تا تفاوت میان نسخه‌های مختلف و کاربرد هرکدام را بهتر بشناسیم.

اگر تاکنون با جمنای کار نکرده‌اید یا حتی نمی‌دانید از کجا باید شروع کنید، این مجموعه برای شماست؛ قرار است Gemini 101 را از صفر شروع کنیم و به‌مرور، از یک کاربر کاملاً مبتدی به کاربری آشنا با امکانات و کاربردهای مختلف جمنای برسیم.


تبلیغات متنی | آژانس طراحی سایت و سئو برانکس 


این عبارت 101 که در دوره های آموزشی استفاده می شود از کجا آمده؟

101 در عنوان دوره‌های آموزشی، به‌خصوص در انگلیسی آمریکایی، معمولاً یعنی «مقدماتی‌ترین و پایه‌ای‌ترین آموزش یک موضوع».

این کاربرد از سیستم شماره‌گذاری درس‌های دانشگاهی در آمریکا آمده است؛ مثلاً یک درس با شماره 101 معمولاً درس مقدماتی یک رشته بوده است. بنابراین امروزه وقتی می‌گویند X 101، منظورشان چیزی شبیه «X از صفر»، «مبانی X» یا «آشنایی با اصول X» است.

نکته جالب اینکه 101 الزاماً به معنی «درس شماره ۱۰۱» نیست؛ بیشتر یک اصطلاح جاافتاده برای نشان دادن سطح مقدماتی است. مثلاً AI 101 را می‌توان در فارسی «مبانی هوش مصنوعی» یا «آشنایی با هوش مصنوعی» ترجمه کرد.


بخش های اصلی جمنای گوگل را بشناسیم 

در صفحه اصلی Gemini در آدرس https://gemini.google.com/app، کاربر می‌تواند گفت‌وگو با هوش مصنوعی را شروع کند، سؤال بپرسد، متن تولید یا ویرایش کند، اطلاعات دریافت کند و فایل یا محتوای مختلفی را برای تحلیل در اختیار Gemini قرار دهد. این بخش در واقع نقطه شروع بیشتر کارهای روزمره با جمنای است.



بخش Image برای تولید و کار با تصاویر است. در این قسمت می‌توان با نوشتن یک توضیح متنی، تصویر جدید ایجاد کرد یا در برخی قابلیت‌ها تصاویر موجود را ویرایش و تغییر داد. کاربردهایی مانند تولید تصاویر تبلیغاتی، ایده‌های گرافیکی و تصاویر موردنیاز برای محتوا در این بخش قرار می‌گیرند.



بخش Video برای تولید و کار با محتوای ویدئویی با کمک هوش مصنوعی طراحی شده است. کاربر می‌تواند از توضیحات متنی برای ایجاد ویدئو استفاده کند و بسته به قابلیت‌های در دسترس، ایده‌های خود را به محتوای ویدئویی تبدیل کند.



Notebook یا NotebookLM بیشتر برای کار عمیق با منابع و اسناد طراحی شده است. می‌توان منابعی مانند فایل‌ها، اسناد و مطالب مختلف را در اختیار آن قرار داد و سپس از هوش مصنوعی برای خلاصه‌سازی، پرسش و پاسخ، استخراج اطلاعات و بررسی محتوای همان منابع استفاده کرد.



بخش Gems امکان ساخت نسخه‌های شخصی‌سازی‌شده از Gemini را فراهم می‌کند. در این قسمت می‌توان برای یک کار مشخص، دستورالعمل‌هایی تعیین کرد تا Gemini در گفت‌وگوهای بعدی با همان نقش و دستورالعمل عمل کند؛ برای مثال می‌توان یک Gem برای تولیدکننده محتوا، دستیار برنامه‌ریزی یا معلم زبان ایجاد کرد.



بخش Connected Apps برای اتصال Gemini به برخی سرویس‌ها و برنامه‌های دیگر است. با این قابلیت، Gemini می‌تواند در صورت فعال بودن اتصال و مجوزهای لازم، با اطلاعات یا امکانات سرویس‌های متصل کار کند؛ برای مثال استفاده از اطلاعات موجود در برخی سرویس‌های گوگل و کمک به انجام کارها میان چند برنامه.

این بخش هایی که در بالا معرفی شدند ، مهم ترین بخش های جمنای گوگل هستند ، در ادامه بخش های رایگان را توضیح خواهم داد. قبل از شروع بیایید ببینیم با چه زبانی می توان با جمنای صحبت کرد؟!

جمنای گوگل زبان فارسی را کامل متوجه می شود ولی بهتر است که انگلیسی هم بلد باشید. گاهی اوقات لازم است شرایط خاص و یا یک ایده خاص برای مثلا یک ویدئو را به انگلیسی به آن بگویید ، فارسی تخصصی را شاید خوب بلد نباشد. 

برای اینکه از Gemini یا هر ابزار هوش مصنوعی دیگری نتیجه بهتری بگیرید، لازم نیست حتماً با اصطلاحات تخصصی مثل «پرامپت‌نویسی» آشنا باشید. کافی است درخواست خود را واضح و دقیق بنویسید و تا حد امکان توضیح دهید چه کاری می‌خواهید انجام شود. به‌جای اینکه فقط بنویسید «یک متن درباره بازاریابی بنویس»، بهتر است مشخص کنید متن برای چه کسی، با چه هدفی و در چه قالبی باشد؛ مثلاً: «یک متن ساده و کاربردی درباره بازاریابی دیجیتال برای صاحبان کسب‌وکارهای کوچک بنویس و در حدود ۵۰۰ کلمه توضیح بده.» هرچه اطلاعات و محدودیت‌های مهم را بهتر بیان کنید، احتمال اینکه پاسخ به چیزی که می‌خواهید نزدیک‌تر باشد بیشتر است.

همچنین لازم نیست اولین درخواست شما کامل و نهایی باشد. می‌توانید پاسخ Gemini را بررسی کنید و سپس در ادامه همان گفت‌وگو از آن بخواهید تغییرات موردنظر شما را اعمال کند؛ مثلاً «متن را ساده‌تر کن»، «این بخش را کوتاه کن»، «مثال بیشتری اضافه کن» یا «لحن آن را رسمی‌تر کن». در واقع می‌توانید با هوش مصنوعی گفت‌وگو کنید و مرحله‌به‌مرحله به نتیجه مطلوب برسید. برای شروع، فقط کافی است تصور کنید در حال توضیح دادن کار موردنظر خود به یک دستیار هستید؛ هرچه خواسته، هدف و جزئیات بیشتری را به شکل طبیعی توضیح دهید، معمولاً نتیجه بهتری دریافت خواهید کرد.


محدودیت های نسخه رایگان چقدر هستند؟ 

در نسخه رایگان Gemini، کاربر به امکانات اصلی گفت‌وگو و مدل‌های عمومی دسترسی دارد، اما میزان استفاده بر اساس منابع پردازشی محدود می‌شود. طبق اطلاعات فعلی گوگل، محدودیت‌ها به پیچیدگی درخواست، مدل مورد استفاده و طول مکالمه بستگی دارند و سقف استفاده در بازه‌های زمانی مشخص بازنشانی می‌شود. مهم‌ترین تفاوت، پنجره زمینه (Context Window) است: در حساب بدون اشتراک Google AI این ظرفیت ۳۲ هزار توکن است، در حالی که در Google AI Pro و Ultra به یک میلیون توکن می‌رسد. بنابراین در نسخه رایگان، هنگام کار با متن‌ها یا فایل‌های بسیار طولانی، مقدار اطلاعاتی که Gemini می‌تواند همزمان در نظر بگیرد محدودتر است. گوگل همچنین تأکید می‌کند که این سقف‌ها ممکن است با توجه به ظرفیت سیستم و میزان تقاضا تغییر کنند. (Google Help)

در بخش تولید تصویر نیز نسخه رایگان دارای سهمیه مشخص است و نباید یک عدد ثابت را برای همیشه در نظر گرفت، زیرا گوگل می‌تواند این محدودیت‌ها را تغییر دهد. برای نمونه، در قابلیت تولید تصویر در AI Mode گوگل، کاربران بدون Google AI تا ۲۰ تصویر در یک بازه ۲۴ ساعته دریافت می‌کنند، در حالی که این عدد برای AI Plus تا ۵۰، برای AI Pro تا ۱۰۰ و برای AI Ultra تا ۱۰۰۰ تصویر افزایش می‌یابد. تولید ویدئو و برخی قابلیت‌های پیشرفته نیز به منابع بیشتری نیاز دارند و ممکن است در نسخه رایگان محدود یا در برخی شرایط در دسترس نباشند؛ بنابراین برای استفاده گسترده‌تر از قابلیت‌های چندرسانه‌ای، پلن‌های پولی دسترسی و سقف بالاتری ارائه می‌کنند. (Google Help)

در مورد NotebookLM، نسخه رایگان همچنان امکانات قابل‌توجهی دارد. در حال حاضر می‌توان تا ۱۰۰ نوت‌بوک ایجاد کرد و در هر نوت‌بوک حداکثر ۵۰ منبع قرار داد. هر منبع می‌تواند تا ۵۰۰ هزار کلمه یا برای فایل‌های بارگذاری‌شده حداکثر ۲۰۰ مگابایت باشد. محدودیت روزانه نسخه استاندارد نیز شامل ۵۰ پرسش در چت و ۳ تولید Audio Overview است. در پلن‌های بالاتر، این سقف‌ها افزایش پیدا می‌کنند؛ برای مثال در یکی از سطوح ارتقایافته، تعداد نوت‌بوک‌ها به ۲۰۰، منابع هر نوت‌بوک به ۱۰۰ و پرسش‌های روزانه به ۲۰۰ مورد می‌رسد. (Google Help)

در نهایت، تفاوت نسخه رایگان و پولی فقط به «تعداد پیام» محدود نمی‌شود، بلکه به مدل‌های قابل استفاده، ظرفیت پردازش، اندازه Context و دسترسی به قابلیت‌های پیشرفته نیز مربوط است. نکته مهم این است که برخی اطلاعات موجود در فهرست‌های قدیمی ممکن است دیگر دقیق نباشند؛ برای مثال Gems در اطلاعات فعلی گوگل برای حساب‌های بدون پلن Google AI نیز در فهرست قابلیت‌های در دسترس قرار گرفته است، بنابراین نمی‌توان آن را صرفاً یک قابلیت پولی دانست. به‌طور کلی، نسخه رایگان برای شروع، یادگیری و بسیاری از کارهای روزمره کاملاً کاربردی است، اما کاربران حرفه‌ای که با فایل‌های بزرگ، تولید محتوای چندرسانه‌ای، مدل‌های قدرتمندتر یا حجم بالای درخواست‌ها کار می‌کنند، از سقف‌های بالاتر پلن‌های پولی بهره بیشتری می‌برند. (Google Help)


برچسب ها

ارسال یک نظر

0 نظرات

ارسال یک نظر (0)
3/related/default
dark_mode