حالتهای Gemini مجموعهای از مدلها و ابزارهای تخصصی در اکوسیستم هوش مصنوعی گوگل هستند که هرکدام برای نوع مشخصی از پردازش، تولید محتوا، پژوهش یا یادگیری طراحی شدند. تفاوت میان این حالتها فقط به قدرت مدل مربوط نمیشود؛ بلکه شیوه استفاده از اطلاعات، سطح استدلال، نوع خروجی و ابزارهای در دسترس کاربر نیز در انتخاب آنها نقش دارد.
Gemini در سالهای اخیر از یک رابط مکالمهای ساده به محیطی چندمنظوره برای تولید تصویر و موسیقی، تحقیق، برنامهنویسی، تدوین محتوا و آموزش تبدیل شد. بنابراین شناخت دقیق این قابلیتها به کاربر کمک میکند بهجای استفاده یکسان از Gemini برای همه وظایف، ابزار مناسب هر پروژه را انتخاب کند. در ادامه، هر حالت را از منظر کاربرد و عملکرد بررسی میکنیم.
انواع حالتهای Gemini
برای شناخت حالتهای جمنای ابتدا باید میان مدل و قابلیت تفاوت قائل شد. مدل، موتور هوش مصنوعی مسئول پردازش درخواست است؛ درحالیکه قابلیت یا حالت، محیط یا شیوهای برای انجام یک کار مشخص محسوب میشود. در نسخههای جدید این سرویس هوش مصنوعی، قابلیتهایی که در این قسمت معرفی میکنیم، در دسترس هستند.
ساخت تصویر
تولید تصویر در Gemini دیگر صرفا به تبدیل یک جمله کوتاه به تصویر محدود نیست و به یکی از بخشهای مهم قابلیتهای چندرسانهای این سرویس تبدیل شد. در نسخههای جدید، Imagen 4 موتور تولید تصویر گوگل در Gemini معرفی شد و نسبت به نسلهای قبلی روی کیفیت بصری، سرعت، جزئیات و نمایش بهتر متن و تایپوگرافی تمرکز دارد.
کاربر میتواند موضوع، سبک، ترکیببندی، نور، محیط و عناصر موردنظر خود را در قالب یک پرامپت توصیف کند و سپس تصویر را بر اساس همان دستور تولید یا اصلاح کند. نکته مهم دیگر، استفاده گوگل از SynthID برای درج واترمارک نامرئی در محتوای تولیدشده با هوش مصنوعی است؛ این فناوری امکان شناسایی محتوای تولیدشده یا ویرایششده با ابزارهای گوگل را فراهم میکند.
ساخت موسیقی

اگر هدف از استفاده حالتهای Gemini، تولید محتوای صوتی باشد، قابلیت ساخت موسیقی مسیر متفاوتی نسبت به پاسخهای متنی دارد. گوگل در سال 2026 مدل Lyria 3 را به جمنای اضافه کرد که امکان ساخت قطعات موسیقی 30 ثانیهای را در قالب آزمایشی فراهم میکند. کاربر میتواند ایده موسیقایی خود را با متن توضیح دهد یا حتی تصویری را بهعنوان محرک خلاقانه ارائه کند تا قطعهای متناسب با آن ساخته شود.
Lyria 3 علاوه بر تولید موسیقی، روی کنترل خلاقانه، ساخت قطعات دشوارتر و تولید ترانه تمرکز دارد. در نسخههای جدیدتر، قابلیت تولید قطعات طولانیتر و تنظیم صدا نیز توسعه یافت. خروجیهای صوتی تولیدشده توسط Lyria نیز با SynthID واترمارک نامحسوس میشوند تا امکان تشخیص محتوای تولیدشده با هوش مصنوعی وجود داشته باشد.
Canvas
Canvas را میتوان فضای کاری تعاملی در میان حالتهای جمنای دانست که برای ساخت و ویرایش محتوای طولانی، برنامهها، اسلایدها و کد کاربرد دارد. تفاوت اصلی آن با گفتوگوی معمولی در این است که کاربر صرفا پاسخ متنی دریافت نمیکند؛ بلکه یک محیط قابلویرایش برای توسعه خروجی در اختیار دارد. در Canvas میتوان سند ایجاد کرد، کد را تغییر داد، یک برنامه تولید کرد یا ساختار یک ارائه را توسعه داد و سپس نتیجه را مستقیما ویرایش کرد.
گوگل همچنین امکان تبدیل محتوای Canvas به قالبهایی مانند آزمون، Audio Overview، اینفوگرافیک و صفحه وب را فراهم کرده است. از این منظر، Canvas بیشتر برای پروژههایی مناسب است که خروجی آنها نیازمند چند مرحله تولید، بازبینی و اصلاح است؛ نه یک پاسخ کوتاه و یکباره.
تحقیق عمیق
Deep Research برای زمانی طراحی شد که پاسخ مناسب با یک جستوجوی ساده یا چند منبع محدود به دست نمیآید. این قابلیت موضوع را بررسی میکند، برای تحقیق یک برنامه به وجود میآورد و سپس با استفاده از منابع انتخابشده گزارش مفصل تولید میکند. Google Search بهصورت پیشفرض یکی از منابع تحقیق است و کاربر میتواند منابع دیگری مانند فایلهای شخصی، Gmail، Drive یا NotebookLM را نیز در فرایند وارد کند.
مزیت مهم این روش، تفکیک مرحله برنامهریزی از مرحله تحقیق است؛ زیرا کاربر میتواند پیش از شروع، طرح تحقیق پیشنهادی Gemini را بررسی و اصلاح کند. گزارشهای Deep Research معمولا چند دقیقه زمان نیاز دارند و در طرحهای Google AI Ultra، امکان افزودن نمودار، دیاگرام و برخی عناصر تعاملی نیز وجود دارد.
یادگیری هدایت شده
Guided Learning رویکرد جمنای به آموزش تعاملی است؛ در این حالت، هدف صرفا ارائه پاسخ نهایی نیست؛ بلکه سیستم تلاش میکند مسیر یادگیری را متناسب با موضوع و سطح کاربر تنظیم کند. کاربر میتواند پرسشی آموزشی مطرح کند یا فایل و تصویر مرتبط با درس را در اختیار Gemini قرار دهد و فرایند آموزش را آغاز کند.
این قابلیت برای موضوعاتی مانند ریاضی، علوم، زبان و مباحث تخصصی کاربرد دارد، زیرا میتوان مسئله را به مراحل کوچکتر تقسیم کرد و از توضیح مفهومی، مثال، پرسش و تمرین برای تثبیت دانش استفاده کرد. در کنار Guided Learning، ابزارهای آموزشی دیگری مانند آزمون، فلشکارت و راهنمای مطالعه نیز در Gemini وجود دارند.
Notebook

قابلیت Notebooks در میان حالتهای Gemini اکنون مفهومی گستردهتر از یک فضای ساده برای یادداشتبرداری دارد. گوگل در ژوئیه 2026 اعلام کرد که NotebookLM با نام Gemini Notebook ادامه فعالیت میدهد و قابلیتهای آن با اکوسیستم یکپارچهتر شد. این محیط برای سازماندهی منابع، پژوهش و یادگیری طراحی شد. همچنین میتواند اطلاعات موجود در اسناد و یادداشتهای کاربر را به زمینه اصلی تعامل تبدیل کند.
از قابلیتهای مهم آن میتوان به خلاصهسازی منابع، پاسخگویی مبتنی بر دیتاهای ارائهشده، تولید محتوای آموزشی و Audio Overview اشاره کرد. همچنین امکان اجرای کد درون Notebook برای تحلیل دیتاها در حال گسترش است. با خرید اکانت جمنای در پلنهای پیشرفته، میتوانید به قابلیتهای بیشتری از این ابزار دسترسی پیدا کنید.
جمعبندی
حالتهای Gemini نشان میدهند که این سرویس دیگر صرفا یک چتبات برای تولید پاسخهای متنی نیست. بلکه به مجموعهای از مدلها و محیطهای تخصصی برای حل مسئله، تولید محتوا، پژوهش و یادگیری تبدیل شد. انتخاب میان پلنهای Fast، Thinking و Pro به ماهیت و پیچیدگی کار وابسته است. درحالیکه ابزارهایی مانند Canvas، Deep Research و Guided Learning هرکدام یک گردش کار متفاوت را پوشش میدهند.
در بخش تولید محتوا نیز Imagen برای تصویر و Lyria برای موسیقی، دامنه استفاده از Gemini را به فراتر از متن گسترش دادند. ازسویدیگر، Gemini Notebook برای سازماندهی و تحلیل منابع و مطالعه ساختاریافته اهمیت ویژهای دارد.
سوالات متداول
1. حالتهای Gemini شامل چه قابلیتهایی هستند؟
حالتهای Gemini شامل ابزارهایی مانند تولید تصویر، موسیقی، Canvas، Deep Research، Guided Learning و Notebook است که برای نیازهای متفاوت طراحی شدند.
2. نوت بوکس جمنای چه کاربردی دارد؟
Gemini Notebook برای پژوهش، سازماندهی منابع و یادگیری استفاده میشود و میتواند از اسناد و یادداشتها خلاصه، پاسخ، راهنمای مطالعه و Audio Overview تولید کند.
3. چطور با جمنای موسیقی تولید کنیم؟
در Gemini میتوان با توصیف متنی یا ارائه تصویر، ایده موسیقایی را به Lyria 3 سپرد تا قطعه تولید شود. این قابلیت در نسخههای جدید Gemini ارائه شده و خروجیها SynthID دارند.
4. موتور تولید تصویر Gemini چیست؟
در نسخه فعلی، Imagen 4 مدل تولید تصویر معرفیشده برای Gemini است و روی کیفیت تصویر، سرعت، جزئیات و نمایش بهتر متن تمرکز دارد.



