موج تازه گوگل: Gemma 4، Gemini 3.5 و ترجمه زنده ۷۰ زبانه

گوگل مجموعه خبرهای AI ژوئن را جمع‌بندی کرد: Gemma 4 روی لپ‌تاپ، عامل‌های Gemini 3.5، مدل تصویر سبک، ترجمه زنده و نسخه تازه NotebookLM.

تتحریریه GPT Plus۱ دقیقه مطالعه
مجموعه ابزارهای هوش مصنوعی گوگل و Gemini

گوگل در جمع‌بندی خبرهای ژوئن ۲۰۲۶، مسیر خود را روشن‌تر کرده است: مدل‌های محلی، عامل‌هایی که با کامپیوتر کار می‌کنند و هوش مصنوعی چندوجهی که وارد محصولات روزمره می‌شود.

مدل‌های تازه برای توسعه‌دهندگان#

Gemma 4 12B برای اجرای محلی روی لپ‌تاپی با ۱۶ گیگابایت حافظه معرفی شده و متن، بینایی و صدا را در یک معماری ترکیب می‌کند. اجرای محلی برای حفظ حریم خصوصی و کاهش هزینه پردازش ابری مهم است.

گوگل همچنین قابلیت کار با کامپیوتر را به Gemini 3.5 Flash افزوده است. توسعه‌دهنده می‌تواند عاملی بسازد که محیط دسکتاپ، موبایل یا مرورگر را ببیند و برای کارهای چندمرحله‌ای اقدام کند. Nano Banana 2 Lite برای تولید تصویر ارزان‌تر و Gemini Omni Flash برای جریان‌های ویدیویی چندوجهی نیز عرضه شده‌اند.

ترجمه، خانه و آموزش#

Gemini 3.5 Live Translate بیش از ۷۰ زبان را خودکار تشخیص می‌دهد و تلاش می‌کند لحن طبیعی گوینده را با مکث کمتر حفظ کند. این مدل وارد Gemini Live API، Google AI Studio و اپ Google Translate می‌شود.

اسپیکر تازه Google Home با Gemini فرمان‌های ترکیبی و گفت‌وگوی پیوسته را بهتر درک می‌کند. NotebookLM نیز استدلال پیشرفته، اجرای کد و ساخت نمودار، شیت و اسلاید را دریافت کرده است؛ دسترسی اولیه این امکانات به برخی مشترکان و حساب‌های Workspace محدود است.

تصویر بزرگ‌تر چیست؟#

این فهرست نشان می‌دهد رقابت از «بهترین چت‌بات» عبور کرده است. گوگل مدل را در سیستم‌عامل، خانه، آموزش، جست‌وجو و ابزار توسعه پخش می‌کند. پرسش اصلی دیگر فقط کیفیت مدل نیست؛ یکپارچگی، هزینه، کنترل داده و قابلیت اعتماد عامل‌ها تعیین‌کننده خواهد بود.

منبع: جمع‌بندی رسمی Google

منبع خبر
Google Blog

این مطلب گزارش و تحلیل مستقل تحریریه GPT Plus بر پایه منبع بالا است.

اشتراک‌گذاری:تلگرامواتساپX
ت
تحریریه GPT Plus

خبرهای مهم هوش مصنوعی و فناوری را از منابع اصلی بررسی می‌کنیم و با زمینه، محدودیت‌ها و اثر عملی آن‌ها به فارسی گزارش می‌دهیم.