27 آگوست

Gemini Omni 1.1 Flash معرفی شد؛ قابلیت پردازش ویدیوی 4K به خانواده جمینای اضافه شد

گوگل با معرفی مدل‌های جدید هوش مصنوعی خود، Gemini Omni 1.1 و Gemini Flash 1.1، گام مهمی در توسعه قابلیت‌های هوش مصنوعی برداشته است. این مدل‌ها که در کنفرانس Google Cloud Next 2024 رونمایی شدند، پیشرفت‌های قابل توجهی در پردازش ویدئو، افزایش سرعت و کاهش هزینه ارائه می‌دهند.

Gemini Omni 1.1: پردازش ویدیوی 4K و قابلیت‌های پیشرفته

Gemini Omni 1.1، جدیدترین و پیشرفته‌ترین مدل هوش مصنوعی گوگل، قابلیت‌های بی‌نظیری را به ارمغان آورده است. این مدل اکنون می‌تواند ویدئوهای 4K را پردازش کند که این امکان را به توسعه‌دهندگان می‌دهد تا برنامه‌های کاربردی جدیدی را در زمینه تحلیل ویدئو، تولید محتوا و نظارت تصویری ایجاد کنند.

ویژگی‌های کلیدی Gemini Omni 1.1:

  • پردازش ویدیوی 4K: این قابلیت به مدل اجازه می‌دهد تا جزئیات دقیق‌تری را از ویدئوها استخراج کرده و تحلیل‌های عمیق‌تری ارائه دهد.
  • پنجره متنی بزرگ‌تر: با افزایش پنجره متنی به 1 میلیون توکن، Gemini Omni 1.1 می‌تواند حجم بیشتری از اطلاعات را در یک زمان پردازش کند که این امر به درک بهتر و پاسخ‌های دقیق‌تر منجر می‌شود.
  • پشتیبانی از 200 زبان: این مدل اکنون از 200 زبان پشتیبانی می‌کند و امکان استفاده از آن را در سطح جهانی فراهم می‌آورد.
  • قابلیت‌های چندوجهی: Gemini Omni 1.1 می‌تواند اطلاعات را از منابع مختلف مانند متن، تصویر، ویدئو و صدا ترکیب و تحلیل کند.
  • عملکرد بهبودیافته: این مدل در آزمون‌های مختلف، از جمله آزمون‌های درک زبان طبیعی و استدلال، عملکرد بهتری نسبت به نسخه‌های قبلی خود نشان داده است.

Gemini جواب جدول آمیرزا Flash 1.1: سرعت و کارایی بالا با هزینه کمتر

در کنار Gemini Omni 1.1، گوگل مدل Gemini Flash 1.1 را نیز معرفی کرده است. این مدل با تمرکز بر سرعت و کارایی، برای کاربردهایی طراحی شده که نیاز به پاسخ‌های سریع و پردازش حجم بالای داده با هزینه کمتر دارند.

ویژگی‌های کلیدی Gemini Flash 1.1:

  • سرعت بالا: Gemini Flash 1.1 به طور خاص برای سرعت بهینه شده است و می‌تواند در زمان کوتاهی به درخواست‌ها پاسخ دهد.
  • هزینه کمتر: این مدل با مصرف منابع کمتر، هزینه استفاده از هوش مصنوعی را برای توسعه‌دهندگان کاهش می‌دهد.
  • پشتیبانی از 200 زبان: همانند Gemini Omni 1.1، این مدل نیز از 200 زبان پشتیبانی می‌کند.
  • پنجره متنی بزرگ‌تر: با پنجره متنی 1 میلیون توکنی، Gemini Flash 1.1 نیز می‌تواند حجم زیادی از اطلاعات را به سرعت پردازش کند.
  • کاربردهای متنوع: این مدل برای خلاصه‌سازی متن، تولید محتوا، چت‌بات‌ها و سایر کاربردهایی که نیاز به سرعت و کارایی بالا دارند، ایده‌آل است.

قابلیت‌های جدید در Vertex AI

گوگل همچنین قابلیت‌های جدیدی را در پلتفرم Vertex AI خود معرفی کرده است که به توسعه‌دهندگان امکان می‌دهد تا از مدل‌های Gemini به بهترین شکل استفاده کنند:

  • ابزارهای جدید برای توسعه‌دهندگان: Vertex AI اکنون ابزارهای جدیدی را برای توسعه، استقرار و مدیریت مدل‌های هوش مصنوعی ارائه می‌دهد.
  • پشتیبانی از مدل‌های متن‌باز: گوگل پشتیبانی خود را از مدل‌های متن‌باز مانند Llama 3 و Gemma گسترش داده است.
  • قابلیت‌های امنیتی پیشرفته: Vertex AI با قابلیت‌های امنیتی جدید، از داده‌ها و مدل‌های هوش مصنوعی محافظت می‌کند.

تاثیر بر آینده هوش مصنوعی

معرفی Gemini Omni 1.1 و Gemini Flash 1.1 نشان‌دهنده تعهد گوگل به پیشرفت در زمینه هوش مصنوعی است. این مدل‌ها با قابلیت‌های جدید خود، از جمله پردازش ویدیوی 4K، سرعت بالا و کاهش هزینه، می‌توانند تحول بزرگی در صنایع مختلف ایجاد کنند و راه را برای نوآوری‌های بیشتر در آینده هموار سازند.

توسعه‌دهندگان اکنون می‌توانند از این مدل‌ها برای ساخت برنامه‌های کاربردی پیشرفته‌تر و هوشمندتر استفاده کنند و مرزهای هوش مصنوعی را جابجا کنند.