










Google Gemini là một tập hợp các mô hình ngôn ngữ lớn đa phương thức (LLMs) do Google DeepMind phát triển. Nó được thiết kế để natively đa phương thức, có nghĩa là nó có thể xử lý và hiểu các loại thông tin khác nhau, bao gồm văn bản, mã, âm thanh, hình ảnh và video. Gemini có ba kích thước: Ultra, Pro và Nano. Gemini Ultra là mô hình lớn nhất và có khả năng nhất, dành cho các nhiệm vụ phức tạp. Gemini Pro được thiết kế cho một loạt các nhiệm vụ và có sẵn qua API Gemini. Gemini Nano được thiết kế cho các tác vụ trên thiết bị di động. Gemini được thiết kế để có trách nhiệm và an toàn, với các tính năng như bộ lọc an toàn và kiểm soát quyền riêng tư.
Gemini có thể được truy cập thông qua API Gemini cho các nhà phát triển, hoặc thông qua AI Studio của Google. Người dùng có thể nhập văn bản, mã, hình ảnh hoặc âm thanh để nhận phản hồi, tạo nội dung hoặc thực hiện các nhiệm vụ khác nhau. Cách sử dụng cụ thể phụ thuộc vào ứng dụng và kích thước của mô hình Gemini đang được sử dụng.


