DEV Community

Cover image for Cách sử dụng Gemini 3.6 Flash miễn phí
Sebastian Petrus
Sebastian Petrus

Posted on • Originally published at apidog.com

Cách sử dụng Gemini 3.6 Flash miễn phí

Trả lời ngắn gọn: có, bạn có thể sử dụng Gemini 3.6 Flash miễn phí theo hai cách. Bạn có thể trò chuyện với nó trong ứng dụng Gemini hoặc gọi mô hình qua gói miễn phí của Gemini API trong Google AI Studio. Cả hai đều miễn phí để bắt đầu, nhưng đều có giới hạn thực tế. Không có gói nào không giới hạn, và gói API miễn phí đi kèm lưu ý về việc sử dụng dữ liệu mà bạn cần đọc trước khi gửi bất kỳ thông tin riêng tư nào.

Dùng thử Apidog ngay hôm nay

Gemini 3.6 Flash là mô hình chủ lực được làm mới của Google, được công bố vào ngày 21 tháng 7 năm 2026. Nó rẻ hơn và nhanh hơn phiên bản 3.5 Flash mà nó thay thế, vì vậy gói miễn phí là nơi phù hợp để tạo mẫu trước khi phát sinh chi phí. Bài viết này hướng dẫn cách truy cập, giới hạn cần lưu ý và thời điểm nên nâng cấp.

Bạn có thể sử dụng Gemini 3.6 Flash miễn phí không?

Có, theo hai cách dành cho hai nhóm người dùng khác nhau:

  1. Ứng dụng Gemini dành cho trò chuyện. Đăng nhập bằng tài khoản Google và bắt đầu nhập yêu cầu. Không cần code, khóa API hay thiết lập thanh toán.
  2. Gói miễn phí của Gemini API dành cho nhà phát triển. Bạn tạo khóa API trong Google AI Studio và gọi mô hình từ code của mình. Gói này có giới hạn tốc độ, nhưng không mất phí để bắt đầu.

Lưu ý về tên phiên bản:

  • Mô hình chủ lực là Gemini 3.6 Flash.
  • Lựa chọn rẻ hơn trong cùng đợt phát hành là Gemini 3.5 Flash-Lite.

Nếu cần tổng quan về mô hình, xem Gemini 3.6 Flash là gì.

Sử dụng Gemini 3.6 Flash miễn phí trong ứng dụng Gemini

Đây là cách nhanh nhất để thử mô hình:

  1. Mở ứng dụng Gemini.
  2. Đăng nhập bằng tài khoản Google.
  3. Gửi một câu hỏi hoặc yêu cầu bất kỳ.

Gemini 3.6 Flash phù hợp cho các tác vụ nhanh như:

  • Hỏi đáp một lần.
  • Soạn thảo nội dung.
  • Tóm tắt thông tin.
  • Kiểm tra logic hoặc ý tưởng.

Tuy nhiên, ứng dụng Gemini không phù hợp để tích hợp sản phẩm vì bạn không thể:

  • Gửi yêu cầu từ code.
  • Quản lý khóa API.
  • Đặt tham số như nhiệt độ.
  • Chạy hàng nghìn yêu cầu lặp lại.

Để làm các việc này, hãy dùng Gemini API.

Sử dụng gói API miễn phí trong Google AI Studio

Quy trình thiết lập cơ bản:

  1. Mở Google AI Studio và đăng nhập.
  2. Chọn Get API key để tạo khóa API.
  3. Lưu khóa vào biến môi trường, không hard-code vào source code.
  4. Gửi yêu cầu đến model ID gemini-3.6-flash.

Ví dụ lệnh gọi tối thiểu:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {
        "parts": [
          {
            "text": "Giải thích REST API là gì trong hai câu."
          }
        ]
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Trước khi chạy lệnh, đặt khóa API vào biến môi trường:

export GEMINI_API_KEY="your-api-key"
Enter fullscreen mode Exit fullscreen mode

Sau khi lệnh hoạt động, bạn có thể dùng cùng cấu trúc yêu cầu này trong backend, script tự động hóa hoặc công cụ kiểm thử API.

Để xem hướng dẫn đầy đủ về tham số và vòng lặp kiểm thử, đọc cách sử dụng Gemini 3.6 Flash API.

Gói miễn phí chấp nhận các loại đầu vào tương tự gói trả phí:

  • Văn bản
  • Hình ảnh
  • Video
  • Âm thanh
  • PDF

Đầu ra là văn bản. Mô hình cũng có cửa sổ ngữ cảnh 1 triệu token, phù hợp để gửi tài liệu dài và đặt câu hỏi trên nội dung đó.

Những giới hạn thực tế của gói miễn phí

Miễn phí không có nghĩa là không giới hạn. Có hai giới hạn quan trọng cần kiểm tra trước khi tích hợp.

Giới hạn tốc độ và hạn ngạch

Gói miễn phí giới hạn số yêu cầu bạn có thể gửi mỗi phút và mỗi ngày. Khi vượt giới hạn, API trả về HTTP 429 Too Many Requests.

Google có thể điều chỉnh các hạn ngạch này theo thời gian. Vì vậy, hãy kiểm tra tài liệu Gemini API để xem giới hạn hiện tại áp dụng cho khóa của bạn.

Khi xử lý lỗi 429, hãy thêm cơ chế retry với exponential backoff thay vì gọi lại ngay lập tức:

async function callWithRetry(request, maxRetries = 3) {
  for (let attempt = 0; attempt < maxRetries; attempt++) {
    const response = await request();

    if (response.status !== 429) {
      return response;
    }

    const delay = 1000 * 2 ** attempt;
    await new Promise((resolve) => setTimeout(resolve, delay));
  }

  throw new Error("Đã vượt quá số lần thử lại sau lỗi 429.");
}
Enter fullscreen mode Exit fullscreen mode

Bài học thực tế: gói miễn phí phù hợp để tạo mẫu và sử dụng cá nhân nhẹ, không phù hợp cho lưu lượng truy cập sản xuất.

Sử dụng dữ liệu

Trên gói miễn phí, Google có thể sử dụng prompts và phản hồi của mô hình để cải thiện sản phẩm. Đây là đánh đổi khi bạn không phải trả phí.

Không gửi các dữ liệu sau qua gói miễn phí:

  • Dữ liệu khách hàng.
  • Bí mật hoặc token truy cập.
  • Mã nguồn độc quyền.
  • Thông tin nội bộ.
  • Bất kỳ nội dung nào bạn không muốn chia sẻ.

Hãy xem gói miễn phí như một môi trường thử nghiệm công khai: phù hợp để học API và xây dựng proof of concept, nhưng không phù hợp với dữ liệu sản xuất.

Nếu bạn đã dùng thế hệ trước, nguyên tắc tương tự cũng áp dụng. Xem thêm cách sử dụng Gemini 3.5 miễn phí.

Khi nào bạn nên chuyển sang gói trả phí?

Nâng cấp khi một trong các điều sau trở thành vấn đề thực tế:

  • Bạn cần giới hạn cao hơn. Ứng dụng thực tế sẽ nhanh chóng vượt giới hạn tốc độ của gói miễn phí. Gói trả phí giúp giảm nguy cơ người dùng gặp hàng loạt lỗi 429.
  • Bạn cần kiểm soát dữ liệu tốt hơn. Việc sử dụng trả phí được xử lý khác với gói miễn phí. Đây là yếu tố quan trọng nếu ứng dụng xử lý dữ liệu riêng tư hoặc dữ liệu khách hàng.
  • Bạn chuẩn bị chạy production. Khi người dùng phụ thuộc vào phản hồi của mô hình, bạn cần thông lượng dự đoán được và các điều khoản dữ liệu phù hợp.

Gemini 3.6 Flash có chi phí vận hành thấp: 1.50 USD cho mỗi triệu token đầu vào và 7.50 USD cho mỗi triệu token đầu ra. Giá đầu ra này đã giảm từ 9.00 USD trên 3.5 Flash.

Mô hình cũng có xu hướng dùng ít token đầu ra hơn cho cùng một công việc, nên chi phí thực tế thường thấp hơn mức giá niêm yết. Xem chi tiết tại giá của Gemini 3.6 Flash.

Rẻ hơn nữa: Gemini 3.5 Flash-Lite

Nếu bài toán của bạn ưu tiên khối lượng hơn chiều sâu, Gemini 3.5 Flash-Lite là lựa chọn rẻ hơn trong cùng họ mô hình.

Giá của Flash-Lite:

  • 0.30 USD cho mỗi triệu token đầu vào.
  • 2.50 USD cho mỗi triệu token đầu ra.
  • Khoảng 350 token đầu ra mỗi giây.
  • Có gói miễn phí riêng.

Flash-Lite phù hợp cho các tác vụ có khối lượng lớn và nhạy cảm về độ trễ:

  • Phân loại.
  • Gắn thẻ.
  • Trích xuất ngắn.
  • Định tuyến đơn giản.

Gemini 3.6 Flash phù hợp hơn khi tác vụ cần lý luận mạnh hoặc sử dụng công cụ. Chọn Flash-Lite khi bạn có nhiều tác vụ nhỏ và muốn giảm chi phí mỗi yêu cầu.

Xem thêm Gemini 3.5 Flash-Lite là gì.

Kiểm thử các lệnh gọi gói miễn phí trong Apidog

Gói miễn phí là nơi các vấn đề API thường xuất hiện: khóa API hoạt động, nhưng một loạt yêu cầu dẫn đến lỗi 429; hoặc phản hồi có cấu trúc khác với dự kiến.

Apidog giúp bạn kiểm thử các tình huống này trước khi đưa request vào ứng dụng.

Thiết lập một lần, sau đó tái sử dụng trong cả quá trình phát triển:

  • Xây dựng request một lần. Tạo yêu cầu POST đến generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent. Lưu API key dưới dạng biến môi trường để khóa không xuất hiện trong request body.
  • Theo dõi lỗi giới hạn tốc độ. Gửi từng request hoặc một loạt request để kiểm tra mã trạng thái. Khi chạm hạn mức miễn phí, bạn sẽ thấy lỗi 429 trực tiếp trong Apidog.
  • Thêm assertion. Kiểm tra status là 200 và các trường JSON mong đợi tồn tại. Điều này giúp phát hiện thay đổi trong cấu trúc phản hồi.
  • Lên lịch kiểm thử hồi quy. Chuyển request thành kiểm thử API được lên lịch để phát hiện thay đổi hạn ngạch hoặc sai lệch hợp đồng API.

Ví dụ assertion cần có cho một request thành công:

Status code = 200
Response body chứa candidates
Response body chứa candidates[0].content.parts
Enter fullscreen mode Exit fullscreen mode

Apidog không phải là mô hình AI. Nó là API client và môi trường kiểm thử xung quanh mô hình, giúp xác minh rằng các request bạn gửi hoạt động đúng như dự kiến.

Tải xuống Apidog và trỏ request đến khóa Gemini miễn phí của bạn để bắt đầu kiểm thử.

Câu hỏi thường gặp

Gemini 3.6 Flash miễn phí có không giới hạn không?

Không. Gói miễn phí có giới hạn tốc độ theo phút và theo ngày. Khi vượt giới hạn, API trả về HTTP 429. Kiểm tra tài liệu Gemini API để biết hạn ngạch hiện tại của khóa API. Gói này được thiết kế cho tạo mẫu, không phải lưu lượng production.

Dữ liệu trên gói miễn phí có riêng tư không?

Không. Trên gói miễn phí, Google có thể dùng prompts và đầu ra của mô hình để cải thiện sản phẩm. Không gửi dữ liệu nhạy cảm, độc quyền hoặc dữ liệu khách hàng. Chuyển sang gói trả phí khi đầu vào cần được giữ riêng tư.

Tôi có cần thẻ tín dụng để dùng gói miễn phí không?

Không. Bạn tạo khóa trong Google AI Studio và bắt đầu gọi API mà không cần thiết lập thanh toán. Bạn chỉ cần thêm phương thức thanh toán khi chuyển sang gói trả phí để có giới hạn cao hơn.

Ứng dụng Gemini có giống gói API miễn phí không?

Không. Ứng dụng Gemini là giao diện trò chuyện cho người dùng và không cần code. Gói API miễn phí cung cấp khóa API và quyền truy cập lập trình. Cả hai đều cho phép dùng mô hình miễn phí, nhưng API mới phù hợp để tích hợp vào phần mềm.

Tôi nên bắt đầu với Flash hay Flash-Lite?

Bắt đầu với Gemini 3.6 Flash cho lý luận tổng quát và các tác vụ nặng về công cụ. Chuyển sang Gemini 3.5 Flash-Lite khi bạn chạy các request đơn giản với số lượng lớn và muốn có chi phí thấp nhất trên mỗi yêu cầu.

Nên đi đâu từ đây?

Bắt đầu với ứng dụng Gemini nếu bạn chỉ muốn thử khả năng của mô hình.

Chuyển sang gói API miễn phí trong Google AI Studio ngay khi muốn tích hợp vào code. Trong giai đoạn này, không gửi dữ liệu thực tế hoặc dữ liệu nhạy cảm.

Khi prototype bắt đầu có lưu lượng truy cập thực tế, hãy cân nhắc gói trả phí để có hạn mức cao hơn và cách xử lý dữ liệu phù hợp hơn. Đồng thời, kết nối các request qua Apidog từ request đầu tiên để phát hiện lỗi 429 và các khác biệt trong phản hồi trước khi người dùng gặp chúng.

Top comments (0)