Không, GPT-6.1 Sol không miễn phí. OpenAI đã ra mắt mô hình này vào ngày 29 tháng 9 năm 2026 cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex. Nó chưa có mặt trong Chat; các gói Free và Go không được sử dụng; và mô hình API gpt-6.1-sol không có bậc miễn phí. Giá API Standard là 2 đô la cho mỗi triệu token đầu vào, 0,10 đô la cho mỗi triệu token đầu vào được lưu trong bộ nhớ cache và 10 đô la cho mỗi triệu token đầu ra.
Mặt tích cực là các tùy chọn rẻ hơn đã trở nên rẻ hơn nữa. GPT-6.1 Sol giữ nguyên giá niêm yết 2/10 đô la của GPT-6 Sol và giảm một nửa chi phí đầu vào được lưu trong bộ nhớ cache.
Hướng dẫn này giúp bạn:
- So sánh mọi cách truy cập theo chi phí.
- Xác định rõ các tùy chọn không miễn phí.
- Tính chi phí từ mức giá thực tế.
- Chọn một giải pháp thay thế miễn phí trong dòng GPT-6.
- Đo token và kiểm tra cache hit trước khi triển khai.
Để tìm hiểu về mô hình, xem GPT-6.1 Sol là gì. Với phiên bản tiền nhiệm, xem GPT-6 Sol có miễn phí không. Trước khi chọn một phương án, hãy đo chi phí lời nhắc trong Apidog.
Mọi cách truy cập GPT-6.1 Sol, so sánh
| Cách truy cập | Chi phí | Những gì bạn nhận được | Điểm cần lưu ý |
|---|---|---|---|
| Giải pháp thay thế miễn phí, không phải Sol: GPT-6 Luna trong ứng dụng ChatGPT dành cho máy tính để bàn | 0 đô la với gói Free | Luna, không phải Sol, trong Work và Codex của ứng dụng máy tính để bàn | Mô hình khác; không có trong Chat; không có khóa API |
| ChatGPT Plus trong Codex hoặc ChatGPT Work | Một gói đăng ký Plus | 6.1 Sol cho tác vụ viết mã và công việc | Có giới hạn sử dụng gói; không có trong Chat; không có khóa API |
| Đăng nhập bằng các ứng dụng đối tác của ChatGPT | Tính vào mức sử dụng gói Plus hoặc Pro | Sử dụng gói trong ứng dụng như Devin, Notion, Vercel, T3, OpenClaw và Dactyl | Chỉ dành cho Plus và Pro; giới hạn hàng tuần theo ứng dụng; tín dụng mặc định tắt |
| API, Batch hoặc Flex | 1 đô la đầu vào, 0,05 đô la cache, 5 đô la đầu ra | Bằng một nửa giá Standard | Batch là bất đồng bộ; Flex chậm hơn và có thể trả về lỗi 429 |
| API, Standard với cache | 2 đô la đầu vào, 0,10 đô la cache, 10 đô la đầu ra | Dùng mô hình từ mã của bạn | Mọi token đều bị tính phí; cache hit cần tiền tố ổn định |
OpenRouter openai/gpt-6.1-sol
|
2 đô la đầu vào, 0,10 đô la cache, 10 đô la đầu ra trên điểm cuối OpenAI | Một khóa cho nhiều nhà cung cấp | Cùng giá niêm yết; không miễn phí |
Tất cả giá API được tính trên mỗi triệu token cho lời nhắc có tối đa 272K token đầu vào, theo trang giá OpenAI và trang mô hình OpenRouter.
ChatGPT Plus: điểm khởi đầu cho sử dụng tương tác
Nếu bạn muốn tự dùng GPT-6.1 Sol trong Codex hoặc ChatGPT Work, Plus là gói thấp nhất bao gồm mô hình này.
Bài đăng ra mắt của OpenAI cho biết GPT-6.1 Sol có sẵn cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex, đồng thời “chưa có mặt trong Chat”.
Theo tài liệu mô hình của OpenAI:
- Enterprise và Edu giữ mô hình ở trạng thái tắt cho đến khi quản trị viên bật.
- Bạn không trả tiền theo token khi dùng gói ChatGPT.
- Giới hạn sử dụng của gói vẫn được áp dụng.
Xem giới hạn sử dụng Codex để hiểu cách giới hạn hoạt động. Nếu cần tùy chọn Codex không tốn phí, xem hướng dẫn Codex miễn phí. Tuy nhiên, GPT-6.1 Sol bắt đầu từ gói Plus.
Đăng nhập bằng ChatGPT: dùng gói trong ứng dụng khác
DevDay đã thêm tính năng Đăng nhập bằng ChatGPT. Phần nhận dạng OAuth/OIDC có sẵn trên toàn cầu. Ngoài ra, người dùng Plus và Pro có thể sử dụng gói của mình trong các công cụ tham gia.
OpenAI đã ra mắt với 16 đối tác. Tóm tắt DevDay đề cập đến Devin của Cognition, Notion, Vercel, T3, OpenClaw và Dactyl.
Theo bài viết trợ giúp của OpenAI, cơ chế sử dụng hoạt động như sau:
- Yêu cầu đủ điều kiện được tính vào mức sử dụng ChatGPT Work và Codex của gói.
- Mỗi ứng dụng có giới hạn sử dụng hàng tuần, được đặt theo tỷ lệ phần trăm tổng mức sử dụng hàng tuần.
- Đây là giới hạn, không phải một nhóm tài nguyên riêng.
- Thanh toán bằng tín dụng sau khi đạt giới hạn là tùy chọn, mặc định tắt và chỉ áp dụng khi giới hạn ứng dụng đạt 100%.
- Ứng dụng nhận tên, email và ảnh hồ sơ của bạn.
- Ứng dụng không nhận cuộc trò chuyện, bộ nhớ hoặc khóa API.
Luôn kiểm tra ứng dụng đang dùng mô hình nào trước khi cho rằng đó là GPT-6.1 Sol. Nếu cần kiểm tra riêng chi phí OpenClaw, xem OpenClaw có miễn phí không.
Phần triển khai cho nhà phát triển, từ client ID đến OAuth flow, nằm trong hướng dẫn Đăng nhập bằng ChatGPT.
Gói ChatGPT không phải là khóa API
Đây là điểm dễ nhầm trong các tìm kiếm về “GPT miễn phí”.
Gói Plus hoặc Pro cho phép bạn dùng GPT-6.1 Sol trong ChatGPT Work và Codex, nhưng không cung cấp khóa API miễn phí. Một script, CI job hoặc agent gửi yêu cầu với:
Authorization: Bearer $OPENAI_API_KEY
đến:
https://api.openai.com/v1
vẫn bị tính phí theo token, bất kể bạn đang dùng gói ChatGPT nào.
Cách duy nhất để mã sử dụng gói là qua OAuth flow của Đăng nhập bằng ChatGPT. Tài liệu sử dụng gói của OpenAI mở cơ chế này cho ứng dụng mã nguồn mở và ứng dụng lưu trữ cục bộ, với các giới hạn xem trước:
- Chỉ hỗ trợ streaming.
- Phải đặt
store: false. - Không hỗ trợ
temperature. - Không hỗ trợ công cụ lưu trữ như tìm kiếm tệp.
Các yêu cầu vẫn tính vào mức sử dụng Plus hoặc Pro và giới hạn của ứng dụng.
Cách truy cập API rẻ nhất: Batch, Flex và cache
Ba đòn bẩy chính để giảm chi phí mỗi token là Batch, Flex và prompt caching.
1. Dùng Batch cho tác vụ không cần phản hồi ngay
Batch chạy tác vụ bất đồng bộ với một nửa giá Standard:
- Đầu vào: 1 đô la / 1 triệu token.
- Cache: 0,05 đô la / 1 triệu token.
- Đầu ra: 5 đô la / 1 triệu token.
Xem hướng dẫn OpenAI Batch API để triển khai một batch job từ đầu đến cuối.
2. Dùng Flex khi chấp nhận độ trễ cao hơn
Flex tính phí theo giá Batch cho yêu cầu thông thường khi bạn đặt:
{
"service_tier": "flex"
}
Hướng dẫn Flex processing cảnh báo rằng phản hồi có thể chậm hơn và đôi khi trả về 429 Resource Unavailable. Các lỗi 429 này không bị tính phí.
3. Tối ưu tiền tố để có cache hit
Prompt caching được bật mặc định. Đầu vào được cache có giá 0,10 đô la, thấp hơn 95% so với đầu vào Standard và bằng một nửa mức 0,20 đô la của GPT-6 Sol.
Theo hướng dẫn prompt caching của OpenAI:
- Ngưỡng tối thiểu là 1.024 token.
- Ghi cache bị tính phí ở mức 1,25 lần giá đầu vào không cache.
- Với GPT-6.1 Sol, chi phí ghi cache là 2,50 đô la / 1 triệu token.
- Tiền tố có thể tái sử dụng được giữ trong 30 phút kể từ lần ghi hoặc sử dụng cuối.
Giữ yêu cầu dưới 272K token đầu vào. Nếu vượt ngưỡng này, trang mô hình GPT-6.1 Sol cho biết toàn bộ yêu cầu bị tính:
- 2 lần giá đầu vào.
- 2 lần giá cache.
- 1,5 lần giá đầu ra.
Ví dụ: tính chi phí một lệnh gọi tác nhân
Giả sử một bước của agent có:
- Tiền tố ổn định: 100.000 token, gồm system prompt, tool schema và ngữ cảnh repository.
- Đầu vào mới: 8.000 token.
- Đầu ra: 2.000 token, gồm cả token suy luận.
- Tiền tố đã có cache hit.
Trong chế độ cache rõ ràng, việc ghi cache dừng tại tiền tố. Vì vậy, token mới được tính như đầu vào thông thường.
Standard có cache hit
- Đầu vào cache:
100.000 × 0,10 / 1.000.000 = 0,0100 đô la - Đầu vào mới:
8.000 × 2,00 / 1.000.000 = 0,0160 đô la - Đầu ra:
2.000 × 10,00 / 1.000.000 = 0,0200 đô la
Tổng chi phí:
0,0100 + 0,0160 + 0,0200 = 0,0460 đô la mỗi lệnh gọi
Batch hoặc Flex có cache hit
Mọi mức giá giảm một nửa:
0,0050 + 0,0080 + 0,0100 = 0,0230 đô la mỗi lệnh gọi
So sánh với GPT-6 Sol
Trên GPT-6 Sol, chi phí token cache tăng gấp đôi lên 0,0200 đô la:
0,0200 + 0,0160 + 0,0200 = 0,0560 đô la mỗi lệnh gọi
Nếu GPT-6.1 Sol không có cache hit, toàn bộ 108.000 token đầu vào bị tính ở mức 2 đô la:
108.000 × 2,00 / 1.000.000 + 2.000 × 10,00 / 1.000.000
= 0,2160 + 0,0200
= 0,2360 đô la mỗi lệnh gọi
| Kịch bản | Mỗi lệnh gọi | 1.000 lệnh gọi |
|---|---|---|
| GPT-6.1 Sol Standard, có cache hit | $0.046 | $46 |
| GPT-6.1 Sol Batch hoặc Flex, có cache hit | $0.023 | $23 |
| GPT-6 Sol Standard, có cache hit | $0.056 | $56 |
| GPT-6.1 Sol Standard, không có cache hit | $0.236 | $236 |
Lệnh gọi đầu tiên ghi tiền tố vào cache với giá 2,50 đô la / 1 triệu token:
100.000 × 2,50 / 1.000.000 = 0,25 đô la
Sau đó:
- Cache hit làm hóa đơn thay đổi khoảng năm lần.
- Batch hoặc Flex giảm một nửa chi phí.
- Chuyển từ GPT-6 Sol sang GPT-6.1 Sol tiết kiệm 0,01 đô la mỗi lệnh gọi trong ví dụ này, vì chỉ giá token cache thay đổi.
Để tối ưu cache, xem lưu cache lời nhắc GPT-6.
Những gì không miễn phí
- ChatGPT Free và Go: không có GPT-6.1 Sol.
- ChatGPT Chat: GPT-6.1 Sol chưa có mặt ở đây, trên bất kỳ gói nào.
- API: không có bậc miễn phí.
- Đăng nhập bằng ChatGPT trên tài khoản Free: sử dụng gói chỉ dành cho Plus và Pro.
- OpenRouter: cùng giá niêm yết, không phải giảm giá.
- Ultrafast: GPT-6.1 Sol đang “sắp ra mắt”; trên GPT-6 Astra, mức này có giá gấp 6 lần Standard.
Giải pháp thay thế miễn phí: GPT-6 Luna
Nếu bạn cần một lựa chọn không tốn phí, GPT-6 Luna có sẵn trong gói Free ở Work và Codex của ứng dụng ChatGPT dành cho máy tính để bàn. Gói Go, là một gói trả phí, cũng có Luna.
Lưu ý:
- Luna không có trong Chat.
- Luna là mô hình khác, rẻ hơn Sol.
- Quyền truy cập qua gói không đi kèm khóa API.
- Bạn không thể dùng quyền truy cập này để cấp nguồn trực tiếp cho script hoặc agent tự viết.
Xem cách thiết lập trong hướng dẫn GPT-6 Luna miễn phí.
Trên API, Luna được niêm yết:
- 0,10 đô la đầu vào / 1 triệu token.
- 0,50 đô la đầu ra / 1 triệu token.
Đây là một phần hai mươi giá đầu vào và đầu ra của GPT-6.1 Sol, phù hợp cho phân loại và trích xuất dữ liệu khối lượng lớn.
Đo token thực tế trong Apidog trước khi chọn
Các ví dụ trên dùng số token giả định. Số liệu thực tế của bạn quyết định lựa chọn nào hiệu quả nhất. Lưu yêu cầu trong Apidog để đo usage, kiểm tra cache hit và chạy lại trong CI.
1. Tạo môi trường
Tạo environment với:
OPENAI_API_KEY
MODEL_ID=gpt-6.1-sol
2. Lưu yêu cầu Responses API
Tạo yêu cầu POST tới:
https://api.openai.com/v1/responses
Thêm header:
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json
Dùng body với mô hình, mức suy luận và lời nhắc thực tế:
{
"model": "{{MODEL_ID}}",
"reasoning": {
"effort": "low"
},
"input": "Lời nhắc thực tế từ khối lượng công việc của bạn"
}
3. Gửi yêu cầu hai lần để kiểm tra cache hit
Gửi cùng một yêu cầu hai lần. Ở lần chạy thứ hai, xác nhận trường sau lớn hơn 0:
$.usage.input_tokens_details.cached_tokens
Sau đó, bạn có thể dùng assertion để khiến kiểm thử thất bại nếu một thay đổi prompt làm mất cache hit.
4. So sánh token đầu ra và token suy luận
So sánh:
usage.output_tokens
usage.output_tokens_details.reasoning_tokens
ở các mức low và medium.
Hướng dẫn reasoning xác nhận token suy luận được tính phí như token đầu ra.
5. Thêm script tính chi phí Standard
Thêm script sau phản hồi trong Apidog:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const written = d.cache_write_tokens || 0;
const fresh = u.input_tokens - cached - written;
const usd =
(fresh * 2 + cached * 0.1 + written * 2.5 + u.output_tokens * 10) / 1e6;
console.log(`gpt-6.1-sol Standard: $${usd.toFixed(4)} cho mỗi lệnh gọi`);
Nhân kết quả với khối lượng hàng ngày của bạn, sau đó giảm một nửa nếu dùng Batch hoặc Flex.
Lưu request thành test scenario và chạy lại bằng Apidog CLI trong CI. Khi một thay đổi prompt làm giảm tỷ lệ cache hit, bạn có thể phát hiện trước khi hóa đơn tăng lên.
Câu hỏi thường gặp
GPT-6.1 Sol có miễn phí trong ChatGPT không?
Không. Mô hình này có trong ChatGPT Work và Codex cho người dùng Plus, Pro, Business, Enterprise và Edu. Nó chưa có trong Chat và không có ở gói Free hoặc Go.
Tôi có thể dùng ChatGPT Plus để gọi API GPT-6.1 Sol không?
Không phải bằng khóa API. Gói ChatGPT không phải khóa API; mã gửi khóa API vẫn trả tiền theo token.
Đăng nhập bằng ChatGPT cho phép ứng dụng triển khai OAuth flow, bao gồm ứng dụng mã nguồn mở và ứng dụng lưu trữ cục bộ. Các yêu cầu đủ điều kiện được tính vào mức sử dụng Plus hoặc Pro, trong phạm vi giới hạn xem trước.
Có API GPT-6.1 Sol miễn phí không?
Không. Mức giá chính thức thấp nhất là Batch hoặc Flex:
- 1 đô la đầu vào / 1 triệu token.
- 0,05 đô la cache / 1 triệu token.
- 5 đô la đầu ra / 1 triệu token.
GPT-6.1 Sol có miễn phí trên OpenRouter không?
Không. OpenRouter liệt kê openai/gpt-6.1-sol với giá 2 đô la đầu vào và 10 đô la đầu ra trên điểm cuối OpenAI, giống giá niêm yết của OpenAI.
GPT-6.1 Sol có rẻ hơn GPT-6 Sol không?
Giá niêm yết tiêu chuẩn giống nhau: 2 đô la đầu vào và 10 đô la đầu ra. Tuy nhiên, đầu vào cache của GPT-6.1 Sol rẻ bằng một nửa:
- GPT-6.1 Sol: 0,10 đô la.
- GPT-6 Sol: 0,20 đô la.
Khối lượng công việc có tỷ lệ cache hit cao sẽ rẻ hơn trên GPT-6.1 Sol.
Bước tiếp theo
Chọn cách truy cập dựa trên số liệu thực tế:
- Tải xuống Apidog.
- Lưu một yêu cầu đại diện cho workload của bạn.
- Gửi hai lần để kiểm tra cache hit.
- Đọc token usage và tính chi phí mỗi lệnh gọi.
- Chuyển tác vụ có thể chờ sang Batch hoặc Flex.
Nếu chỉ cần dùng GPT-6.1 Sol tương tác, Plus trong Codex là điểm bắt đầu. Nếu mã của bạn cần mô hình, dùng API với prompt caching và chuyển mọi tác vụ không cần phản hồi ngay sang Batch hoặc Flex.
Xem hướng dẫn API GPT-6.1 Sol để tạo yêu cầu đầu tiên và di chuyển từ gpt-6-sol.
Top comments (0)