Codex bật ngữ cảnh GPT-5.6 Sol 1M: Hướng dẫn cấu hình 3 dòng `config.toml`
GPT-5.6 Sol chính thức hỗ trợ ngữ cảnh 1,05 triệu token. Chỉ cần thêm 3 dòng cấu hình vào đầu config.toml của Codex là có thể chạy với cửa sổ 1 triệu token và tự động nén lịch sử ở khoảng 900 nghìn token. Kèm theo cấu hình vĩnh viễn, lệnh một lần, xác minh và lưu ý về chi phí.

Cửa sổ ngữ cảnh chính thức của GPT-5.6 Sol là 1.050.000 token, nhưng Codex mặc định không dùng hết toàn bộ cửa sổ. Muốn các phiên siêu dài ít bị nén nhất, chỉ cần thêm 3 dòng cấu hình vào đầu config.toml của Codex:
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000Sau khi lưu, khởi động lại Codex và mở một phiên mới là được. Dưới đây sẽ giải thích rõ vị trí cấu hình, vai trò của từng dòng, cách khởi động một lần và những lưu ý.
Kết luận trước: 3 dòng này có tác dụng gì
| Cấu hình | Tác dụng |
|---|---|
model = "gpt-5.6-sol" |
Chọn rõ mô hình flagship Sol thuộc dòng GPT-5.6 |
model_context_window = 1000000 |
Bảo Codex cấp ngân sách ngữ cảnh 1 triệu token cho mô hình hiện tại |
model_auto_compact_token_limit = 900000 |
Tự động nén lịch sử cũ khi ngữ cảnh đang hoạt động gần 900.000 token, tránh đụng trần cửa sổ |
Tài liệu tham khảo cấu hình Codex của OpenAI đã chính thức liệt kê hai mục cấu hình model_context_window và model_auto_compact_token_limit; trang mô hình GPT-5.6 Sol ghi rõ cửa sổ ngữ cảnh của nó là 1.050.000 token, đầu ra tối đa là 128.000 token.
Ở đây không đặt thẳng 1.050.000, mà đặt 1.000.000, để dành một chút khoảng trống cho system prompt, kết quả công cụ và khác biệt triển khai; sau đó đặt ngưỡng tự động nén ở 900.000, để Codex có không gian hoàn tất việc nén, thay vì đợi đến khi cửa sổ sắp vỡ mới xử lý.
Bước 1: Tìm `config.toml` của Codex
Tệp cấu hình cấp người dùng của Codex nằm tại:
- macOS / Linux:
~/.codex/config.toml - Windows:
%USERPROFILE%\.codex\config.toml
Trên macOS hoặc Linux, bạn có thể chạy trực tiếp:
mkdir -p ~/.codex
nano ~/.codex/config.tomlTrên Windows PowerShell, bạn có thể chạy:
notepad $env:USERPROFILE\.codex\config.tomlNếu tệp chưa tồn tại thì tạo mới, nếu đã tồn tại thì sửa trên tệp gốc, đừng ghi đè các cấu hình MCP, phân quyền hoặc cấu hình dự án đã có.
Bước 2: Đặt cấu hình ở đầu tệp
Đặt 3 dòng sau vào đầu config.toml:
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000Phải đặt trước tiêu đề [section] đầu tiên. Ví dụ tệp của bạn đã có:
[projects."/path/to/project"]
trust_level = "trusted"3 dòng cấu hình mô hình đó phải nằm phía trên nó. Trong TOML, các khóa thông thường viết sau [projects."..."] sẽ bị coi là nội dung của section đó, không còn là cấu hình toàn cục.
Nếu trong tệp đã có dòng model = "...", hãy đổi trực tiếp thành gpt-5.6-sol, đừng viết lặp hai dòng model. Dấu nháy cũng phải dùng dấu nháy kép tiếng Anh nửa chiều rộng ", đừng sao chép từ rich text thành dấu nháy cong.
Bước 3: Khởi động lại và mở phiên mới
Sau khi lưu tệp:
- Thoát khỏi Codex client hoặc CLI hiện tại;
- Khởi động lại Codex;
- Tạo một phiên mới.
Các phiên cũ đã mở thường không chuyển đổi ngân sách ngữ cảnh khi đang chạy, vì vậy chỉ tải lại cửa sổ và tiếp tục luồng cũ là không chắc chắn, tạo phiên mới trực tiếp là tiện nhất.
Có thể dùng lệnh chẩn đoán tích hợp của Codex để kiểm tra cấu hình đã tải thành công chưa:
codex doctor --jsonHãy chú ý các mục sau:
overallStatuslàok;config.loadlàok;modelhiển thịgpt-5.6-sol.
Lệnh này chỉ xác minh tệp cấu hình có thể phân tích và tải chính xác hay không, sẽ không thực sự tiêu tốn vài trăm nghìn token để “kiểm tra 1M”.
Không thay đổi cấu hình mặc định: Chỉ bật 1M cho phiên CLI hiện tại
Nếu bạn chỉ thỉnh thoảng xử lý kho lưu trữ siêu lớn hoặc tác vụ siêu dài, không muốn mọi phiên đều mặc định dùng 1M, bạn có thể ghi đè tạm thời khi khởi động:
codex -m gpt-5.6-sol \
-c model_context_window=1000000 \
-c model_auto_compact_token_limit=900000Nhóm tham số này chỉ ảnh hưởng đến lần khởi động này. Sau khi tắt Codex hiện tại, lần sau vẫn quay về giá trị mặc định trong config.toml.
1M ngữ cảnh phù hợp với tình huống nào
Nó phù hợp nhất với các tác vụ sau:
- Sửa đổi liên tục nhiều mô-đun trong kho lưu trữ nguyên khối (monorepo) lớn;
- Agent cần giữ lại lâu dài các quyết định kiến trúc, quá trình gỡ lỗi và kết quả kiểm thử;
- Nhập một lần rất nhiều tài liệu thiết kế, mô tả giao diện hoặc nhật ký;
- Không muốn nhiệm vụ chạy giữa chừng bị tự động nén thường xuyên, làm mất chi tiết ban đầu.
Nếu chỉ sửa một hai tệp, sửa lỗi thông thường hoặc viết script ngắn, cửa sổ mặc định của Codex thường là đủ. Cửa sổ lớn hơn là “có thể chứa được nhiều hơn”, không phải mỗi lượt đều phải nhét đầy, cũng không có nghĩa là ngữ cảnh càng dài thì tỷ lệ tận dụng sự chú ý của mô hình nhất định càng cao.
Chi phí và chất lượng cần biết trước khi bật
Ngữ cảnh dài rất hữu ích, nhưng không phải bữa trưa miễn phí.
1. Sau khi vượt 272K, ngữ cảnh dài của API sẽ vào mức giá cao hơn
Trang mô hình GPT-5.6 Sol của OpenAI ghi rõ: Khi đầu vào vượt quá 272K token, giá đầu vào của toàn bộ yêu cầu tính theo 2 lần, giá đầu ra tính theo 1,5 lần.
Nếu bạn dùng tính phí theo API, điều này sẽ phản ánh trực tiếp trên hóa đơn; nếu bạn đăng nhập qua gói đăng ký ChatGPT / Codex, biểu hiện cụ thể có thể là hạn mức tiêu hao nhanh hơn, vẫn nên dựa theo chính sách hạn mức hiển thị trên client.
2. Mỗi lượt đều phải mang theo lịch sử dài hơn
Phiên càng dài, độ trễ, tiêu thụ token và hành vi bộ nhớ đệm càng đáng chú ý. Nếu phần lớn nhật ký cũ hàng trăm nghìn token đã không còn hữu dụng, tiếp tục mang theo nguyên trạng không chắc tốt hơn một bản tóm tắt nén chất lượng cao.
3. Hỗ trợ 1M, không có nghĩa chất lượng ở 1M không thay đổi
Ngữ cảnh siêu dài có thể giảm việc thông tin bị cắt bớt, nhưng mô hình vẫn có thể bị phân tán bởi nhiều nhiễu. Hãy thường xuyên dọn các nhật ký build, đầu ra công cụ lặp lại và các đường gỡ lỗi đã không còn hiệu lực; khi giai đoạn nhiệm vụ chuyển đổi rõ ràng, có thể chủ động dùng /compact.
Các câu hỏi thường gặp
Đã cấu hình đúng, sao phiên hiện tại không thay đổi?
config.toml chủ yếu được tải khi khởi động và tạo phiên. Hãy khởi động lại client và tạo phiên mới, đừng dùng phiên dài cũ để kiểm tra tiếp.
Tệp cấu hình tải được, nhưng mô hình không phải Sol?
Hãy kiểm tra xem có dùng codex -m ..., --profile, và trong thư mục dự án có còn .codex/config.toml không. Tham số dòng lệnh, cấu hình dự án và profile của Codex đều có thể ghi đè cấu hình cấp người dùng.
Codex báo “không nhận cấu hình này” thì sao?
Trước tiên xem phiên bản:
codex --versionSau đó nâng cấp lên phiên bản hiện tại:
codex updateCác phiên bản Codex cũ hơn có thể chưa có hai khóa cấu hình này.
Muốn khôi phục cài đặt mặc định thì sao?
Xóa hai dòng dưới đây là có thể khôi phục ngữ cảnh mặc định của mô hình và chiến lược tự động nén:
model_context_window = 1000000
model_auto_compact_token_limit = 900000model = "gpt-5.6-sol" có thể giữ lại, cũng có thể đổi lại mô hình bạn dùng trước đó.
Tóm tắt
Để bật vĩnh viễn ngữ cảnh GPT-5.6 Sol 1M, chỉ cần đặt 3 dòng này ở đầu ~/.codex/config.toml:
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 9000001 triệu là ngân sách ngữ cảnh, 900.000 là ngưỡng tự động nén. Nó rất phù hợp cho kho lưu trữ lớn và tác vụ Agent kéo dài, nhưng với tác vụ thông thường, tiếp tục dùng cài đặt mặc định của Codex thường tiết kiệm hạn mức hơn, nhanh hơn và cũng ổn định hơn.
Nếu bạn để Codex chạy tác vụ lâu dài trên máy phát triển mà không muốn lúc nào cũng ngồi trước máy tính, bạn cũng có thể dùng PandaNpc để xem phiên và xử lý tương tác từ xa trên trình duyệt, máy tính để bàn hoặc điện thoại.
Hướng dẫn liên quan

pandacode: Trải nghiệm Claude Code chạy trên bất kỳ mô hình nào
pandacode là công cụ agent lập trình mã nguồn mở được tích hợp trong pandapaw, tương thích với trải nghiệm đầy đủ của Claude Code, nhưng backend mô hình do bạn quyết định — có thể kết nối DeepSeek, Qwen, vLLM/Ollama, proxy nội bộ công ty, hỗ trợ cả hai định dạng API OpenAI và Anthropic. Cài đặt bằng một lệnh, điều khiển từ xa qua điện thoại, trình duyệt, máy tính để bàn như bình thường.
Đọc bài viết →
Lịch sử biến mất sau khi `/compact` trong Claude Code? Hướng dẫn tìm lại toàn bộ hội thoại
Lịch sử biến mất sau khi Claude Code /compact? Dữ liệu không hề mất — PandaNpc ghép nối toàn bộ lịch sử theo chuỗi nén, khôi phục đầy đủ trên bản desktop/web, hỗ trợ nén nhiều lần mà không ảnh hưởng đến ngữ cảnh thực.
Đọc bài viết →
Tắt máy tính này, sang máy khác vẫn điều khiển từ xa Claude Code của bạn
Claude Code bị khóa cứng vào một máy? Hãy để nó chạy trên máy phát triển, bạn đổi máy tính khác hoặc trình duyệt để điều khiển từ xa — xem phiên, phê duyệt công cụ, xem thay đổi mã, không cần phải ngồi trước máy đó suốt.
Đọc bài viết →