Codex bật ngữ cảnh GPT-5.6 Sol 1M: Hướng dẫn cấu hình 3 dòng `config.toml`

GPT-5.6 Sol chính thức hỗ trợ ngữ cảnh 1,05 triệu token. Chỉ cần thêm 3 dòng cấu hình vào đầu config.toml của Codex là có thể chạy với cửa sổ 1 triệu token và tự động nén lịch sử ở khoảng 900 nghìn token. Kèm theo cấu hình vĩnh viễn, lệnh một lần, xác minh và lưu ý về chi phí.

PandaNpcLần đầu xuất bản
Codex bật ngữ cảnh GPT-5.6 Sol 1M: Hướng dẫn cấu hình 3 dòng `config.toml`

Cửa sổ ngữ cảnh chính thức của GPT-5.6 Sol là 1.050.000 token, nhưng Codex mặc định không dùng hết toàn bộ cửa sổ. Muốn các phiên siêu dài ít bị nén nhất, chỉ cần thêm 3 dòng cấu hình vào đầu config.toml của Codex:

toml
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000

Sau khi lưu, khởi động lại Codex và mở một phiên mới là được. Dưới đây sẽ giải thích rõ vị trí cấu hình, vai trò của từng dòng, cách khởi động một lần và những lưu ý.

Kết luận trước: 3 dòng này có tác dụng gì

Cấu hình Tác dụng
model = "gpt-5.6-sol" Chọn rõ mô hình flagship Sol thuộc dòng GPT-5.6
model_context_window = 1000000 Bảo Codex cấp ngân sách ngữ cảnh 1 triệu token cho mô hình hiện tại
model_auto_compact_token_limit = 900000 Tự động nén lịch sử cũ khi ngữ cảnh đang hoạt động gần 900.000 token, tránh đụng trần cửa sổ

Tài liệu tham khảo cấu hình Codex của OpenAI đã chính thức liệt kê hai mục cấu hình model_context_windowmodel_auto_compact_token_limit; trang mô hình GPT-5.6 Sol ghi rõ cửa sổ ngữ cảnh của nó là 1.050.000 token, đầu ra tối đa là 128.000 token.

Ở đây không đặt thẳng 1.050.000, mà đặt 1.000.000, để dành một chút khoảng trống cho system prompt, kết quả công cụ và khác biệt triển khai; sau đó đặt ngưỡng tự động nén ở 900.000, để Codex có không gian hoàn tất việc nén, thay vì đợi đến khi cửa sổ sắp vỡ mới xử lý.

Bước 1: Tìm `config.toml` của Codex

Tệp cấu hình cấp người dùng của Codex nằm tại:

  • macOS / Linux: ~/.codex/config.toml
  • Windows: %USERPROFILE%\.codex\config.toml

Trên macOS hoặc Linux, bạn có thể chạy trực tiếp:

bash
mkdir -p ~/.codex
nano ~/.codex/config.toml

Trên Windows PowerShell, bạn có thể chạy:

powershell
notepad $env:USERPROFILE\.codex\config.toml

Nếu tệp chưa tồn tại thì tạo mới, nếu đã tồn tại thì sửa trên tệp gốc, đừng ghi đè các cấu hình MCP, phân quyền hoặc cấu hình dự án đã có.

Bước 2: Đặt cấu hình ở đầu tệp

Đặt 3 dòng sau vào đầu config.toml:

toml
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000

Phải đặt trước tiêu đề [section] đầu tiên. Ví dụ tệp của bạn đã có:

toml
[projects."/path/to/project"]
trust_level = "trusted"

3 dòng cấu hình mô hình đó phải nằm phía trên nó. Trong TOML, các khóa thông thường viết sau [projects."..."] sẽ bị coi là nội dung của section đó, không còn là cấu hình toàn cục.

Nếu trong tệp đã có dòng model = "...", hãy đổi trực tiếp thành gpt-5.6-sol, đừng viết lặp hai dòng model. Dấu nháy cũng phải dùng dấu nháy kép tiếng Anh nửa chiều rộng ", đừng sao chép từ rich text thành dấu nháy cong.

Bước 3: Khởi động lại và mở phiên mới

Sau khi lưu tệp:

  1. Thoát khỏi Codex client hoặc CLI hiện tại;
  2. Khởi động lại Codex;
  3. Tạo một phiên mới.

Các phiên cũ đã mở thường không chuyển đổi ngân sách ngữ cảnh khi đang chạy, vì vậy chỉ tải lại cửa sổ và tiếp tục luồng cũ là không chắc chắn, tạo phiên mới trực tiếp là tiện nhất.

Có thể dùng lệnh chẩn đoán tích hợp của Codex để kiểm tra cấu hình đã tải thành công chưa:

bash
codex doctor --json

Hãy chú ý các mục sau:

  • overallStatusok;
  • config.loadok;
  • model hiển thị gpt-5.6-sol.

Lệnh này chỉ xác minh tệp cấu hình có thể phân tích và tải chính xác hay không, sẽ không thực sự tiêu tốn vài trăm nghìn token để “kiểm tra 1M”.

Không thay đổi cấu hình mặc định: Chỉ bật 1M cho phiên CLI hiện tại

Nếu bạn chỉ thỉnh thoảng xử lý kho lưu trữ siêu lớn hoặc tác vụ siêu dài, không muốn mọi phiên đều mặc định dùng 1M, bạn có thể ghi đè tạm thời khi khởi động:

bash
codex -m gpt-5.6-sol \
  -c model_context_window=1000000 \
  -c model_auto_compact_token_limit=900000

Nhóm tham số này chỉ ảnh hưởng đến lần khởi động này. Sau khi tắt Codex hiện tại, lần sau vẫn quay về giá trị mặc định trong config.toml.

1M ngữ cảnh phù hợp với tình huống nào

Nó phù hợp nhất với các tác vụ sau:

  • Sửa đổi liên tục nhiều mô-đun trong kho lưu trữ nguyên khối (monorepo) lớn;
  • Agent cần giữ lại lâu dài các quyết định kiến trúc, quá trình gỡ lỗi và kết quả kiểm thử;
  • Nhập một lần rất nhiều tài liệu thiết kế, mô tả giao diện hoặc nhật ký;
  • Không muốn nhiệm vụ chạy giữa chừng bị tự động nén thường xuyên, làm mất chi tiết ban đầu.

Nếu chỉ sửa một hai tệp, sửa lỗi thông thường hoặc viết script ngắn, cửa sổ mặc định của Codex thường là đủ. Cửa sổ lớn hơn là “có thể chứa được nhiều hơn”, không phải mỗi lượt đều phải nhét đầy, cũng không có nghĩa là ngữ cảnh càng dài thì tỷ lệ tận dụng sự chú ý của mô hình nhất định càng cao.

Chi phí và chất lượng cần biết trước khi bật

Ngữ cảnh dài rất hữu ích, nhưng không phải bữa trưa miễn phí.

1. Sau khi vượt 272K, ngữ cảnh dài của API sẽ vào mức giá cao hơn

Trang mô hình GPT-5.6 Sol của OpenAI ghi rõ: Khi đầu vào vượt quá 272K token, giá đầu vào của toàn bộ yêu cầu tính theo 2 lần, giá đầu ra tính theo 1,5 lần.

Nếu bạn dùng tính phí theo API, điều này sẽ phản ánh trực tiếp trên hóa đơn; nếu bạn đăng nhập qua gói đăng ký ChatGPT / Codex, biểu hiện cụ thể có thể là hạn mức tiêu hao nhanh hơn, vẫn nên dựa theo chính sách hạn mức hiển thị trên client.

2. Mỗi lượt đều phải mang theo lịch sử dài hơn

Phiên càng dài, độ trễ, tiêu thụ token và hành vi bộ nhớ đệm càng đáng chú ý. Nếu phần lớn nhật ký cũ hàng trăm nghìn token đã không còn hữu dụng, tiếp tục mang theo nguyên trạng không chắc tốt hơn một bản tóm tắt nén chất lượng cao.

3. Hỗ trợ 1M, không có nghĩa chất lượng ở 1M không thay đổi

Ngữ cảnh siêu dài có thể giảm việc thông tin bị cắt bớt, nhưng mô hình vẫn có thể bị phân tán bởi nhiều nhiễu. Hãy thường xuyên dọn các nhật ký build, đầu ra công cụ lặp lại và các đường gỡ lỗi đã không còn hiệu lực; khi giai đoạn nhiệm vụ chuyển đổi rõ ràng, có thể chủ động dùng /compact.

Các câu hỏi thường gặp

Đã cấu hình đúng, sao phiên hiện tại không thay đổi?

config.toml chủ yếu được tải khi khởi động và tạo phiên. Hãy khởi động lại client và tạo phiên mới, đừng dùng phiên dài cũ để kiểm tra tiếp.

Tệp cấu hình tải được, nhưng mô hình không phải Sol?

Hãy kiểm tra xem có dùng codex -m ..., --profile, và trong thư mục dự án có còn .codex/config.toml không. Tham số dòng lệnh, cấu hình dự án và profile của Codex đều có thể ghi đè cấu hình cấp người dùng.

Codex báo “không nhận cấu hình này” thì sao?

Trước tiên xem phiên bản:

bash
codex --version

Sau đó nâng cấp lên phiên bản hiện tại:

bash
codex update

Các phiên bản Codex cũ hơn có thể chưa có hai khóa cấu hình này.

Muốn khôi phục cài đặt mặc định thì sao?

Xóa hai dòng dưới đây là có thể khôi phục ngữ cảnh mặc định của mô hình và chiến lược tự động nén:

toml
model_context_window = 1000000
model_auto_compact_token_limit = 900000

model = "gpt-5.6-sol" có thể giữ lại, cũng có thể đổi lại mô hình bạn dùng trước đó.

Tóm tắt

Để bật vĩnh viễn ngữ cảnh GPT-5.6 Sol 1M, chỉ cần đặt 3 dòng này ở đầu ~/.codex/config.toml:

toml
model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000

1 triệu là ngân sách ngữ cảnh, 900.000 là ngưỡng tự động nén. Nó rất phù hợp cho kho lưu trữ lớn và tác vụ Agent kéo dài, nhưng với tác vụ thông thường, tiếp tục dùng cài đặt mặc định của Codex thường tiết kiệm hạn mức hơn, nhanh hơn và cũng ổn định hơn.

Nếu bạn để Codex chạy tác vụ lâu dài trên máy phát triển mà không muốn lúc nào cũng ngồi trước máy tính, bạn cũng có thể dùng PandaNpc để xem phiên và xử lý tương tác từ xa trên trình duyệt, máy tính để bàn hoặc điện thoại.