5 điểm bởi GN⁺ 1 ngày trước | 1 bình luận | Chia sẻ qua WhatsApp
  • Đây là trang ghi lại thời điểm đặt lại giới hạn sử dụng Codex bằng cách theo dõi các thông báo trên X của @thsottiaux; hiện lần đặt lại gần nhất là 2 ngày trước
  • Đến nay đã ghi nhận 35 lần, với khoảng chờ trung bình là 8,9 ngày và quãng trống dài nhất là 67,7 ngày
  • Việc đặt lại không chỉ diễn ra để bù cho sự cố, độ trễ hoặc lỗi tính hạn mức, mà còn được dùng khi số người dùng tăng, ra mắt sản phẩm, dịp kỷ niệm hoặc để khuyến khích dùng tính năng mới
  • Một số lần đặt lại khôi phục 100% giới hạn theo tuần và theo giờ của gói trả phí, đồng thời cũng cung cấp đặt lại tích trữ (banked reset) có thể áp dụng vào thời điểm mong muốn
  • Cùng với sự tăng trưởng của Codex và ChatGPT Work, tần suất đặt lại cũng dày hơn; các thông báo gần đây còn đề cập tới việc đạt 7 triệu, 8 triệu, 9 triệu người dùng hoạt động và quá trình mở rộng hạ tầng

Lịch sử đặt lại và thống kê

  • Codex Resets thu thập các thông báo đặt lại giới hạn sử dụng Codex từ feed X của @thsottiaux
  • Trang lưu lại khoảng cách giữa các lần đặt lại trong 26 tuần gần đây cùng nguyên văn thông báo
  • Tình hình thống kê hiện tại như sau
    • Tổng số lần đặt lại: 35
    • Thời gian chờ trung bình: 8,9 ngày
    • Quãng trống dài nhất giữa các lần đặt lại: 67,7 ngày
    • Lần đặt lại gần nhất là 2 ngày trước

Các lần đặt lại theo đà tăng trưởng của Codex và ChatGPT Work

  • Khi số người dùng hoạt động tăng nhanh, các đợt đặt lại liên tiếp đã được triển khai
    • Khi đạt 7 triệu người dùng hoạt động, hệ thống thêm đặt lại tích trữ cho mọi tài khoản, cho phép áp dụng trên ứng dụng desktop hoặc web để bổ sung hạn mức theo tuần
    • Khi đạt 8 triệu người dùng hoạt động, toàn bộ hạn mức được đặt lại lần nữa và giới hạn tốc độ 5 giờ cũng không được áp dụng
    • Vào đúng ngày đạt 9 triệu người dùng hoạt động, hệ thống tiếp tục đặt lại và cho biết đang tiến hành công việc nhằm duy trì độ ổn định và độ tin cậy của hệ thống
  • Nhiều lần đặt lại đã được áp dụng cho tất cả người dùng Codex và ChatGPT Work trả phí; một số thông báo cho biết thay đổi sẽ có hiệu lực trong 30 phút đến 1 giờ
  • Trong bối cảnh lưu lượng tăng nhanh chưa từng có, đã có trường hợp sau một lần đặt lại lại tiếp tục báo trước thêm một lần đặt lại nữa ngay trong cùng ngày

Việc đưa vào và phạm vi áp dụng của đặt lại tích trữ

  • Đặt lại tích trữ là cách không ép áp dụng ngay, mà lưu vào tài khoản để người dùng tự dùng vào thời điểm mong muốn nhằm bổ sung hạn mức theo tuần
  • Ban đầu tính năng này chỉ dùng được trên ứng dụng desktop, sau đó được mở rộng sang web và mobile
  • Trong thông báo bổ sung đặt lại tích trữ cho 500.000 người dùng ChatGPT Work và Codex, phía công ty cho biết vấn đề chỉ ảnh hưởng đến dưới 10% những người đã sử dụng tính năng này
  • Một số thông báo vừa khôi phục ngay toàn bộ hạn mức, vừa cấp thêm đặt lại tích trữ có thể dùng trong vòng 24 giờ tới
  • Khi người dùng đã tích lũy sẵn tối đa 3 lần đặt lại tích trữ, hệ thống đôi khi áp dụng đặt lại cưỡng bức (hard reset) riêng với phần tích trữ
  • Cũng có trường hợp đặt lại kép (double reset), vừa cung cấp đặt lại toàn bộ vừa thêm đặt lại tích trữ có thể dùng linh hoạt

Bồi hoàn cho sự cố và vấn đề hiệu năng

  • Sau khi xảy ra 3 sự cố nhỏ trong vòng 24 giờ ảnh hưởng đến độ tin cậy của Codex, hệ thống đặt lại giới hạn sử dụng của mọi gói trả phí và triển khai biện pháp ngăn tái diễn
  • Sau khi giảm thiểu một sự cố kéo dài khoảng 10 phút và xác nhận đã khôi phục, hệ thống thông báo sẽ đặt lại
    • Codex có hỗ trợ quá trình khắc phục, nhưng manh mối dẫn tới giải pháp cuối cùng là do con người tìm ra
  • Sau khi xử lý một sự cố khác và hệ thống vận hành ổn định trong vài giờ, giới hạn tốc độ đã được đặt lại; ở một trường hợp riêng khi dịch vụ ổn định trở lại, nút đặt lại cũng được áp dụng
  • Một vấn đề khiến các yêu cầu bị phân loại nhầm là rủi ro mạng cao rồi bị chặn hoặc từ chối đã được sửa trong khoảng 8 phút, và hạn mức được khởi tạo lại sau khi dịch vụ phục hồi
  • Trong trường hợp một sự cố nhỏ kéo dài 45 phút rồi leo thang thành sự cố toàn cầu trong 30 phút cuối, giới hạn tốc độ được đặt lại sau khi khôi phục
  • Để bù cho độ trễ cao bất thường tại Mỹ hoặc khu vực lân cận, hệ thống khởi tạo lại hạn mức của toàn bộ người dùng Codex và cũng khuyến nghị dùng GPT-5.1-Codex-Max
  • Để bù cho việc chậm lại trong lúc chuẩn bị thêm GPU, hệ thống đặt lại hạn mức gpt-5-codex và cho biết sẽ tiếp tục mở rộng dung lượng trong suốt tuần đó
  • Cũng có trường hợp dùng việc đặt lại hạn mức cho toàn bộ người dùng như biện pháp giảm thiểu nhanh nhất trong lúc xử lý nguyên nhân gốc rễ, với thông báo dự kiến có hiệu lực trong khoảng 10 phút

Vấn đề tính mức sử dụng và cạn hạn mức

  • Một tối ưu áp dụng cho nén phiên dài đã ảnh hưởng tới tỷ lệ cache hit, khiến hạn mức bị tiêu hao nhanh hơn dự kiến; sau khi rollback thay đổi này, hệ thống đặt lại hạn mức cho toàn bộ tài khoản
  • Có trường hợp điều tra các báo cáo cho rằng mức sử dụng Codex bị tiêu tốn nhanh hơn dự kiến nhưng không tìm được một nguyên nhân trung tâm duy nhất; hệ thống bồi hoàn bằng một lần đặt lại toàn bộ và thêm đặt lại tích trữ
  • Dù không có bằng chứng về ảnh hưởng trên diện rộng, khi số lượng báo cáo đủ nhiều, giới hạn tốc độ của thuê bao Plus và Pro vẫn được đặt lại và cuộc điều tra được lên kế hoạch hoàn tất trong 1 đến 3 ngày
  • Trong một cuộc điều tra khác, dù không xác nhận được tác động lớn tới người dùng, hệ thống vẫn áp dụng biện pháp giảm thiểu, cấp một lần đặt lại miễn phí cho mọi người dùng Codex rồi tiếp tục theo dõi
  • Khi dashboard cho thấy tỷ lệ người dùng chạm hạn mức đang tăng nhưng chưa xác định đầy đủ nguyên nhân, hệ thống chủ động đặt lại hạn mức cho mọi gói
  • Hệ thống đã sửa lỗi khiến hạn mức khuyến mãi gấp đôi không áp dụng với khoảng 9% người dùng Plus và Pro, đồng thời khởi tạo lại giới hạn tốc độ của toàn bộ các gói đó để bồi hoàn
  • Trong quá trình viết lại hệ thống theo dõi sử dụng và tính phí của Codex, hệ thống đã đặt lại hạn mức và cung cấp lượng sử dụng miễn phí thay vì cộng bù lại mức dùng trong quá khứ

Ra mắt gói, sản phẩm và các sự kiện kỷ niệm

  • Hệ thống đặt lại hạn mức Codex của mọi thuê bao ChatGPT trả phí, khôi phục 100% cả hạn mức theo tuần lẫn theo giờ
  • Để ăn mừng thành quả của một tuần và giúp người dùng lập trình nhiều hơn với GPT-5.5, hệ thống cung cấp đặt lại cho mọi gói trả phí
  • Nhân kỷ niệm 1 năm của Codex, Codex được phép tự đặt lại giới hạn tốc độ của mọi gói
  • Khi ra mắt gói 100 USD, hệ thống cung cấp mức sử dụng Codex và cũng triển khai lần đặt lại hạn mức đã báo trước từ hôm trước
  • Khi số người dùng Codex theo tuần tăng từ 2 triệu lên 3 triệu trong chưa đầy một tháng, hệ thống đặt lại giới hạn tốc độ để kỷ niệm
  • Hệ thống khởi tạo lại hạn mức của mọi gói để người dùng có thể thử plugin mới
  • Cuối năm, giới hạn tốc độ được đặt lại và hạn mức sử dụng gấp đôi so với bình thường được áp dụng đến ngày 1 tháng 1
  • Cũng đã có nhiều thông báo đơn giản chỉ vì cuối tuần mà đặt lại giới hạn sử dụng cho mọi gói trả phí

Cách vận hành các đợt đặt lại

  • Việc đặt lại không chỉ dùng để bồi hoàn sự cố, mà còn được tận dụng cho tăng trưởng người dùng, ra mắt sản phẩm, thử nghiệm tính năng mới, ngày kỷ niệm và sự kiện cuối tuần
  • Phạm vi áp dụng thay đổi theo tình huống, gồm toàn bộ người dùng Codex, mọi gói trả phí, mọi thuê bao ChatGPT trả phí, Plus và Pro, hoặc người dùng Codex và ChatGPT Work
  • Thời điểm có hiệu lực cũng khác nhau giữa các thông báo, từ áp dụng ngay lập tức cho tới trong 10 phút, 30 phút, 1 giờ hoặc vài giờ tiếp theo
  • Dù thừa nhận việc đặt lại có tốn chi phí, hệ thống vẫn lặp đi lặp lại việc khôi phục hạn mức để bồi hoàn vấn đề ổn định và giúp người dùng có thể lập trình nhiều hơn

1 bình luận

 
Ý kiến trên Hacker News
  • Giống như vòng quay miễn phí của máy đánh bạc. Một người bạn của tôi bị ám ảnh với việc dùng hết toàn bộ hạn mức Fable sẽ hết hạn hôm nay, đến mức làm cả đống việc có giá trị đáng ngờ chỉ vì đó trông như một tài nguyên khan hiếm

    • Tôi thấy một nửa số dự án làm bằng AI đều như vậy. Đồng nghiệp thì quản lý hạ tầng gia đình bằng cả OpenClaw và một đội agent, nhưng tôi không hiểu tại sao lại cần như thế khi ngôi nhà đã được tự động hóa bằng Home Assistant. Ngoài công việc, tôi gần như không cảm thấy cần dùng AI
    • Bản thân AI cũng giống như một máy đánh bạc, và sẽ không lạ nếu đó là một yếu tố lớn gây ra chứng loạn thần. Bạn kéo cần gạt bằng prompt, nhìn màn hình quay, rồi thi thoảng lắm mới có đồng xu đổ ra
    • Có vẻ như chúng ta đã bước vào giai đoạn gamification để thúc đẩy sử dụng sản phẩm
    • Đầu tuần này Permafable đã được công bố, và cảm giác máy đánh bạc đó là rất rõ ràng
  • Việc bỏ reset và giới hạn 5 giờ đã âm thầm đẩy mức nền sử dụng của tôi lên cao hơn rất nhiều. Tôi აღარ tiết kiệm nữa mà chạy nhiều agent theo tốc độ mình muốn, vì ít nhất trong tuần trước vẫn liên tục được cấp thêm reset
    Tôi lo rằng đến một ngày reset ngừng lại, quy trình làm việc thường ngày sẽ đột ngột vượt quá hạn mức, và ngay cả việc nâng lên gói cao hơn cũng sẽ có cảm giác như thụt lùi

    • Những lần reset này được cung cấp vì cạnh tranh với đối thủ. Một khi đã thắng trên thị trường thì họ sẽ vắt tiền tối đa
    • Tôi nghi ngờ liệu nó có thực sự là ‘âm thầm’ hay không
  • Thật ấn tượng khi họ cung cấp reset thường xuyên đến vậy. Claude Code và Grok Build cũng có reset nhưng không đến mức này, còn Antigravity của Google, một tập đoàn lớn với hạ tầng dồi dào, thì nghịch lý là theo tôi thấy chưa từng làm vậy. Tôi tò mò chi phí reset mà OpenAI phải gánh là bao nhiêu

    • Một số đợt reset là để xoa dịu khách hàng vì lỗi phát hành 5.6 khiến token của người dùng agent cấp thấp bị tiêu hao quá nhiều
      Dù vậy, việc họ có đủ năng lực để gánh điều đó vẫn rất ấn tượng
    • OpenAI có thể làm điều này thường xuyên vì họ có đủ tài nguyên tính toán, và phần dư dả đó cũng một phần nhờ đang tụt lại khá xa sau Anthropic ở mảng khách hàng doanh nghiệp lớn. Sau khi 5.6 ra mắt, nghe nói họ tăng thêm hàng triệu người dùng nên đà tăng trưởng rất mạnh, nhưng những người này có ở lại hay không thì còn phải xem
      Cá nhân tôi thì đã từng thấy nó thử làm một việc rất nguy hiểm lúc tôi không để ý, nên tôi không còn dùng cho việc quan trọng nữa, và những người quen của tôi cũng đã qua giai đoạn trăng mật ban đầu, nhiệt tình đã nguội đi
  • 5 ngày trước là 7 triệu, 4 ngày trước là 8 triệu, 3 ngày trước là 9 triệu — tăng trưởng đáng kinh ngạc

    • Vì ứng dụng ChatGPT trên macOS hiện có thể đã được đổi thành Codex, nên người dùng Codex ‘mới’ có khi chỉ là những người đã cập nhật ứng dụng ChatGPT
    • Kiểu cho dùng hào phóng này có vẻ có thể là một sự kiện để thổi phồng câu chuyện tăng trưởng IPO. Tốt nhất là tận dụng trợ giá AI tối đa khi còn có thể
    • Tôi tò mò họ đo số người dùng thế nào. Không biết có phải mỗi lần cập nhật ứng dụng ChatGPT lại tính là thêm một người hay không
    • Như mọi startup khác, chắc họ sẽ thống kê số người dùng theo cách rất lố bịch. Nếu một người dùng trên hai máy tính và một điện thoại thì hoàn toàn có thể bị tính thành 3 người dùng
      Giới growth hacker và SEO đã khiến thế giới trở nên khó chịu hơn, và chiến dịch tâm lý của OpenClaw giờ đã không còn liên quan gì nữa vì chẳng mang lại kết quả nào, nhưng ít ra cũng phải công nhận đó là một màn nói nhảm đầy sáng tạo
    • Đây là một màn growth hacking khôn khéo khi gộp ứng dụng ChatGPT và ứng dụng Codex thành một siêu ứng dụng
  • Nếu tính cả reset tích lũy thì hiện tại giá trị so với chi phí là cực kỳ lớn. Công ty chúng tôi dùng Claude Enterprise với mức giá API, và riêng tháng này đã tiêu hết 10.000 USD, chủ yếu dùng agent Opus 4.8 và Sonnet 5 khi có thể
    Trên Codex Pro tôi chạy 5.6 Sol mỗi ngày và thỉnh thoảng còn dùng chế độ ultra, nên nếu quy đổi ra mức dùng API thực tế thì sẽ là mức không thể duy trì được

    • Giá API có thể đã bao gồm mức biên lợi nhuận khổng lồ so với chi phí thực tế. Theo thử nghiệm của tôi, với Pro 20x giá 200 USD/tháng mà chỉ dùng GPT 5.6 Sol thì tương đương khoảng 2.200 USD tiền dùng API mỗi tuần, tức 9.000~10.000 USD mỗi tháng, dù có dao động tùy chi phí cache
      Gói 100 USD và 200 USD của Anthropic có hạn mức tuần chênh 2 lần nhưng giới hạn 5 giờ chênh nhiều hơn. Trong khi đó Pro 20x của OpenAI đắt gấp 2 Pro 5x nhưng lượng sử dụng gấp 4, còn toàn bộ hạn mức tuần của Codex trên tài khoản Plus 20 USD chỉ bằng 5% hạn mức của Pro 20x
      Reset tích lũy sẽ biến mất sau 30 ngày kể từ khi được cấp, nên nếu cố tình dùng hết toàn bộ quota trước rồi mới dùng chúng thì có thể tối đa hóa mức sử dụng thêm
    • Tôi tò mò không hiểu sao bạn dùng nhiều đến vậy. Công ty tôi cũng dùng mức giá Claude Enterprise, nhưng hạn mức tháng là 800 USD và kể cả dùng Opus cho mọi việc thì cũng chỉ gần chạm trần vào cuối tháng. Thật khó tưởng tượng việc dùng nhiều token gấp 12 lần mà không cố tình đốt tiền
    • Tôi tò mò liệu Anthropic có bắt buộc các công ty trên một quy mô nhất định phải dùng gói Enterprise hay không, hay là các bạn tự chọn vì các tính năng doanh nghiệp. Dù tôi chạy 2~3 phiên bản VS Code cả ngày bằng ghế Premium Team với Opus 4.8 Max thì vẫn không chạm hạn mức
    • Thật thú vị khi mọi người đều xem giá API như thể đó là chi phí thực. Rất có thể API đang tạo ra lợi nhuận cao, còn gói thuê bao dù có lỗ nhẹ thì vẫn có thể kiếm bộn tiền nếu khiến người dùng cá nhân quen với mô hình GPT rồi đề xuất nó tại nơi làm việc
      Nếu nhìn theo mức trung bình của toàn bộ người đăng ký thì phần lớn lượng dùng thuê bao chắc vẫn dư ra. Một số ít khách hàng dùng hết 100% mỗi tuần được hưởng lợi lớn, nhưng đa số dùng ít hơn nhiều
      Trò chơi reset tạo áp lực phải dùng tối đa trước lần reset tiếp theo không thể đoán trước là một cơ chế khiến người dùng cốt lõi nghiện sản phẩm hơn
    • Tôi tiếc vì đã không kịp dùng dù chỉ một trong 4 reset đã hết hạn, nhưng dù sao toàn bộ lượng dùng cũng lại được reset. Hiện tôi đang đẩy mạnh những dự án mà bình thường sẽ không làm bằng 5.6-Sol-ultra, cụ thể là biên tập lớn một cuốn tiểu thuyết của người khác và thêm minh họa
  • Tôi đã phải vất vả mới biết rằng khi chu kỳ tuần bắt đầu, Codex sẽ xóa các reset đang có

  • Tôi thích cảm giác như có hai bậc cha mẹ cạnh tranh xem ai tặng con nhiều quà hơn. Kiểu như Giáng Sinh hai lần vậy

    • Anthropic không tặng nhiều quà lắm
  • Anthropic vẫn đều đặn reset vào khoảng giữa thứ Năm và thứ Sáu, nên với những người vốn được reset vào đúng thời điểm đó thì có phần bất lợi

    • Nếu Anthropic cũng cho reset miễn phí thì hiện tại dùng đồng thời hai gói thuê bao 20 USD/tháng có lẽ là phương án đáng tiền nhất
  • Sẽ tốt hơn nếu có endpoint API chính thức để kiểm tra bằng lập trình mức sử dụng Codex và thời điểm đặt lại hạn ngạch. Khi đó có thể dùng vibe coding để làm một ứng dụng thông báo khi mức sử dụng quay về 100% vì OpenAI đã đặt lại, hoặc khi trong 5 giờ chỉ còn 10% hạn mức sử dụng
    Hiện tại phải vòng qua Codex App Server nên không lý tưởng

    • Có thể kiểm tra thời điểm đặt lại hạn ngạch ở endpoint này. Dùng token xác thực cục bộ của Codex làm Bearer token và gửi yêu cầu GET thì phản hồi sẽ bao gồm available_countcredits[].expires_at
      https://chatgpt.com/backend-api/wham/rate-limit-reset-credit...
    • Chỉ cần dùng CodexBar
      https://github.com/steipete/CodexBar
    • Hiện tại giới hạn 5 giờ đã biến mất nên không cần theo dõi nữa. Với phần còn lại, chỉ cần nhờ Codex tạo mã Python để trả về mức sử dụng còn lại và thời điểm đặt lại tiếp theo, v.v.
      Kết quả có dùng Codex App Server nhưng là một tiến trình ngắn hạn giao tiếp qua stdio nên cũng tạm ổn
    • Tôi đánh dấu trang này và kiểm tra thường xuyên
      https://chatgpt.com/codex/cloud/settings/analytics
    • Có vẻ phần đầu có thể kiểm tra ở trang đó. Không rõ họ có cung cấp cả API thông báo hay không
  • Đây là một trang hữu ích. Tôi thích việc reset, và vì vẫn còn 3 lượt reset chưa dùng nên đang tiếp tục dùng chế độ 5.6 Sol Fast với 1 tỷ token mỗi ngày
    Tuy nhiên, tôi xác nhận trong Codex rằng khi bỏ giới hạn 5 giờ, họ cũng âm thầm hạ context của 5.6 Sol từ 354k xuống khoảng 258k

    • Có vài tweet liên quan nên không hẳn là thay đổi hoàn toàn âm thầm. Có vẻ có thể khôi phục về kích thước ban đầu bằng cách đặt model_context_window=YOUR_VALUE trong ~/.codex/config.toml