Bỏ qua để vào nội dung chính

DeepSeek tăng giá 3x theo giờ UTC: dev VN nên chạy job lúc nào

Bởi Ryan Patel
06 thg 9, 20267 phút đọc

DeepSeek chuyển V4 Pro sang giá theo giờ UTC, Sol có hạn promotional 21/11, Astra đẩy index +29% trong một ngày. Cách đọc lại giá theo tier.

Hóa đơn DeepSeek tháng 8 của bạn tăng gần gấp ba, và không có email nào báo trước. Pipeline vẫn chạy y như tháng 7 — cùng số token, cùng model, cùng prompt. Bài này chỉ ra chỗ bảng giá đã đổi, cách đọc giá theo tier thay vì theo một con số, và những gì cần kiểm tra trước khi chốt budget API quý sau.

Số liệu dưới đây lấy từ báo cáo giá LLM chốt ngày 01/09/2026 của ModelPriceWatch — tác giả tự công bố "Disclosure: I maintain ModelPriceWatch." Báo cáo theo dõi index bình quân đều của 10 flagship, mỗi lab một model, giá blended theo tỷ lệ 3 phần input : 1 phần output, lấy đúng giá niêm yết của từng vendor.

DeepSeek V4 Pro: giá giờ là một bảng theo giờ UTC

Đến 16:00 UTC ngày 16/08, V4 Pro tính một mức phẳng duy nhất: $0.435 input / $0.87 output cho mỗi triệu token. Sau mốc đó, trang giá tách làm hai bậc:

  • Peak (01:00–04:00 và 06:00–10:00 UTC): $1.32 / $3.96
  • Off-peak (mọi giờ còn lại): đúng một nửa peak — $0.66 / $1.98

Chỗ dễ đọc sai nhất: off-peak không phải mức giá cũ quay lại. Báo cáo tính off-peak blended ở $0.99, tức vẫn cao hơn 82% so với mức phẳng trước đây, và mô tả thay đổi này là "a 3x increase with a discount window attached" — tăng 3x rồi gắn thêm một cửa sổ giảm giá.

Quy đổi hai cửa sổ peak sang giờ Việt Nam (UTC+7, không DST): 08:00–11:00 và 13:00–17:00. Gần như trùng khít giờ hành chính. Nghĩa là nếu cron của bạn chạy theo giờ làm việc VN, mặc định bạn đang trả mức peak. Báo cáo nói thẳng về chuyện này: "If your pipeline runs at 08:00 UTC, you're paying double for no reason", và lưu ý off-peak là 17 giờ mỗi ngày.

Áp dụng được ngay cho workload không cần realtime: embed lại corpus, gán nhãn, tóm tắt log, chạy eval hàng loạt. Dời các job đó ra khỏi hai cửa sổ peak là khoản giảm chi phí lấy được mà không phải đổi model.

V4 Flash tăng 3.8x nhưng "giá sàn" không nhích — vì một reseller

Cùng ngày 16/08, DeepSeek nâng peak rate của V4 Flash từ $0.14/$0.28 lên $0.44/$1.32 — blended từ $0.175 lên $0.66, tức 3.8x. Nhưng mức giá sàn mà báo cáo theo dõi — model rẻ nhất vượt một ngưỡng năng lực cố định — lại không đổi: vẫn $0.113 cho mỗi triệu token, do chính V4 Flash giữ từ 25/07.

Lý do nằm ở cách tính: giá sàn đọc mức niêm yết rẻ nhất trên mọi host phục vụ model đó, và DeepInfra vẫn để V4 Flash ở $0.09/$0.18 — thấp hơn hẳn mức peak của chính lab đã train nó. Câu chốt của báo cáo đáng dán lên tường phòng dev: "A lab's list price is a policy; a reseller's list price is a margin."

Với team VN quen chọn model rẻ qua reseller, đây là rủi ro cụ thể: con số bạn đưa vào dự toán có thể là quyết định biên lợi nhuận của một host, không phải chính sách giá của lab. Trước khi gia hạn budget, mở lại trang giá của host đó và xác nhận mức niêm yết còn nguyên.

GPT-5.6 Sol giảm 29% — kèm một đồng hồ đếm ngược

Ngày 21/08, Sol đi từ $5/$30 xuống $4/$20, blended $11.25 → $8.00, giảm 29%. Báo cáo ghi nhận đây là lần đầu tiên một thành viên trong index bị cắt giá niêm yết, chứ không phải bị thay bằng model mới. Cùng ngày, một câu xuất hiện trên trang giá: "GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026."

Đọc kỹ mệnh đề đó: nó là mức sàn thời gian, không phải ngày giá quay về cũ. Báo cáo nhấn mạnh OpenAI không công bố ngày tăng lại, nên khuyến nghị là coi mức $4/$20 như sẽ hết hạn ngày 21/11 rồi mô hình hóa phần tăng ngược lên — thay vì đưa nó vào dự toán 2027 như giá vĩnh viễn.

Trần giá vừa mở lại thành 27x sau khi Astra vào rổ

Ngày 03/09, OpenAI phát hành GPT-6 Astra ở $10/$50 — blended $20.00 — và đặt làm flagship mặc định. Ngày 04/09 Astra thay Sol trong rổ, và index nhảy từ $4.14 lên $5.34 trong một ngày: +29.0%, cú dịch chuyển lớn nhất trong lịch sử index. Khoảng cách giá giữa các flagship vừa co lại còn 13x hôm 01/09 thì mở lại thành 27x.

Theo bảng thông số OpenAI công bố, Astra có context tối đa 1,050,000 token, output tối đa 128,000 token, tên model API là gpt-6-astra, kèm một chế độ fast mode nhân đôi tốc độ với giá cao hơn. Model đang rollout theo giai đoạn: một nhóm tổ chức giới hạn trước, sau đó tới người dùng ChatGPT trả phí và developer qua OpenAI API, Microsoft Azure và AWS Bedrock.

Về hiệu quả chi phí, báo cáo tính: ở điểm benchmark công bố là 96, Astra tốn $0.208 cho mỗi điểm năng lực đo được — gấp 3.5 lần mức trung bình của nhóm frontier ngày 01/09. Hai ngày trước đó, Claude Fable 5.1 ra mắt cùng mức $10/$50 nhưng cached input chỉ $0.25, tức 2.5% giá input, và báo cáo gọi đây là mức giảm cache sâu nhất trên các thẻ giá flagship mà họ theo dõi.

Với đa số team VN, con số cache đó quyết định hóa đơn nhiều hơn giá niêm yết: nếu workload gửi lặp lại cùng một khối context — codebase, tài liệu nội bộ, system prompt dài — hai model cùng giá niêm yết vẫn có thể lệch rất xa ở phần input được cache.

Bảng đọc nhanh: giá nào đang kèm điều kiện

ModelGiá niêm yết (input/output per 1M)Điều kiện kèm theo
DeepSeek V4 Pro$1.32 / $3.96 (peak)Off-peak đúng một nửa: $0.66 / $1.98
DeepSeek V4 Flash$0.44 / $1.32 (peak)DeepInfra vẫn niêm yết $0.09 / $0.18
GPT-5.6 Sol$4 / $20Giá promotional, "at least through November 21, 2026"
GPT-6 Astra$10 / $50Fast mode nhân đôi tốc độ, giá cao hơn
Claude Fable 5.1$10 / $50Cached input $0.25 (2.5% giá input)

Ba mốc cần theo

  • 21/11/2026 — mốc hết hạn tối thiểu của giá promotional Sol. Nếu bạn đang chốt kế hoạch chi phí dài hơn mốc này, phần sau mốc nên tính ở mức $5/$30.
  • Mức niêm yết của DeepInfra cho V4 Flash. Giá rẻ nhất bạn đang dựa vào hiện phụ thuộc vào một host, không phải lab.
  • Lab tiếp theo áp giá theo giờ. Báo cáo lưu ý ba lần chuyển flagship khác trong tháng 8 — Muse Spark 1.1 → 1.2, Grok 4.5 → 4.6, GLM-5.2 → 5.3 — không làm index đổi vì model mới giữ nguyên giá của model cũ. Đúng mô hình "giá không đổi" đó vừa bị hai lab phá trong ba tuần.

Việc cần làm ngay không phải đổi model. Mở lại trang giá của từng model bạn đang gọi, ghi tier ngay bên cạnh con số — peak hay off-peak, standard hay promotional — rồi đối chiếu với giờ cron thực tế của pipeline. Báo cáo tóm gọn thành một câu: "Write the tier next to the price, not just the date." Đó là phần hóa đơn bạn kiểm soát được ngay hôm nay.

Không spam, hủy đăng ký bất kỳ lúc nào.

Bài viết liên quan