
Prompt caching: giảm chi phí LLM 10x, đo trên 393 model API
Đo thực tế trên 393 model: Anthropic chỉ cache khi bạn khai báo, OpenAI cache mặc định nhưng có ngưỡng 1.024 token. Cách bật và ba cái bẫy hay gặp.

Đo thực tế trên 393 model: Anthropic chỉ cache khi bạn khai báo, OpenAI cache mặc định nhưng có ngưỡng 1.024 token. Cách bật và ba cái bẫy hay gặp.

OpenAI giảm giá GPT-5.6 Luna ~80%, Terra ~20% và thêm Sol Fast mode. Đây là quyết định model routing, không phải đợt giảm hóa đơn toàn dòng.

Meta mở mã Muse Glimmer, model 30B chạy thẳng trên PC/Mac. Kèm hướng dẫn tự host LLM local bằng Open WebUI, Ollama để cắt chi phí subscription AI.

Codex CLI thiên về autonomy với full-auto mode, Claude Code thiên về control với permission model và hooks. So sánh triết lý và cách chọn công cụ phù hợp.

OpenAI bỏ giới hạn chat text cho ChatGPT Free/Go, thêm nút Think và nâng GPT-5.6 Sol/Luna. Cách tận dụng thay đổi này cho workflow dev hàng ngày.

GPTBot và OAI-SearchBot là hai bot khác nhau: chặn nhầm cái, site vừa bị train vừa mất traffic từ ChatGPT. Cách cấu hình robots.txt đúng cho từng AI company.

Apple xin lệnh cấm khẩn cấp với OpenAI, tiết lộ thêm 11 cựu nhân viên liên quan vụ rò rỉ bí mật. OpenAI công khai tin nhắn nội bộ để phản pháo ngay trong đêm.

The GPT-5.5-Cyber capability profile beyond OpenAI's marketing: Simon Willison's evals, the Trusted Access Program scope, and what the Five Eyes briefings actually covered.

We compared what Anthropic Mythos and OpenAI GPT-5.5-Cyber actually do on offensive testing tasks. Capabilities, refusal patterns, evals, and where each model breaks down.

Anthropic's Mythos and OpenAI's GPT-5.5-Cyber both ship locked behind allowlists. Here's what's inside each model, who actually gets access, and what the rest of us can build today.

OpenAI's new gpt-image-2 (Apr 21, 2026) ships 2K images with thinking mode and 8-image batches for ~$0.21 each — wire it into a Next.js server action.