Z.AI, phòng lab AI Trung Quốc còn gọi là Zhipu, ngày 26/08 xác nhận với Bloomberg rằng Ox Alpha, model “stealth” gây tò mò suốt gần một tuần qua, là một bản phát hành mới thuộc dòng GLM của hãng, và sẽ mở weights công khai ngay trong đêm.
Chuyện quay lại như sau: Ox Alpha xuất hiện trên OpenRouter và OpenCode ngày 20/08, hoàn toàn ẩn danh, không logo, không nhà cung cấp, chỉ mô tả ngắn là “reasoning model cho coding, agentic work dài hơi và production workload”. Miễn phí trong giai đoạn preview, model leo nhanh lên đỉnh bảng usage của OpenRouter, dùng nhiều hơn gấp đôi DeepSeek. CEO Stripe Patrick Collison gọi nó là “very impressive”, cộng đồng AI phân tích cả tuần: có người đoán GLM, có người bảo là model MAI của Microsoft, Reddit cãi nhau xem nó có phải hàng Trung Quốc hay không.

Đặc tả kỹ thuật từ OpenRouter giải thích vì sao nó hút người dùng nhanh vậy: cửa sổ ngữ cảnh gốc 1.048.576 token (1M), hỗ trợ đa phương thức gồm text, ảnh và video, thiết kế cho quy trình lập trình kéo dài và agent chạy nhiệm vụ dài hạn. Cộng đồng developer đã tự so sánh cú pháp output và hành vi tokenization với GLM-5, tìm thấy trùng khớp phong cách rõ rệt, từ đó suy ra đây là checkpoint thử nghiệm của GLM-5.3 hay GLM-5.3-Flash trước khi chính thức lộ diện.
Việc xác nhận danh tính đặt Z.AI vào thế đối đầu trực tiếp với các model mở khác đến từ DeepSeek, Moonshot AI và Alibaba, nhưng với một lợi thế hiếm có: model đã chứng minh sức hút thực trên bảng usage trước khi phát hành chính thức. Mở weights cho một model đang hot như vậy tiếp thêm xu hướng đang mạnh dần lên: năng lực tầm frontier chuyển sang hình thái open deployment.
Chi tiết đáng suy ngẫm hơn cả con số benchmark nằm ở cách phát hành. Ox Alpha là một ví dụ điển hình cho chiến thuật stealth rollout: phòng lab tung model ẩn danh lên hub developer để stress-test hạ tầng inference, thu dữ liệu telemetry và đo lường tối ưu post-training trước khi công bố. Với người dùng, đó là một tuần được dùng miễn phí model tốt; với hãng, đó là đợt beta quy mô toàn cầu không mất tiền marketing. Hai bên đều có lợi, nhưng cũng đáng để tự hỏi: khi danh tính bị che, những đánh giá “model này tuyệt” trong tuần qua có bao nhiêu phần là chất lượng thật, bao nhiêu phần là hiệu ứng tò mò của một cái tên bí ẩn?