Inherent, một AI lab tại London do cựu nhân viên Google DeepMind sáng lập, vừa công bố kết quả của agent AI mang tên Faraday: tái tạo thành công kết quả của các bài báo khoa học đã công bố mà không hề biết trước đáp án, và theo đánh giá của chính công ty, làm tốt hơn các model lớn hơn nhiều từ Anthropic và OpenAI.
Điểm đáng chú ý nhất nằm ở kích thước. Trong khi đối thủ là hai hệ quy mô frontier, Faraday chạy trên Qwen 3.6 chỉ vỏn vẹn 27 tỷ tham số. Nói một cách gần đúng, tham số thường tương ứng với kích thước và chi phí huấn luyện của model. Nghĩa là một hệ thống nhỏ hơn hàng chục lần lại thắng ở một tác vụ đòi hỏi suy luận nghiên cứu thực thụ.
Chính Inherent đặt chuẩn thành công cao hơn accuracy thông thường. Ngoài việc tái tạo đúng kết quả, họ muốn Faraday thể hiện thứ gọi là “research taste”: bản năng nhận ra thí nghiệm nào đáng chạy và thiết kế chúng ra sao cho tốt. Cách dạy thứ vô hình này là reinforcement learning, phương pháp thưởng cho kết quả tốt thay vì viết sẵn luật lệ. Inherent không huấn luyện agent chủ yếu trên tri thức về cách khoa học vận hành, mà cược rằng hướng reward-based sẽ tổng quát hóa tốt hơn cho mục tiêu dài hạn: agent góp phần vào nhiều lĩnh vực khoa học.
Đồng sáng lập kiêm chief scientist Edward Hughes nói tái tạo paper không phải trò biểu diễn. “Nhiều nghiên cứu sinh thực sự bắt đầu bằng việc này.” Điều ông tâm đắc nhất không phải là thắng các frontier agent, mà là đường đến đó. Ông cũng nhấn mạnh triết lý hợp tác: thay vì agent nói điều người dùng muốn nghe, mục tiêu là kiểu đồng nghiệp quay lại và nói “tôi tò mò về cái này nên đi làm mấy thí nghiệm, bạn xem kết quả thế nào”.
Cách tiếp cận tiết kiệm cũng rõ ở hạ tầng: thay vì tự xây coding tool, Faraday dùng luôn GPT-5.5 Codex của OpenAI, giống cách nhà khoa học người tận dụng phần mềm sẵn có.
Vài con số về công ty: Inherent thoát khỏi stealth hồi tháng 5 với vòng seed 50 triệu USD, đội ngũ hiện ~12 người làm trực tiếp tại văn phòng King’s Cross, kế hoạch tăng lên 20-25 người vào cuối năm. Bốn đồng sáng lập là Louis Kirsch, Kaloyan Aleksiev, Tantum Collins và Edward Hughes.
Lưu ý quan trọng: kết quả so sánh trên do chính Inherent công bố, chưa có xác minh độc lập từ bên thứ ba.