
Mercury 2.5 của Inception: Diffusion LLM đạt 1.100 token/giây, tuyên bố chất lượng ngang tầm tiên phong
Inception Labs phát hành Mercury 2.5, một LLM dựa trên diffusion với mức cải thiện chất lượng 40% so với Mercury 2, thông lượng 1.107 token/giây và mức giá cạnh tranh hơn các mô hình chủ đạo. Bản cập nhật nhắm vào các khối lượng công việc nhạy cảm với độ trễ như tác tử thoại và tác tử phụ lập trình.









