Trang chủ Đồ chơi số Xiaomi Xring O100: Chip AI đạt 330 token/giây
Đồ chơi số

Xiaomi Xring O100: Chip AI đạt 330 token/giây

Xiaomi giới thiệu Xring O100, chip tăng tốc AI với băng thông bộ nhớ 1,22TB/s và tốc độ suy luận tối đa 330 token/giây. Sản phẩm dự kiến thương mại hóa từ năm 2027.
Dũng Virgo Dũng Virgo
10/09/2026 13 phút đọc 10 lượt xem
Chia sẻ: f 𝕏
Tổng quan bài viết

Xiaomi vừa công bố Xring O100, chip tăng tốc AI chuyên dụng được phát triển cho các thiết bị cá nhân. Khác với những giải pháp phải gửi dữ liệu lên máy chủ đám mây, Xring O100 hướng đến việc chạy các mô hình AI trực tiếp trên thiết bị.

Sơ đồ hệ sinh thái chip Xring của Xiaomi
Máy tính mini Xiaomi AI Cube dùng cho các tác vụ AI
Thiết bị dạng máy tính bảng trình diễn khả năng xử lý AI cục bộ
Minh họa thiết kế bộ nhớ xếp chồng 3D của chip AI

Điểm đáng chú ý nhất của chip là băng thông bộ nhớ tối đa 1,22TB/s cùng tốc độ suy luận được Xiaomi công bố lên tới 330 token/giây. Đây là thông số có thể tạo khác biệt khi người dùng tương tác với các mô hình ngôn ngữ lớn, đặc biệt trong những tác vụ cần phản hồi liên tục và xử lý dữ liệu tại chỗ.

Xring O100 tập trung vào bài toán AI tại thiết bị

Trong hệ thống AI, năng lực tính toán của bộ xử lý chỉ là một phần của bài toán. Khi mô hình phải liên tục đọc và ghi dữ liệu, tốc độ trao đổi giữa bộ xử lý với bộ nhớ cũng ảnh hưởng trực tiếp đến thời gian phản hồi. Nếu dữ liệu không được truyền đủ nhanh, hiệu suất của chip có thể bị giới hạn dù phần tính toán vẫn còn dư địa.

Xiaomi thiết kế Xring O100 để xử lý vấn đề này. Chip được định hướng cho các tác vụ AI phức tạp ngay trên thiết bị, thay vì phụ thuộc hoàn toàn vào kết nối Internet và hạ tầng máy chủ bên ngoài. Cách tiếp cận này có thể hữu ích trong các tình huống cần phản hồi nhanh, bảo vệ dữ liệu cục bộ hoặc hoạt động ở nơi mạng không ổn định.

Về mặt trải nghiệm, người dùng có thể hình dung Xring O100 là một bộ tăng tốc dành riêng cho những ứng dụng như mô hình ngôn ngữ, trợ lý AI tạo sinh hoặc các tính năng cần xử lý dữ liệu trong thời gian dài. Tuy nhiên, thông số công bố hiện mới phản ánh năng lực của chip; hiệu quả thực tế còn phụ thuộc vào mô hình, phần mềm và thiết bị thương mại sau này.

Băng thông 1,22TB/s đến từ thiết kế bộ nhớ xếp chồng

Xring O100 sử dụng kiến trúc wafer-on-wafer, trong đó khuôn xử lý và DRAM tốc độ cao được xếp chồng theo chiều dọc. Hai phần này được kết nối bằng công nghệ hybrid bonding, giúp rút ngắn khoảng cách vật lý giữa bộ xử lý và bộ nhớ.

Theo Xiaomi, đây là giải pháp đóng gói 3D xếp chồng cấp wafer 6nm đầu tiên trên thế giới. Hãng cho biết khoảng cách giữa các điểm kết nối đã được thu hẹp gần giới hạn vật lý. Nhờ đó, dữ liệu có thể di chuyển giữa các thành phần với tốc độ cao hơn so với cách bố trí truyền thống.

Xiaomi tuyên bố băng thông bộ nhớ của Xring O100 cao gấp 16 lần so với smartphone truyền thống. Con số 1,22TB/s không đồng nghĩa mọi ứng dụng đều sẽ chạy nhanh hơn 16 lần, bởi hiệu năng còn phụ thuộc vào nhiều yếu tố khác. Dù vậy, đây vẫn là hướng cải tiến đáng chú ý khi các mô hình AI ngày càng lớn và cần truy cập lượng dữ liệu đáng kể trong quá trình suy luận.

Thiết kế bộ nhớ xếp chồng cũng cho thấy Xiaomi không chỉ tập trung vào việc thu nhỏ tiến trình sản xuất. Với chip AI, cách đóng gói và tổ chức dữ liệu có thể quan trọng không kém số lượng nhân xử lý. Việc đưa bộ nhớ đến gần bộ xử lý giúp giảm tác động của nút thắt băng thông, vốn thường xuất hiện khi chạy mô hình ngôn ngữ lớn trên thiết bị di động.

Tốc độ 330 token/giây có ý nghĩa gì?

Token là đơn vị mà mô hình ngôn ngữ sử dụng để phân tích và tạo văn bản. Một token có thể là một từ, một phần của từ hoặc một ký tự, tùy theo cách mô hình mã hóa dữ liệu. Vì vậy, tốc độ 330 token/giây không nên được hiểu đơn giản là chip tạo ra 330 từ hoàn chỉnh mỗi giây.

Trong thực tế, tốc độ token cao thường giúp câu trả lời của trợ lý AI xuất hiện nhanh và liền mạch hơn. Khi thiết bị tạo văn bản, tóm tắt tài liệu hoặc phản hồi một yêu cầu, người dùng có thể nhìn thấy nội dung được sinh ra với độ trễ thấp hơn. Thông số này đặc biệt quan trọng với những tác vụ xử lý trực tiếp trên thiết bị, nơi năng lực phần cứng quyết định phần lớn tốc độ phản hồi.

Xiaomi cho biết Xring O100 có thể đạt tốc độ suy luận tại thiết bị lên tới 330 token/giây. Cụm từ “lên tới” cho thấy đây là mức tối đa trong điều kiện trình diễn hoặc thử nghiệm nhất định, không phải tốc độ cố định cho mọi mô hình và ứng dụng. Các yếu tố như kích thước mô hình, mức độ tối ưu phần mềm, nhiệt độ và giới hạn năng lượng đều có thể làm kết quả thay đổi.

NPU đa lõi và khả năng định tuyến dữ liệu động

Xring O100 được trang bị hệ thống NPU đa lõi. NPU là bộ xử lý chuyên cho các phép tính AI, thường đảm nhiệm những công việc mà CPU hoặc GPU không thực hiện hiệu quả bằng. Trong trường hợp của Xring O100, NPU được tối ưu cho các giai đoạn khác nhau trong quy trình suy luận.

Chip cũng hỗ trợ định tuyến dữ liệu động. Về nguyên tắc, cơ chế này cho phép hệ thống phân bổ dữ liệu đến các phần xử lý phù hợp hơn tùy theo từng giai đoạn của tác vụ. Khi kết hợp với băng thông bộ nhớ lớn, thiết kế trên có thể giúp hạn chế tình trạng các nhân xử lý phải chờ dữ liệu.

Tuy nhiên, để khai thác tối đa phần cứng, Xiaomi vẫn cần tối ưu lớp phần mềm và hệ sinh thái mô hình AI. Một chip có thông số cao không tự động mang lại trải nghiệm tốt nếu ứng dụng chưa hỗ trợ, mô hình chưa được tinh chỉnh hoặc hệ điều hành chưa phân bổ tài nguyên hiệu quả.

Nguyên mẫu đã được trình diễn

Tại sự kiện, Xiaomi trình diễn các nguyên mẫu sử dụng Xring O100, bao gồm một thiết bị dạng máy tính bảng. Hãng cũng giới thiệu mẫu máy tính mini Xiaomi AI Cube, kết hợp Xring O100 với các chip Xring khác để xử lý AI cục bộ trong thời gian dài.

Việc đưa chip vào nhiều dạng nguyên mẫu cho thấy Xiaomi đang thử nghiệm Xring O100 như một nền tảng có thể mở rộng, thay vì chỉ dành cho một sản phẩm duy nhất. Máy tính bảng có thể phù hợp với trợ lý AI và công việc di động, trong khi máy tính mini có nhiều không gian hơn cho hệ thống tản nhiệt và nguồn điện.

Trong hệ sinh thái sản phẩm của Xiaomi, dòng máy tính bảng đang được mở rộng với nhiều cấu hình khác nhau. Người dùng có thể xem thêm thông tin về Xiaomi Pad 9 Pro Max để hình dung hướng phát triển thiết bị màn hình lớn của hãng, dù mẫu máy này không được xác nhận sử dụng Xring O100.

Kế hoạch thương mại hóa từ năm 2027

Xring O100 là một phần trong hệ sinh thái Xring mà Xiaomi đang xây dựng. Bên cạnh chip tăng tốc AI, hãng còn phát triển các SoC di động cao cấp và chip dành cho ô tô. Chiến lược này cho thấy Xiaomi muốn chủ động hơn ở nhiều lớp phần cứng, từ thiết bị cá nhân đến các nền tảng có yêu cầu xử lý chuyên biệt.

Xiaomi dự kiến đưa Xring O100 vào các sản phẩm thương mại từ năm 2027. Những nhóm thiết bị được đề cập gồm smartphone, máy tính bảng, robot và một số sản phẩm khác. Mục tiêu là giúp các tính năng AI tạo sinh hoạt động nhanh hơn ngay cả khi thiết bị không có kết nối Internet.

Trong trường hợp được triển khai rộng rãi, xử lý AI tại thiết bị có thể đem lại ba lợi ích chính. Thứ nhất là giảm độ trễ do dữ liệu không phải liên tục di chuyển đến máy chủ. Thứ hai là giảm sự phụ thuộc vào đường truyền mạng. Thứ ba là dữ liệu nhạy cảm có thêm cơ hội được xử lý cục bộ thay vì gửi ra ngoài.

Dù vậy, AI tại thiết bị cũng đi kèm những thách thức. Các nhà sản xuất phải cân bằng giữa hiệu năng, mức tiêu thụ điện, nhiệt lượng và dung lượng bộ nhớ. Họ cũng cần xây dựng công cụ để nhà phát triển có thể tận dụng NPU, đồng thời tối ưu mô hình cho từng nhóm thiết bị.

Xring O100 có thể tạo khác biệt ra sao?

Điểm đáng chú ý của Xring O100 không chỉ nằm ở con số 330 token/giây. Quan trọng hơn, Xiaomi đang lựa chọn hướng tiếp cận kết hợp giữa NPU đa lõi, bộ nhớ xếp chồng 3D và băng thông rất cao. Đây là cách giải quyết nút thắt dữ liệu thay vì chỉ tăng thêm năng lực tính toán thuần túy.

Nếu đạt được hiệu quả như kỳ vọng trong sản phẩm thương mại, chip có thể giúp các thiết bị Xiaomi xử lý trợ lý AI, tóm tắt văn bản, tạo nội dung hoặc điều khiển thiết bị nhanh hơn. Các robot cũng có thể hưởng lợi từ khả năng xử lý cục bộ khi phải phản hồi trong thời gian ngắn.

Tuy nhiên, còn quá sớm để đánh giá Xring O100 qua một vài thông số công bố. Hiệu năng cuối cùng sẽ cần được kiểm chứng trên thiết bị hoàn thiện, với các mô hình và phần mềm thực tế. Mốc thương mại hóa từ năm 2027 cũng đồng nghĩa người dùng sẽ phải chờ thêm để biết chip này có thể chuyển hóa lợi thế băng thông thành trải nghiệm cụ thể đến đâu.

Với Xring O100, Xiaomi đang cho thấy tham vọng xây dựng nền tảng phần cứng riêng cho kỷ nguyên AI. Nếu giải quyết tốt bài toán nhiệt độ, điện năng và hỗ trợ phần mềm, chip tăng tốc này có thể trở thành nền tảng quan trọng cho các thiết bị Xiaomi trong những năm tới.

Có thể bạn quan tâm

Bài viết liên quan