AMD KHẲNG ĐỊNH VỊ THẾ AI: ZYPHRA RA MẮT MÔ HÌNH ZAYA1 ĐƯỢC ĐÀO TẠO HOÀN TOÀN TRÊN NỀN TẢNG MI300X

Vừa qua, AMD đã công bố một bước tiến mang tính bước ngoặt, củng cố vị thế của hãng trong cuộc đua Trí tuệ Nhân tạo thế hệ mới. Công ty Zyphra đã chính thức ra mắt ZAYA1, mô hình nền tảng Mixture-of-Experts (MoE) quy mô lớn đầu tiên được đào tạo 100% bằng hệ sinh thái tăng tốc của AMD.

Thành tựu này là minh chứng rõ ràng nhất cho khả năng của nền tảng AMD trong việc xử lý các tác vụ AI phức tạp, quy mô sản xuất, vốn trước đây thường bị thống trị bởi các đối thủ khác.

ZAYA1: Sức Mạnh Từ Hệ Sinh Thái AMD

Việc đào tạo mô hình ZAYA1 được thực hiện trên một kiến trúc tích hợp chặt chẽ, bao gồm ba thành phần cốt lõi của AMD:

  1. GPU AMD Instinct™ MI300X: Cung cấp sức mạnh tính toán vượt trội.

  2. Mạng lưới AMD Pensando™: Đảm bảo khả năng kết nối và truyền dữ liệu tốc độ cao.

  3. Bộ phần mềm mở ROCm™: Cung cấp tính linh hoạt và khả năng tùy chỉnh cao.

Hiệu Suất Vượt Trội so với Đối Thủ

Kết quả kiểm tra kỹ thuật từ Zyphra cho thấy ZAYA1 không chỉ là một mô hình thử nghiệm mà là một đối thủ nặng ký trên thị trường.

  • ZAYA1-base (với tổng cộng 8.3 tỷ tham số và 760 triệu tham số hoạt động) đã vượt mặt các mô hình phổ biến như Llama-3-8B và OLMoE.

  • Mô hình này sánh ngang về hiệu suất với Qwen3-4B (Alibaba) và Gemma3-12B (Google) trong các lĩnh vực quan trọng như suy luận, toán học và viết code.

Ông Emad Barsoum, Phó Chủ tịch cấp cao của AMD, khẳng định: "Cột mốc này thể hiện sức mạnh và tính linh hoạt của GPU AMD Instinct và mạng lưới Pensando trong việc đào tạo các mô hình phức tạp, quy mô lớn."

Lợi Thế Kỹ Thuật Đưa Đến Hiệu Quả Tối Đa

Yếu tố then chốt giúp Zyphra đạt được hiệu quả vượt trội là GPU MI300X với 192 GB Bộ nhớ Băng thông Cao (HBM). Dung lượng bộ nhớ lớn này cho phép Zyphra:

  • Đơn giản hóa quy trình đào tạo: Tránh các kỹ thuật phân mảnh tensor hoặc expert (sharding) tốn kém và phức tạp, giúp cải thiện thông lượng trên toàn bộ mô hình.

  • Tăng tốc lưu trữ dữ liệu: Tối ưu hóa I/O phân tán của AMD giúp thời gian lưu mô hình (model save times) nhanh hơn hơn 10 lần, nâng cao độ tin cậy và tốc độ lặp lại trong quá trình nghiên cứu.

CEO của Zyphra, Krithik Puthalath, nhấn mạnh rằng ZAYA1 là sự phản ánh của triết lý "Hiệu quả" của công ty, cho thấy lợi ích của việc đồng thiết kế kiến trúc mô hình với nền tảng silicon và hệ thống.

AMD, Zyphra và IBM đã hợp tác chặt chẽ để thiết kế và triển khai cụm đào tạo lớn này, khẳng định cam kết chung nhằm thúc đẩy ranh giới của AI tiên tiến.

Nguồn Tổng Hợp

Bình luận

Bài viết bạn có thể quan tâm

AMD Ryzen™ AI MAX+ 392 trong ASUS TUF Gaming A14 có gì đặc biệt, hiệu năng ra sao

AMD Ryzen™ AI MAX+ 392 là một bộ xử lý vô cùng ấn tượng với CPU mạnh mẽ kết hợp cùng GPU tích hợp sở hữu sức mạnh tương đương với một GPU rời, kết hợp cùng bộ nhớ hợp nhất lớn mang đến hiệu năng vượt trội trong mọi nhu cầu từ làm việc, giải trí, chơi game cho đến chạy các mô hình AI trên thiết bị

Giải pháp cấu hình tối ưu chi phí và hiệu năng cho phòng net hiện đại với AMD Ryzen 7 5700G, 5700X và Radeon RX 6500XT, 7600 8GB

Mô hình phòng net hiện đại ngày nay đòi hỏi rất cao về tính ổn định và hiệu quả kinh doanh. Khách hàng đến phòng máy không chỉ để chơi game giải trí thông thường mà còn yêu cầu trải nghiệm mượt mà, không bị sụt giảm khung hình đột ngột khi vào các pha giao tranh phức tạp

Microsoft sẽ triển khai bộ vi xử lý AMD Instinct và AMD EPYC thế hệ tiếp theo khi hai công ty mở rộng quan hệ đối tác chiến lược lâu dài

AMD và Microsoft công bố hợp tác nhằm mở rộng cơ sở hạ tầng AI cho Azure. Microsoft sẽ triển khai AMD Helios, được trang bị bộ tăng tốc MI455X, bộ xử lý EPYC và mạng Pensando của AMD. Hệ thống này hỗ trợ đào tạo, suy luận và tinh chỉnh AI quy mô lớn. Các sản phẩm Azure mới sẽ sử dụng chip EPYC thế hệ thứ sáu cho hệ thống và thiết kế dữ liệu AI. Sự hợp tác nhằm cung cấp thêm nhiều lựa chọn cơ sở hạ tầng cho tin tức AI + crypto và các ứng dụng doanh nghiệp.