Thách thức tốc đ ộ Token gấp 30 lần so với GPU! Société Générale ca ngợi Cerebras (CBRS.US) CS-4 mở ra kỷ nguyên “wafer-level + decoupled inference”
Sau sự kiện Supernova Day được tổ chức vào thứ Ba bởi công ty chip trí tuệ nhân tạo (AI) Cerebras Systems, BNP Paribas cho biết họ ấn tượng mạnh với các đối tác hợp tác được công bố và các thông báo liên quan của công ty này.
Theo thông tin từ Ứng dụng tài chính Zhihui, sau sự kiện Supernova Day do công ty chip trí tuệ nhân tạo (AI) Cerebras Systems (CBRS.US) tổ chức vào thứ Ba, BNP Paribas cho biết các đối tác và thông báo liên quan mà công ty này công bố đã để lại ấn tượng mạnh mẽ.
Nhà phân tích của BNP Paribas, Karl Ackerman, đã viết trong một báo cáo gửi khách hàng: "Tương tự như LPU của NVIDIA (NVDA.US), các quan hệ hợp tác mới của Cerebras với OpenAI, Amazon (AMZN.US) AWS và AMD (AMZ.US) nổi bật nhu cầu ngày càng tăng của thị trường đối với các giải pháp cải thiện giai đoạn giải mã nhạy cảm với độ trễ cao trong quá trình suy luận."
Nhà phân tích này tiếp tục cho biết, về mặt suy luận tốc độ cao, động cơ Wafer-Scale Engine dựa trên SRAM CS-4 mới được công bố cung cấp "băng thông bộ nhớ trên chip lên tới 43,2 PB/s đáng kinh ngạc" và được trang bị một giao diện wafer I/O mới sử dụng RDMA. Cerebras tự hào rằng hệ thống CS-4 có tốc độ tạo Token nhanh gấp 30 lần các hệ thống GPU trong môi trường sản xuất hiện tại.
Ngoài ra, nhà phân tích nhận định, lộ trình sản phẩm của Cerebras rất ấn tượng khi mỗi năm nâng cao hiệu suất gấp đôi và dự kiến tăng thông lượng gấp 20 lần vào năm 2027. Nhà phân tích cho biết: "Cerebras đang tập trung vào giải pháp suy luận phi tập trung, định vị động cơ wafer scale của mình là một động cơ giải mã siêu tốc để tạo Token nhanh và phối hợp với các hệ thống đòi hỏi tính toán cao như AWS Trainium hoặc AMD Helios. Cerebras cho biết hệ thống suy luận phi tập trung này dự kiến sẽ nhanh gấp 10 lần GPU và hiệu suất tăng gấp 5 lần so với cấu hình chỉ sử dụng WSE."
Cuối cùng, nhà phân tích cho biết Arista Networks (ANET.US) đã trở thành đối tác mạng "chìa khóa" của Cerebras và kỳ vọng rằng theo thời gian, mối quan hệ hợp tác này sẽ giúp Arista mở rộng các kịch bản ứng dụng khách hàng mới.
Được biết, tại sự kiện Supernova Day vào thứ Ba, Cerebras đã chính thức ra mắt hệ thống AI cấp rack thế hệ mới Cerebras CS-4, tuyên bố rằng đây là "bộ tăng tốc AI nhanh nhất ngành". Hệ thống này hướng đến lĩnh vực suy luận mô hình lớn, trực tiếp đối đầu với các sản phẩm máy chủ GPU của NVIDIA. Ngoài ra, Cerebras cũng công bố các mối quan hệ đối tác với OpenAI, AMD, Arista Networks, AWS, Figma, Cognition và CrowdStrike tại sự kiện này.
CS-4 là sản phẩm đầu tiên thuộc kiến trúc nền tảng Nexus cấp rack thế hệ mới của Cerebras, được vận hành bởi ba bộ vi xử lý Wafer Scale Engine 3 Turbo (WSE-3T) hoàn toàn mới. WSE-3T là bộ xử lý AI lớn nhất từng được sản xuất, với mỗi con chip tích hợp 4 nghìn tỷ transistor và 900 nghìn lõi tối ưu hóa AI, bao phủ diện tích silicon 46.225 mm², tích hợp 44 GB SRAM. Hệ thống CS-4 cung cấp hiệu năng AI 750 PFLOPs, băng thông bộ nhớ 129,6 PB/s và thông lượng I/O 7,2 Tbps. Hiệu năng AI của một chip WSE-3T tăng gấp đôi so với thế hệ trước từ 125 PFLOPS lên 250 PFLOPS, và băng thông bộ nhớ tăng từ 21,6 PB/s lên 43,2 PB/s.
Cerebras tuyên bố CS-4 đã thiết lập tiêu chuẩn mới trong ngành về tốc độ suy luận. Trong bài thử nghiệm so sánh trực tiếp với mẫu GPT-OSS-120B, CS-4 có thể tạo ra hơn 4.400 Token mỗi giây cho mỗi người dùng, cao hơn gấp 30 lần giải pháp GPU. Hệ thống này có thể hỗ trợ các mô hình lên tới hơn 50 nghìn tỷ tham số. So với CS-3 thế hệ trước, CS-4 có tốc độ nhanh gấp đôi, thông lượng trên mỗi watt tăng 10 lần, giúp tối ưu hóa đáng kể hiệu quả kinh tế của trung tâm dữ liệu.
Tuyên bố miễn trừ trách nhiệm: Mọi thông tin trong bài viết đều thể hiện quan điểm của tác giả và không liên quan đến nền tảng. Bài viết này không nhằm mục đích tham khảo để đưa ra quyết định đầu tư.
Bạn cũng có thể thích
Dữ liệu: Chỉ số Tham lam và Sợ hãi tiền mã hóa hiện là 68, đang ở trạng thái tham lam.
Cuộc chiến xe tự hành toàn cầu bước vào giai đoạn mới! Waymo, công ty con của Alphabet (GOOGL.US), liên kết với tập đoàn hàng đầu Nhật Bản để thâm nhập thị trường Tokyo
Waymo, một công ty con của Alphabet, đã hợp tác với ông lớn taxi Nhật Bản để thông báo sẽ ra mắt dịch vụ tự lái tại Tokyo vào năm 2027, cổ phiếu của đối tác Go lập tức tăng 9,7%.

UOB Kay Hian: Giữ nguyên đánh giá “Mua” đối với Waterdrop (WDH.US), nâng giá mục tiêu lên 2,23 USD
Dựa trên việc điều chỉnh tăng dự báo lợi nhuận, UOB Kay Hian duy trì xếp hạng "mua vào" đối với công ty Waterdrop và nâng giá mục tiêu lên 2,23 USD.

"Cơn sốt tích trữ đồng" hạ nhiệt? LME ghi nhận giao hàng lớn nhất trong gần bốn tuần qua, giá đồng rút về 14.000 USD
Giá đồng đã ổn định sau khi giảm xuống gần 14,000 đô la Mỹ mỗi tấn, trước đó các kho lưu trữ theo dõi bởi sàn giao dịch đã đón một đợt giao hàng tồn kho mới, cho thấy tình trạng thiếu nguồn cung đã được cải thiện.

