Tin sâu TechFlow ngày 29 tháng 7, nhà nghiên cứu của OpenAI Jeffrey Wang đánh giá giải pháp AI cho suy luận do AMD và Cerebras phối hợp phát triển có hiệu suất “không thể tin nổi”. Giải pháp này tích hợp AMD Helios dạng tủ rack và động cơ cấp độ wafer của Cerebras, lần lượt xử lý giai đoạn đầu vào prompt và tạo token. Dự kiến có thể tăng số lượng token mỗi giây trên mỗi watt lên 5 lần. Lộ trình công nghệ này tối ưu hiệu suất suy luận thông qua tính toán dị cấu hình, phản ánh sự quan tâm liên tục của các phòng thí nghiệm AI hàng đầu đến việc giảm chi phí suy luận.

AMD-8,13%
Xem bản gốc
Trang này có thể chứa nội dung của bên thứ ba, được cung cấp chỉ nhằm mục đích thông tin (không phải là tuyên bố/bảo đảm) và không được coi là sự chứng thực cho quan điểm của Gate hoặc là lời khuyên về tài chính hoặc chuyên môn. Xem Tuyên bố từ chối trách nhiệm để biết chi tiết.
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Bình luận
Thêm một bình luận
Thêm một bình luận
Không có bình luận
  • Đã ghim