OpenAI tiết lộ ASIC Jalapeño tối ưu cho inference, nhấn mạnh lợi ích của thiết kế nội bộ
OpenAI Jalapeño design interview transcript

Tóm tắt nhanh
- OpenAI trình làng ASIC inference tên Jalapeño tại Hot Chips tháng 8/2026, với thời gian thiết kế ngắn nhờ ứng dụng AI trong quy trình.
- Richard Ho, VP Hardware OpenAI, nói mục tiêu chính của chip là tối ưu hiệu suất điện năng (efficiency) để giải quyết giới hạn compute trong datacenter.
- Jalapeño tập trung vào inference vì chi phí và trải nghiệm người dùng (độ trễ) chủ yếu nằm ở khâu này, không phải training.
- Chip cung cấp cả chế độ độ trễ thấp cho ứng dụng cần phản hồi nhanh và chế độ throughput cao để giảm chi phí inference.
- OpenAI chọn tự phát triển ASIC để tận dụng cơ hội co-design giữa phần cứng, phần mềm và mô hình AI mà khó đạt được với nhà sản xuất bên thứ ba.
- Theo Ho, làm việc nội bộ cho phép đội phần cứng truy cập đầy đủ IP nghiên cứu và toàn bộ stack để cân bằng tối ưu giữa model, compiler và hardware.
- Ho cảnh báo rằng không thể chia sẻ rộng rãi IP mô hình với bên thứ ba vì rủi ro rò rỉ dù có NDA.
- Kết quả của thiết kế toàn stack là khả năng đưa tối ưu cần thiết vào compiler và stack để làm cho phần cứng đạt hiệu năng cho mục tiêu ứng dụng của OpenAI.
- Tom's Hardware thực hiện phỏng vấn toàn văn với Richard Ho, bài được chỉnh sửa để dễ đọc và mở miễn phí trong thời gian giới hạn trên Tom's Hardware Premium.
Tóm tắt tự động bằng AI từ bài gốc, có thể có sai sót. Hãy kiểm chứng ở bài gốc.
Trích đoạn bài gốc
We sit down with OpenAI's Hardware boss to talk about its chart-topping Jalapeño inference chip in this unredacted interview transcript.Tapview chỉ hiển thị tiêu đề, trích đoạn ngắn, tóm tắt và đường dẫn tới bài gốc. Nội dung gốc thuộc bản quyền của Tom's Hardware.





