🌶️ OpenAI ra mắt chip Jalapeño: Giảm 50% chi phí inference AI

🌶️ OpenAI ra mắt chip Jalapeño: Giảm 50% chi phí inference AI

OpenAI vừa hé lộ chip tự chế đầu tiên của mình và con số gây sốc nhất không phải là tốc độ xử lý, mà là mức tiết kiệm chi phí lên đến 50% so với GPU NVIDIA hiện tại.

🔥 Jalapeño là gì và tại sao nó quan trọng

Jalapeño là chip inference tùy chỉnh do OpenAIBroadcom cùng phát triển, công bố ngày 24/6/2026. Chip này được thiết kế chuyên biệt để chạy các mô hình AI đã huấn luyện sẵn, tức là xử lý từng yêu cầu của người dùng ChatGPT hay các sản phẩm khác của OpenAI theo thời gian thực. Đây là ASIC kích thước reticle, một trong những chip đơn lớn nhất về mặt vật lý có thể sản xuất được.

⚡ Hiệu suất ngang NVIDIA Blackwell, chi phí thấp hơn một nửa

Kết quả thử nghiệm sớm cho thấy Jalapeño đạt hiệu suất tương đương chip NVIDIA Blackwell và TPU của Google, nhưng tiêu tốn chi phí inference thấp hơn ~50% trên mỗi token so với GPU thế hệ hiện tại. Kiến trúc chip giảm thiểu di chuyển dữ liệu và cân bằng tài nguyên tính toán, bộ nhớ, mạng để đạt mức sử dụng thực tế sát với giới hạn lý thuyết hơn nhiều so với GPU đa dụng.

🏗️ 9 tháng từ ý tưởng đến tape-out

Từ khi bắt đầu thiết kế đến khi hoàn thành tape-out chỉ mất 9 tháng, chu kỳ phát triển ASIC nhanh nhất từng ghi nhận trong lĩnh vực bán dẫn tiên tiến. OpenAI dùng chính các mô hình AI của mình để tăng tốc quá trình thiết kế và tối ưu hóa chip. Broadcom đảm nhận phần triển khai silicon, còn Celestica xử lý bo mạch, rack và hệ thống. Quan hệ đối tác này được thông báo chính thức từ tháng 10/2025.

📅 Lộ trình triển khai và mục tiêu dài hạn

Cuối 2026: prototype quy mô nhỏ đầu tiên chạy thực tế. Năm 2027: bắt đầu mở rộng quy mô. Nửa đầu 2028: vận hành toàn tốc. Mục tiêu xa hơn là triển khai trung tâm dữ liệu quy mô gigawatt cùng Microsoft và các đối tác khác. Phần huấn luyện mô hình nặng vẫn dùng GPU NVIDIA, nhưng inference, vốn chiếm phần lớn chi phí vận hành hàng ngày, sẽ chuyển dần sang Jalapeño.

🧩 Tại sao OpenAI tự làm chip thay vì tiếp tục mua NVIDIA

OpenAI chạy hàng tỷ yêu cầu inference mỗi ngày. Ở quy mô đó, 50% tiết kiệm chi phí không phải là con số trên giấy mà là hàng trăm triệu USD mỗi năm. Google có TPU, Amazon có Trainium và Inferentia, giờ OpenAI tự xây chip riêng để chủ động kiểm soát toàn bộ stack từ phần cứng đến sản phẩm. Greg Brockman, Chủ tịch OpenAI, nói rõ: mục tiêu là hiểu sâu workload của mình và xây thứ có thể đẩy giới hạn xa hơn.

Bạn nghĩ Jalapeño có thay đổi được cuộc chơi chip AI hay NVIDIA vẫn giữ ngôi vương? Chia sẻ góc nhìn của bạn bên dưới.

#OpenAI #Jalapeño #AIChip #VibeAICoder #Broadcom

Bài viết liên quan

🌶️ OpenAI ra mắt chip Jalapeño: Giảm 50% chi phí inference AI | Vibe AI Coder