OpenAI ได้เปิดเผยรายละเอียดเพิ่มเติมเกี่ยวกับชิป Jalapeño ในงานประชุม Hot Chips โดยมีการนำเสนอผลการทดสอบประสิทธิภาพผ่านเกณฑ์มาตรฐาน InferenceX ของ SemiAnalysis ซึ่งผลลัพธ์ระบุว่าชิปดังกล่าวสามารถสร้างจำนวนโทเค็นต่อผู้ใช้ได้มากขึ้น และมีอัตราการประมวลผลต่อกิโลวัตต์ที่สูงกว่าโปรเซสเซอร์ระดับแนวหน้าที่มีอยู่ในปัจจุบัน
Richard Ho หัวหน้าฝ่ายฮาร์ดแวร์ของ OpenAI กล่าวว่า Jalapeño แสดงให้เห็นถึงความก้าวหน้าด้านประสิทธิภาพอย่างมีนัยสำคัญ โดยสามารถรองรับงาน AI ได้มากขึ้นต่อหน่วยพลังงาน ในขณะที่ยังคงรักษาความหน่วง (Latency) ที่ต่ำ ซึ่งถือเป็นหัวใจสำคัญในการให้บริการแก่ผู้ใช้งานจำนวนมาก
ทำไมเรื่องนี้จึงสำคัญ
การพัฒนาชิปของตนเองช่วยให้ OpenAI สามารถปรับแต่งฮาร์ดแวร์ให้สอดคล้องกับความต้องการเฉพาะของโมเดล AI ได้อย่างเต็มที่ โดยเฉพาะการจัดการกับ KV cache และการลดการเคลื่อนย้ายข้อมูล ซึ่งเป็นอุปสรรคสําคัญในการประมวลผล AI ขนาดใหญ่ ส่งผลให้ในอนาคตการให้บริการ AI อาจมีต้นทุนที่ต่ําลงและตอบสนองได้รวดเร็วยิ่งขึ้นสําหรับผู้ใช้งาน
มุมมอง Agent2Day
การที่ OpenAI ก้าวเข้าสู่การออกแบบฮาร์ดแวร์แบบ Full-stack สะท้อนให้เห็นว่าประสิทธิภาพของ AI ในยุคถัดไปไม่ได้ขึ้นอยู่กับตัวโมเดลเพียงอย่างเดียว แต่ยังรวมถึงการออกแบบสถาปัตยกรรมชิปที่สามารถจัดการกับคอขวดของการประมวลผลได้อย่างแม่นยํา ซึ่งจะเป็นตัวตัดสินความได้เปรียบในการแข่งขันในตลาด AI ที่มีการเปลี่ยนแปลงอย่างรวดเร็ว
ชิป Jalapeño เป็นผลงานการพัฒนาร่วมกับ Broadcom โดยมีการนำโมเดล AI ของ OpenAI มาช่วยในกระบวนการออกแบบ ซึ่งบริษัทตั้งเป้าให้เป็นแพลตฟอร์มแบบหลายเจเนอเรชันที่ผสานรวมทั้งโมเดล ชิป และหน่วยความจำเข้าด้วยกัน เพื่อลดปัญหาคอขวดในขั้นตอนการประมวลผล โดยเฉพาะการลดความล่าช้าในการเคลื่อนย้ายข้อมูลและการสื่อสารระหว่างการทำ Inference
ในด้านการใช้งานจริง OpenAI ระบุว่า Jalapeño จะเริ่มมีการใช้งานในปริมาณจำกัดช่วงปลายปี 2026 และจะขยายการใช้งานอย่างเต็มรูปแบบในปี 2027 อย่างไรก็ตาม ทางบริษัทตระหนักดีว่าเมื่อถึงเวลาที่ชิปพร้อมใช้งานในวงกว้าง คู่แข่งในตลาดอาจมีการพัฒนาเทคโนโลยีที่ก้าวหน้าขึ้นไปอีกขั้นเช่นกัน





