ข่าว AI และเทคโนโลยี

Nvidia ประกาศเดินหน้าผลิต Groq 3 LPX เต็มรูปแบบ ทำความเร็วสูงสุด 3,400 โทเค็นต่อวินาที

Nvidia ยืนยันการผลิต Groq 3 LPX อย่างเต็มรูปแบบ พร้อมโชว์ประสิทธิภาพการประมวลผล AI Inference ที่ทำความเร็วได้ถึง 3,400 โทเค็นต่อวินาที

Nvidia ประกาศเดินหน้าผลิต Groq 3 LPX เต็มรูปแบบ ทำความเร็วสูงสุด 3,400 โทเค็นต่อวินาที

ฟังบทความ

Nvidia ประกาศว่า Groq 3 LPX ซึ่งเป็นตัวเร่งความเร็วสำหรับการประมวลผล AI Inference (AI Inference Accelerator) ได้เข้าสู่กระบวนการผลิตเต็มรูปแบบแล้ว โดยถือเป็นผลลัพธ์สำคัญจากการเข้าซื้อกิจการเทคโนโลยี LPU ของ Groq ที่ผ่านมา

จากการทดสอบประสิทธิภาพโดย Artificial Analysis พบว่า Groq 3 LPX สามารถทำความเร็วได้สูงถึง 3,400 โทเค็นต่อวินาที ในการรันโมเดล Gemma 4 31B โดยใช้ลำดับข้อมูลนำเข้า (Input Sequence) ขนาด 100,000 โทเค็น ซึ่งถือเป็นก้าวสำคัญในการเพิ่มขีดความสามารถด้านความเร็วในการสร้างโทเค็น

ทำไมเรื่องนี้จึงสำคัญ

การที่ Groq 3 LPX เข้าสู่การผลิตเต็มรูปแบบและทําความเร็วได้สูงถึง 3,400 โทเค็นต่อวินาที ส่งผลโดยตรงต่อผู้ให้บริการคลาวด์และองค์กรที่ต้องการพัฒนา Agentic AI ที่ซับซ้อน ซึ่งต้องการความเร็วในการตอบสนองที่รวดเร็วขึ้นอย่างมาก เพื่อรองรับการใช้งานในระดับอุตสาหกรรม

มุมมอง Agent2Day

ความสําเร็จของ Groq 3 LPX สะท้อนให้เห็นว่า Nvidia ไม่ได้เป็นเพียงผู้ผลิต GPU เท่านั้น แต่กําลังขยายขอบเขตสู่การเป็นผู้ให้บริการโซลูชันโครงสร้างพื้นฐาน AI แบบครบวงจรที่เน้นความเร็วในการประมวลผล Inference เป็นหัวใจสําคัญในการขับเคลื่อนยุคถัดไปของ AI

ในด้านการใช้งานจริง Nebius ได้กลายเป็นลูกค้ารายแรกที่นำ Groq 3 LPX เข้าสู่ระบบคลาวด์ของตนเอง นอกจากนี้ Nvidia ยังได้เปิดตัว CPU รุ่น Vera ซึ่งออกแบบมาเพื่อรองรับการทำงานของ Agentic AI โดยเฉพาะ โดย SpaceXAI ได้เลือกนำ CPU Vera ไปใช้งานเพื่อเพิ่มประสิทธิภาพการประมวลผลในระดับขนาดใหญ่

การดำเนินงานครั้งนี้ยังได้รับความร่วมมือจากพันธมิตรอย่าง Dell Technologies ที่เข้ามามีส่วนร่วมในการติดตั้งและปรับใช้ Groq 3 LPX เพื่อรองรับความต้องการของตลาด AI ที่กำลังเติบโตอย่างรวดเร็ว โดยระบบนี้จะถูกนำไปใช้ควบคู่กับโครงสร้างพื้นฐานอย่าง Vera Rubin NVL72 เพื่อสร้างสภาพแวดล้อมการประมวลผล AI ที่ทรงพลังยิ่งขึ้น