ข่าว AI และเทคโนโลยี

กูเกิลเปิดตัว DiffusionGemma โมเดลทำนายข้อความทีละบล็อค เร็วขึ้นกว่าเดิม 4 เท่า

กูเกิลเปิดตัว DiffusionGemma โมเดลภาษาแบบเปิดรุ่นทดลองที่ใช้เทคนิค Text Diffusion ในการสร้างข้อความทีละบล็อค แทนการทำนายทีละคำแบบเดิม ส่งผลให้ประมวลผลเร็วขึ้นถึง 4 เท่า และสามารถรันบนจีพียูสำหรับผู้บริโภคทั่วไปได้

กูเกิลเปิดตัว DiffusionGemma โมเดลทำนายข้อความทีละบล็อค เร็วขึ้นกว่าเดิม 4 เท่า

ฟังบทความ

กูเกิลเปิดตัว "DiffusionGemma" โมเดลภาษาแบบเปิดตัวใหม่ล่าสุดในรูปแบบทดลอง โดยนำเทคนิค Text Diffusion มาใช้งาน ซึ่งใช้วิธีปิดบางส่วนของข้อความแล้วคาดเดาผลลัพธ์พร้อมกันทีเดียว แตกต่างจากโมเดลตระกูล Transformer ดั้งเดิมที่ต้องสร้างข้อความทีละโทเค็น ทำให้การประมวลผลมีประสิทธิภาพสูงและรวดเร็วขึ้นอย่างก้าวกระโดด\n\nด้วยเทคนิคใหม่นี้ช่วยให้ DiffusionGemma ทำงานได้เร็วขึ้นสูงสุดถึง 4 เท่าเมื่อเทียบกับโมเดล Gemma รุ่นมาตรฐาน โดยสามารถสร้างข้อความได้พร้อมกันทีเดียวครั้งละ 256 โทเค็น และสามารถทำความเร็วได้มากกว่า 1,000 โทเค็นต่อวินาทีเมื่อรันบนจีพียูระดับองค์กรอย่าง NVIDIA H100\n\nตัวโมเดลมีขนาดพารามิเตอร์ 26B บนสถาปัตยกรรมแบบ Mixture of Experts (MoE) ซึ่งขณะทำงานจริงจะเรียกใช้พารามิเตอร์เพียง 3.8B เท่านั้น ทำให้ใช้หน่วยความจำ VRAM เพียง 18GB นอกจากนี้กูเกิลยังจับมือกับ NVIDIA เพื่อปรับแต่งโมเดลให้ทำงานได้ดีเยี่ยมบนจีพียูระดับคอนซูเมอร์อย่าง RTX 5090 และ RTX 4090 อีกด้วย\n\nอย่างไรก็ดี กูเกิลยอมรับว่าคุณภาพผลลัพธ์ของ DiffusionGemma ยังเป็นรอง Gemma 4 รุ่นมาตรฐาน เนื่องจากเน้นพัฒนาเรื่องความเร็วในการประมวลผลเป็นหลัก ดังนั้น หากผู้ใช้งานต้องการเน้นคุณภาพของเนื้อหาที่ละเอียดและแม่นยำสูง ทางกูเกิลยังคงแนะนำให้เลือกใช้งาน Gemma 4 รุ่นมาตรฐานจะเหมาะสมกว่า