DeepSeek ได้เปิดตัวโมเดลปัญญาประดิษฐ์รุ่นทดลองตัวใหม่ในชื่อ V4 Flash Vision Exp ซึ่งเป็นเวอร์ชัน Multimodal ที่สามารถทำความเข้าใจและประมวลผลข้อมูลผ่านการมองเห็น (Visual Prompts) ได้ โดยทางบริษัทระบุว่าโมเดลรุ่นนี้มีประสิทธิภาพในการทดสอบด้าน Multimodal Agentic ใกล้เคียงกับโมเดล Opus 4.8 ของคู่แข่งอย่าง Anthropic
โมเดลรุ่นใหม่นี้ถูกพัฒนาขึ้นบนพื้นฐานของ V4 Flash โดยยังคงความสามารถด้านข้อความ การใช้ Agent การให้เหตุผล และความรู้รอบตัวไว้อย่างครบถ้วน นอกจากนี้ยังรองรับการทำงานร่วมกับเฟรมเวิร์กของ Agent ต่างๆ เพื่อช่วยให้ผู้ใช้งานสามารถสร้างเวิร์กโฟลว์ที่ซับซ้อนและมีประสิทธิภาพมากขึ้นผ่านการผสมผสานความเข้าใจด้านภาพเข้ากับเครื่องมือต่างๆ
ในด้านการใช้งาน DeepSeek ได้เปิดให้เข้าถึงโมเดลดังกล่าวผ่านทาง API Platform แล้ว โดยมีการรองรับการส่งข้อมูลทั้งในรูปแบบข้อความและรูปภาพ ซึ่งรูปภาพจะถูกแปลงเป็นโทเค็นสำหรับการคิดค่าบริการตามราคาของ V4 Flash นอกจากนี้ยังมีการเปิดตัว Files API เพื่อให้ผู้ใช้งานสามารถอัปโหลดรูปภาพและอ้างอิงผ่าน file_id ช่วยลดการใช้แบนด์วิดท์ในการส่งข้อมูลซ้ำในแต่ละคำสั่ง
การเคลื่อนไหวครั้งนี้ถือเป็นก้าวสำคัญของ DeepSeek ในการขยายขีดความสามารถของโมเดลให้รองรับงานที่หลากหลายมากขึ้น โดยบริษัทระบุว่าจะยังคงเดินหน้าพัฒนาโมเดลอย่างต่อเนื่องและเปิดรับฟังความคิดเห็นจากผู้ใช้งานเพื่อนำไปปรับปรุงประสิทธิภาพของระบบต่อไปในอนาคต





