General Intuition สตาร์ทอัพด้าน AI กำลังมองว่าวงการหุ่นยนต์กำลังจะก้าวเข้าสู่ยุคใหม่ที่คล้ายคลึงกับช่วงเวลาที่ OpenAI เปิดตัว GPT-3 ซึ่งเป็นโมเดลภาษาขนาดใหญ่ (LLM) ที่พลิกโฉมอุตสาหกรรม AI ด้านภาษาธรรมชาติ พิม เดอ วิตต์ ซีอีโอของ General Intuition กล่าวว่า แทนที่จะสร้างโมเดลเฉพาะทางสำหรับหุ่นยนต์แต่ละประเภทและแต่ละสภาพแวดล้อม อุตสาหกรรมควรหันมาพัฒนาโมเดลพื้นฐาน (foundation models) ที่มีคุณภาพสูง ซึ่งสามารถถ่ายทอดความเข้าใจเกี่ยวกับการเคลื่อนไหวและการโต้ตอบในสภาพแวดล้อมที่หลากหลายได้
เดอ วิตต์ อธิบายว่า บริษัทจำนวนมากในปัจจุบันกำลังทำงานเฉพาะทางที่มุ่งเน้นไปที่หุ่นยนต์แต่ละตัว สภาพแวดล้อมแต่ละแบบ และการใช้งานเฉพาะอย่าง ซึ่งงานเหล่านี้ส่วนใหญ่จะกลายเป็นสิ่งซ้ำซ้อนในไม่ช้า เมื่อมีโมเดลทั่วไป เช่น โมเดลที่ General Intuition กำลังพัฒนาและนำไปใช้งาน เขาเน้นย้ำว่า "การทำให้โมเดลมีความสามารถในการปรับตัวได้เองคือผลิตภัณฑ์" และความสามารถในการให้เหตุผลเกี่ยวกับพื้นที่และเวลาในระดับพื้นฐาน จะทำให้ผู้คนไม่ต้องเสียเวลาเก็บข้อมูลจริงจำนวนมหาศาลอีกต่อไป เพราะอาจต้องการเพียงข้อมูลไม่กี่นาทีเท่านั้น
General Intuition ได้สร้างโมเดลพื้นฐานของตนเองขึ้นมา โดยฝึกฝนจากข้อมูลวิดีโอเกมหลายล้านชั่วโมง ซึ่งรวมถึงข้อมูลการกดปุ่มบนคอนโทรลเลอร์และเวลาที่กด ทั้งเดอ วิตต์ และ วินอด โคสลา นักลงทุนรายใหญ่ของบริษัท เชื่อว่าข้อมูลการกระทำเหล่านี้เป็นกุญแจสำคัญในการพัฒนาสัญชาตญาณที่คล้ายมนุษย์สำหรับการให้เหตุผลเชิงพื้นที่-เวลา สตาร์ทอัพนี้เพิ่งระดมทุนได้ 320 ล้านดอลลาร์ ด้วยมูลค่าบริษัท 2.3 พันล้านดอลลาร์ จากแนวคิดดังกล่าว
บริษัทได้แสดงให้เห็นแล้วว่าโมเดลปัจจุบันของพวกเขาสามารถเล่นวิดีโอเกมได้นานหลายชั่วโมง และยังสามารถขับเคลื่อนหุ่นยนต์สี่ขาได้ หลังจากปรับแต่งด้วยข้อมูลหุ่นยนต์จริงเพียงแปดนาทีเท่านั้น เดอ วิตต์ กล่าวว่า ความสามารถของหุ่นยนต์ในการทำงานแบบ zero-shot โดยใช้เพียงกล้องหน้าและไม่มีเซ็นเซอร์อื่น ๆ ในสำนักงานที่มีวัตถุเคลื่อนไหวและผู้คนเดินผ่านไปมานั้น เป็นเรื่องที่น่าประหลาดใจอย่างยิ่ง และเป็นสัญญาณของสิ่งที่กำลังจะมาถึง เป้าหมายสูงสุดของ General Intuition ไม่ใช่การสร้างหุ่นยนต์ด้วยตนเอง แต่เป็นการเป็นโมเดลพื้นฐานสำหรับ AI ทางกายภาพ (physical AI) เพื่อให้บริษัทหุ่นยนต์อื่น ๆ นำไปต่อยอดสำหรับเครื่องจักรของตนเอง





