GEN-1.5 หุ่นยนต์เรียนงานใหม่จากการดูครั้งเดียว 3–12 วินาที — ความสามารถที่ไม่มีใครตั้งใจสร้าง
ที่ผ่านมาการสอนงานใหม่ให้หุ่นยนต์หนึ่งอย่างต้องใช้ตัวอย่างหลายร้อยครั้งและการฝึกซ้ำนับหมื่นรอบ แต่ Generalist AI เพิ่งเปิดตัวโมเดล GEN-1.5 ที่เรียนงานใหม่ได้จากการดูสาธิตเพียงครั้งเดียว ยาว 3–12 วินาที โดยไม่ต้องฝึกเพิ่มแม้แต่รอบเดียว สิ่งที่ทำให้เรื่องนี้น่าสนใจกว่าตัวเลข คือทีมผู้พัฒนาบอกเองว่า พวกเขาไม่ได้ตั้งใจสร้างความสามารถนี้ ทำงานอย่างไร GEN-1.5 เป็นโมเดลหลายรูปแบบขนาดใหญ่ที่รับข้อมูลเข้าได้ทั้งวิดีโอ สัญญาณเซนเซอร์ ภาษา และข้อมูลตำแหน่งข้อต่อของตัวเอง มีหน่วยความจำย้อนหลัง 30 วินาที และส่งคำสั่งการเคลื่อนไหวออกมาที่ความถี่ 100 ครั้งต่อวินาที วิธีสอนงานใหม่เรียกว่า physical prompting — ผู้ใช้ลากไฟล์ตัวอย่างการทำงานหนึ่งชิ้น ซึ่งประกอบด้วยข้อมูลเซนเซอร์และเส้นทางการเคลื่อนไหว ใส่เข้าไปในหน่วยความจำ 30 วินาทีนั้น พื้นที่ที่เหลือใช้เก็บภาพสิ่งที่หุ่นยนต์กำลังเห็นอยู่ จากนั้นหุ่นยนต์ก็ทำงานนั้นได้ทันที แนวคิดนี้เหมือนกับการที่เราพิมพ์ตัวอย่างให้ ChatGPT ดูหนึ่งตัวอย่างแล้วมันทำตามได้




