NVIDIA ประกาศเรื่องนี้ในงาน Hot Chips โดย NVIDIA Groq 3 LPX เป็นส่วนขยายของแพลตฟอร์ม NVIDIA Vera Rubin ที่เข้ามาเพิ่มอัตราการสร้าง Token ให้สูงขึ้นอย่างมีนัยสำคัญ เหตุผลอยู่ที่ระบบ Agentic AI ต้องสร้าง Token ปริมาณมหาศาลผ่านขั้นตอน Inference นับร้อยจนถึงนับพันครั้งกว่าจะทำงานหนึ่งชิ้นให้เสร็จ
ความเร็วในการสร้าง Token จึงกลายเป็นตัวชี้ขาดว่า AI Agent จะประมวลผล ตัดสินใจ และลงมือทำงานที่ซับซ้อนได้ทันเวลาหรือไม่ ขณะที่ Vera Rubin NVL72 เป็นแพลตฟอร์มที่รองรับได้ทั้งงาน Training และ Inference สำหรับ AI Factory