27 ส.ค. เวลา 08:05 • ไอที & แก็ดเจ็ต

NVIDIA เริ่มผลิต Groq 3 LPX เต็มรูปแบบ ชิป Inference เร่ง Agentic AI ที่ 3,400 Token ต่อวินาที

NVIDIA ประกาศว่า Groq 3 LPX ตัวเร่งการประมวลผล AI Inference สำหรับงานที่ต้องการการโต้ตอบแบบทันที ได้เข้าสู่สายการผลิตเต็มรูปแบบแล้ว พร้อมทำสถิติสร้าง Output Token ได้ 3,400 Token ต่อวินาทีในการทดสอบของ Artificial Analysis
NVIDIA ประกาศเรื่องนี้ในงาน Hot Chips โดย NVIDIA Groq 3 LPX เป็นส่วนขยายของแพลตฟอร์ม NVIDIA Vera Rubin ที่เข้ามาเพิ่มอัตราการสร้าง Token ให้สูงขึ้นอย่างมีนัยสำคัญ เหตุผลอยู่ที่ระบบ Agentic AI ต้องสร้าง Token ปริมาณมหาศาลผ่านขั้นตอน Inference นับร้อยจนถึงนับพันครั้งกว่าจะทำงานหนึ่งชิ้นให้เสร็จ
ความเร็วในการสร้าง Token จึงกลายเป็นตัวชี้ขาดว่า AI Agent จะประมวลผล ตัดสินใจ และลงมือทำงานที่ซับซ้อนได้ทันเวลาหรือไม่ ขณะที่ Vera Rubin NVL72 เป็นแพลตฟอร์มที่รองรับได้ทั้งงาน Training และ Inference สำหรับ AI Factory
โฆษณา