วันนี้ เวลา 02:09 • วิทยาศาสตร์ & เทคโนโลยี

ลาก่อน ChatGPT? ฉีกกฎ AI เดิมๆ Jev AI ตัวใหม่ที่ไม่ต้องพิมพ์คุยกับมนุษย์

ใครจะไปเชื่อว่าวันนึง คนที่ปั้นแชตบอตระดับโลกมากับมือ จะออกมายืดอกยอมรับว่าผลงานตัวเองทำเอาเขาอกหักอย่างจัง
เรื่องนี้ไม่ได้นั่งเทียนเขียนขึ้นมาเอง แต่เป็นคำพูด จาก Diogo Almeida อดีตนักวิจัยระดับท็อปจาก OpenAI
เขาคือหนึ่งในผู้ร่วมคิดค้นเทคนิค RLHF ที่สอนให้ AI คุยกับคนได้เนียนกริบเหมือนเพื่อนสนิท
พูดง่ายๆ คือเขาเป็นหนึ่งในเสาหลักที่จุดประกายยุคทองของ AI ที่เรากำลังบ้าคลั่งใช้งานกันอยู่นี่แหละครับ
แต่ท่ามกลางเสียงปรบมือและยอดผู้ใช้งานที่พุ่งทะยาน เขากลับมองเห็นรอยร้าวบางอย่างที่คนอื่นอาจจะมองข้ามไป…
เขาเปรียบเปรยให้ฟังว่าสิ่งที่วงการนี้ทำสำเร็จ มันเหมือนเราสามารถจับเอาสายฟ้าฟาดมาขังไว้ในขวดแก้วได้
พลังงานที่อยู่ในขวดมันมหาศาลมาก แต่มันกลับเอาไปใช้งานในชีวิตจริงโคตรยาก
ตลอดช่วงสี่ปีที่ผ่านมา วงการ AI เอาแต่หมกมุ่นกับการทำให้คอมพิวเตอร์เข้าใจและพูดภาษามนุษย์ให้เก่งที่สุด
ผลลัพธ์คือมันทำได้ดีจนน่าขนลุก แต่นั่นแหละคือหลุมพรางชิ้นโตที่ขัดขวางการไปสู่เป้าหมายที่แท้จริง…
เป้าหมายที่ว่าคือเรื่องของระบบอัตโนมัติ เพราะคอมพิวเตอร์มันไม่ได้คุยกันด้วยภาษาคนแบบที่เราคุยกัน
คอมพิวเตอร์มันคุยกันด้วยโค้ด ด้วยตัวเลข และด้วยข้อมูลที่มีโครงสร้างชัดเจนแบบเป๊ะๆ
เขาเลยตั้งคำถามว่า โมเดลพวกนี้แชตเก่งกว่ามนุษย์มาตั้งหลายปี แล้วไอ้ระบบอัตโนมัติที่สัญญากันไว้มันอยู่ไหนล่ะ
เขาเคยเชื่อหมดใจว่าโมเดลแชตพวกนี้จะนำพาเราไปสู่จุดสูงสุดของเทคโนโลยี แต่พอเวลาผ่านไป สิ่งที่ขาดหายก็เริ่มชัดเจน…
เมื่อเห็นปัญหาที่ไม่มีใครกล้าลุกขึ้นมาแก้ เมื่อสองปีที่แล้วเขาเลยตัดสินใจทิ้งเก้าอี้แสนสบายที่ OpenAI
เขาออกมาก่อตั้งสตาร์ทอัปของตัวเองที่ชื่อว่า Typesafe AI พร้อมกับเงินทุนในกระเป๋า 40 ล้านดอลลาร์สหรัฐ
พวกเขาปิดห้องซุ่มเงียบพัฒนาเทคโนโลยีระดับเทพอยู่ถึงสองปีเต็ม ก่อนจะเปิดประตูปล่อยของเด็ดออกมาให้โลกเห็น
สิ่งที่พวกเขาเปิดตัวคือโมเดลที่ชื่อว่า Jev ซึ่งถูกวางตัวให้เป็น “System 1” ตัวแรกของวงการ…
1
Jev ไม่ใช่แค่โมเดลธรรมดาทั่วไป แต่มันคือโมเดลระดับ Frontier ที่เกิดมาเพื่อการตัดสินใจที่รวดเร็ว
ความพีกมันอยู่ตรงที่ ถึงมันจะสร้างบนสถาปัตยกรรม Transformer เหมือนโมเดลดังๆ ทั่วไป แต่มันไม่ใช่ LLM
เวลากดสั่งงาน มันจะไม่พ่นข้อความยาวเหยียดมาให้เราอ่านแบบที่คุ้นเคยกันในแชตบอตทั่วไป
แต่มันจะโยนค่าความน่าจะเป็น หรือสิ่งที่บริษัทเรียกว่า Calibrated Confidence หรือค่าความเชื่อมั่นที่ผ่านการปรับเทียบแล้วออกมาแทน…
Diogo เรียกแนวคิดสุดล้ำนี้ว่า “Machine Native AI” ซึ่งมีปรัชญาเบื้องหลังที่น่าสนใจมาก
เขาบอกว่าถ้า AI จะเข้ามาเปลี่ยนโลกจริงๆ ซอฟต์แวร์และคอมพิวเตอร์ก็ต้องใช้ประโยชน์จากมันได้เต็มที่ด้วย
ลองนึกภาพตามง่ายๆ ปกติเราโยนประโยคดิบๆ เข้าไปในระบบ เช่น มีลูกค้าบ่นว่าบัตรเครดิตโดนรูดสองรอบ
แล้วเราก็ใช้คำสั่งพื้นฐานถามระบบไปว่า ควรส่งเคสวุ่นวายนี้ไปให้แผนกไหนดูแลจัดการดี…
ผลลัพธ์ที่ได้จาก Jev จะไม่ใช่ประโยคตอบกลับยืดยาวแบบที่เราเคยเจอในยุคก่อน
แต่มันจะส่งตัวเลขกลับมาตรงๆ เลยว่า โอกาสเป็นแผนกบิลลิ่ง 0.08 แผนกเทคนิค 0.85 และแผนกเซลส์ 0.07
ข้อมูลตัวเลขลุ่นๆ แบบนี้ คนทั่วไปอ่านแล้วอาจจะเกาหัวว่าเอาไปทำอะไรได้
แต่วิศวกรซอฟต์แวร์เห็นแล้วต้องร้องว้าว เพราะมันสามารถเอาไปเขียนโค้ดผูกเงื่อนไขต่อได้ทันทีแบบไม่ต้องคิดเยอะ…
ตรงนี้แหละที่กลายมาเป็นชื่อของบริษัท คำว่า Type Safety ในวงการโปรแกรมเมอร์มีความหมายลึกซึ้ง
มันคือวิธีป้องกันไม่ให้มีข้อมูลประหลาดๆ หลุดเข้ามาทำระบบพังพินาศ
สำหรับ Jev ผู้ใช้งานสามารถล็อกโครงสร้างผลลัพธ์ไว้ล่วงหน้าได้เลยแบบเบ็ดเสร็จ
ทำให้โมเดลไม่มีทางพ่นอะไรที่อยู่นอกเหนือโครงสร้างนั้นออกมาเด็ดขาด หมดปัญหาเรื่องข้อมูลขยะ…
ลองคิดดูว่าถ้าเราใช้ LLM ทั่วไปทำระบบอัตโนมัติ ผลลัพธ์มันจะคาดเดายากขนาดไหน
บางทีก็ตอบตรงคำถาม บางทีก็พ่นโค้ดมั่วซั่ว หรือบางทีก็เกิดอาการหลอนข้อมูลขึ้นมาหน้าตาเฉย
การต้องมานั่งเขียนโค้ดดักจับความไม่แน่นอนพวกนี้มันกินพลังงานและเปลืองเวลาชีวิตวิศวกรมาก
Typesafe เลยเคลมว่าโมเดลของพวกเขาไม่มีวันเกิดอาการข้อมูลหลอน (Hallucination) โดยเด็ดขาด…
แถมยังสามารถทำงานตรรกะระดับ “System 1” ได้เทียบเท่ากับโมเดลยักษ์ใหญ่ แต่เร็วกว่าหลักร้อยเท่า
เบื้องหลังความเทพนี้คือเทคนิคการเทรนลับเฉพาะที่เรียกว่า RLCD ซึ่งสร้างมาเพื่อท้าชนกับ RLHF โดยเฉพาะ
โมเดลทั่วไปจะค่อยๆ พ่นคำออกมาทีละคำ เรียงต่อกันไปเรื่อยๆ เหมือนคนกำลังคิดไปพูดไป
แต่ Jev ใช้วิธีประมวลผลตู้มเดียวจบในการเรียกฮาร์ดแวร์แค่ครั้งเดียว ไม่ต้องมารอเรียงประโยคให้เสียเวลา…
ผลที่ได้คือความเร็วระดับปีศาจ โมเดลตัวท็อปในตลาดอาจใช้เวลา 3 ถึง 329 วินาทีในการตอบคำถาม
แต่ Jev ใช้เวลาแค่ 70 ถึง 500 มิลลิวินาที ซึ่งคำนวณแล้วเร็วกว่ากันแบบ 40 ถึง 200 เท่า
เรื่องราคายิ่งไม่ต้องพูดถึง มันถูกจนแทบจะเหมือนแจกฟรีให้เอาไปใช้กันเลยทีเดียว
LLM ทั่วไปคิดค่าบริการแพงหูฉี่ แต่ Jev คิดแค่ 42 ดอลลาร์สหรัฐต่อข้อมูลพันล้าน Tokens…
แถมฝั่งส่งออกเขาก็ให้ใช้ฟรีๆ ไปเลย ด้วยเหตุผลว่าต้นทุนมันต่ำเกินกว่าจะเอามานั่งคิดเงิน
อีกเรื่องที่วงการไอทีมองว่าเป็นตัวเปลี่ยนเกมคือเรื่องของความมั่นใจ
ปกติแล้ว LLM มักจะมีความมั่นใจในตัวเองสูงปรี๊ดเสมอ แม้ว่าคำตอบนั้นจะผิดเต็มประตูก็ตาม
ถ้าเรามี AI ที่ทำงานถูก 95 เปอร์เซ็นต์ แต่ไม่รู้เลยว่ามันจะพลาดตอนไหน เราก็เอามันไปรันอัตโนมัติไม่ได้…
แต่ความมั่นใจของ Jev ผ่านการปรับเทียบมาอย่างดีเยี่ยม ตัวเลขความมั่นใจสูง แปลว่าแม่นยำสูงจริงๆ
มันเหมือนเป็นการผลักอำนาจการตัดสินใจกลับมาให้อยู่ในมือของวิศวกรผู้ใช้งานอีกครั้ง
ถ้าโมเดลบอกว่ามั่นใจแค่ 50 เปอร์เซ็นต์ เราก็แค่เซตโปรแกรมให้ข้ามเคสนั้นไปก่อน
แต่ถ้ามันบอกว่ามั่นใจ 95 เปอร์เซ็นต์ เราก็ปล่อยให้ระบบวิ่งอัตโนมัติไปได้เลยแบบชิลๆ ไร้กังวล…
แน่นอนว่าการออกมาเคลมแรงระดับนี้ Typesafe ก็รู้ตัวดีว่าต้องมีคนหมั่นไส้และคอยจับผิดอย่างแน่นอน
พวกเขาเลยกางหลักฐานให้ดูแบบโปร่งใส เผยแพร่วิธีการประเมินผลเวิร์กโฟลว์แบบไม่มีหมกเม็ด
เพื่อพิสูจน์ความเจ๋ง ทีมงานถึงขั้นสร้างบอตขึ้นมาให้เล่นเกม Doom แบบโชว์ความเก๋า
บอตตัวนี้อ่านสถานการณ์ในเกมเป็นข้อความล้วนๆ แล้วประมวลผลตัดสินใจรัวๆ 10 ครั้งต่อวินาที…
กระแสตอบรับหลังการเปิดตัวถือว่าถล่มทลายมาก จนระบบ API ของบริษัทถึงกับล่มไปพักหนึ่งเลย
นักพัฒนาจากบริษัทชื่อดังอย่าง Vercel ลองเอา Jev ไปเสียบแทนโมเดลเดิมที่ใช้อยู่
ปรากฏว่าได้ผลลัพธ์เร็วกว่าและแม่นยำกว่าถึง 18 เท่า ซึ่งเล่นเอาตะลึงกันไปทั้งบาง
ข้อมูลชี้ว่า Jev กลายเป็นโมเดลที่มียอดผู้ใช้งานเสียเงินเติบโตเร็วที่สุดในประวัติศาสตร์ของ Gateway แซงหน้าโมเดลตัวท็อปไปแบบไม่เห็นฝุ่น…
คำถามตัวโตๆ คือข้างในโมเดลตัวนี้มันซ่อนความลับอะไรไว้กันแน่
Diogo ปิดปากเงียบเรื่องโครงสร้าง แต่บอกใบ้ว่ามันถูกฝึกสอนด้วยข้อมูลสังเคราะห์ล้วนๆ ร้อยเปอร์เซ็นต์
เขาบอกเลยว่าการสร้างข้อมูลสังเคราะห์ขึ้นมาเทรนโมเดลเองทั้งหมด คือการเดิมพันที่คุ้มค่าที่สุดในชีวิต
เขาเชื่อมั่นว่าการปรับแต่งโมเดลให้ตรงกับลักษณะของงานที่ทำ คือสิ่งที่สำคัญที่สุด…
มันสำคัญกว่าการประเคนข้อมูลและพลังคอมพิวเตอร์ใส่เข้าไปแบบไม่ลืมหูลืมตาเสียอีก
เทคนิคดั้งเดิมอย่าง RLHF มันดีแค่ตอนทำแชตบอตไว้คุยเล่น แต่มันพังพินาศเมื่อต้องเอามาทำระบบอัตโนมัติ
เป้าหมายสูงสุดของเขาไม่ใช่การสร้างพระเจ้าในศูนย์ข้อมูล หรือผลาญเงินนักลงทุนไปวันๆ
แต่เขาต้องการสร้างโครงสร้างพื้นฐานด้าน AI ที่ซอฟต์แวร์ทั่วโลกสามารถดึงไปใช้งานได้แบบถูกและเสถียรที่สุด…
หนทางของ Typesafe AI เพิ่งจะเริ่มต้นขึ้นเท่านั้น
และแน่นอนว่าในอนาคตอันใกล้ ย่อมมีคู่แข่งยักษ์ใหญ่กระโดดลงมาฟาดฟันในสมรภูมินี้แน่นอน
แต่การกล้าคิดต่างและมองเห็นปัญหาที่คนอื่นมองข้าม ก็ทำให้พวกเขาชิงความได้เปรียบไปแล้ว
เรื่องราวทั้งหมดนี้คงต้องรอดูกันยาวๆ ว่าวงการซอฟต์แวร์จะเปลี่ยนโฉมไปทิศทางไหน
ถ้าใครมีไอเดียว่าอยากเอาโมเดลล้ำๆ แบบนี้ไปเชื่อมต่อทำอะไรเจ๋งๆ ซักอย่าง ลองเอาไปคิดต่อยอดกันดูได้นะครับเผื่อได้ไอเดียธุรกิจใหม่ๆ กัน
References : [techcrunch, theregister, vercel, openai, typesafe]
=========================
😴 นอนไม่หลับ? 😴 หลับไม่สนิท?
=========================
ใครที่มีปัญหานอนไม่สนิท ตื่นมาแล้วเพลียเหมือนผมบ้างครับ ผมอยากแนะนำ Diip CBD ที่มีทั้งแบบกัมมี่และแคปซูล
พอดีผมได้ลองใช้เองมาเพียงแค่อาทิตย์แรก บอกเลยว่าชีวิตเปลี่ยน ปัญหาเรื่องการนอนหมดไปเลยครับ สนใจแอดไลน์ @diipgeek มีผู้เชี่ยวชาญดูแลคอยปรึกษาตลอด 24 ชั่วโมง หรือคลิกลิงก์ใน Comment ได้เลยครับ
The original article appeared here https://www.tharadhol.com/goodbye-chatgpt/
ติดตามสาระดี ๆ อัพเดททุกวันผ่าน Line OA ด.ดล Blog
คลิกเลย --> https://lin.ee/aMEkyNA
——————————————––
ติดตาม ด.ดล Blog เพิ่มเติมได้ที่
=========================
โฆษณา