30 ส.ค. 2024 เวลา 15:30 • ไอที & แก็ดเจ็ต

Alibaba Cloud เปิดตัวโมเดล AI Qwen2-VL

โดย
Alibaba Cloud ได้เปิดตัวโมเดลภาษาขนาดใหญ่ (LLM) รุ่นใหม่ล่าสุด Qwen2-VL ซึ่งเป็นการพัฒนาต่อยอดมาจากโมเดล Qwen2 โดยมีจุดเด่นที่ความสามารถในการ ทำความเข้าใจภาพและวิดีโอ ได้เป็นอย่างดี
  • ​จุดเด่น
○ เข้าใจภาพได้หลากหลาย สามารถประมวลผลภาพที่มีความละเอียดและสัดส่วนแตกต่างกันได้อย่างมีประสิทธิภาพ
○ สรุปวิดีโอได้ยาว
สามารถสรุปเนื้อหาของวิดีโอที่มีความยาวสูงสุดถึง 20 นาที ได้ทั้งการตอบคำถามเกี่ยวกับเนื้อหา หรือสรุปบทสนทนาในวิดีโอนั้น
1
○ รองรับหลายภาษา
นอกจากภาษาอังกฤษแล้ว ยังรองรับภาษาอื่นๆ อีกมากมาย เช่น ภาษาในทวีปยุโรป ญี่ปุ่น เกาหลี อาหรับ และเวียดนาม
  • ​ประโยชน์
○ สมาร์ทโฟน
ช่วยให้สมาร์ทโฟนสามารถเข้าใจสิ่งที่ผู้ใช้ถ่ายภาพได้
○ หุ่นยนต์
ทำให้หุ่นยนต์สามารถทำความเข้าใจสภาพแวดล้อมรอบตัวได้ดีขึ้น
○ ระบบอัตโนมัติ
ช่วยในการตัดสินใจในกระบวนการผลิตหรือบริการที่เกี่ยวข้องกับภาพและวิดีโอ
  • ​การเปิดให้ใช้งาน
○ โอเพนซอร์ส
โมเดลขนาดเล็กสองรุ่น (Qwen2-Vl-2B และ Qwen2-VL-7B) เปิดให้ผู้ใช้งานทั่วไปนำไปพัฒนาต่อได้ฟรีภายใต้ใบอนุญาต Apache 2.0
○ API
โมเดลขนาดใหญ่ (Qwen2-VL-72B) สามารถใช้งานผ่าน API ของ Alibaba Cloud
  • ​LLM คืออะไร 👇
2
Credit :
👇
  • ​https://www.blognone.com/node/141754
โฆษณา