vLLM Bangkok Day: ผู้สร้าง vLLM กำลังจะมากรุงเทพฯ

โดย vLLM Bangkok6 นาที
Read in English

สิ่งที่ยังไม่เคยเกิดขึ้นในประเทศไทยกำลังจะเกิดขึ้นใน วันอาทิตย์ที่ 6 กันยายน 2569: core maintainer ของ vLLM กำลังจะมากรุงเทพฯ

vLLM Bangkok Day จัดเวลา 14:00 – 19:00 น. ที่ JAS Green Village รามคำแหง เข้าร่วมฟรี และออกแบบมาสำหรับคนที่รัน — หรืออยากรัน — โมเดลภาษาขนาดใหญ่บนงานจริง

ทำไมเรื่องนี้ถึงสำคัญกับประเทศไทย

vLLM คือ inference engine โอเพนซอร์สที่อยู่เบื้องหลังการให้บริการ LLM จำนวนมากทั่วโลก ถ้าคุณเคย deploy โมเดล open-weights หลัง endpoint ที่ compatible กับ OpenAI ในช่วงสองปีที่ผ่านมา มีโอกาสสูงมากที่ vLLM คือตัวที่ทำงานอยู่เบื้องหลัง

และนี่สำคัญกับบ้านเราด้วยเหตุผลที่ชัดเจน ทีมไทยที่สร้างงานบนโมเดลเปิดกำลังตัดสินใจเรื่องเดียวกันอยู่ — กลยุทธ์ batching, การกำหนดขนาด KV cache, quantisation, ค่า GPU — โดยส่วนใหญ่ต่างคนต่างทำ และส่วนใหญ่หาคำตอบจากการไล่อ่าน GitHub issue ตอนเที่ยงคืน งานนี้มีขึ้นเพื่อทำให้วงจรนั้นสั้นลง:

  • ถาม maintainer ได้โดยตรง แทนที่จะเปิด issue แล้วรอ
  • ฟังว่าทีมไทยที่รัน vLLM บนโปรดักชันอยู่แล้วพลาดตรงไหน ก่อนที่คุณจะพลาดตาม
  • รู้ว่ามีใครในกรุงเทพฯ ที่กำลังแก้ปัญหาเดียวกับคุณอยู่ในไตรมาสนี้

มีอะไรในงาน

ฟังจากผู้สร้าง vLLM โดยตรง maintainer จากสหรัฐฯ และสิงคโปร์ เล่าเบื้องลึกของระบบ — paged attention, continuous batching และทิศทางต่อไปของโปรเจกต์

เคสการใช้งานจริงบนโปรดักชัน บริษัท นักพัฒนา และนักวิจัยไทย เล่าว่าอะไรพังจริง ต้นทุนเท่าไร และถ้าย้อนกลับไปได้จะทำอะไรต่างออกไป ไม่ใช่การประกาศเปิดตัว แต่เป็นการถอดบทเรียน

เซสชันสำหรับองค์กรและสายเทคนิค รูปแบบการ deploy ต้นทุน GPU และโจทย์เฉพาะของการเสิร์ฟโมเดลภาษาไทยให้ได้ latency ระดับโปรดักชัน

เน็ตเวิร์กกิ้ง ไทย ↔ ทั่วโลก มีเวลาให้ได้พบกับคอมมูนิตี้ vLLM ระดับโลกและคนที่สร้างโครงสร้างพื้นฐาน AI ในไทย

ใครควรมา

คุณจะได้ประโยชน์จากงานนี้มากที่สุดถ้าคุณ:

  • เสิร์ฟโมเดล open-weights อยู่แล้ว และอยากให้เร็วขึ้นหรือถูกลง
  • กำลังประเมินว่าจะ self-host แทนการจ่ายแบบ per token ดีไหม
  • ทำวิจัยด้าน inference, quantisation หรือ serving system
  • เป็นคนที่ต้องรับผิดชอบบิลค่า GPU

คุณไม่จำเป็นต้องเป็น contributor ของ vLLM ไม่จำเป็นต้องเชี่ยวชาญ CUDA ขอแค่เอาโจทย์ที่คุณติดอยู่จริง ๆ มาด้วย

รายละเอียด

วันที่ อาทิตย์ที่ 6 กันยายน 2569
เวลา 14:00 – 19:00 น. (ICT, UTC+7)
สถานที่ JAS Green Village รามคำแหง กรุงเทพฯ
ค่าเข้าร่วม ฟรี — ต้องลงทะเบียนล่วงหน้า
ภาษา อังกฤษและไทย

คาดว่าจะมีผู้เข้าร่วมกว่า 200 คนทั้งไทยและต่างประเทศ ดูเวลานับถอยหลังแบบเป๊ะ ๆ ได้ที่หน้างาน

มาร่วมกับเรา

ถ้าทีมของคุณใช้ vLLM อยู่ในไทย เพิ่มทีมเข้าไดเรกทอรีคอมมูนิตี้ เรากำลังรวบรวมภาพว่ามีใครทำงานสายนี้อยู่บ้างในบ้านเรา — และมันเยอะกว่าที่พวกเราคิดกันไว้มาก

ถ้าบริษัทของคุณอยากสนับสนุนงานนี้ แพ็กเกจสปอนเซอร์ เปิดรับแล้ว

เจอกันวันที่ 6 กันยายน

แท็ก

  • งานอีเวนต์
  • คอมมูนิตี้

บทความอื่น

9 นาที

vLLM คืออะไร และทำไม throughput ถึงกระโดดเมื่อย้ายมาใช้

ปูพื้นแบบใช้งานได้จริงกับสองแนวคิดที่ทำให้ vLLM เร็ว — PagedAttention และ continuous batching — และมันหมายความว่าอย่างไรกับบิลค่า GPU ของทีมไทย ที่เสิร์ฟโมเดล open-weights

  • vllm
  • inference
  • พื้นฐาน