คู่มือสร้าง Rubric ประเมิน LLM: ปลดล็อกคุณภาพโมเดลภาษาขนาดใหญ่ด้วยสายตามนุษย์
คู่มือสร้าง Rubric ประเมิน LLM: ปลดล็อกคุณภาพโมเดลภาษาขนาดใหญ่ด้วยสายตามนุษย์ โลกของ โมเดลภาษาขนาดใหญ่ (Large Language Models - LLM) พัฒนาไปอย่างรวดเร็ว แต่ความฉลาดของ AI ไม่ได้วัดกันแค่ความเร็วหรือปริมาณข้อมูลที่ใช้ การจะรู้ว่า LLM ของเรา "ดีจริง"…