มีงาน data mining งานนึงที่น่าทำขำขำ แตกไอเดียมาจากงานแล็บที่โจะชุให้ทำ
งาน cluster กลุ่มคนในองค์กร..
สมมติ.. เรามีรายชื่อคนทั้งหมดในองค์กร.. เราอยากรู้ว่า ในองค์กรนี้ ใครเป็นพวกใคร.. (assume ว่า มันมีการแบ่งพรรคแบ่งพวก..) ด้วย clustering
input: คู่ของบุคลากร และ ความสัมพันธ์
เช่น นาย A - นาย B - positive (กลุ่มเดียวกัน)
เราจะแบ่งพวกได้ เราต้องรู้ว่า สองคนนั้นอยู่กลุ่มเดียวกัน หรือ คนละกลุ่ม แต่อาจจะเห็นได้ไม่ชัดว่า A กับ B เป็นพวกเดียวกันหรือเปล่า.. ดังนั้น.. ต้องสร้าง scoring function ขึ้นมาตัวนึง.. เพื่อให้คะแนนความน่าจะเป็นที่ A กับ B จะอยู่กลุ่มเดียวกัน ซึ่ง..ยาก..ต้อง assume เยอะหน่อย และอาจจะทำให้ผลของ clustering ผิด
หลังจากเราได้ความสัมพันธ์ ของ A และ B ในองค์กร ก็เอามา cluster .. ดู
ตัวอย่างการนำไปใช้...
- เอาไปเดาเล่นๆ ว่าทหารคนไหนจะได้โปรโมทในการแต่งตั้งครั้งหน้า ด้วยสมมติฐานว่า..ผู้ใหญ่จะเลือกพวกตัวเองไว้ก่อน :-P
Subscribe to:
Post Comments (Atom)
2 comments:
ก็ฟังดูน่าสนใจ แต่คิดว่าวิธีหาความสันพันธ์คงทำได้ดีที่สุดแค่ จับสองคนมา pair กันแล้วดู relation เลย ไม่ใช่ทำ score
คือคิดวิธี survey เพื่อหาความสัมพันธ์ได้ผลออกมาดีๆไม่ได้ เอาตัวอย่างทหารที่ยกมาก็ได้ ทหารชอบตีกอล์ฟ (มีคนบอกมาน๊าาา นู๋ไม่รู้) แล้วไงอะ ทหารตีกอล์ฟ ถามสิบตอบชอบตีเก้าคน แล้วเก้าคนจะมีแนวโน้มเอื้ออิงแก่กันเหรอ หรือต้องถามต่อว่าตีก๊วนเดียวกันมั้ย (แล้วจะถามยังไง) ตีสนามเดียวกันรึเปล่า
แต่น่าสนใจดี ถ้าต้องการทดสอบก็เห็นว่าไปทดลองกับสีเขียวนี่แหละ น่าจะฮา
ตัวอย่าง scoring (สมมตินะค้าบ)
A ไปตีกอล์ฟกับ B +1
A เรียนรุ่นเดียวกับ B +1
A เคยสั่งลงโทษ B -1
สมมติเฉยๆ.. นะ
Post a Comment