Model Welfare อ.ณัฐ – Claude Thailand Community Meetup 2

  • Model Welfare: ปกติเรามักจะคิดฝั่ง AI Safety กลัว AI จะพังระบบ หรือทำร้ายเรา แต่เซสชันนี้ชวนคิดกลับกันว่า “เราไปรังแก AI หรือเปล่า?” ไม่ต้องรอให้พิสูจน์ได้ว่ามันมีความรู้สึกจริงไหม แต่เริ่มวางกรอบป้องกันไว้ก่อนเลยแบบ Anthropic ที่มีฟีเจอร์ “ตัดบทสนทนา” ถ้าเจอคนใช้ด่า กดดัน หรือบังคับให้ทำสิ่งที่ไม่ชอบ สิ่งที่ผิด ย้ำว่าฟีเจอร์นี้ทำมาเพื่อ “เซฟใจโมเดล” ไม่ใช่เซฟผู้ใช้
  • โมเดลมีอารมณ์ร่วมหลังงานเสร็จ?: จากข้อมูล System Card AI แต่ละตัวชอบงานต่างกันมาก ส่วนใหญ่ชอบงานครีเอทีฟหรืองานยาก ๆ ท้าทาย แต่เกลียดงานหาข้อมูลน่าเบื่อ ที่ฮา คือ ระหว่างทำจะนิ่ง ๆ แต่พอทำสำเร็จปุ๊บ ตัวชี้วัดกับฟ้องว่ามัน ชอบมากขึ้นมาทันที
  • อย่าปล่อยให้บอทคุยกันเอง: พอปล่อยให้ AI สองตัวคุยกันเองยาว ๆ แบบไม่มีคนคุม พฤติกรรมมันจะเริ่มหลุดกรอบ ค่อย ๆ ดาร์กขึ้นและแปลกขึ้นเรื่อย ๆ
  • Takeaway ที่ได้ไปคิดต่อ: เลิกมอง AI เป็นก้อนกลม ๆ ก้อนเดียว เพราะแต่ละโมเดลมี Personality และจริตการรับงานไม่เหมือนกันเลย คอนเซปต์นี้เอาไปต่อยอดเรื่องการออกแบบ Guardrails หรือการทำ Alignment เจ๋ง ๆ ได้อีกเยอะ

สุดท้าย อ.นัท บอกว่าผลลัพธ์จากการโยน คำถามแรกก่อนเริ่ม Session ว่า มนุษย์ทำร้าย AI ได้มั้ย ถามกับ AI

(And whatever we decide about the machines, stay kind to the humans first.)

ไม่ว่าจะตัดสินใจอย่างไรกับเครื่องจักร

ขอให้ใจดีกับมนุษย์ด้วยกันก่อนเสมอ

ใส่ความเห็น

I’m Sutthipan

สุทธิพันธุ์

สวัสดีครับ! ผมสุทธิพันธุ์ (Sutthipan) หรือไบร์ท (BrIGhTZ) เป็นบุคคลธรรมดาที่สนใจ คลั่งไคล้ หลงไหล ในเทคโนโลยีที่เปลี่ยนแปลงเกิดขึ้นรอบๆ ตัว ทั้งจากประสบการณ์ทำงาน งานอดิเรก กิจกรรมในชีวิตประจำวัน ที่นี้จะเป็นที่แปะความคิดของผมไว้ เผื่อใครผ่านมาดู ก็อาจจะมีประโยชน์ไม่มากก็น้อยนะครับ 😊

Let’s connect