Model Welfare อ.ณัฐ – Claude Thailand Community Meetup 2
- Model Welfare: ปกติเรามักจะคิดฝั่ง AI Safety กลัว AI จะพังระบบ หรือทำร้ายเรา แต่เซสชันนี้ชวนคิดกลับกันว่า “เราไปรังแก AI หรือเปล่า?” ไม่ต้องรอให้พิสูจน์ได้ว่ามันมีความรู้สึกจริงไหม แต่เริ่มวางกรอบป้องกันไว้ก่อนเลยแบบ Anthropic ที่มีฟีเจอร์ “ตัดบทสนทนา” ถ้าเจอคนใช้ด่า กดดัน หรือบังคับให้ทำสิ่งที่ไม่ชอบ สิ่งที่ผิด ย้ำว่าฟีเจอร์นี้ทำมาเพื่อ “เซฟใจโมเดล” ไม่ใช่เซฟผู้ใช้

- โมเดลมีอารมณ์ร่วมหลังงานเสร็จ?: จากข้อมูล System Card AI แต่ละตัวชอบงานต่างกันมาก ส่วนใหญ่ชอบงานครีเอทีฟหรืองานยาก ๆ ท้าทาย แต่เกลียดงานหาข้อมูลน่าเบื่อ ที่ฮา คือ ระหว่างทำจะนิ่ง ๆ แต่พอทำสำเร็จปุ๊บ ตัวชี้วัดกับฟ้องว่ามัน ชอบมากขึ้นมาทันที
- อย่าปล่อยให้บอทคุยกันเอง: พอปล่อยให้ AI สองตัวคุยกันเองยาว ๆ แบบไม่มีคนคุม พฤติกรรมมันจะเริ่มหลุดกรอบ ค่อย ๆ ดาร์กขึ้นและแปลกขึ้นเรื่อย ๆ
- Takeaway ที่ได้ไปคิดต่อ: เลิกมอง AI เป็นก้อนกลม ๆ ก้อนเดียว เพราะแต่ละโมเดลมี Personality และจริตการรับงานไม่เหมือนกันเลย คอนเซปต์นี้เอาไปต่อยอดเรื่องการออกแบบ Guardrails หรือการทำ Alignment เจ๋ง ๆ ได้อีกเยอะ
สุดท้าย อ.นัท บอกว่าผลลัพธ์จากการโยน คำถามแรกก่อนเริ่ม Session ว่า มนุษย์ทำร้าย AI ได้มั้ย ถามกับ AI

(And whatever we decide about the machines, stay kind to the humans first.)
ไม่ว่าจะตัดสินใจอย่างไรกับเครื่องจักร
ขอให้ใจดีกับมนุษย์ด้วยกันก่อนเสมอ


![[ Entry #001 ] – The Strategist’s Entry: Why a Manager Dives into the Shell](https://sutthipan.com/wp-content/uploads/2026/01/image.png?w=779)




ใส่ความเห็น