---
title: นักวิจัยพบร่องรอยขั้นตอนการคิดของโมเดลภาษาในสถานะภายใน
url: https://www.dataloco.com/th/story-5
published: 2026-09-13T10:46:54+00:00
language: th
section: AI
source: https://the-decoder.de/denkschritte-von-ki-modellen-lassen-sich-in-deren-internen-zustaenden-nachweisen/
organizations: KAIST, Naver AI Lab, OpenAI, Anthropic
publisher: Dataloco
---

# นักวิจัยพบร่องรอยขั้นตอนการคิดของโมเดลภาษาในสถานะภายใน

นักวิจัยจากสถาบันเทคโนโลยีแห่งเกาหลีและห้องปฏิบัติการปัญญาประดิษฐ์ของเนเวอร์ ได้เผยแพร่ผลการศึกษาที่แสดงให้เห็นว่าขั้นตอนการคิดต่าง ๆ ที่โมเดลภาษาแสดงออกมาในข้อความ สามารถตรวจพบได้ภายในสถานะตัวเลขของโมเดลนั้น

ทีมวิจัยได้กำหนดขั้นตอนการคิดที่พบซ้ำกันไว้แปดประเภท ได้แก่ การดึงข้อมูล การแยกส่วนปัญหา การเรียกใช้สูตร การอนุมาน และการคำนวณ โดยให้โมเดลสามตัว ได้แก่ เควิน 2.5 ขนาด 7 พันล้านพารามิเตอร์ เควิน 3 ขนาด 8 พันล้านพารามิเตอร์ และแกมมา 4 ขนาด 31 พันล้านพารามิเตอร์ ทำโจทย์คณิตศาสตร์ จากนั้นใช้โมเดลจีพีที 5 ในการจัดหมวดหมู่แต่ละส่วนคำตอบให้ตรงกับขั้นตอนการคิดประเภทใดประเภทหนึ่ง

ผลการวิเคราะห์พบว่าขั้นตอนการคิดเหล่านี้สามารถแยกออกจากกันได้อย่างชัดเจนในสถานะภายในของโมเดล โดยเฉพาะอย่างยิ่งในชั้นกลางของโครงสร้างโมเดล ซึ่งการแยกแยะนี้ชัดเจนกว่าการวิเคราะห์จากคำที่เลือกใช้เพียงอย่างเดียว หรือจากตำแหน่งของข้อความในลำดับคำตอบ

การศึกษาพบว่าคำที่ใช้บ่อยในขั้นตอนการคิดที่แตกต่างกัน จะมีการแสดงออกในสถานะภายในที่แตกต่างกันตามบริบท เมื่อทีมวิจัยทำการรบกวนการประมวลผลข้อมูล 30 คำก่อนหน้า สัญญาณของขั้นตอนการคิดจะอ่อนลง ซึ่งบ่งชี้ว่าขั้นตอนการคิดไม่ได้เกิดขึ้นอย่างโดดเดี่ยว แต่ขึ้นอยู่กับข้อความก่อนหน้า

แม้ในกรณีที่โมเดลตอบผิด ประเภทของขั้นตอนการคิดยังคงตรวจพบได้ เช่น ขั้นตอนการคำนวณที่ผิดพลาดยังคงมีลักษณะภายในคล้ายกับขั้นตอนการคำนวณที่ถูกต้อง ผลการทดลองนี้สามารถทำซ้ำได้กับโมเดลลามา 3 ขนาด 8 พันล้านพารามิเตอร์ และตัวจำแนกที่เรียนรู้แล้วทำงานได้ดีกับชุดข้อมูลอื่น ๆ ด้วย

งานวิจัยนี้จำกัดอยู่เฉพาะโจทย์คณิตศาสตร์และโมเดลจำนวนน้อยเท่านั้น ประเด็นนี้มีความสำคัญด้านความปลอดภัย เนื่องจากความสามารถในการอ่านขั้นตอนการคิดถือเป็นเครื่องมือควบคุมที่มีอยู่อย่างจำกัด โมเดลของแอนโทรปิกเปิดเผยข้อมูลที่ใช้เพียงร้อยละ 25 ถึง 39 ในบางกรณี และเทคนิคของโอเพนเอไอบางส่วนย้ายขั้นตอนการคิดเข้าสู่สถานะภายในของโมเดล
