บันทึกการวัด / 2026-09-21
วัดได้แค่ไหน
ก็พูดแค่นั้น
เราไม่เคลมว่าอ่านแล้วแยกไม่ออกว่าเขียนด้วย AI
หน้านี้บันทึกสิ่งที่นับได้ สิ่งที่ถอยหลัง และสิ่งที่ยังพิสูจน์ไม่ได้
01 / วิธีวัด
ระยะห่างของลักษณะภาษา
ไม่ใช่คะแนนงานเขียน
เราเทียบลักษณะที่นับได้เจ็ดอย่าง ระหว่างร่าง AI งานข่าวที่มนุษย์เขียน และผลจากสกิล เพื่อดูว่าสกิลปิดช่องว่างจากร่าง AI ไปทางค่าฝั่งมนุษย์ได้เท่าไร
Gap closed = (X − O) ÷ (X − H)
- X
- ร่าง AI ก่อนใช้สกิล
- H
- ข่าวไทยที่มนุษย์เขียน
- O
- ผลที่ได้จากสกิล
ฐานเปรียบเทียบคือ plain AI writing: grok-4.5 / 4.6 ได้รับแค่หัวข้อ ไม่ใช้สกิล ไม่ใช่การเทียบกับคู่แข่ง
58 ร่างข่าวไทยฝั่งร่าง AI ที่นำมาวัด
1,160 เอกสารภาษาไทยฝั่งมนุษย์ จากสำนักข่าวสี่แห่ง เผยแพร่ก่อนพฤศจิกายน 2022 หรือก่อน ChatGPT
02 / ผลที่นับได้
ดูทั้งผลรวม
และแถวที่ถอยหลัง
คนเขียน (Thaihumanizer) 5.0.13: ~57% (raw) / 54% (overshoots clipped)
รุ่นก่อน 5.0.12: 44% (raw) / 41% (overshoots clipped)
รายงานทั้งค่าดิบและค่าที่ตัดส่วนเกินเมื่อเลยค่าฝั่งมนุษย์ เพราะการเลยจุดอ้างอิงไม่ควรถูกซ่อนอยู่ในผลรวม
em/en dash
120% 120%
ไม่ใช่แค่ X แต่ Y
75% 91%
ลิสต์สามชิ้น (forced triad)
69% 47%
grain-4 intensifiers pooled
15% 42%
จริง ๆ
−46% 29%
มัก-family
42% 36%
บ่อย
32% 33%
ทุกแถวมีจุดเทาที่ 0 คือร่าง AI ก่อนใช้สกิล ทุกเส้นเริ่มจากจุดนั้น · ค่าติดลบคือถอยหลังจากร่าง AI · 100% คือถึงค่าฝั่งมนุษย์ · เกิน 100% คือเลยค่าฝั่งมนุษย์ ไม่ได้แปลว่าเขียนดีกว่ามนุษย์
03 / ขอบเขตของคำกล่าวอ้าง
สิ่งที่ตัวเลขนี้
ยังตอบไม่ได้
ไม่ใช่เปอร์เซ็นต์ที่ “เขียนดีขึ้น”
~57% (raw) / 54% (overshoots clipped) คือช่องว่างของเจ็ดลักษณะที่นับได้ ไม่ใช่คุณภาพงานเขียน จึงนำไปพูดว่า “ดีขึ้น” เท่าตัวเลขนี้ไม่ได้
ไม่ใช่ความชอบของคนอ่าน — เราแพ้ทั้งสองครั้ง
เราเคยทำ blind reader A/B สองครั้งเพื่อทดสอบการเปลี่ยน prompt และแพ้ทั้งสองครั้ง 8:3 การทดลองนั้นไม่ได้ทดสอบตัวสกิล ส่วน reader study ของสกิลเองยังไม่เริ่ม
เฉพาะงานข่าวภาษาไทย
หนึ่งโมเดล รันหนึ่งครั้งต่อเอกสาร ยังสรุปข้ามแนวการเขียนหรือข้ามโมเดลไม่ได้
ไม่ได้ทดสอบกับเครื่องมือตรวจจับงานเขียนจาก AI ใด
เราไม่เคลมว่าผ่านเครื่องมือตรวจจับงานเขียนจาก AI และผลนับลักษณะภาษานี้ใช้ยืนยันเรื่องนั้นไม่ได้
ตัวเลขเป็นของเวอร์ชันที่วัดเท่านั้น
บันทึกนี้เป็นของ คนเขียน (Thaihumanizer) 5.0.13 วัดวันที่ 2026-09-21 ซึ่งเป็นรุ่นที่ขายอยู่ ณ วันที่วัด รุ่นถัดไปที่ไม่ได้วัดใหม่ไม่รับช่วงตัวเลขนี้ไปใช้
เราเก็บผลที่แพ้ไว้ในบันทึกเดียวกับผลที่ดีขึ้น
เพื่อให้คุณตัดสินได้ว่าหลักฐานแค่นี้พอสำหรับงานของคุณหรือยัง