บันทึกการวัด / 2026-09-21

วัดได้แค่ไหน
ก็พูดแค่นั้น

เราไม่เคลมว่าอ่านแล้วแยกไม่ออกว่าเขียนด้วย AI
หน้านี้บันทึกสิ่งที่นับได้ สิ่งที่ถอยหลัง และสิ่งที่ยังพิสูจน์ไม่ได้

สกิลที่วัด คนเขียน (Thaihumanizer) 5.0.13
ไฟล์สกิลชื่อ humanizer-v2

วันที่วัด 2026-09-21

ขอบเขต งานข่าวภาษาไทย

01 / วิธีวัด

ระยะห่างของลักษณะภาษา
ไม่ใช่คะแนนงานเขียน

เราเทียบลักษณะที่นับได้เจ็ดอย่าง ระหว่างร่าง AI งานข่าวที่มนุษย์เขียน และผลจากสกิล เพื่อดูว่าสกิลปิดช่องว่างจากร่าง AI ไปทางค่าฝั่งมนุษย์ได้เท่าไร

Gap closed = (X − O) ÷ (X − H)

X
ร่าง AI ก่อนใช้สกิล
H
ข่าวไทยที่มนุษย์เขียน
O
ผลที่ได้จากสกิล

ฐานเปรียบเทียบคือ plain AI writing: grok-4.5 / 4.6 ได้รับแค่หัวข้อ ไม่ใช้สกิล ไม่ใช่การเทียบกับคู่แข่ง

58 ร่างข่าวไทยฝั่งร่าง AI ที่นำมาวัด

1,160 เอกสารภาษาไทยฝั่งมนุษย์ จากสำนักข่าวสี่แห่ง เผยแพร่ก่อนพฤศจิกายน 2022 หรือก่อน ChatGPT

02 / ผลที่นับได้

ดูทั้งผลรวม
และแถวที่ถอยหลัง

คนเขียน (Thaihumanizer) 5.0.13: ~57% (raw) / 54% (overshoots clipped)
รุ่นก่อน 5.0.12: 44% (raw) / 41% (overshoots clipped)

รายงานทั้งค่าดิบและค่าที่ตัดส่วนเกินเมื่อเลยค่าฝั่งมนุษย์ เพราะการเลยจุดอ้างอิงไม่ควรถูกซ่อนอยู่ในผลรวม

ช่องว่างที่ปิดได้ แยกตามลักษณะจุดเทา = ร่าง AI · วงโปร่ง = 5.0.12 · จุดทึบ = 5.0.13
  1. em/en dash

    120% 120%

  2. ไม่ใช่แค่ X แต่ Y

    75% 91%

  3. ลิสต์สามชิ้น (forced triad)

    69% 47%

  4. grain-4 intensifiers pooled

    15% 42%

  5. จริง ๆ

    −46% 29%

  6. มัก-family

    42% 36%

  7. บ่อย

    32% 33%

ทุกแถวมีจุดเทาที่ 0 คือร่าง AI ก่อนใช้สกิล ทุกเส้นเริ่มจากจุดนั้น · ค่าติดลบคือถอยหลังจากร่าง AI · 100% คือถึงค่าฝั่งมนุษย์ · เกิน 100% คือเลยค่าฝั่งมนุษย์ ไม่ได้แปลว่าเขียนดีกว่ามนุษย์

03 / ขอบเขตของคำกล่าวอ้าง

สิ่งที่ตัวเลขนี้
ยังตอบไม่ได้

  1. ไม่ใช่เปอร์เซ็นต์ที่ “เขียนดีขึ้น”

    ~57% (raw) / 54% (overshoots clipped) คือช่องว่างของเจ็ดลักษณะที่นับได้ ไม่ใช่คุณภาพงานเขียน จึงนำไปพูดว่า “ดีขึ้น” เท่าตัวเลขนี้ไม่ได้

  2. ไม่ใช่ความชอบของคนอ่าน — เราแพ้ทั้งสองครั้ง

    เราเคยทำ blind reader A/B สองครั้งเพื่อทดสอบการเปลี่ยน prompt และแพ้ทั้งสองครั้ง 8:3 การทดลองนั้นไม่ได้ทดสอบตัวสกิล ส่วน reader study ของสกิลเองยังไม่เริ่ม

  3. เฉพาะงานข่าวภาษาไทย

    หนึ่งโมเดล รันหนึ่งครั้งต่อเอกสาร ยังสรุปข้ามแนวการเขียนหรือข้ามโมเดลไม่ได้

  4. ไม่ได้ทดสอบกับเครื่องมือตรวจจับงานเขียนจาก AI ใด

    เราไม่เคลมว่าผ่านเครื่องมือตรวจจับงานเขียนจาก AI และผลนับลักษณะภาษานี้ใช้ยืนยันเรื่องนั้นไม่ได้

  5. ตัวเลขเป็นของเวอร์ชันที่วัดเท่านั้น

    บันทึกนี้เป็นของ คนเขียน (Thaihumanizer) 5.0.13 วัดวันที่ 2026-09-21 ซึ่งเป็นรุ่นที่ขายอยู่ ณ วันที่วัด รุ่นถัดไปที่ไม่ได้วัดใหม่ไม่รับช่วงตัวเลขนี้ไปใช้

เราเก็บผลที่แพ้ไว้ในบันทึกเดียวกับผลที่ดีขึ้น
เพื่อให้คุณตัดสินได้ว่าหลักฐานแค่นี้พอสำหรับงานของคุณหรือยัง

ดูสกิล คนเขียน (Thaihumanizer) →