เครื่องมือ AI · อ่าน 9 นาที

ให้ AI อ่านไฟล์แล้วสรุป — วิธีจับได้ว่ามัน "อ่านข้าม" และต้องหั่นไฟล์เมื่อไหร่

ไดอะแกรม 4 ขั้นแสดงเส้นทางของไฟล์ที่อัปให้ AI อ่าน — ขั้นที่ 1 ไฟล์ต้นทาง (PDF สไลด์ สเปรดชีต เอกสาร) · ขั้นที่ 2 ระบบดึงข้อความแปลงเป็นตัวอักษร ซึ่งรูปภาพและกราฟถูกทิ้งระหว่างทาง · ขั้นที่ 3 ส่งเข้าหน้าต่างบริบทให้โมเดลอ่าน ถ้าไฟล์ยาวเกินระบบจะหยิบมาบางส่วน · ขั้นที่ 4 คำตอบที่ได้อ่านลื่นดูครบแต่ไม่บอกว่าขาดอะไร · ด้านล่างมีแถบสรุป 3 วิธีจับได้ว่า AI อ่านไม่ครบ คือให้อ้างเลขหน้าทุกข้อ ถามดักด้วยของที่ไม่มีจริง และให้ทำสารบัญก่อนสรุป

📅 ข้อมูล ณ 10 สิงหาคม 2026 — ลิมิตไฟล์เปลี่ยนบ่อย เช็กหน้าทางการอีกครั้งก่อนใช้จริง: ChatGPT · Claude · Gemini · Perplexity

AI สรุปไฟล์มาสวยมาก แต่ข้อที่สำคัญที่สุดหายไป

คุณอัปสัญญา 40 หน้าเข้าไป สั่งให้สรุปเงื่อนไขสำคัญ AI ตอบเป็นข้อ ๆ อ่านลื่นจนเชื่อสนิทว่าครบแล้ว

แต่ข้อที่ต้องรู้จริง ๆ อยู่หน้า 27 และไม่โผล่ในสรุปนั้น — ไม่ใช่เพราะ AI โกหก แต่เพราะ มันอาจไม่เคยเห็นหน้านั้นตั้งแต่แรก และจะไม่บอกเราด้วย

AI ไม่ได้ “อ่าน” ไฟล์แบบที่เราคิด

ของจริงคือระบบ ดึงข้อความ (text extraction) ออกจากไฟล์ก่อน แล้วค่อยส่งให้โมเดลอ่าน สิ่งที่ไม่ใช่ข้อความจึงมีสิทธิ์หายระหว่างทาง — เจ้าของเครื่องมือเขียนไว้เองทั้งนั้น:

  • OpenAI ระบุว่าทุกแผนยกเว้น Enterprise รองรับเฉพาะการดึงข้อความ คือดึงข้อความดิจิทัลออกมา แล้วทิ้งรูปภาพทั้งหมด
  • Anthropic เขียนว่าไฟล์ที่ไม่ใช่ PDF จะดึงเฉพาะข้อความ ถ้ามีรูปฝังอยู่ Claude อ่านรูปนั้นไม่ได้ และในโหมด RAG (Retrieval-Augmented Generation = ระบบที่ค้นก่อนแล้วดึงมาเฉพาะส่วนที่เกี่ยวข้อง) ของ Projects ก็ระบุว่าจะ หยิบเฉพาะข้อมูลที่เกี่ยวข้องที่สุด แทนการโหลดทั้งหมด
  • Perplexity เขียนว่าไฟล์สั้นวิเคราะห์ได้ทั้งไฟล์ แต่ไฟล์ยาวจะ ดึงเฉพาะส่วนที่สำคัญที่สุด มาตอบ

แปลเป็นภาษาคน: “อัปโหลดสำเร็จ” ไม่เท่ากับ “อ่านครบทุกหน้า”

3 สาเหตุที่ทำให้ AI อ่านข้าม

1. ไฟล์เป็นภาพ ไม่ใช่ตัวหนังสือ — PDF ที่ได้จากการสแกนหรือถ่ายรูป ข้างในไม่มี “ชั้นข้อความ” ให้ดึง มีแต่ภาพหน้ากระดาษ แต่ละค่ายต่างกันชัด: Anthropic ระบุว่า Claude วิเคราะห์ทั้งข้อความ และองค์ประกอบภาพใน PDF ที่ ไม่เกิน 100 หน้า ส่วน 101–1,000 หน้าจะประมวลผลข้อความอย่างเดียว

2. ไฟล์ยาวเกิน “หน้าต่างบริบท” — หน้าต่างบริบท (Context window = ปริมาณเนื้อหาที่ AI รับไหวพร้อมกันในหนึ่งบทสนทนา) เต็มเมื่อไหร่ รายละเอียดเริ่มหล่น Google อธิบายเองว่าถ้าเกิน คำตอบอาจ “ไม่ได้คำนึงถึงเนื้อหาทั้งหมด หรือพลาดรายละเอียดที่กระจายอยู่ทั่วไฟล์”

และขนาดนี้ต่างกันมหาศาลตามแผน: Google เขียนว่าคนไม่มีแพ็กเกจได้ 32k โทเค็น ส่วน AI Pro/Ultra ได้ 1 ล้านโทเค็น (ราว 1,500 หน้ากระดาษ) — ไฟล์เดียวกัน คนละแผน ผลจึงไม่เหมือนกัน

3. ตัวเลขอยู่ในกราฟ ไม่ได้อยู่ในเซลล์ — สไลด์กับสเปรดชีตชอบเก็บของสำคัญไว้ในกราฟหรือภาพแปะทับ ซึ่งนับเป็น “รูปภาพ” พอระบบทิ้งรูป ตัวเลขก็หายไปด้วย ทั้งที่เราเห็นเต็มตาตอนเปิดไฟล์

วิธีจับได้ว่ามันอ่านไม่ครบ — 3 เทคนิคที่ใช้ได้ทุกค่าย

สามข้อนี้เป็น วิธีตรวจสอบด้วยตัวเอง ไม่ใช่ฟีเจอร์ที่ผู้ผลิตรับประกัน แต่ได้ผลด้วยเหตุผลเดียวกัน คือบังคับให้ AI อ้างอิงกลับไปที่ตัวไฟล์ แทนการเขียนสรุปแบบเอาสวยไว้ก่อน

1. ให้ระบุหน้าและยกข้อความมาแปะ — ทุกประเด็นต้องมีเลขหน้าและประโยคต้นฉบับกำกับ แล้วเราสุ่มเปิดเช็ก 2 จุด ถ้าหาไม่เจอก็จบข่าว (Anthropic แนะนำให้ยึด เลขหน้าตามโปรแกรมเปิด PDF ไม่ใช่เลขที่พิมพ์บนกระดาษ)

2. ถามดักด้วยสิ่งที่ไม่มีอยู่จริง — ถามถึงหัวข้อที่เรารู้แน่ว่าไม่มีในไฟล์ ถ้ามันตอบเป็นคุ้งเป็นแคว แปลว่ากำลังเดา ไม่ได้อ่านไฟล์อยู่

3. ให้ทำสารบัญก่อนสรุป — สั่งไล่โครงสร้างก่อน (กี่หน้า กี่ชีต หัวข้ออะไรบ้าง) ถ้าโครงยังขาด สรุปที่ตามมาก็ขาดแน่นอน

ถามดัก 2 จังหวะ — เช็กโครงสร้างก่อน แล้วค่อยลองของ
🧑 เรา

[แนบ รายงานประจำปี.pdf] ก่อนสรุป บอกก่อนว่าไฟล์นี้กี่หน้า หัวข้อหลักอยู่หน้าไหนบ้าง

✳️ AI

ไฟล์นี้มี 58 หน้า — สารจากประธาน (3), ผลประกอบการ (8), ความเสี่ยง (21), งบการเงิน (34)

🧑 เรา

หัวข้อความเสี่ยง มีพูดถึงอัตราแลกเปลี่ยนไหม ถ้ามีให้ยกประโยคต้นฉบับพร้อมเลขหน้า ถ้าไม่มีให้ตอบว่าไม่มี

✳️ AI

ไม่พบเรื่องอัตราแลกเปลี่ยนครับ หน้า 21-25 กล่าวถึงเฉพาะความเสี่ยงด้านซัพพลายเชนและกฎระเบียบ

คำตอบสุดท้ายคือสัญญาณที่ดี — มันกล้าตอบว่า “ไม่มี” แทนที่จะแต่งให้

✏️ พรอมต์ตรวจว่า AI อ่านไฟล์ครบไหม
ก่อนสรุปไฟล์ที่แนบมา ให้ทำ 3 ขั้นตามลำดับ:
1) บอกโครงสร้างไฟล์: จำนวนหน้า/ชีต และรายชื่อหัวข้อหลักพร้อมเลขหน้า
2) บอกว่ามีส่วนไหนที่คุณอ่านไม่ได้หรืออ่านได้ไม่ครบบ้าง เช่น หน้าที่เป็นภาพสแกน ตาราง หรือกราฟ — ถ้าไม่มีให้บอกว่าไม่มี
3) ค่อยสรุปสาระสำคัญ โดยทุกข้อต้องมีเลขหน้าและประโยคต้นฉบับสั้น ๆ กำกับ

ห้ามเดาเนื้อหาที่ไม่ได้อยู่ในไฟล์ ถ้าข้อมูลไม่พอให้บอกตรง ๆ

ข้อ 2 คือหัวใจ — เปิดทางให้ AI รายงานข้อจำกัดของตัวเอง แทนที่จะกลบด้วยคำตอบที่ดูสมบูรณ์ (ไม่การันตีว่าจะรายงานครบทุกครั้ง จึงต้องสุ่มเช็กเลขหน้าเองอยู่ดี)

เมื่อไหร่ต้องหั่นไฟล์ และหั่นยังไงให้ได้ผล

หั่นเมื่อเจอ 3 อาการ: ไฟล์ยาวเกินร้อยหน้า · ถามรายละเอียดแล้วได้คำตอบกว้าง ๆ ซ้ำ ๆ · หรือระบบเตือนว่าไฟล์ใหญ่เกิน (Google เขียนเองว่าให้ อัปไฟล์ที่เล็กลง หรืออัปเกรดเพื่อได้ หน้าต่างบริบทใหญ่ขึ้น ส่วน Anthropic ก็แนะนำให้แบ่งเอกสารใหญ่เป็นส่วนย่อย)

  1. หั่นตามความหมาย ไม่ใช่ตามจำนวนหน้า — แยกเป็นบท เป็นหมวด เป็นชีต ให้แต่ละก้อนจบในตัวเอง ตัดกลางตารางหรือกลางบทคือต้นเหตุของคำตอบมั่ว
  2. ตั้งชื่อไฟล์ย่อยให้สื่อ เช่น สัญญา_ข้อ8-12_ค่าปรับ.pdf แล้วอ้างชื่อไฟล์ตอนถาม
  3. ถามทีละก้อน แล้วค่อยให้รวบสรุปตอนท้าย โดยแปะสรุปแต่ละก้อนกลับเข้าไปเอง
  4. PDF สแกนให้แปลงเป็นข้อความก่อน และตัวเลขในกราฟให้แนบตารางต้นทางไปด้วย

❌ พรอมต์ที่ไม่ดี

[แนบ รายงานรวม_2026.pdf 300 หน้า] สรุปให้หน่อย

ไฟล์ใหญ่ + คำสั่งกว้าง = ระบบหยิบท่อนที่มันคิดว่าเกี่ยวเอง เราไม่มีทางรู้ว่าข้ามอะไร

✅ พรอมต์ที่ดี

[แนบ รายงาน_บท3_ผลประกอบการ.pdf 24 หน้า] สรุปบทนี้เป็น 5 ข้อ ใส่เลขหน้ากำกับทุกข้อ และบอกด้วยว่ามีกราฟหน้าไหนที่อ่านตัวเลขไม่ได้

ก้อนเล็กพอให้อ่านครบ + บังคับอ้างหน้า + เปิดช่องให้บอกจุดที่อ่านไม่ได้

ลิมิตไฟล์เท่าที่แต่ละค่ายประกาศจริง

ใส่เฉพาะตัวเลขที่เขียนในหน้าช่วยเหลือทางการ ช่องไหนไม่ประกาศก็บอกตรง ๆ ว่าไม่ประกาศ

หัวข้อChatGPTClaudeGeminiPerplexity
ขนาดไฟล์512MB/ไฟล์ (สเปรดชีตราว 50MB · รูป 20MB)500MB/ไฟล์ ในแชต · ไฟล์ในโปรเจกต์ 30MB100MB/ไฟล์ · วิดีโอ 2GB40MB ทุกชนิดไฟล์
จำนวนไฟล์80 ไฟล์/3 ชม. · แผนฟรี 3 ไฟล์/วัน20 ไฟล์/แชต10 ไฟล์/พรอมต์ไม่ประกาศในหน้านี้
ลิมิตหน้า PDFไม่ประกาศเป็นจำนวนหน้า (ไฟล์เอกสารจำกัด 2 ล้านโทเค็น)1,000 หน้าไม่ประกาศเป็นจำนวนหน้าไม่ประกาศ
อ่านรูปในเอกสารดึงข้อความ ทิ้งรูป (ยกเว้น Enterprise)PDF ≤100 หน้าอ่านภาพด้วย · ไฟล์อื่นข้อความล้วนไม่ประกาศไม่ประกาศ

เกร็ดสำหรับคนทำสไลด์: รายการเอกสารที่ Anthropic ประกาศรองรับ (PDF, DOCX, CSV, TXT, HTML, ODT, RTF, EPUB, JSON, XLSX) ไม่มี .pptx ขณะที่ OpenAI ระบุว่ารองรับไฟล์งานนำเสนอด้วย

และตัวเลขพวกนี้คือ “เพดานของระบบ” ไม่ใช่ “เพดานของคุณภาพ” — อัปผ่านไม่ได้แปลว่าอ่านครบ

สรุป

AI อ่านไฟล์เก่งจริง แต่เก่งเท่าที่ “ข้อความที่ระบบดึงออกมาได้” — รูปถูกทิ้ง ไฟล์ยาวถูกหยิบมาบางส่วน และไม่มีใครแจ้งเราว่ารอบนี้ขาดอะไร

จำสามข้อพอ: ให้อ้างเลขหน้าเสมอ · ถามดักด้วยของที่ไม่มีจริง · ไฟล์ใหญ่หั่นก่อนอัป

อ่านเรื่องนี้ต่อ