เครื่องมือ AI · อ่าน 9 นาที
ให้ AI อ่านไฟล์แล้วสรุป — วิธีจับได้ว่ามัน "อ่านข้าม" และต้องหั่นไฟล์เมื่อไหร่
📅 ข้อมูล ณ 10 สิงหาคม 2026 — ลิมิตไฟล์เปลี่ยนบ่อย เช็กหน้าทางการอีกครั้งก่อนใช้จริง: ChatGPT · Claude · Gemini · Perplexity
AI สรุปไฟล์มาสวยมาก แต่ข้อที่สำคัญที่สุดหายไป
คุณอัปสัญญา 40 หน้าเข้าไป สั่งให้สรุปเงื่อนไขสำคัญ AI ตอบเป็นข้อ ๆ อ่านลื่นจนเชื่อสนิทว่าครบแล้ว
แต่ข้อที่ต้องรู้จริง ๆ อยู่หน้า 27 และไม่โผล่ในสรุปนั้น — ไม่ใช่เพราะ AI โกหก แต่เพราะ มันอาจไม่เคยเห็นหน้านั้นตั้งแต่แรก และจะไม่บอกเราด้วย
AI ไม่ได้ “อ่าน” ไฟล์แบบที่เราคิด
ของจริงคือระบบ ดึงข้อความ (text extraction) ออกจากไฟล์ก่อน แล้วค่อยส่งให้โมเดลอ่าน สิ่งที่ไม่ใช่ข้อความจึงมีสิทธิ์หายระหว่างทาง — เจ้าของเครื่องมือเขียนไว้เองทั้งนั้น:
- OpenAI ระบุว่าทุกแผนยกเว้น Enterprise รองรับเฉพาะการดึงข้อความ คือดึงข้อความดิจิทัลออกมา แล้วทิ้งรูปภาพทั้งหมด
- Anthropic เขียนว่าไฟล์ที่ไม่ใช่ PDF จะดึงเฉพาะข้อความ ถ้ามีรูปฝังอยู่ Claude อ่านรูปนั้นไม่ได้ และในโหมด RAG (Retrieval-Augmented Generation = ระบบที่ค้นก่อนแล้วดึงมาเฉพาะส่วนที่เกี่ยวข้อง) ของ Projects ก็ระบุว่าจะ หยิบเฉพาะข้อมูลที่เกี่ยวข้องที่สุด แทนการโหลดทั้งหมด
- Perplexity เขียนว่าไฟล์สั้นวิเคราะห์ได้ทั้งไฟล์ แต่ไฟล์ยาวจะ ดึงเฉพาะส่วนที่สำคัญที่สุด มาตอบ
แปลเป็นภาษาคน: “อัปโหลดสำเร็จ” ไม่เท่ากับ “อ่านครบทุกหน้า”
3 สาเหตุที่ทำให้ AI อ่านข้าม
1. ไฟล์เป็นภาพ ไม่ใช่ตัวหนังสือ — PDF ที่ได้จากการสแกนหรือถ่ายรูป ข้างในไม่มี “ชั้นข้อความ” ให้ดึง มีแต่ภาพหน้ากระดาษ แต่ละค่ายต่างกันชัด: Anthropic ระบุว่า Claude วิเคราะห์ทั้งข้อความ และองค์ประกอบภาพใน PDF ที่ ไม่เกิน 100 หน้า ส่วน 101–1,000 หน้าจะประมวลผลข้อความอย่างเดียว
2. ไฟล์ยาวเกิน “หน้าต่างบริบท” — หน้าต่างบริบท (Context window = ปริมาณเนื้อหาที่ AI รับไหวพร้อมกันในหนึ่งบทสนทนา) เต็มเมื่อไหร่ รายละเอียดเริ่มหล่น Google อธิบายเองว่าถ้าเกิน คำตอบอาจ “ไม่ได้คำนึงถึงเนื้อหาทั้งหมด หรือพลาดรายละเอียดที่กระจายอยู่ทั่วไฟล์”
และขนาดนี้ต่างกันมหาศาลตามแผน: Google เขียนว่าคนไม่มีแพ็กเกจได้ 32k โทเค็น ส่วน AI Pro/Ultra ได้ 1 ล้านโทเค็น (ราว 1,500 หน้ากระดาษ) — ไฟล์เดียวกัน คนละแผน ผลจึงไม่เหมือนกัน
3. ตัวเลขอยู่ในกราฟ ไม่ได้อยู่ในเซลล์ — สไลด์กับสเปรดชีตชอบเก็บของสำคัญไว้ในกราฟหรือภาพแปะทับ ซึ่งนับเป็น “รูปภาพ” พอระบบทิ้งรูป ตัวเลขก็หายไปด้วย ทั้งที่เราเห็นเต็มตาตอนเปิดไฟล์
วิธีจับได้ว่ามันอ่านไม่ครบ — 3 เทคนิคที่ใช้ได้ทุกค่าย
สามข้อนี้เป็น วิธีตรวจสอบด้วยตัวเอง ไม่ใช่ฟีเจอร์ที่ผู้ผลิตรับประกัน แต่ได้ผลด้วยเหตุผลเดียวกัน คือบังคับให้ AI อ้างอิงกลับไปที่ตัวไฟล์ แทนการเขียนสรุปแบบเอาสวยไว้ก่อน
1. ให้ระบุหน้าและยกข้อความมาแปะ — ทุกประเด็นต้องมีเลขหน้าและประโยคต้นฉบับกำกับ แล้วเราสุ่มเปิดเช็ก 2 จุด ถ้าหาไม่เจอก็จบข่าว (Anthropic แนะนำให้ยึด เลขหน้าตามโปรแกรมเปิด PDF ไม่ใช่เลขที่พิมพ์บนกระดาษ)
2. ถามดักด้วยสิ่งที่ไม่มีอยู่จริง — ถามถึงหัวข้อที่เรารู้แน่ว่าไม่มีในไฟล์ ถ้ามันตอบเป็นคุ้งเป็นแคว แปลว่ากำลังเดา ไม่ได้อ่านไฟล์อยู่
3. ให้ทำสารบัญก่อนสรุป — สั่งไล่โครงสร้างก่อน (กี่หน้า กี่ชีต หัวข้ออะไรบ้าง) ถ้าโครงยังขาด สรุปที่ตามมาก็ขาดแน่นอน
[แนบ รายงานประจำปี.pdf] ก่อนสรุป บอกก่อนว่าไฟล์นี้กี่หน้า หัวข้อหลักอยู่หน้าไหนบ้าง
ไฟล์นี้มี 58 หน้า — สารจากประธาน (3), ผลประกอบการ (8), ความเสี่ยง (21), งบการเงิน (34)
หัวข้อความเสี่ยง มีพูดถึงอัตราแลกเปลี่ยนไหม ถ้ามีให้ยกประโยคต้นฉบับพร้อมเลขหน้า ถ้าไม่มีให้ตอบว่าไม่มี
ไม่พบเรื่องอัตราแลกเปลี่ยนครับ หน้า 21-25 กล่าวถึงเฉพาะความเสี่ยงด้านซัพพลายเชนและกฎระเบียบ
คำตอบสุดท้ายคือสัญญาณที่ดี — มันกล้าตอบว่า “ไม่มี” แทนที่จะแต่งให้
ก่อนสรุปไฟล์ที่แนบมา ให้ทำ 3 ขั้นตามลำดับ:
1) บอกโครงสร้างไฟล์: จำนวนหน้า/ชีต และรายชื่อหัวข้อหลักพร้อมเลขหน้า
2) บอกว่ามีส่วนไหนที่คุณอ่านไม่ได้หรืออ่านได้ไม่ครบบ้าง เช่น หน้าที่เป็นภาพสแกน ตาราง หรือกราฟ — ถ้าไม่มีให้บอกว่าไม่มี
3) ค่อยสรุปสาระสำคัญ โดยทุกข้อต้องมีเลขหน้าและประโยคต้นฉบับสั้น ๆ กำกับ
ห้ามเดาเนื้อหาที่ไม่ได้อยู่ในไฟล์ ถ้าข้อมูลไม่พอให้บอกตรง ๆ ข้อ 2 คือหัวใจ — เปิดทางให้ AI รายงานข้อจำกัดของตัวเอง แทนที่จะกลบด้วยคำตอบที่ดูสมบูรณ์ (ไม่การันตีว่าจะรายงานครบทุกครั้ง จึงต้องสุ่มเช็กเลขหน้าเองอยู่ดี)
เมื่อไหร่ต้องหั่นไฟล์ และหั่นยังไงให้ได้ผล
หั่นเมื่อเจอ 3 อาการ: ไฟล์ยาวเกินร้อยหน้า · ถามรายละเอียดแล้วได้คำตอบกว้าง ๆ ซ้ำ ๆ · หรือระบบเตือนว่าไฟล์ใหญ่เกิน (Google เขียนเองว่าให้ อัปไฟล์ที่เล็กลง หรืออัปเกรดเพื่อได้ หน้าต่างบริบทใหญ่ขึ้น ส่วน Anthropic ก็แนะนำให้แบ่งเอกสารใหญ่เป็นส่วนย่อย)
- หั่นตามความหมาย ไม่ใช่ตามจำนวนหน้า — แยกเป็นบท เป็นหมวด เป็นชีต ให้แต่ละก้อนจบในตัวเอง ตัดกลางตารางหรือกลางบทคือต้นเหตุของคำตอบมั่ว
- ตั้งชื่อไฟล์ย่อยให้สื่อ เช่น
สัญญา_ข้อ8-12_ค่าปรับ.pdfแล้วอ้างชื่อไฟล์ตอนถาม - ถามทีละก้อน แล้วค่อยให้รวบสรุปตอนท้าย โดยแปะสรุปแต่ละก้อนกลับเข้าไปเอง
- PDF สแกนให้แปลงเป็นข้อความก่อน และตัวเลขในกราฟให้แนบตารางต้นทางไปด้วย
❌ พรอมต์ที่ไม่ดี
[แนบ รายงานรวม_2026.pdf 300 หน้า] สรุปให้หน่อย
ไฟล์ใหญ่ + คำสั่งกว้าง = ระบบหยิบท่อนที่มันคิดว่าเกี่ยวเอง เราไม่มีทางรู้ว่าข้ามอะไร
✅ พรอมต์ที่ดี
[แนบ รายงาน_บท3_ผลประกอบการ.pdf 24 หน้า] สรุปบทนี้เป็น 5 ข้อ ใส่เลขหน้ากำกับทุกข้อ และบอกด้วยว่ามีกราฟหน้าไหนที่อ่านตัวเลขไม่ได้
ก้อนเล็กพอให้อ่านครบ + บังคับอ้างหน้า + เปิดช่องให้บอกจุดที่อ่านไม่ได้
ลิมิตไฟล์เท่าที่แต่ละค่ายประกาศจริง
ใส่เฉพาะตัวเลขที่เขียนในหน้าช่วยเหลือทางการ ช่องไหนไม่ประกาศก็บอกตรง ๆ ว่าไม่ประกาศ
| หัวข้อ | ChatGPT | Claude | Gemini | Perplexity |
|---|---|---|---|---|
| ขนาดไฟล์ | 512MB/ไฟล์ (สเปรดชีตราว 50MB · รูป 20MB) | 500MB/ไฟล์ ในแชต · ไฟล์ในโปรเจกต์ 30MB | 100MB/ไฟล์ · วิดีโอ 2GB | 40MB ทุกชนิดไฟล์ |
| จำนวนไฟล์ | 80 ไฟล์/3 ชม. · แผนฟรี 3 ไฟล์/วัน | 20 ไฟล์/แชต | 10 ไฟล์/พรอมต์ | ไม่ประกาศในหน้านี้ |
| ลิมิตหน้า PDF | ไม่ประกาศเป็นจำนวนหน้า (ไฟล์เอกสารจำกัด 2 ล้านโทเค็น) | 1,000 หน้า | ไม่ประกาศเป็นจำนวนหน้า | ไม่ประกาศ |
| อ่านรูปในเอกสาร | ดึงข้อความ ทิ้งรูป (ยกเว้น Enterprise) | PDF ≤100 หน้าอ่านภาพด้วย · ไฟล์อื่นข้อความล้วน | ไม่ประกาศ | ไม่ประกาศ |
เกร็ดสำหรับคนทำสไลด์: รายการเอกสารที่ Anthropic ประกาศรองรับ (PDF, DOCX, CSV, TXT, HTML, ODT, RTF, EPUB, JSON, XLSX) ไม่มี .pptx ขณะที่ OpenAI ระบุว่ารองรับไฟล์งานนำเสนอด้วย
และตัวเลขพวกนี้คือ “เพดานของระบบ” ไม่ใช่ “เพดานของคุณภาพ” — อัปผ่านไม่ได้แปลว่าอ่านครบ
สรุป
AI อ่านไฟล์เก่งจริง แต่เก่งเท่าที่ “ข้อความที่ระบบดึงออกมาได้” — รูปถูกทิ้ง ไฟล์ยาวถูกหยิบมาบางส่วน และไม่มีใครแจ้งเราว่ารอบนี้ขาดอะไร
จำสามข้อพอ: ให้อ้างเลขหน้าเสมอ · ถามดักด้วยของที่ไม่มีจริง · ไฟล์ใหญ่หั่นก่อนอัป
อ่านเรื่องนี้ต่อ
- แผนฟรีของ AI แชต 4 ค่าย ได้อะไรจริง ๆ บ้าง — หน้าต่างบริบทของแต่ละแผนคือตัวกำหนดว่าไฟล์ยาวแค่ไหนถึงเริ่มหลุด บทนั้นเทียบไว้ครบ
- AI ตอบผิดได้ด้วยเหรอ? รู้จักอาการหลอน (Hallucination) — เวลาอ่านไฟล์ไม่ครบแล้วเติมช่องว่างด้วยการเดา ผลลัพธ์คืออาการเดียวกับในบทนั้น
- ขั้นตอนแนบไฟล์ทีละค่าย: คู่มือ Claude บทที่ 6 · คู่มือ ChatGPT บทที่ 9