ห้องแล็บปัญญาประดิษฐ์ (AI) ชื่อดัง 4 แห่งได้ปล่อยโมเดลภาษาระดับแนวหน้าออกมาภายในช่วงเวลาเพียงสามสัปดาห์ในเดือนกรกฎาคม 2026 และช่องว่างระหว่างสิ่งที่ระบบเหล่านี้ทำงานจนจบได้โดยไม่ต้องมีมนุษย์คอยแทรกแซงกับสิ่งที่เคยทำได้ในอดีตได้แคบลงอย่างมาก
ยักษ์ใหญ่ด้าน AI ปล่อยโมเดลแนวหน้าจำนวน 4 รุ่นใน 3 สัปดาห์ ขณะที่การแข่งขันเข้าสู่โหมดเร่งเต็มพิกัด

ประเด็นสำคัญ
- xAI ส่งมอบ Grok 4.5 เมื่อวันที่ 8 กรกฎาคม ที่ราคา $2/$6 ต่อหนึ่งล้านโทเค็น ตัดราคาของ Opus 4.8 ลงมากกว่า 60%
- Anthropic เปิดตัว Claude Opus 5 เมื่อวันที่ 24 กรกฎาคม เป็นโมเดลเริ่มต้นตัวใหม่บนแพ็กเกจสมัครสมาชิก Claude Max
- Moonshot AI เผยแพร่ Kimi K3 ซึ่งเป็นโมเดลที่ใหญ่ที่สุดของบริษัทที่ 2.8 ล้านล้านพารามิเตอร์
Grok 4.5 จาก xAI, Claude Opus 5 จาก Anthropic, ตระกูล GPT-5.6 จาก OpenAI และ Kimi K3 จาก Moonshot AI ต่างมุ่งแก้ปัญหาเดียวกัน: ทำอย่างไรให้ระบบ AI สามารถแบกรับงานที่กินเวลาหลายชั่วโมง ตั้งแต่วิจัย เขียนโค้ด ไปจนถึงรายงานเชิงโครงสร้าง โดยไม่หลุดแผน
Grok 4.5 ฝึกจากเซสชันนักพัฒนาจริง
xAI เปิดตัว Grok 4.5 เมื่อวันที่ 8 กรกฎาคม โมเดลนี้รันบนฐานที่มี 1.5 ล้านล้านพารามิเตอร์ และได้รับการฝึกบางส่วนจากข้อมูลการใช้งานจริงจาก Cursor แพลตฟอร์มเขียนโค้ดที่ SpaceXAI เข้าซื้อกิจการเมื่อต้นปีนี้ ราคาอยู่ที่ $2 ต่อหนึ่งล้านโทเค็นขาเข้า และ $6 ต่อหนึ่งล้านโทเค็นขาออก พร้อมหน้าต่างคอนเท็กซ์ 500,000 โทเค็น

อีลอน มัสก์อธิบาย Grok 4.5 ว่าเป็นโมเดลระดับ Opus ที่ทำงานได้เร็วกว่าและต้นทุนต่ำกว่า ตัวติดตามอิสระจัดให้อยู่ในอันดับสี่ของ Artificial Analysis Intelligence Index นำหน้าทุกโมเดลแบบ open weight โดยมีราคาต่ำกว่า Claude Opus 4.8 และ GPT-5.5 มากกว่า 60% ใน Terminal-Bench 2.1 ซึ่งเป็นการทดสอบที่ให้คะแนนว่าโมเดลทำงานวิศวกรรมผ่านคอมมานด์ไลน์ได้ดีเพียงใด Grok 4.5 ได้คะแนน 83.3%
การเปลี่ยนแปลงที่ใหญ่กว่าคือประสิทธิภาพต่อโทเค็น xAI ระบุว่าโมเดลนี้ต้องใช้โทเค็นขาออกเพียงราวหนึ่งในห้าของที่ Opus 4.8 ต้องใช้สำหรับงานที่เทียบเคียงกันได้ ซึ่งช่วยลดต้นทุนในการรันเซสชันเอเจนต์ที่ยาวนาน
Claude Opus 5 ยืนราคาเดิม
Anthropic เปิดตัว Claude Opus 5 เมื่อวันที่ 24 กรกฎาคม โดยวางตำแหน่งให้เป็นโมเดลที่เข้าใกล้ประสิทธิภาพของ Claude Fable 5 ซึ่งเป็นรุ่นที่ทรงความสามารถที่สุดของบริษัท ในราคาครึ่งหนึ่งของ Fable ที่ $10 ขาเข้าและ $50 ขาออก ต่อหนึ่งล้านโทเค็น ส่วน Opus 5 เองยังคงราคาเท่าเดิมที่ $5 ขาเข้าและ $25 ขาออก เช่นเดียวกับรุ่นก่อนหน้า Opus 4.8

โมเดลนี้มาพร้อมหน้าต่างคอนเท็กซ์ 1 ล้านโทเค็น โทเค็นขาออกสูงสุด 128,000 โทเค็น และการตั้งค่า “ความพยายามในการให้เหตุผล” ที่ปรับได้ ตั้งแต่ระดับต่ำไปจนถึงโหมด xhigh ใหม่ Anthropic ระบุว่า Opus 5 ทำสถิติใหม่ใน Frontier-Bench และ GDPval-AA ซึ่งเป็นการประเมินงานเขียนโค้ดและงานความรู้สองรายการ แม้จะยังตามหลังโมเดล Claude Mythos 5 แบบจำกัดสิทธิ์ในงานด้านความปลอดภัยไซเบอร์ก็ตาม ตอนนี้ Opus 5 เป็นโมเดลเริ่มต้นบน Claude Max และเป็นตัวเลือกที่แข็งแกร่งที่สุดบน Claude Pro
OpenAI แบ่ง GPT-5.6 ออกเป็นสามระดับ
OpenAI เปิดให้ GPT-5.6 ใช้งานได้ทั่วไป เมื่อวันที่ 9 กรกฎาคม หลังช่วงพรีวิวสองสัปดาห์ที่จำกัดไว้ราว 20 องค์กรซึ่งผ่านการคัดกรองโดยรัฐบาลสหรัฐฯ ตามคำสั่งฝ่ายบริหารที่เชื่อมโยงกับการทบทวนความปลอดภัยของโมเดลระดับแนวหน้า ตระกูลนี้มาในสามระดับ: Sol รุ่นเรือธง ราคา $5 ขาเข้าและ $30 ขาออก ต่อหนึ่งล้านโทเค็น; Terra รุ่นกลาง ราคา $2.50 และ $15 ซึ่ง OpenAI ระบุว่าเทียบเท่า GPT-5.5 ด้วยต้นทุนครึ่งหนึ่ง; และ Luna ระดับที่เร็วและต้นทุนต่ำ ราคา $1 และ $6

OpenAI รายงานว่า Sol เป็นผู้นำใน Artificial Analysis Coding Agent Index และทำได้ 88.8% บน Terminal-Bench 2.1 โดยเพิ่มเป็น 91.9% เมื่อโมเดลรันซับเอเจนต์สี่ตัวแบบขนานภายใต้โหมด ultra ใหม่ ทั้งสามระดับได้รับเรตติ้งความเสี่ยงภายในที่สูงที่สุดของ OpenAI สำหรับศักยภาพการนำไปใช้ในทางมิชอบด้านไซเบอร์และชีวภาพ ซึ่งเป็นเหตุให้มีการทบทวนเพิ่มเติมระหว่างพรีวิวที่ถูกจำกัดโดยรัฐบาล
Kimi K3 ผลักโมเดล Open Weight เข้าใกล้แนวหน้า
Moonshot AI เปิดตัว Kimi K3 เมื่อวันที่ 16 กรกฎาคม ซึ่งเป็นโมเดล mixture of experts ขนาด 2.8 ล้านล้านพารามิเตอร์ มีผู้เชี่ยวชาญรวม 896 ตัว และใช้งานพร้อมกัน 16 ตัวต่อหนึ่งงาน โมเดลนี้มีหน้าต่างคอนเท็กซ์ 1 ล้านโทเค็น และรองรับอินพุตมัลติโหมดแบบเนทีฟ โดยราคา API อยู่ที่ $3 ขาเข้าและ $15 ขาออก ต่อหนึ่งล้านโทเค็น Moonshot ให้คำมั่นว่าจะเผยแพร่น้ำหนักแบบเปิดเต็มรูปแบบภายในวันที่ 27 กรกฎาคม

K3 เป็นโมเดลแบบ open-weight ที่ใหญ่ที่สุดที่ถูกปล่อยออกมาจนถึงปัจจุบัน โดยมีขนาดใหญ่กว่าราว 75% เมื่อเทียบกับโมเดลแบบเปิดที่ใหญ่ที่สุดซึ่งถูกใช้อย่างแพร่หลายในก่อนหน้านี้ ตัวติดตามอิสระจัดให้ K3 อยู่ในอันดับสี่ในบรรดาระบบแนวหน้าปัจจุบัน โดยตามหลัง Claude Fable 5 และ GPT-5.6 Sol แต่แซงหน้า Claude Opus 4.8
ทำไมช่องว่างกับโมเดลรุ่นก่อนจึงสำคัญ
หน้าต่างคอนเท็กซ์ที่ต่ำกว่า 200,000 โทเค็นเคยบังคับให้นักพัฒนาต้องแตกโค้ดเบสขนาดใหญ่หรือชุดข้อมูลวิจัยออกเป็นชิ้น ๆ ตอนนี้ทุกโมเดลในกลุ่มนี้รันได้ที่ 500,000 โทเค็นขึ้นไป และสามในสี่โมเดลไปถึง 1 ล้านโทเค็น ทำให้หนึ่งเซสชันสามารถถือทั้งรีโพซิทอรีหรือกองเอกสารแหล่งข้อมูลปฐมภูมิได้ครบ
ความน่าเชื่อถือของเอเจนต์ก็ขยับไปด้วย ระบบในช่วงปี 2023 และ 2024 มักหลุดแผนหลังจากเรียกใช้เครื่องมือได้ไม่กี่ครั้ง โมเดลที่ปล่อยในเดือนนี้ถูกสร้างมาเพื่อคงความต่อเนื่องของขั้นตอนที่ประสานกันได้เป็นสิบ ๆ ขั้น และฟื้นตัวได้เมื่อการเรียกเครื่องมือส่งข้อมูลที่ผิดพลาดกลับมา แทนที่จะค้างหรือหยุดทำงาน
สำหรับนักพัฒนา ผลลัพธ์เชิงปฏิบัติคือ “ต้นทุนต่อภารกิจที่เสร็จ” ลดลง มากกว่าจะเป็นเพดานที่สูงขึ้นของตัวชี้วัดเดี่ยว ๆ การควบคุมความพยายามใน Opus 5 การกำหนดราคาเป็นระดับใน GPT-5.6 และคำกล่าวอ้างด้านประสิทธิภาพของ Grok 4.5 ล้วนชี้ไปยังเป้าหมายเดียวกัน: ให้ทีมเลือกได้ว่างานหนึ่ง ๆ สมควรใช้คอมพิวต์มากแค่ไหน แทนที่จะต้องจ่ายราคาเรือธงกับทุกคำขอ
สำหรับองค์กรและผู้กำหนดนโยบาย การปล่อย GPT-5.6 แบบมี “ประตูรัฐบาล” ส่งสัญญาณว่าการกำกับดูแลถูกฝังอยู่ในตารางการปล่อยของโมเดลที่ใหญ่ที่สุดแล้ว ไม่ใช่มาเพิ่มทีหลัง การระงับการเข้าถึง Fable และ Mythos แบบสั้น ๆ ของ Anthropic ในเดือนมิถุนายนที่เป็น การระงับที่รัฐบาลสั่งการ คือเวอร์ชันก่อนหน้าของรูปแบบเดียวกันนี้
บทความนี้แปลจากภาษาอังกฤษโดยใช้ AI เวอร์ชันภาษาอังกฤษต้นฉบับเป็นแหล่งข้อมูลที่เชื่อถือได้ การแปลอัตโนมัติอาจมีความไม่ถูกต้อง โดยเฉพาะอย่างยิ่งในคำศัพท์ทางกฎหมายและข้อบังคับ

















