Grok Build: เปิดสนามชน Claude Code และ Codex สรุปผลทดสอบจริงจากคลิป Bijan Bowen
xAI ปล่อย Grok Build ซึ่งเป็น terminal coding agent ตัวใหม่ที่วางตัวชน Claude Code และ Codex โดยตอนนี้เปิดเฉพาะผู้สมัคร SuperGrok Heavy ราคา $300 ต่อเดือน Bijan Bowen ทดสอบใช้งานจริงควบกับโมเดล Grok 4.3 นาน 44 นาที พบว่าความเร็วสูงมาก และความสามารถด้าน multimodal น่าสนใจ แต่ยังเป็น early beta ที่คุณภาพงานไม่สม่ำเสมอ

ช่อง Bijan Bowen หยิบ Grok Build เวอร์ชัน early beta ซึ่งเป็น coding agent บนเทอร์มินัลตัวใหม่จาก xAI มาทดสอบชนกับ Claude Code และ Codex ควบคู่ไปกับโมเดล Grok 4.3 ตัวเต็มที่เพิ่งออกจากสถานะเบต้าช่วงเดือนเมษายน 2026 คลิปทดสอบความยาวกว่า 44 นาทีนี้ เผยให้เห็นทั้งความเร็วที่น่าทึ่งและความสามารถ multimodal ที่แปลกใหม่ แต่จุดที่ผู้รีวิวเน้นย้ำตั้งแต่ต้นคือ ปัจจุบันเครื่องมือนี้ยังจำกัดให้ใช้เฉพาะผู้สมัครแพ็กเกจ SuperGrok Heavy ราคา $300 ต่อเดือนเท่านั้น ซึ่งถือเป็นเรตที่สูงที่สุดในกลุ่ม Frontier Labs ฝั่งสหรัฐ แม้จะมีดีลราคาพิเศษราว $99 ต่อเดือนให้เห็นบ้างก็ตาม ในเซสชันนี้ ระบบให้ context length รวมสูงถึง 512k สำหรับนักพัฒนาที่กำลังจับตาดูทิศทางของ AI coding agent บทความนี้สรุปทุกประเด็นสำคัญจากคลิป ทั้งการทดลองฟีเจอร์และผลลัพธ์การรันโค้ดสดแบบตรงไปตรงมา (Bijan Bowen, YouTube)
1. Grok Build คืออะไร และวางตัวชน Claude Code กับ Codex ตรงไหน
Bijan Bowen อธิบายว่า Grok Build วางตำแหน่งเป็นคู่แข่งโดยตรงของ Claude Code และ Codex บนสมรภูมิเทอร์มินัล โดยใช้ Terminal User Interface (TUI) เป็นหลัก สิ่งที่ทำให้ผู้รีวิวประทับใจตั้งแต่แรกสัมผัส คือการผสมผสานระหว่างเทอร์มินัลแบบดั้งเดิมกับความสะดวกของ IDE ตัวอย่างเช่น เมื่อพิมพ์คำสั่งสั่งการผ่านเทอร์มินัล ระบบยังมีหน้าต่างป็อปอัปให้ใช้เมาส์คลิก approve, revise หรือ abandon แผนงานได้ทันที ช่วยลดความเกร็งในการจำคีย์ลัดลงไปได้มาก
ขั้นตอนการเริ่มต้นใช้งานทำได้ไม่ยาก เริ่มจากการรันคำสั่งติดตั้ง ล็อกอินยืนยันตัวตนกับบัญชี xAI ผ่านเบราว์เซอร์ แล้วพิมพ์คำว่า grok บนเทอร์มินัลเพื่อเปิดเซสชัน เมื่อผู้รีวิวถามระบบว่ารันอยู่บนโมเดลอะไร ตัวระบบตอบว่าเป็น Grok 4.3 นอกจากนี้ยังพบรายละเอียดที่น่าสนใจว่า ฟีเจอร์ web search ภายในแอบเรียกใช้โมเดล Grok 4.20 multi-agent อีกตัวหนึ่งด้วย ขณะที่หน้าจอจะแสดง Chain of Thought ค่อนข้างชัดเจน ทำให้ผู้ใช้เห็นกระบวนการคิดของโมเดลแบบเรียลไทม์
2. ฟีเจอร์เด่นจากการเดินดูเอกสารและการทดลองจริง
จากเอกสารและการลองเล่นจริงในคลิป Grok Build พกฟีเจอร์สำหรับ coding agent ยุคใหม่มาค่อนข้างครบครัน แม้จะเป็นการทดสอบแบบรวดเร็วจนอาจยังไม่ได้ลองครบทุกคำสั่ง แต่ก็มีไฮไลต์สำคัญที่น่าสนใจหลายจุด
Plan Mode โหมดวางแผนที่ระบบจะล็อกไม่ให้แก้ไขไฟล์ใดๆ ยกเว้นไฟล์แผนงานของเซสชัน เมื่อได้รับคำสั่ง ระบบจะร่างโครงสร้างสถาปัตยกรรมและขั้นตอนการทำงานก่อนลงมือจริง แม้ช่วงแรกผู้รีวิวจะเปิดโหมดนี้ไม่ติด แต่สุดท้ายพบว่าสามารถสลับโหมดได้ด้วยการกด Shift + Tab ซึ่งใช้สลับโหมด Always Approve ได้ด้วย จุดที่น่าประทับใจคือเมื่อสั่งให้วางแผนทำเกมสเก็ตบอร์ด C++ ระบบสามารถสแกน repository เจาะหาไฟล์ instruction และร่างแผนการพัฒนาทั้งหมดขึ้นมาได้เองอย่างเป็นระบบ
Always Approve หรือ Full-Access โหมดการทำงานอัตโนมัติที่เทียบเท่ากับแฟล็ก dangerously-skip-permissions ใน Claude Code หรือดร็อปดาวน์ full access ใน Codex เหมาะสำหรับงานที่ต้องการให้ AI ลุยเองยาวๆ โดยไม่ต้องคอยกดยืนยันทุกสเต็ป เช่น การสั่งให้ clone repository แล้วบิลด์ต่อทันที
Sub-Agents Grok Build สามารถแตก sub-agent ออกไปลุยงานย่อยคู่ขนานได้ ความสามารถนี้เริ่มกลายเป็นมาตรฐานของ coding agent ยุคนี้ (คล้ายกับฟีเจอร์ agent swarm ใน Kimi K2.6) แต่ความพิเศษคือการเห็น sub-agent ถูก spawn ขึ้นมาทำงานและรายงานผลตรงจากหน้าต่างเทอร์มินัล
Skills, Plugins และ Marketplace ตัวระบบรองรับ skills และ plugins เสริม พร้อมทั้งมีแท็บ Marketplace ให้เลือกค้นหาและติดตั้ง plugin เพิ่มเติม ช่วยขยายขีดความสามารถในการทำงานเฉพาะทางได้ยืดหยุ่น
Memory และคำสั่ง Dream ในส่วน shell-provided commands มีคำสั่งแปลกใหม่อย่าง dream ที่ใช้ทริกเกอร์ offline memory consolidation เพื่อรวบรวมบริบทความจำ, คำสั่ง memory สำหรับค้นหาและแก้ไขหน่วยความจำถาวร และคำสั่ง flush เพื่อบันทึกความจำลงดิสก์ จากการทดลองพบว่าระบบจำบริบทได้ดีจริง เพราะเมื่อสั่งแก้งานรอบหลัง ระบบยังดึงเอาข้อความเชิงกำชับที่เคยพิมพ์ไว้ก่อนหน้ามาอ้างอิงได้อย่างถูกต้อง
สร้างภาพและวิดีโอในเทอร์มินัล หนึ่งในฟีเจอร์ที่สร้างความตื่นตาตื่นใจที่สุดคือการสั่งสร้างสื่อได้โดยตรง เพียงพิมพ์คำว่า imagine ตามด้วยพรอมต์ ระบบจะเจนภาพหรือวิดีโอแล้วเซฟลงในโฟลเดอร์ Grok sessions ซึ่งผู้พัฒนาสามารถนำภาพที่ได้มาใช้เป็น reference image ในการสั่งให้ระบบเขียนโค้ดต่อได้ทันที
รองรับ Custom Model Grok Build ไม่ได้ผูกขาดเฉพาะโมเดลของ xAI เท่านั้น แต่เปิดให้ต่อ custom model อื่นๆ รวมถึงการเชื่อมต่อกับ local model ได้ตามต้องการ
กำแพงราคา $300 ต่อเดือน ฟีเจอร์ทั้งหมดนี้ยังผูกอยู่กับแพ็กเกจ SuperGrok Heavy ราคา $300 ต่อเดือน แม้จะมีกระแสเรื่องดีลส่วนลด $99 ออกมาเป็นระยะ แต่ผู้รีวิวคาดว่าในอนาคต xAI น่าจะทยอยเปิดให้แพ็กเกจระดับรองลงมาเข้าถึงได้มากขึ้น
3. ผลงานจริง 6 โปรเจกต์ที่รันสดในคลิป
หัวใจสำคัญของการรีวิวคือการปล่อยให้ Grok Build รันงานสดแบบไม่มีการตัดต่อ ซึ่ง Bijan Bowen ได้ทดสอบทั้งหมด 6 ชิ้นงานพร้อมวิจารณ์ตรงไปตรงมา
Browser OS เวอร์ชัน 3D การทดสอบแรกคือการสั่งทำ Browser OS V2.5 ที่ต้องมีมินิเกม GTA โคลนแบบ 3D, เกม 3D อีกหนึ่งเกม, ฟังก์ชันเปลี่ยน wallpaper และแอปเสริม สิ่งแรกที่เห็นชัดเจนคือความเร็วในการสร้างโค้ดที่ไวมาก แม้จะใช้โหมดปกติ ตัวระบบสามารถสร้าง UI ออกมาได้ครบ ทั้งนาฬิกา เมนู Start ช่องค้นหา File Explorer รวมถึงฟีเจอร์เด่นอย่าง Nexus ที่จัดหน้าต่างแบบโฮโลแกรม 3D สำหรับเกม GTA โคลน ตัวเกมมีเมือง รถยนต์ คนเดินถนน และเก็บเหรียญได้จริง แต่ยังมีบั๊กตรรกะ เช่น รถตำรวจวาร์ปมาทับตำแหน่งผู้เล่นแบบไม่มีระยะห่าง โดยรวมจัดว่าผ่านเกณฑ์การทดสอบบนเบราว์เซอร์ แม้จะยังมีจุดบกพร่องตามสไตล์โมเดลที่ยังไม่ใช่ frontier ตัวท็อปสุด
เกมสเก็ตบอร์ด C++ ผู้รีวิวสร้างโฟลเดอร์ใหม่พร้อมระบุ instruction สำหรับทำเกมสเก็ตบอร์ด C++ สไตล์เรโทร Grok Build ทำงานได้อย่างน่าประทับใจด้วยการสร้าง architecture tradeoff matrix กำหนดขอบเขตโค้ด 2,000 ถึง 3,000 บรรทัด และตั้งตัววัดความสำเร็จว่าต้องเล่นได้ต่อเนื่อง 3 ถึง 5 นาทีโดยไม่แครช ในการรันรอบแรกกราฟิกและสียังดูกลืนกัน ผู้รีวิวจึงจับภาพหน้าจอแล้วส่งกลับเข้าไปให้ระบบวิเคราะห์ ด้วยความสามารถ multimodal ทำให้ระบบแก้ไขเรื่องสีและองค์ประกอบภาพได้ดีขึ้นทันตา แม้ระบบฟิสิกส์การกระโดดยังไม่สมบูรณ์แบบ แต่การแก้ปัญหาจากภาพหน้าจอถือว่าทำได้ยอดเยี่ยม
เดโมเว็บจาก Repo อัลกอริทึมของ X ผู้รีวิวสั่งให้ระบบ clone repository อัลกอริทึมของ X จาก GitHub แล้วสร้างเว็บเดโมจำลองการให้คะแนนโพสต์ จุดเด่นคือระบบไม่ได้เมคข้อมูลมั่ว แต่แจ้งผู้ใช้ตรงๆ ว่า repo ต้นทางไม่มี trained weights หรือข้อมูล user history จริง จึงเสนอทำเป็น educational simulator เพื่อความสมจริง งานชิ้นนี้ใช้เวลาราว 6 นาที ได้หน้าเว็บที่มี Seven-Stage Stepper, การ์ดกรองเงื่อนไขพร้อมลิงก์ไปยังไฟล์ต้นฉบับ และตารางปรับค่าน้ำหนักที่คำนวณคะแนนใหม่ได้ทันที ถือเป็นงาน front-end ซับซ้อนที่ทำออกมาได้เนียนตา
เกมขับเครื่องบิน Low-Poly ผู้รีวิวทดสอบกระบวนการ multimodal coding โดยสั่งให้ Grok เจนภาพเครื่องบินขึ้นมาก่อน แล้วนำภาพนั้นเป็น reference เพื่อเขียนเกมเครื่องบิน F-16 สไตล์ low-poly ผลลัพธ์ที่ได้ออกมาเหนือความคาดหมาย ทั้งโมเดลเครื่องบิน ก้อนเมฆ และฉากภูมิประเทศ จัดเป็นหนึ่งในงานจำลอง 3D ที่สวยงามและสมบูรณ์ที่สุดชิ้นหนึ่งที่เคยทดสอบมา
แปลง UI Mockup เป็นหน้าเว็บจริง เมื่อป้อนภาพ mockup เว็บไซต์ Token Sphere แล้วสั่งให้เขียนโค้ดให้เหมือนแบบเป๊ะ (pixel perfect) ระบบกลับตีความตรงตัวเกินไปจนวาดกรอบหน้าต่างเบราว์เซอร์ ปุ่มปิด และแถบ URL ติดมาในหน้าเว็บด้วย ยิ่งไปกว่านั้น แดชบอร์ดภายในยังกินแรมมหาศาลจนทำให้เครื่องทดสอบเกิดอาการ out of memory จึงไม่สามารถทดสอบต่อจนจบได้
ชุดกลองเสมือนจริง (Virtual Drum Kit) โปรเจกต์สุดท้ายคือชุดกลอง 4 แทร็กพร้อมระบบ Auto-play โดยสั่งงานผ่าน Plan Mode และรันด้วย Always Approve ผลงานที่ได้มีโมเดลกลอง 3D สวยงาม ปรับ BPM และหมุนมุมมองได้จริง แต่การจัดวางปุ่มควบคุมยังดูรกตา และที่สำคัญคือเสียงสังเคราะห์ที่ออกมาแตกพร่า (overdrive) อย่างหนัก ซึ่งตรวจสอบแล้วว่าเป็นบั๊กจากฝั่งโค้ด ไม่ใช่ปัญหาจากลำโพง
4. สรุปจุดแข็ง จุดอ่อน และความคุ้มค่า
Bijan Bowen ให้ความเห็นสรุปไว้อย่างน่าสนใจ โดยยกให้ ความเร็ว เป็นจุดเด่นอันดับหนึ่ง เพราะทำงานเสร็จไวกว่าเครื่องมือส่วนใหญ่ในตลาด ตามด้วย ความสามารถ Multimodal ที่ใช้งานได้จริง ทั้งการนำภาพหน้าจอมาดีบักโค้ด และการเจนภาพอ้างอิงเพื่อนำไปขึ้นโครง 3D นอกจากนี้ยังชื่นชมงานดีไซน์ TUI ที่ผสานการคลิกเมาส์ได้อย่างลงตัว
ในส่วนของ จุดอ่อน ผลงานเว็บหลายชิ้นยังคอมไพล์ติด error ในรอบแรก ทำให้ผู้ใช้ต้องคอยแก้รอบสอง ตัวระบบยังขาดการทดสอบอัตโนมัติด้วย headless browser ที่แม่นยำพอ บางครั้งระบบยังมีอาการจำฝังใจกับคำสั่งเดิม เช่น การรันโหมดวางแผนซ้ำซาก หรือแอบไปดึงไฟล์จากโฟลเดอร์เก่าเข้ามาปน รวมถึงงานด้านฟิสิกส์และเสียงที่ยังขาดความสมบูรณ์
Grok Build ในสถานะ Early Beta ควบคู่กับ Grok 4.3 นับเป็นการเปิดตัวที่น่าจับตามองของ xAI ความเร็วและลูกเล่น multimodal คืออาวุธสำคัญที่สร้างความแตกต่าง แต่ด้วยคุณภาพของโค้ดที่ยังแกว่งและกำแพงราคา $300 ต่อเดือน ทำให้ตอนนี้ยังเหมาะสำหรับทีมพัฒนาหรือสายทดลองที่มีงบประมาณ มากกว่าจะเป็นเครื่องมือหลักสำหรับทุกคน การรอให้ระบบเสถียรขึ้นและเปิดให้แพ็กเกจทั่วไปใช้งานได้ น่าจะเป็นจังหวะเวลาที่คุ้มค่ายิ่งกว่า
ชอบเรื่องแนวนี้ มีอีบุ๊คฟรีให้อ่านต่อ
Local LLM ฉบับเข้าใจง่าย รัน AI ไว้ในเครื่องตัวเอง ติดตั้ง อัปเดต จัดการ ลบ ครบวงจรด้วย Ollama
กดสมัครแล้วเราจะส่งเทคนิค AI และของแจกใหม่ๆ ให้ทางอีเมล เลิกรับได้ตลอด
สร้าง AI Automation Pipeline ทุกแบบ ด้วย Agents และ Skills

ปูจากพื้นฐาน prompt, context และ cost ไปจนปั้น Skill สั่ง Agent กับ Sub-agent แล้วต่อทุกอย่างเป็น pipeline อัตโนมัติที่ออกแบบเองได้ ดูฟรี 7 บทก่อนตัดสินใจ


