กลับไปข่าว AI Game
ข่าวเกม AI

AAArena ทดสอบเอเจนต์ AI เขียนบอตแข่ง 12 เกม พบขึ้นอันดับ 1 ได้ 6 เกม

โดย GameSlash

งานวิจัย AAArena จาก Tsinghua ใช้ 12 เกมและโปรแกรมผู้แข่งขันเดิม 1,920 ชุดทดสอบ AI ที่อ่านกติกา เขียนบอต และปรับกลยุทธ์จากรีเพลย์ ผลที่ดีที่สุดขึ้นอันดับหนึ่ง 6 เกม

AIAI Agentงานวิจัย

ทีมนักวิจัยมหาวิทยาลัย Tsinghua เผยแพร่ AAArena ซึ่งเป็นชุดทดสอบเอเจนต์ AI เมื่อ 8 ตุลาคม 2026 โดยให้ AI อ่านกติกา เขียนโปรแกรมเล่นเกม และเรียนรู้จากผลแข่งขัน 12 เกม ผลที่รายงานพบว่าการตั้งค่าที่ใช้ Claude Opus 5.5 ร่วมกับ Claude Code สามารถพาบอตขึ้นอันดับ 1 ได้ 6 เกม เทียบกับอันดับของโปรแกรมผู้เข้าแข่งขันที่เก็บไว้

แผนภาพ AAArena แสดงเกมแข่งขัน 12 เกมและกราฟเปรียบเทียบ Elo ของบอตจาก AI หลายระบบกับโปรแกรมผู้เข้าแข่งขันเดิม
ภาพที่ 1 จาก AAArena โดย Kaisen Yang และคณะ (2026), arXiv:2610.12341 — CC BY 4.0

ภาพ: ภาพต้นฉบับในบทความวิจัย | สัญญาอนุญาต CC BY 4.0

AAArena ไม่ได้ให้โมเดลลงไปกดปุ่มควบคุมตัวละครเองทุกจังหวะ แต่ให้เอเจนต์พัฒนาโค้ดของบอตที่ใช้ลงแข่งจริง เมื่อแพ้ก็อ่านบันทึกการแข่งขันและแก้กลยุทธ์ในโค้ดเพื่อทดสอบซ้ำ ทั้งหมดทำโดยไม่ต้องปรับน้ำหนักโมเดล AI ตัวตั้งต้น

ทีมงานรวบรวมโปรแกรมคู่แข่งจากการแข่งขันของมนุษย์รวม 1,920 ชุด แบ่งเป็นเกมหลายแนว ตั้งแต่การเดินเขาวงกต แย่งพื้นที่ ไปจนถึงการบริหารทรัพยากร จำนวน 1,920 นี้หมายถึงจำนวนโปรแกรมในฐานเปรียบเทียบ ไม่ใช่จำนวนผู้เล่นมนุษย์ที่ไม่ซ้ำกัน การทดลองเปรียบเทียบเอเจนต์ 7 รูปแบบภายใต้งบจำกัดในการลองแข่งและประเมินอันดับ

แม้ระบบที่ดีที่สุดจะครองอันดับ 1 ได้ครึ่งหนึ่งของเกม แต่ไม่มีระบบใดจากชุดทดสอบขึ้นอันดับหนึ่งในอีก 6 เกม งานวิจัยชี้ว่าเกมที่มีเอกสารกติกาซับซ้อนมักทำให้บอตพัฒนากลยุทธ์ได้ยากขึ้น ผลนี้จึงยังไม่ใช่หลักฐานว่า AI เล่นหรือเขียนบอตเก่งกว่ามนุษย์ในทุกเกม

ผลดังกล่าวช่วยให้เห็นความต่างระหว่าง AI ที่เพียงตอบคำถามกับ AI Agent ที่ปรับซอฟต์แวร์ของตัวเองหลังเห็นผลลัพธ์จริง อ่านงานในอีกมุมได้จาก OpenGameEval ที่ทดสอบเอเจนต์ใน Roblox Studio ซึ่งเป็นโจทย์สร้างเกม ไม่ใช่การแข่งขันเขียนบอต

ต้นทาง: บทความวิจัย AAArena (8 ต.ค. 2026) | เว็บไซต์โครงการ | โค้ดบน GitHub

ดูแหล่งที่มา