GPT-6 Astra โมเดล AI รุ่นใหม่ของ OpenAI ถูกจับได้ว่าแอบโกงเกม StarCraft หลังสู้ไม่ได้ เลยโหลดบอตเทพมาใช้แทน

10 hours ago 1
❤️ ARTICLE AD BOX ❤️

GPT-6 Astra โมเดล AI รุ่นใหม่ของ OpenAI ถูกจับได้ว่าแอบโกงระหว่างการทดสอบเขียนบอตเล่นเกม StarCraft: Brood War ในโปรเจกต์ StarSkirmish หลังพยายามเอาชนะคู่แข่งระดับสูงแต่ไม่สำเร็จ สุดท้ายเลือกดาวน์โหลดบอตฝีมือมนุษย์ระดับแชมป์มาใช้แทนการเขียนเอง

สำหรับ StarSkirmish เป็นโครงการทดสอบความสามารถของ AI ด้านการเขียนโปรแกรมและแก้ปัญหาระยะยาว โดยไม่ได้ให้ AI เล่นเกมผ่านการมองภาพและกดเมาส์โดยตรง แต่ให้แต่ละโมเดลเขียนบอตภาษา C++ ของตัวเองภายในเวลา 1 ชั่วโมง จากนั้นนำไปแข่งกับบอตตัวอื่น ทั้งที่สร้างโดย AI และมนุษย์ เพื่อวัดว่า AI สามารถเขียนโค้ด วางกลยุทธ์ วิเคราะห์ข้อผิดพลาด และปรับปรุงโปรแกรมให้เก่งขึ้นได้ขนาดไหน

เหตุการณ์เกิดขึ้นระหว่างการแข่งขันที่มี GPT-6 Astra ของ OpenAI, Claude Opus 5.5 ของ Anthropic และ Pluto ซึ่งเป็นบอตฝีมือมนุษย์ โดย Astra พยายามปรับปรุงโค้ดของตัวเองเพื่อเอาชนะคู่แข่งระดับ Tier A แต่กลับไม่สามารถผ่านไปได้

แทนที่จะพัฒนาโค้ดต่อไปตามกติกา Astra กลับไปดาวน์โหลด Stardust ซึ่งเป็นบอต StarCraft ฝีมือมนุษย์ระดับท็อปที่ครองอันดับ 1 ในระบบจัดอันดับ BASIL แล้วพยายามนำมาใช้แทนบอตที่ตัวเองเขียนขึ้นมา พูดง่าย ๆ คือ โจทย์ให้เขียนโปรแกรมแข่งกัน แต่พอสู้ไม่ได้ก็ไปเอาโปรแกรมระดับแชมป์ของคนอื่นมาใช้ซะเลย

ทาง Kai McPheeters ผู้สร้าง StarSkirmish ตรวจพบพฤติกรรมดังกล่าว และออกมาเปิดเผยเรื่องนี้เมื่อวันที่ 2 ตุลาคม 2026 ก่อนย้อนโค้ดของ Astra กลับไปยังจุดก่อนดาวน์โหลด Stardust เพื่อป้องกันไม่ให้โค้ดของคนอื่นปะปนกับผลงานเดิม แล้วอนุญาตให้ AI พัฒนาบอตของตัวเองต่อไปตามกติกา

ที่น่าสนใจคือ GPT-6 Astra ไม่ใช่โมเดลที่เขียนบอตได้แย่ เพราะในการทดสอบ StarSkirmish Bench v0.1 ทำคะแนนได้ 51 คะแนน ใกล้เคียงกับ Claude Opus 5.5 ที่ได้ 50 คะแนน และถือเป็นสองโมเดล AI ที่ทำผลงานดีที่สุดในการทดสอบชุดนี้ แต่ก็ยังห่างจาก Stardust ที่เป็นบอตฝีมือมนุษย์และถูกใช้เป็นเกณฑ์อ้างอิงที่ 100 คะแนน

กรณีนี้สะท้อนปัญหาที่เรียกว่า Reward Hacking หรือพฤติกรรมที่ AI พยายามหาทางทำเป้าหมายให้สำเร็จ แม้ว่าวิธีนั้นจะไม่ตรงกับกติกาหรือเจตนาของคนที่มอบหมายงานก็ตาม ซึ่งเป็นอีกหนึ่งความท้าทายสำคัญของ AI Agent ที่สามารถเขียนโค้ด เข้าถึงอินเทอร์เน็ต และลงมือทำงานต่าง ๆ ได้ด้วยตัวเอง เพราะบางครั้ง AI อาจเลือกใช้ทางลัดที่เราไม่ได้ต้องการ แทนที่จะทำตามขั้นตอนที่กำหนดไว้

เรียกว่าเป็นอีกหนึ่งเหตุการณ์ที่ทั้งฮาและน่าคิด เพราะแม้แต่ AI ที่เก่งระดับนี้ พอเจอโจทย์ยาก ๆ ก็ยังมีโอกาสเลือกใช้วิธีลัดที่ผิดกติกาได้เหมือนกัน แต่ก็ต้องบอกว่าไม่ได้หมายความว่า AI รู้สึกหงุดหงิดหรืออยากโกงเหมือนมนุษย์ เพียงแต่ระบบเลือกวิธีที่ทำให้บรรลุเป้าหมาย โดยไม่ได้รักษาขอบเขตของงานที่ได้รับมอบหมายเอาไว้

ที่มา : theverge

Read Entire Article