Claude Opus 5 xây dựng một game FPS có thể chơi được với một prompt đơn giản gồm ba đoạn

Key Takeaways
  • Claude Opus 5 đã phát triển một trò chơi bắn súng góc nhìn thứ nhất có thể chơi hoàn chỉnh chỉ từ một prompt gồm ba đoạn vào ngày 25 tháng 7.
  • Trò chơi chạy trên Three.js và WebGL2 với khoảng 55.000 dòng mã trên 11 phân hệ.
  • Nhiều nhà phát triển đã tái tạo kết quả bằng các prompt giống hệt hoặc được chỉnh sửa; trong đó, James Altucher và Leon Lin đã xây dựng các phiên bản có thể chơi trực tiếp trên trình duyệt.

Nhà đầu tư AI và cựu CEO HyperWrite Matt Shumer đã đăng một video về một game bắn súng góc nhìn thứ nhất (FPS) hoàn toàn có thể chơi được, được xây dựng hoàn toàn bởi Claude Opus 5 chỉ hai ngày sau khi mô hình ra mắt, bằng cách sử dụng một prompt gồm ba đoạn được đăng trên GitHub. Game này, theo Shumer là “đã bắn một phát” mà không cần tài sản bên ngoài, ngay lập tức vấp phải nhiều hoài nghi do chất lượng và tính đơn giản của prompt. Shumer đã công bố đầy đủ prompt và toàn bộ mã nguồn sau khi các nhà phê bình cho rằng có mã hóa thủ công ẩn, khiến nhiều nhà phát triển thử lại với cùng phương pháp mà anh gọi là Gauntlet Loop.

Claude Opus 5 Xây Dựng Game Bắn Súng Góc Nhìn Thứ Nhất Bằng Prompt Gồm Ba Đoạn

Matt Shumer đăng vào ngày 25 Tháng 7 rằng Claude Opus 5 đã xây dựng một game bắn súng góc nhìn thứ nhất với prompt chạy ba đoạn ngắn. Prompt này được đăng đầy đủ trên GitHub, yêu cầu Opus 1.3Mạo một game bắn súng ngang tầm các game Call of Duty gần đây, triển khai subagents cho từng nhiệm vụ riêng lẻ, và lặp lại từng phần thông qua một critic riêng cho đến khi khớp với cảnh quay Call of Duty thật trong các so sánh đối chiếu song song kiểu “blind”. Bản hoàn thiện chạy trên Three.js và WebGL2, với khoảng 55.000 dòng mã trên 11 phân hệ. Mọi texture, mesh, animation và âm thanh đều được tạo ngay trong trình duyệt tại thời điểm tải, không có mô hình tải về hay tệp bên ngoài. Shumer không chỉ định renderer, không liệt kê các hệ thống game, và cũng không đưa ra yêu cầu chất lượng kiểu AAA cụ thể. Prompt yêu cầu subagents phải “bị choáng hoàn toàn” và để phần định nghĩa thực tế cho một critic mà Opus 1.3Mự xây dựng cho chính nó. Nhật ký critic Shumer công bố cho thấy điểm số tăng dần từ 3,59/10 lên chỉ nhỉnh hơn 5, và mọi round được ghi lại đều do Call of Duty thật giành chiến thắng.

Các Nhà Phát Triển Lặp Lại Kết Quả Bằng Prompt Giống Y Hệt Và Có Chỉnh Sửa

James Altucher, cựu quản lý quỹ phòng hộ và podcaster, đã chạy prompt y hệt và báo cáo đã tốn hơn 10 giờ cùng khoảng 1,3 triệu tokens trên Opus 5. Bản của anh, Operation Blackout, có thể chơi miễn phí trực tiếp trong trình duyệt. Nhà phát triển của Prompt Silo đã gửi yêu cầu tương tự tới Sol 5.6 Ultra của OpenAI—top tier trong dòng GPT-5.6 gồm ba mô hình mà OpenAI phát hành rộng rãi vào ngày 9 Tháng 7. Nhà phát triển Leon Lin đã phân tích ngược một prompt chi tiết chạy sâu tới 20 phần, chỉ rõ các yếu tố từ vật lý ragdoll đến bản đồ bóng đổ xếp tầng, rồi đưa vào Cursor với Opus 5 “thuần”, chạy nỗ lực cao nhưng không dùng subagents và không ultracode. Kết quả của anh, Dust Corridor, cũng có thể chơi trực tiếp trong trình duyệt. Không có bản lặp lại nào sau đó trải qua bài kiểm tra “blind” mà Shumer đã chạy cho dự án của mình. Nhật ký critic của Shumer cho thấy Call of Duty thật thắng ở mọi round mà anh ghi lại.

Phương Pháp Gauntlet Loop Đảo Ngược Cách Tiếp Cận Từ Prompt Engineering Truyền Thống

Shumer gọi hướng tiếp cận của mình là Gauntlet Loop: đưa cho một tác nhân một “thước đo” có thật, có thể kiểm tra, thay vì các chỉ dẫn mơ hồ; để nó chia công việc thành từng phần nhỏ; và chuyển từng phần qua một critic mà chưa bao giờ thấy lý do/logic hợp tác của người xây dựng. Hai tính năng của Claude Code hỗ trợ cho vòng lặp này. Subagents được khởi tạo trong các cửa sổ ngữ cảnh cô lập với chỉ dẫn riêng và quyền truy cập công cụ, để một critic chấm một mô hình vũ khí không thừa hưởng “lời bào chữa” từ người xây dựng. Ultracode là một thiết lập trong Claude Code thúc mô hình tăng nỗ lực suy luận lên mức cao nhất và cho phép nó tự viết kế hoạch điều phối, phân tán công việc sang tối đa 16 agents cùng lúc, giới hạn tối đa 1.000 lần chạy mỗi lượt. Kỹ năng tích hợp /loop của Anthropic, được tạo cho các chu kỳ lặp fix-test-adjust, đã ngăn phiên chạy dừng lại khi game trông đã ổn. Shumer không chỉ định một số round và để critic tiếp tục nêu ra các “khoảng trống” mới trong nhiều giờ trước khi anh đóng phiên.

Các Nhà Nghiên Cứu Đưa Ra Lo Ngại Về Tình Trạng Nhiễm Dữ Liệu

Three.js đi kèm bộ điều khiển camera pointer-lock như một ví dụ chính thức, và mẫu nền tảng—nhìn theo chuột, di chuyển WASD, raycasting để bắn súng—đã được fork và hướng dẫn hóa trên GitHub, gists và các diễn đàn phát triển trong hơn một thập kỷ. Một mô hình lập trình được huấn luyện trên các kho mã công khai có khả năng đã thấy hàng trăm, nếu không phải hàng nghìn, game bắn súng gần như giống hệt trước khi đọc prompt của Shumer. Các nhà nghiên cứu về mô hình tạo mã gọi vấn đề này là nhiễm dữ liệu (data contamination), khi một mô hình làm tốt một tác vụ chủ yếu vì các ví dụ gần như giống hệt đã nằm sẵn trong dữ liệu huấn luyện, chứ không phải vì nó đã suy luận ra điều gì đó mới mẻ. Không có bản game bắn súng góc nhìn thứ nhất nào được công bố kèm một kiểm tra về nhiễm dữ liệu. Repo của Shumer có chứa mã do mô hình tạo ra, nhưng điều đó khiến “đã bắn một phát một game AAA” trở thành một tác nhân có khả năng chạy bên trong một trong những thể loại được ghi chép dày đặc nhất trong lập trình, hơn là bằng chứng rằng một AI được thiết kế để làm game bắn súng mà không có tiền đề/không có chất liệu trước đó để dựa vào.

Câu hỏi thường gặp

Prompt Claude Opus 5 của Matt Shumer thực sự chứa những gì? Prompt gồm ba đoạn ngắn được đăng trên GitHub. Nó yêu cầu Opus 5 tạo một game bắn súng ngang tầm các game Call of Duty gần đây, triển khai subagents cho từng nhiệm vụ riêng lẻ, và lặp lại từng phần thông qua một critic riêng cho đến khi khớp với cảnh quay Call of Duty thật trong các so sánh đối chiếu song song kiểu “blind”. Shumer không chỉ định renderer, không liệt kê các hệ thống game, và không định nghĩa các yêu cầu chất lượng AAA. Các nhà phát triển khác đã lặp lại kết quả xây dựng game của Claude Opus 5 như thế nào? James Altucher chạy prompt y hệt và tốn hơn 10 giờ cùng khoảng 1,3 triệu tokens trên Opus 5 để tạo Operation Blackout. Nhà phát triển Prompt Silo dùng Sol 5.6 Ultra của OpenAI với cùng prompt. Nhà phát triển Leon Lin phân tích ngược một prompt chi tiết gồm 20 phần và đưa vào Cursor bằng Opus 5 “thuần”, không dùng subagents và không ultracode, tạo ra Dust Corridor.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận