01
API Grok 4.7 cho Terminal Tự động & Lập trình Agentic
Các agent lập trình tự động thường gặp trở ngại với các công cụ dòng lệnh, môi trường thực thi kiểm thử và các lỗi xây dựng phức tạp gồm nhiều bước. Grok 4.7 cho thấy bước tiến vượt bậc trên các điểm chuẩn lập trình agentic, đạt 38.0% trên Terminal-Bench 4.0 (+17.7 điểm so với Grok 4.6) và 71.0% trên DeepSWE v1.1. Các nhà phát triển và đội ngũ kỹ thuật có thể tự động hóa các quá trình di chuyển phức tạp trên nhiều tệp, thực thi các bộ kiểm thử đầu-cuối và giải quyết các vấn đề ở quy mô toàn bộ kho mã với độ trung thực ổn định.
- Đạt 38.0% trên Terminal-Bench 4.0 (+17.7 điểm cải thiện)
- Đạt 71.0% trên DeepSWE v1.1 cho lập trình ở quy mô kho mã
- Thực hiện liên tục các tác vụ dòng lệnh và lập trình nhiều bước



