GPT-6.1 SOL · SẮP CÓ TRÊN POYO

Lập trình, phân tích tài liệu, thao tác máy tính và tác nhân nhiều bước trong một mô hình

API GPT-6.1 Sol cho lập trình và quy trình tác nhân

GPT-6.1 Sol là mô hình Sol của OpenAI dành cho lập trình phức tạp, thao tác máy tính và công việc chuyên môn. Mô hình hỗ trợ các tác nhân có thể xem xét mã nguồn, sử dụng công cụ, đọc tài liệu chi tiết và hoàn thành nhiệm vụ qua nhiều bước.

Cửa sổ ngữ cảnh 1.050.000 token và mức suy luận có thể điều chỉnh giúp nhà phát triển làm việc với kho mã lớn và tài liệu dài. OpenAI ghi nhận những cải thiện so với GPT-6 Sol trong các đánh giá về kỹ thuật phần mềm, hiểu tài liệu, tự động hóa nghiệp vụ và thao tác máy tính.

Các tính năng chính của API GPT-6.1 Sol

Năng lực dành cho nhóm phát triển và tác nhân làm việc với mã nguồn, tài liệu và ứng dụng.

01

Lập trình phức tạp và kỹ thuật phần mềm

GPT-6.1 Sol có thể khảo sát kho mã, truy tìm lỗi, chỉnh sửa nhiều tệp và xác minh thay đổi trong suốt nhiệm vụ phát triển kéo dài. Theo đánh giá DeepSWE v1.1 của OpenAI, mô hình đạt kết quả ngang GPT-6 Astra và cao hơn điểm tốt nhất của GPT-6 Sol 6,4 điểm phần trăm dù dùng mức suy luận thấp hơn.

  • Khảo sát mã nguồn trên nhiều tệp
  • Triển khai và xác minh thay đổi có phạm vi rõ ràng
  • Hỗ trợ tác nhân lập trình chạy dài hạn
Đánh giá DeepSWE v1.1 của OpenAI về GPT-6.1 Sol, GPT-6 Sol và GPT-6 Astra trong tác vụ kỹ thuật phần mềm

02

Hiểu tài liệu và quy trình nghiệp vụ

GPT-6.1 Sol xử lý PDF chi tiết có bảng, biểu đồ, sơ đồ và chú thích chữ nhỏ. Mô hình cũng điều phối quy trình nghiệp vụ nhiều bước sử dụng nhiều công cụ. OpenAI báo cáo kết quả tốt hơn GPT-6 Sol trên GDP.pdf và cải thiện 4,8 điểm trên AutomationBench ở mức suy luận trung bình.

  • Đọc bảng và sơ đồ phức tạp
  • Liên kết thông tin trong tài liệu dài
  • Thực hiện quy trình công cụ nhiều bước
Đánh giá GDP.pdf của OpenAI về khả năng hiểu tài liệu chuyên môn của GPT-6.1 Sol

03

Thao tác máy tính trên nhiều ứng dụng

GPT-6.1 Sol có thể hiểu ngữ cảnh hình ảnh và thao tác qua giao diện ứng dụng trong quy trình của tác nhân. Ở bài đánh giá OSWorld 2.0 ngoại tuyến, OpenAI báo cáo mô hình cao hơn GPT-6 Sol 7 điểm tại mức suy luận tối đa. Nhóm có thể kết hợp hiểu ảnh chụp màn hình, thao tác giao diện và kiểm tra kết quả trong cùng một quy trình.

  • Hiểu ảnh chụp màn hình và trạng thái hiển thị
  • Thực hiện nhiệm vụ qua giao diện ứng dụng
  • Kiểm tra kết quả sau mỗi thao tác
Đánh giá OSWorld 2.0 ngoại tuyến của OpenAI về GPT-6.1 Sol trong quy trình thao tác máy tính

04

Ngữ cảnh dài và suy luận có thể điều chỉnh

GPT-6.1 Sol nhận tối đa 1.050.000 token ngữ cảnh và tạo tối đa 128.000 token đầu ra. Nhà phát triển có thể chọn mức suy luận low, medium, high, xhigh hoặc max theo độ sâu cần thiết. Đánh giá độ chính xác thực tế của OpenAI cũng cho thấy câu trả lời đáng tin cậy hơn ở mức suy luận thấp. Dải lựa chọn này phù hợp với kho mã lớn, báo cáo dài và phiên tác nhân kéo dài.

  • Đọc tối đa 1.050.000 token ngữ cảnh
  • Chọn một trong năm mức suy luận
  • Tạo tối đa 128.000 token đầu ra
Đánh giá của OpenAI về độ chính xác thực tế của GPT-6.1 Sol và các mô hình GPT-6 khác ở nhiều mức suy luận

Ai có thể hưởng lợi từ API GPT-6.1 Sol?

01

Nhóm phát triển phần mềm

Dùng GPT-6.1 Sol để tìm hiểu kho mã, triển khai tính năng, sửa lỗi và rà soát thay đổi trong nhiệm vụ liên quan đến nhiều tệp.

02

Nhà phát triển tác nhân

Xây dựng tác nhân biết lập kế hoạch, gọi công cụ, xem xét kết quả và tiếp tục công việc dựa trên ngữ cảnh của các bước trước.

03

Nhóm tài liệu và nghiên cứu

Phân tích PDF chi tiết, kết hợp bằng chứng từ biểu đồ và văn bản, rồi tạo bản tóm tắt dựa trên nguồn.

04

Nhóm sản phẩm và đảm bảo chất lượng

Dùng ảnh chụp màn hình và trạng thái ứng dụng để xem xét giao diện, thực hiện quy trình và kiểm tra kết quả quan sát được.

05

Nhóm vận hành

Điều phối các quy trình nghiệp vụ lặp lại qua công cụ, tài liệu và các bước bàn giao, đồng thời theo dõi từng bước.

06

Nhóm khoa học và dữ liệu

Thực hiện phân tích, mô phỏng và nghiên cứu trên terminal khi cần dùng mã nguồn và kiểm tra lặp lại.

So sánh GPT-6.1 Sol, GPT-6 Sol và GPT-6 Astra

Năng lựcGPT-6.1 SolGPT-6 SolGPT-6 Astra
Trọng tâm mô hìnhLập trình phức tạp, thao tác máy tính và quy trình chuyên mônLập trình phức tạp và quy trình tác nhânCác nhiệm vụ đầu cuối đòi hỏi cao nhất
DeepSWE v1.1Ngang Astra; cao hơn điểm tốt nhất của Sol 6,4 điểm phần trăm6.1 Sol cao hơn điểm tốt nhất của mô hình này 6,4 điểm phần trămNgang 6.1 Sol
OSWorld 2.0 ngoại tuyến (mức tối đa)Cao hơn Sol 7 điểm phần trăm; kém Astra 2,1 điểm6.1 Sol cao hơn 7 điểm phần trămCao hơn 6.1 Sol 2,1 điểm phần trăm
Terminal-Bench Science 0.1 (mức tối đa)Điểm cao hơn gấp đôi Sol6.1 Sol đạt điểm cao hơn gấp đôi kết quả nàyĐiểm cao nhất được công bố: 68,1%
Tỷ lệ lỗi thông tin (mức suy luận thấp)7,7%11,4%6.1 Sol chênh lệch không quá 1,9 điểm phần trăm ở các mức đã kiểm tra
Giá chính thức · Đầu vào tiêu chuẩn / 1 triệu token$2.00$2.00$10.00
Giá chính thức · Đầu vào đã lưu cache / 1 triệu token$0.10$0.20$1.00
Giá chính thức · Ghi cache / 1 triệu token$2.50$2.50$12.50
Giá chính thức · Đầu ra tiêu chuẩn / 1 triệu token$10.00$10.00$50.00

Câu hỏi thường gặp về API GPT-6.1 Sol

GPT-6.1 Sol là gì?

GPT-6.1 Sol là mô hình Sol của OpenAI dành cho lập trình phức tạp, thao tác máy tính và quy trình chuyên môn. Mô hình hỗ trợ tác nhân chạy dài hạn làm việc với mã nguồn, tài liệu, công cụ và giao diện ứng dụng.

GPT-6.1 Sol giúp nhóm phần mềm như thế nào?

Nhóm có thể dùng GPT-6.1 Sol để khảo sát kho mã lớn, sửa nhiều tệp, gỡ lỗi và xác minh thay đổi. OpenAI báo cáo mô hình ngang GPT-6 Astra trên DeepSWE v1.1 và cao hơn điểm tốt nhất của GPT-6 Sol 6,4 điểm phần trăm trong đánh giá này.

GPT-6.1 Sol hỗ trợ tài liệu và nghiệp vụ ra sao?

Mô hình đọc được PDF chi tiết có bảng, biểu đồ, sơ đồ và chú thích chữ nhỏ, rồi liên kết thông tin từ tài liệu dài. Mô hình cũng hỗ trợ quy trình công cụ nhiều bước; OpenAI báo cáo mức tăng 4,8 điểm so với GPT-6 Sol trên AutomationBench ở mức suy luận trung bình.

GPT-6.1 Sol hỗ trợ cửa sổ ngữ cảnh và mức suy luận nào?

GPT-6.1 Sol hỗ trợ cửa sổ ngữ cảnh 1.050.000 token và tối đa 128.000 token đầu ra. Nhà phát triển có thể đặt mức suy luận low, medium, high, xhigh hoặc max tùy nhiệm vụ.

API GPT-6.1 Sol có lợi thế giá chính thức gì?

Theo giá API tiêu chuẩn của OpenAI cho yêu cầu có tối đa 272.000 token đầu vào, GPT-6.1 Sol có giá $2 cho đầu vào và $10 cho đầu ra trên mỗi triệu token, thấp hơn 80% so với mức $10 và $50 của GPT-6 Astra. Đầu vào đã lưu cache có giá $0.10, thấp hơn 50% so với mức $0.20 của GPT-6 Sol. Đây là giá API trực tiếp của OpenAI; giá trên PoYo sẽ được công bố khi ra mắt.

Khi nào GPT-6.1 Sol có trên PoYo?

GPT-6.1 Sol sắp có trên PoYo. Trang này tổng hợp năng lực lập trình, tài liệu, thao tác máy tính và tác nhân để giúp các nhóm lên kế hoạch tích hợp.

Vì sao chọn PoYo để tích hợp API GPT-6.1 Sol?

01

Khám phá danh mục mô hình thống nhất

Tìm GPT-6.1 Sol bên cạnh các mô hình PoYo khác và xem năng lực lập trình, tài liệu, thao tác máy tính và tác nhân tại một nơi.

02

Lựa chọn dựa trên đánh giá công bố

Dùng các kết quả OpenAI công bố để so sánh GPT-6.1 Sol, GPT-6 Sol và GPT-6 Astra theo nhiệm vụ của nhóm.

03

Lên kế hoạch cho quy trình phát triển

Xác định cách đưa đầu vào ngữ cảnh dài, mức suy luận và các bước dùng công cụ vào quy trình lập trình và tác nhân.

04

Theo dõi ngày ra mắt trên PoYo

Theo dõi GPT-6.1 Sol sắp có trên PoYo và dùng trang này để chuẩn bị.