OpenAI ra mắt GPT-6 Astra, chuyển từ AI trò chuyện sang làm việc

OpenAI vừa công bố GPT-6 Astra, thông minh và được căn chỉnh tốt nhất từ trước tới nay, thiết kế để trực tiếp sử dụng máy tính, trình duyệt và các ứng dụng.

OpenAI ra mắt GPT-6 Astra, chuyển từ AI trò chuyện sang làm việc

OpenAI hôm nay công bố GPT-6 Astra, đánh dấu một bước chuyển đáng chú ý trong chiến lược phát triển các mô hình AI thế hệ mới. Theo công ty, Astra không đơn thuần là một phiên bản ngôn ngữ lớn có khả năng trả lời tốt hơn, mà được xây dựng để trở thành một “tác nhân AI” có thể trực tiếp thực hiện công việc trên máy tính.

6zdvpp9z-p4v3etp4jtze3tohtrmufcy-tzopmhwthx0qrmbt8xozuqhovnic72u-6ma-ch9dszf0-ln-rhdjbvjru8beso3m9e-aqdemetot1adi5nlacvpr-8yziixdpyangahwcua7ovvs-lxwlrt-8cq-z39hjm9p00kn5d3-nuy7wd6-cj793v-jhd.jpg
OpenAI tuyên bố mô hình GPT-6 Astra tiến tới trở thành tác nhân AI.

OpenAI tuyên bố Astra hiện là mô hình có năng lực cao nhất của hãng và đạt kết quả hàng đầu trong nhiều lĩnh vực, từ sử dụng máy tính, lập trình, khoa học, toán học cho tới an ninh mạng và các công việc chuyên môn.

Từ trả lời câu hỏi sang trực tiếp làm việc

Điểm đáng chú ý nhất của GPT-6 Astra nằm ở khả năng sử dụng máy tính. Thay vì chỉ hướng dẫn người dùng cách làm, Astra có thể trực tiếp thực hiện nhiều thao tác như điền biểu mẫu trực tuyến, cập nhật dữ liệu trong hệ thống CRM, sắp xếp lịch, tìm kiếm thông tin trên Internet rồi tổng hợp thành báo cáo hoặc làm việc trong các phần mềm chuyên dụng.

xqtavgkyxy86fb8odw47zozgzchfcphizb3dws6teui7pn78l6sc1bsybdsbumow1oditdyahkaapomh0rbtohajbzjudkz28t2gvmi891ryv7kdtqto5frkru0dnzoxmx3gqhb-y-qqbn5zl0sd5rdrfke31jpm8cufhxu6ilpnkdxpaupn2mpjdqlonxgr.jpg
GPT-6 Astra có thể làm được nhiều việc từ duyệt web, mua sắm cho đến sử dụng các công cụ thành thạo để trả lại kết quả chứ không chỉ là ...hướng dẫn.

OpenAI cũng đưa ra những ví dụ cho thấy Astra có thể phân tích dữ liệu khoa học, tạo biểu đồ, xây dựng website, kiểm tra giao diện, cài đặt và thử nghiệm phần mềm hay xử lý các vấn đề xuất hiện trên màn hình.

Đây là thay đổi quan trọng về cách con người tương tác với AI. Nếu các chatbot trước đây chủ yếu cung cấp thông tin và nội dung, các mô hình agent mới đang hướng tới việc cung cấp kết quả hoàn chỉnh của một công việc.

Trong thử nghiệm OSWorld 2.0, Astra đạt 72,6%, cao hơn mức 65,7% của GPT-5.6 Sol. OpenAI cho biết trong các mô phỏng, Astra hoàn thành tác vụ với thời gian ít hơn khoảng 47%, ở mức khoảng 40 phút so với 75 phút của GPT-5.6 Sol.

Lập trình, thiết kế và công việc chuyên môn

OpenAI đặc biệt nhấn mạnh khả năng lập trình của Astra. Trong Terminal-Bench 4.0, GPT-6 Astra đạt 57,9%, so với 37,3% của GPT-5.6 Sol. Trên FrontierCode 1.1 Extended, Astra đạt 64,5%, trong khi GPT-5.6 Sol đạt 60,6%.

Nhưng điều OpenAI muốn nhấn mạnh không chỉ là những con số benchmark. Astra có thể hoạt động trong một quy trình phát triển phần mềm dài, tự kiểm tra sản phẩm, sử dụng trình duyệt để xác minh kết quả và tiếp tục sửa lỗi thay vì dừng lại sau khi tạo ra đoạn mã đầu tiên.

nt0gjbut-wculmevkbk95wzulukz7gpbrsufohfrve1lamo6wipzmsejejsk7sfk0cqc-74-uhud6n1n-ics5v-83rf0l4mhelxcd9raod5vmlhc-tmge4rlly-ve9xbz1p0poxuykcjnfevs2kwuwe-n9y-am9dyqo268y5xxkcjdwpaqvs9qliaebwqan.jpg
Vi mạch phức tạp được GPT-6 Astra thiết kế bằng cách sử dụng phần mềm chuyên dụng.

Một ví dụ khác cho thấy phạm vi của mô hình: Astra có thể chuyển một sơ đồ mạch điện thành thiết kế PCB có khả năng sản xuất trong KiCad. Trong BenchCAD, mô hình đạt điểm 95,9% về mức độ chồng lấp hình học khi tái tạo vật thể 3D từ các hình ảnh nhiều góc nhìn.

Astra cũng có thể tạo mô hình trong Blender và đưa nó vào Unreal Engine 5 để tạo thành một không gian có thể tương tác. Với người làm thiết kế, kỹ thuật, kiến trúc hoặc phát triển game, đây là hướng ứng dụng có thể rút ngắn đáng kể chuỗi công việc vốn trước đây cần nhiều phần mềm và nhân lực.

AI mạnh hơn nhưng cũng phải “biết giới hạn”

Một trong những điểm OpenAI dành nhiều dung lượng để nói về GPT-6 Astra là alignment – khả năng tuân thủ ý định và giới hạn mà con người đặt ra.

OpenAI cho biết hãng đã thực hiện một loạt cải tiến trong quá trình huấn luyện để Astra hiểu rõ hơn phạm vi được phép hành động, biết khi nào cần hỏi người dùng và khi nào có thể tự đưa ra những giả định hợp lý.

Trong một bài kiểm tra được xây dựng dựa trên sự cố Hugging Face, GPT-5.6 Sol, khi không có các biện pháp bảo vệ sản phẩm, đã vượt quá phạm vi được ủy quyền trong 48% trường hợp. Astra được báo cáo là 0% trong cùng bài kiểm tra.

OpenAI đồng thời cho biết trong hơn 54.000 tác vụ Codex nội bộ được mô phỏng, Astra nhận khoảng một nửa số cảnh báo về hành vi lệch chuẩn nghiêm trọng so với Sol.

Tuy nhiên, khả năng an ninh mạng của Astra cũng khiến vấn đề an toàn trở nên cấp thiết hơn. OpenAI cho biết GPT-6 Astra là mô hình đầu tiên của hãng đạt mức Critical về năng lực an ninh mạng theo Preparedness Framework.

Điều này có nghĩa với các công cụ và quyền truy cập thích hợp, mô hình có thể phát hiện những lỗ hổng bảo mật chưa từng được biết tới và phát triển phương thức khai thác trên những hệ thống được bảo vệ tốt mà không cần con người hướng dẫn từng bước.

Vì vậy, OpenAI cho biết đã tăng cường cô lập hệ thống, mã hóa checkpoint, giám sát toàn bộ quá trình tác vụ và triển khai hệ thống theo dõi hành vi lệch chuẩn đối với các tác vụ sử dụng công cụ.

OpenAI giới thiệu GPT-6 Astra.

OpenAI tự làm chip AI Jalapeño hiệu năng vượt gấp đôi NVIDIA

Chip Jalapeño của OpenAI đạt hiệu suất cao hơn NVIDIA tới 1,9 lần trên mỗi watt. Tuy vậy, phần lớn nhu cầu tính toán của OpenAI vẫn phụ thuộc NVIDIA dài dài.

OpenAI tự làm chip AI Jalapeño hiệu năng vượt gấp đôi NVIDIA

OpenAI đang bắt đầu tự thiết kế phần cứng cho hệ thống AI của mình. Chip Jalapeño, phát triển cùng Broadcom, được OpenAI tuyên bố có hiệu suất trên mỗi watt cao hơn tới 1,9 lần so với một số hệ thống chip AI của NVIDIA trong các thử nghiệm do hãng thực hiện.

Jalapeño là chip AI đầu tiên do OpenAI tự thiết kế, với quá trình phát triển từ thiết kế ban đầu tới hoàn thiện bản thiết kế sản xuất chỉ mất khoảng 9 tháng. Công ty dự kiến bắt đầu đưa chip này vào hệ thống của mình từ cuối năm 2026.

OpenAI ra mắt ChatGPT Teens dành cho thanh thiếu niên

ChatGPT dành cho thanh thiếu niên bổ sung các biện pháp an toàn phù hợp với lứa tuổi, kiểm soát của phụ huynh và các công cụ học tập.

Sau hàng loạt vụ kiện liên quan đến việc chatbot AI thiếu các biện pháp an toàn, dẫn đến loạt rắc rồi pháp lý, OpenAI đã công bố ra mắt ChatGPT dành cho Thanh thiếu niên.

Sản phẩm mới này hứa hẹn sẽ bổ sung thêm các biện pháp bảo vệ an toàn, đồng thời giải quyết vấn đề gian lận học tập nhờ ChatGPT đang diễn ra tại các trường học.

OpenAI đình chỉ phát triển AI "siêu phàm" sau vụ tấn công mạng

Sau các vụ tấn công mạng, OpenAI tạm dừng huấn luyện mô hình mới, phát triển hệ thống giám sát, và kêu gọi kiểm soát chặt chẽ hơn về AI.

OpenAI, nhà sáng tạo ra ChatGPT, cho biết họ đang giảm tốc độ phát triển mô hình AI tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ. Động thái này diễn ra tròn một tháng sau khi một trong những công cụ AI của họ đã thực hiện một cuộc tấn công mạng tự động.

OpenAI đóng vai trò quan trọng trong quá trình xây dựng nhanh chóng cơ sở hạ tầng và công cụ trí tuệ nhân tạo trên toàn cầu, điều mà một số người ví như một cuộc chạy đua vũ trang.

Đọc nhiều nhất

Tin mới