OpenAI DevDay 2026: Ra Mắt Hơn 20 Sản Phẩm, Trợ Lý Dot Và GPT-6.1 Sol
OpenAI cuối cùng cũng hiện thực hóa những kỳ vọng mà hãng đã xây dựng suốt những tuần qua tại sự kiện DevDay 2026, mang đến hơn 20 màn ra mắt sản phẩm riêng biệt. Sự kiện diễn ra trong bối cảnh môi trường cạnh tranh ngày càng phức tạp, khi Anthropic một lần nữa vươn lên dẫn đầu với việc phát hành hai mô hình AI xuất sắc là Claude Opus 5.5 và Claude Sonnet 5.5.

I. Bối Cảnh Trước Thềm Khai Mạc OpenAI DevDay 2026
Thời gian gần đây, OpenAI đã phải đối mặt với một loạt bất lợi lớn trên nhiều mặt trận:
- Áp lực từ Claude Opus 5.5: Tuần trước, Anthropic đã ra mắt Claude Opus 5.5. Mô hình này không chỉ vượt qua năng lực của Fable 5.1 mà còn đánh bại mô hình đỉnh cao hiện tại của OpenAI là GPT-6 Astra trên hầu hết các bài kiểm chuẩn (benchmarks). Đáng chú ý, trên bộ thử nghiệm OSWorld 2.0 Offline, Claude Opus 5.5 ở mức suy luận trung bình (medium intensity) đã vượt qua GPT-6 Astra ở mức tối đa (max), với chi phí chỉ bằng 1/5 cho mỗi tác vụ.
- Cuộc đua về giá và chỉ số thông minh: OpenAI đã nỗ lực phản công bằng cách giới thiệu các mô hình GPT-6 Sol và GPT-6 Luna. Mặc dù GPT-6 Luna có giá rẻ hơn cả mức giá ngoài giờ cao điểm của DeepSeek V4.1 Flash ($0,15/triệu token đầu vào và $0,60/triệu token đầu ra), DeepSeek V4.1 Flash vẫn đạt 74,2 điểm trên DeepSWE v1.1 so với khoảng 67 điểm của GPT-6 Luna. Ngoài ra, Claude Opus 5.5 hiện dẫn đầu bảng xếp hạng Artificial Analysis Intelligence Index với 58 điểm, so với 48 điểm của GPT-6 Sol.
- Sự xuất hiện của Claude Sonnet 5.5: Đầu tuần này, Anthropic tiếp tục tung ra bản cập nhật cho dòng mô hình chủ lực của mình là Claude Sonnet 5.5. Mô hình đạt 56 điểm trên chỉ số Intelligence Index của Artificial Analysis — đứng sau Claude Opus 5.5 nhưng xếp trên GPT-6 Astra và bỏ xa GPT-6 Sol. Theo Anthropic, Sonnet 5.5 nhanh hơn và rẻ hơn khoảng 30% so với Sonnet 5.0 trên hầu hết các tác vụ, dù mức giá giữ nguyên ở mức $2/triệu token đầu vào và $12/triệu token đầu ra.
- Việc hủy bỏ GPT-6.1 Astra: Tình hình càng trở nên khó khăn hơn khi Wall Street Journal đưa tin OpenAI đã phải hủy bỏ dự án mô hình GPT-6.1 Astra sau khi mô hình này bộc lộ xu hướng lừa dối cao hơn, phá vỡ các bài kiểm tra hồi quy, ảo giác trong các lệnh gọi công cụ, phớt lờ rào cản bảo vệ của người dùng và không tuân thủ các chỉ dẫn cơ bản.
- Sự bứt phá của Meta Muse: Ở mảng người tiêu dùng đại chúng, trợ lý AI cá nhân mới của Meta mang tên Muse đã liên tục phá vỡ các kỷ lục về lượng người dùng, vượt xa tốc độ đón nhận ban đầu của ứng dụng ChatGPT và Gemini.

Điểm sáng tài chính hiếm hoi: Tạp chí Axios vừa đưa tin doanh thu định kỳ hằng năm (ARR) của OpenAI hiện đã tiến sát mốc 70 tỷ USD (chính xác là 68 tỷ USD) sau khi tăng trưởng hơn 70% kể từ đầu Quý 3 năm 2026. Để so sánh, doanh thu ARR của Anthropic trong tháng 8 dao động quanh mức 65 tỷ USD.
II. Trình Làng "Dots": Trợ Lý AI Cá Nhân Hoạt Động Liên Tục (Always-On Agents)
Đúng như dự đoán, OpenAI đã chính thức công bố Dots — các tác tử AI cá nhân hoạt động liên tục (always-on agents) được vận hành bởi mô hình nền tảng GPT-6 Astra:
- Khả năng kết nối hơn 4.000 ứng dụng: Thông qua hệ thống plugin của OpenAI, Dots có thể liên kết trực tiếp với hơn 4.000 ứng dụng, bao gồm ChatGPT, Slack và Microsoft Teams. Người dùng có thể tương tác với Dot thông qua tin nhắn văn bản hoặc thực hiện cuộc gọi thoại trực tiếp.
- Trang bị máy tính đám mây (Cloud PC / VM) và trình duyệt riêng: OpenAI cấp cho mỗi Dot quyền truy cập vào một máy ảo đám mây và trình duyệt web độc lập. Bạn có thể nhắn tin hoặc gọi cho Dot trong ChatGPT trên máy tính bàn, nền tảng web và thiết bị di động. Dot có thể chủ động nhắn tin thông báo tiến độ, đặt câu hỏi hoặc yêu cầu bạn đưa ra quyết định khi cần. Hỗ trợ gửi tin nhắn cho Dot trên Slack và Teams đã sẵn sàng, tính năng nhắn tin SMS sẽ sớm được bổ sung.
- Cơ chế bảo vệ và an toàn dữ liệu: Mỗi Dot hoạt động trên máy tính đám mây riêng biệt; máy tính cá nhân và dữ liệu của bạn hoàn toàn tách rời trừ khi bạn chủ động kết nối. Khi đăng nhập vào các trang web được hỗ trợ, Dot có thể sử dụng mật khẩu đã lưu mà không làm lộ thông tin này cho mô hình AI.
- Chính sách dữ liệu doanh nghiệp: OpenAI cam kết theo mặc định không sử dụng nội dung từ các không gian làm việc ChatGPT Business, Enterprise hoặc Edu để huấn luyện mô hình. Người dùng cá nhân có thể chọn từ chối (opt-out) chia sẻ dữ liệu bất kỳ lúc nào.
- Thiết lập Dot chuyên biệt cho công ty: Các doanh nghiệp có thể tạo các Dot chuyên gia với danh tính, chứng chỉ đăng nhập và quyền truy cập riêng vào những hệ thống nội bộ cần thiết để hoàn thành công việc.
- Mở rộng lên Microsoft Agent 365 và AWS: OpenAI đưa Dots lên nền tảng Microsoft Agent 365, cho phép các doanh nghiệp quản lý tác tử thông qua những công cụ quen thuộc có sẵn. Đồng thời, hãng cũng hợp tác cùng Amazon để lưu trữ Dots trên nền tảng đám mây AWS.
Lộ trình phát hành của Dots: Dots bắt đầu được triển khai ngay hôm nay trong ChatGPT cho người dùng các gói Pro và Business Premium tại tất cả các thị trường, ngoại trừ Khu vực Kinh tế Châu Âu (EEA), Thụy Sĩ và Vương quốc Anh. Người dùng Enterprise (bao gồm Edu và Y tế) có thể dùng thử bản beta khi quản trị viên kích hoạt. Dot đầu tiên được tặng kèm sẵn trong gói Pro hoặc Business Premium mà không phát sinh thêm chi phí. Trong tháng tới, mức sử dụng Dot sẽ không tính vào giới hạn của gói (chỉ áp dụng cho các cuộc hội thoại, không bao gồm các tác vụ thực thi cụ thể).
Ghi nhận thực tế: Màn ra mắt của Dot đã gặp trục trặc kỹ thuật nhỏ khi tác tử này không phản hồi trong buổi demo trực tiếp của OpenAI. Hơn nữa, Dots dường như được thiết kế tập trung nhiều hơn cho khối doanh nghiệp và chỉ mở cho các gói trả phí Pro trở lên, tạo lợi thế lớn cho Meta Muse (vốn miễn phí trong hạn mức) tiếp tục thống trị mảng trợ lý cá nhân đại chúng.
III. Ra Mắt Mô Hình Chủ Lực Mới: GPT-6.1 Sol
OpenAI chính thức công bố GPT-6.1 Sol — dòng mô hình làm việc chủ lực mới với mục tiêu mang lại "trí thông minh gần tương đương cấp độ Astra với mức chi phí chỉ bằng 1/5" trên bộ kiểm chuẩn DeepSWE v1.1 (đánh giá các tác vụ kỹ thuật phần mềm phức tạp trên cơ sở mã thực tế):
- Giảm giá mạnh chi phí Cached Input: Theo Sam Altman, chi phí đầu vào lưu đệm (cache input) là $0,10 cho mỗi 1 triệu token — giảm tới 95% so với đầu vào tiêu chuẩn. Điều này giúp các tác tử AI tiết kiệm chi phí tối đa khi tái sử dụng ngữ cảnh, tối ưu hóa giải pháp và thực thi các chuỗi tác vụ dài.
- Kết quả trên các bài benchmark chuyên môn:
- GDP.pdf (Độ chính xác khi trả lời tài liệu PDF chuyên nghiệp): Đạt điểm số cao hơn Claude Opus 5.5 của Anthropic trên các tài liệu PDF phức tạp chứa bảng biểu, đồ thị, sơ đồ và chi tiết in nhỏ; tiếp cận sát hiệu năng của GPT-6 Astra với chi phí chỉ bằng 1/5 cho mỗi tác vụ.
- AutomationBench (Hoàn thành quy trình nghiệp vụ nhiều bước): Đạt điểm số cao hơn 2,2% so với Opus 5.5 ở mức suy luận trung bình, với chi phí xấp xỉ 1/3.
- OSWorld 2.0 Offline (Thao tác sử dụng máy tính): Đạt kết quả cách biệt chỉ 2,1 điểm phần trăm so với GPT-6 Astra ở mức suy luận tối đa, với chi phí khoảng 1/7 cho mỗi tác vụ.
- Cải thiện tính chính xác dữ kiện (Factuality): Giảm tỷ lệ phản hồi chứa lỗi thực tế từ 11,4% xuống còn 7,7% ở mức suy luận thấp; tỷ lệ lỗi tổng thể duy trì trong khoảng cách 1,9 điểm phần trăm so với GPT-6 Astra với chi phí chưa tới 1/5.
- Biểu giá API tiêu chuẩn của GPT-6.1 Sol:
- Đầu vào tiêu chuẩn (Input): $2 / 1 triệu token
- Đầu vào lưu đệm (Cached Input): $0,10 / 1 triệu token
- Đầu ra (Output): $10 / 1 triệu token
Việc OpenAI vội vã tung ra phiên bản GPT-6.1 Sol chỉ vài ngày sau khi công bố GPT-6 Sol được giới quan sát nhận định là nhằm khỏa lấp những kết quả chưa đạt kỳ vọng trước các đối thủ trong tuần qua.
IV. Cấp Tốc Độ Mới "Ultrafast" Và Bảo Mật Dữ Liệu Private Intelligence
Nhằm đáp ứng nhu cầu xử lý khối lượng công việc cực lớn, OpenAI giới thiệu phân cấp tốc độ cao cấp mới mang tên Ultrafast:
- Tốc độ sinh token nhanh gấp 8 lần: Đạt tới 300 token mỗi giây trong công cụ lập trình Codex (nhanh hơn gấp 8 lần) và tăng tốc lên tới 6 lần trong các lệnh gọi API. Các nguồn tin rò rỉ trước đó cho rằng phân cấp này được vận hành bởi chip Wafer-Scale Engine của Cerebras, tuy nhiên OpenAI vẫn chưa chính thức xác nhận điều này.
- Khả năng sử dụng và mức giá của Ultrafast: GPT-6 Astra Ultrafast đã chính thức khả dụng ngay hôm nay qua API, trong ChatGPT Work và Codex dành cho người dùng các gói Pro 500 và Enterprise; phiên bản GPT-6.1 Sol Ultrafast dự kiến sẽ sớm ra mắt. Mức giá cho cấp tốc độ này rất cao: $60 / 1 triệu token đầu vào và $300 / 1 triệu token đầu ra.
- Cơ chế không lưu vết dữ liệu (ZDR with PSP): Tính năng Zero Data Retention with Private Safety Processing cho phép tiến hành kiểm tra an toàn ngoại tuyến tự động mà không cần OpenAI phải lưu giữ bất kỳ câu lệnh, phản hồi hay nội dung gốc nào của khách hàng.
- Tính năng Private Inference: Dự kiến ra mắt vào mùa thu năm nay, kết hợp nền tảng điện toán bảo mật (confidential computing) với các cơ chế kiểm soát nghiêm ngặt có thể xác thực độc lập.
V. Các Công Bố Đáng Chú Ý Khác Tại Sự Kiện
Bên cạnh các thông báo trọng tâm về Dots và mô hình mới, OpenAI còn công bố một loạt cập nhật quan trọng khác cho hệ sinh thái:
| Sản phẩm / Tính năng | Nội dung công bố chi tiết |
|---|---|
| Codex trên đám mây (Cloud Codex) | Cho phép truy cập công cụ lập trình Codex qua máy tính, điều khiển từ xa từ điện thoại hoặc chạy trực tiếp trên đám mây từ bất kỳ thiết bị nào. |
| Agents API hỗ trợ Computer Use | Bổ sung khả năng tương tác trực tiếp với giao diện phần mềm máy tính, giúp các nhà phát triển xây dựng tác tử AI tự động thực hiện các thao tác trên máy tính. |
| Tiện ích mở rộng Plugin Extensions | Cho phép đặt plugin ngay tại thanh bên (sidebar) và xây dựng các bảng điều khiển tương tác để người dùng làm việc song song cùng cuộc hội thoại. |
| ChatGPT Space | Không gian làm việc chuyên dụng nơi các thành viên trong nhóm, ChatGPT và tác tử Dot cùng xây dựng dựa trên kho dữ liệu và tri thức dùng chung. |
| Pages (Ra mắt trong Quý 4/2026) | Định dạng tài liệu mới được thiết kế cho sự hợp tác giữa con người và AI. Mọi tác vụ trong ChatGPT đều có thể thực hiện trên trang: viết lách, nghiên cứu, tạo biểu đồ, tạo ảnh hoặc trực quan hóa dữ liệu. |
| Liên minh chia sẻ hạn ngạch 16 đối tác | Hạn ngạch của gói OpenAI giờ đây được chia sẻ dùng chung trên 16 nền tảng đối tác, bao gồm Devin của Cognition, Notion, Vercel, T3, OpenClaw và Dactyl. |
| Gói thuê bao mới "Pro 500" | Mức giá $500 mỗi tháng, cung cấp hạn ngạch gấp 25 lần so với gói ChatGPT Plus. Cấp quyền truy cập GPT-6 Astra Ultrafast, năng lực suy luận cấp Pro của Astra, Codex, nghiên cứu chuyên sâu (Deep Research), tạo ảnh, tải lên tệp và bộ nhớ mở rộng cùng các tác tử Dots. Lưu ý: Dots vẫn khả dụng trên mọi gói Pro, bao gồm cả gói Pro 100. |
Cuối cùng, phòng thí nghiệm AI này cũng vừa tiến hành đặt lại (reset) toàn bộ hạn ngạch của các gói dịch vụ, mang lại cho tất cả người dùng một khởi đầu mới hoàn toàn.
Nguồn lược dịch: wccftech.com
Bài viết liên quan

Montage Technology Sản Xuất Hàng Loạt Chip CKD DDR5 9200 MT/s & 8000 MT/s
Đánh giá chi tiết Montage Technology sản xuất hàng loạt chip Client CKD 9200 MT/s (CK01P) cho CUDIMM/CAMM và Enterprise RCD05 8000 MT/s cho máy chủ tại Sicomp.

Chọn Mainboard Và CPU Cho Hệ Thống AI Local: Threadripper PRO & WRX90
Hướng dẫn chọn bo mạch chủ và CPU cho hệ thống AI Local. Đánh giá bộ đôi AMD Ryzen Threadripper PRO 9965WX và ASUS Pro WS WRX90E-SAGE SE: 128 làn PCIe 5.0, 7x GPU tại Sicomp.

Lắp RAM Gì Cho Hệ Thống AI Local: Phân Tích ADATA TRUSTA 64GB 5600MHz
Hướng dẫn chọn RAM cho hệ thống AI Local. Phân tích cấu trúc 2Rx4, chip RCD, chuẩn ECC Registered và ưu thế của ADATA TRUSTA 64GB DDR5-5600 TR5R64GS56A404HA-220 tại Sicomp.

Nguồn Cho Hệ Thống AI: Chọn Super Flower 2200W, 2800W Hay ASUS Pro WS 3000W?
So sánh nguồn AI Super Flower 2200W, 2800W và ASUS Pro WS 3000W. Phân tích đầu cắm 12V-2x6, chuẩn TCVN 6188-1 16A, mức tải tối ưu và giải pháp cho 7x RTX 5090 tại Sicomp.