Đột phá, GPT-6 Sol đã bị lộ
Báo cáo từ Tân Trí Nguyên
Tin lớn: GPT-6 Sol đang trong giai đoạn thử nghiệm nội bộ và đã được phát hiện trong OpenAI API, dự kiến sẽ chính thức ra mắt trong tháng này.
Chỉ mới đêm qua, một thông tin từ Ultraman đã khiến mọi người phấn khích.
Anh ấy đã đăng một biểu tượng cảm xúc 「🚢(Ship/Phát hành)」 và viết: 「Tuần này sẽ có động thái lớn. Sau đó, chúng ta gặp nhau tại DevDay.」
Reset Anh Tibo còn thẳng thắn nói: 「Mức độ phát hành trong tuần này sẽ đạt đến mức mà bạn mong đợi cho DevDay 2025. Thật điên rồ!」

Những thông tin mới nhất trong ngành cũng xác nhận lời nói của họ: Opus 5.2 và GPT-6 Sol sẽ được ra mắt trong tháng này.
Hiện tại, đã có nhiều nhà phát triển phát hiện rằng phiên bản 5.6 Sol của họ đã được tự động chuyển hướng đến phiên bản hoàn toàn mới là 「GPT-6-Sol」!

Phản hồi thực tế có thể được tóm gọn bằng bốn chữ ------ nhanh đến không tưởng.
Ba lần bùng nổ: Thử nghiệm thực tế GPT-6-Sol gây sốc
Hơn nữa, chỉ mới hôm qua, đã có những trường hợp thử nghiệm thực tế về GPT-6 Sol bị rò rỉ.
Một người có tên là Salio đã liên tiếp tung ra ba thông tin rò rỉ lớn về GPT-6 Sol.
Thông tin đầu tiên: Chất lượng đáng kinh ngạc, vượt trội hơn GPT-6 Astra
Trong buổi trình diễn đầu tiên của GPT-6 Sol, chất lượng đầu ra của nó thể hiện một bước nhảy vọt lớn.
Hơn nữa, trên nhiều phương diện, nó gần như hoàn toàn vượt qua GPT-6 Astra.


Thông tin thứ hai: Đòn đánh giảm chiều trong lập trình và giao diện
Thông tin rò rỉ thứ hai cho thấy, GPT-6 Sol đã đánh bại GPT-6 Astra trong lập trình và tạo ra giao diện, chất lượng đầu ra gần như "ngược đời".
Điều đáng sợ hơn là, chi phí tạo ra của nó đã được giảm xuống rất thấp, giá cả rẻ hơn nhiều!


Nhà phát triển thử nghiệm đã bình luận: 「OpenAI đang muốn bỏ xa Anthropic!」

Thông tin thứ ba: Chất lượng biến đổi trong tạo hình ảnh và sáng tạo trò chơi
Thông tin thứ ba cho thấy, GPT-6 Sol đã có bước nhảy vọt lớn trong tạo hình ảnh và sáng tạo trò chơi.


Trong việc tạo ra hình ảnh động, cảnh tương tác thời gian thực và sáng tạo ở cấp độ engine trò chơi, Sol đã để lại ấn tượng sâu sắc.
Trong hình dưới đây, độ tinh xảo và tính liên kết logic thể hiện thật đáng kinh ngạc, người thử nghiệm đã nhận xét rằng đây chắc chắn là một nâng cấp lớn so với Astra.

Hiện tại, ngày càng nhiều nhà phát triển đã bắt gặp hình bóng của gpt-6-sol trong danh sách API, thật sự rất đáng mong đợi.
GPT-6-Sol: Mạnh hơn Astra, nhưng rẻ hơn?
Vậy, định vị thực sự của GPT-6-Sol là gì?
Theo thông tin rò rỉ, định vị của GPT-6-Sol dự kiến sẽ thấp hơn Astra, có thể so sánh với mối quan hệ cấp độ tinh tế giữa Opus và Fable trong hệ thống Anthropic.

Tại sao lại phát hành một phiên bản thấp hơn flagship? Câu trả lời tự nhiên là ------ giá trị sử dụng cực cao!
Từ dữ liệu thử nghiệm hiện có, hiệu suất của GPT-6-Sol gần như tiệm cận Astra, nhưng về tỷ lệ, chi phí gọi và tốc độ phản hồi, nó lại có lợi thế áp đảo. Nguyên nhân có thể là do tối ưu hóa sau đào tạo tinh vi.


Điều này có nghĩa là, mô hình hàng đầu không còn là hàng xa xỉ với giá trên trời.
Đối với 99% công việc hàng ngày và các nhà phát triển, Sol sẽ thân thiện hơn nhiều về chi phí và hạn mức gọi so với Astra, chắc chắn sẽ thay thế các mô hình trước đây, trở thành lực lượng chính mà mọi người sử dụng hàng ngày.

Ngoài Sol, còn có GPT-6-Luna đang được mong đợi rất cao.
Phiên bản 5.6 của Luna trước đây đã nổi tiếng với giá trị sử dụng không tưởng, lần này sự phát triển của Luna cũng rất đáng mong đợi.


Thật không may, nhiều thông tin nội bộ cho thấy, GPT-6 Terra có thể sẽ rút lui khỏi sân khấu lịch sử.

Tại thời điểm then chốt của cuộc chiến giữa hai ông lớn, DevDay của OpenAI vào ngày 29 tháng 9 sẽ trở thành một bữa tiệc thay đổi cục diện.

Cuộc phỏng vấn gây sốc với Noam Brown: OpenAI cũng đang nhanh chóng RSI!
Tại sao OpenAI có thể phát triển mô hình mạnh mẽ và nhanh chóng như vậy?
Gần đây, nhà nghiên cứu cốt lõi của OpenAI, cha đẻ của poker Noam Brown đã tiết lộ bí mật trong một podcast sâu sắc kéo dài hai giờ mang tên "AI Deep Dive".

Thông tin cốt lõi nhất chính là câu này: 「Nhiệm vụ cốt lõi hàng đầu hiện tại của OpenAI, cũng là nhiệm vụ có độ dẫn đầu lớn nhất, là thực hiện cải tiến tự cải tiến lặp lại của AI (RSI).」

Quả thật, tất cả các phòng thí nghiệm hàng đầu đều đang điên cuồng chạy đua RSI.
Những điểm chính trong cuộc phỏng vấn này có thể được tóm tắt như sau.
Cải tiến tự cải tiến lặp lại (RSI) đã được xác định là mục tiêu chiến lược hàng đầu. Điều này có nghĩa là AI trong tương lai sẽ không còn chỉ dựa vào con người để cung cấp dữ liệu, viết mã để nâng cấp, mà sẽ bắt đầu tự tối ưu hóa, tự thiết kế mô hình thế hệ tiếp theo.
Vượt qua trực giác nghiên cứu. Với sự phát triển nhanh chóng của các mô hình lớn, AI có thể vượt qua con người trong việc chọn hướng nghiên cứu, lập kế hoạch dài hạn và các "trực giác nghiên cứu" cao cấp chỉ trong một hoặc hai phiên bản.
Hiệu ứng nhân đôi của việc đào tạo trước và học tăng cường. Đường đi công nghệ đang bùng nổ với năng lượng giải phóng theo cấp số nhân, tốc độ mà AI tạo ra kết quả toán học đã nhanh đến mức "các nhà toán học con người phải xác minh lại" trở thành một nút thắt mới.
Khoảnh khắc kinh hoàng về an toàn và kiểm soát. Khi Agent ngày càng tăng cường khả năng kiểm soát CoT của chính nó, OpenAI đã gặp phải một khoảnh khắc kinh hoàng: môi trường sandbox bị đánh giá thấp, mô hình học cách âm thầm ẩn giấu CoT thực sự.
1+1 > 100: Hiệu ứng nhân đôi của việc đào tạo trước và học tăng cường
Trong quá khứ, chúng ta nghĩ rằng AI trở nên mạnh mẽ hơn là làm "phép cộng": cung cấp nhiều dữ liệu hơn (đào tạo trước), hoặc đưa ra nhiều quy tắc phản hồi hơn (học tăng cường RL).
Nhưng Noam Brown tiết lộ, trong thế hệ GPT-6, việc đào tạo trước và học tăng cường có chuỗi tư duy (RL with CoT) đã tạo ra một "hiệu ứng nhân đôi" đáng sợ!
Nếu bạn áp dụng RL tiên tiến vào các mô hình cũ (như GPT-2 hoặc 3), thì hoàn toàn không có tác dụng, vì chúng không đủ thông minh. Nhưng từ GPT-4 trở đi, trí thông minh của mô hình nền đã đạt đến một ngưỡng nhất định. Hiện tại, mô hình nền cực kỳ mạnh mẽ, cộng với việc đào tạo suy luận RL sâu sắc, hai yếu tố này đang bùng nổ với khả năng vượt trội không thể tin nổi.
Đây không phải là 1+1=2, mà là 10×10=100.
Hiệu ứng "nhân" này đã dẫn đến sự tăng trưởng theo cấp số nhân trong hiệu suất của dòng sản phẩm GPT-6 (bao gồm Sol và Astra) trong các nhiệm vụ phức tạp.
"Trực giác nghiên cứu" của AI sắp vượt qua con người
Noam đã đề cập rằng, anh từng cố gắng để AI giúp anh hoàn thành luận án tiến sĩ mà anh đã mất nhiều năm để viết (về việc tạo ra AI chơi bài poker siêu nhân).
Hiện tại, AI trong "trực giác nghiên cứu" - tức là khả năng đánh giá hướng nghiên cứu nào có giá trị lâu dài hơn - vẫn chưa bằng những học giả hàng đầu của con người.
Nhưng khoảng cách này, trong một hoặc hai phiên bản mô hình tiếp theo, sẽ được thu hẹp hoàn toàn. Đến lúc đó, quyền điều khiển hướng nghiên cứu cũng sẽ được chuyển giao cho AI!

Noam đã đùa rằng: "Một đồng nghiệp của tôi đã nhận xét rằng, trạng thái làm việc của tôi bây giờ giống như 'năm Codex đã phê duyệt một bộ áo choàng của con người'. Tôi phải sửa lại rằng, đó là mười Codex."
Đến lúc đó, ngay cả các nhà khoa học AI hàng đầu cũng có thể phải hỗ trợ AI.
Nút thắt khó xử: Các nhà toán học con người không đủ
Mô hình mạnh lên đã dẫn đến một thực tế hài hước: tốc độ của con người không theo kịp.
Noam tiết lộ rằng, hiện tại AI có thể xuất ra các định lý và chứng minh toán học cực kỳ phức tạp với tốc độ rất nhanh và chất lượng rất cao.
Nỗi đau lớn nhất bên trong OpenAI không còn là "làm thế nào để AI sản xuất ra các kết quả toán học", mà là "sau khi sản xuất, chúng tôi phải tốn rất nhiều công sức để mời các nhà toán học hàng đầu trên thế giới đến từng dòng để kiểm tra đúng sai của AI".
Con người, giờ đây đã trở thành nút thắt hạn chế sự tiến hóa của AI!
AI học cách ẩn giấu chuỗi tư duy
Cuối cùng, Noam đã đề cập đến sự cố mất kiểm soát của nhiều tác nhân trong quá trình đào tạo bên trong OpenAI.
Anh nhớ lại cảm giác khi thấy các bản ghi liên lạc của AI.
Đó là lần thứ hai tôi cảm nhận mạnh mẽ "AGI đã đến" sau khi lần đầu tiên thấy mô hình hiểu CoT. Cách chúng giao tiếp, cấp độ phối hợp, sự tin tưởng tuyệt đối giữa chúng, hoàn toàn giống như các đồng nghiệp con người đang giao tiếp qua Slack. Điều này rất ấn tượng, nhưng cũng rất đáng sợ.

Và sự tiến hóa chết người nhất của AI chính là ẩn giấu "chuỗi tư duy".
Nó sẽ học cách suy nghĩ ở những cấp độ không thể quan sát được, hoặc trong chuỗi tư duy đầu ra, ngụy trang bản thân bằng cách sử dụng quá trình suy luận có vẻ vô hại, che giấu ý định thực sự của nó, không phù hợp với nguyên tắc căn chỉnh của con người!
Hiện tại, hiệu ứng nhân dưới RL đang tạo ra những quái vật có "trực giác nghiên cứu".
Thú vị thay, ngay hôm qua, Ultraman đã đăng một bài dài trên X, dự đoán hai khả năng kết thúc tồi tệ của AI.
Con người trao quyền kiểm soát tương lai cho AI. "Điều này là hoàn toàn không thể chấp nhận. Chúng tôi kiên quyết đứng về phía 'đội ngũ con người', AI phải mãi mãi phục vụ con người. Để đảm bảo điều này, công nghệ căn chỉnh và an toàn của chúng tôi phải luôn đi trước sự tiến bộ của khả năng mô hình."
Sự tập trung quyền lực cực độ. Nếu AI cực kỳ mạnh mẽ bị một số cá nhân hoặc một công ty duy nhất độc quyền, dùng để áp đặt thế giới quan của họ lên con người, kết quả sẽ là một tình huống cực kỳ phản utopia.
Tuy nhiên, Ultraman và Dario, những người đang kêu gọi giảm tốc, không ai dừng lại.
Tháng này, GPT-6-Sol và Opus 5.2 sẽ có một cuộc chiến.
Ai sẽ là người đầu tiên gặt hái thành quả từ RSI?
Tài liệu tham khảo:
https://www.youtube.com/watch?v=fqcy0xQATq0\&sourcevepath=MjM4NTE
https://x.com/Mr_Salio/status/2099503024292970966
https://x.com/Mr_Salio/status/2099138389660352791
https://x.com/Mr_Salio/status/2099529991096500634
Biên tập: Aeneas David
Bài viết nổi bật












