Trang chủTrung tâm tin tức LBank
Rio de Janeiro xây dựng một mô hình AI đánh bại DeepSeek—nhưng lại dựa trên công trình của người khác
rio-ai-model-beat-deepseek-ownership-dispute-nex
Rio de Janeiro xây dựng một mô hình AI đánh bại DeepSeek—nhưng lại dựa trên công trình của người khác
Rio de Janeiro đã ra mắt một mô hình AI đẳng cấp tiên phong, tuyên bố vượt mặt những thành tựu tốt nhất của Alibaba. Sau đó, Nex xuất hiện với bằng chứng không thể chối cãi.
2026-06-15 Nguồn:decrypt.co

Tóm tắt

  • IplanRIO đã phát hành Rio 3.5 Open 397B vào ngày 13 tháng 6, quảng cáo đây là mô hình AI tiên phong do chính phủ xây dựng với điểm chuẩn vượt trội so với Qwen 3.7 Plus.
  • Công ty AI Nex đã công bố bằng chứng toán học cho thấy mô hình này là sự hợp nhất trọng số trực tiếp 0.6 Nex / 0.4 Qwen.
  • IplanRIO đã cập nhật thẻ mô hình, ghi nhận Nex, rút lại các tuyên bố về điểm chuẩn và đổ lỗi cho một "lỗi tải lên không chính xác".

IplanRIO của Rio de Janeiro đã phát hành Rio 3.5 vào ngày 13 tháng 6. Cơ quan CNTT của thành phố gọi đây là một mô hình thuộc phân khúc tiên phong: 397 tỷ tham số, với giấy phép mã nguồn mở tự do, được xây dựng bởi chính quyền thành phố của một thành phố ở phía Nam bán cầu.

Thời điểm ra mắt của Rio 3.5 rất hoàn hảo: Brazil đang chơi trận mở màn World Cup, và mạng xã hội đã bùng nổ. Những bình luận về nó nhanh chóng lan truyền từ Brazil ra khắp thế giới.

Nhưng ngay khi nó thu hút sự chú ý, đã có một tranh cãi về việc ai chính xác đã tạo ra mô hình này.

Thẻ mô hình gốc mô tả Rio 3.5 là một bản huấn luyện sau của Qwen 3.5 397B, mô hình nền tảng mở của Alibaba, với một lớp suy luận mới gọi là SwiReasoning được thêm vào. Chi phí phát triển được báo cáo là 500.000 R$ (Rio không xác nhận điều này), hoặc gần 100.000 USD—rẻ hơn khoảng 30 lần so với các hệ thống AI thương mại tương đương.

Kiến trúc là Mixture-of-Experts (Hỗn hợp chuyên gia), nghĩa là chỉ khoảng 17 tỷ trong số 397 tỷ tham số được kích hoạt trên bất kỳ token nào. Điều đó làm cho suy luận rẻ hơn so với kích thước được công bố. Mô hình này cũng hỗ trợ thị giác và văn bản, xử lý hơn một tá ngôn ngữ và được phát hành theo giấy phép MIT hoàn toàn mở.

SwiReasoning là trọng tâm kỹ thuật. Đây là một khung suy luận không cần huấn luyện, tự động chuyển đổi giữa hai chế độ. Khi mô hình tự tin về từ tiếp theo—entropy thấp trong phân phối xác suất—nó suy luận bằng ngôn ngữ tự nhiên. Khi không chắc chắn, nó chuyển sang suy luận tiềm ẩn, tư duy trong các trạng thái nội bộ ẩn mà không phát ra token. IplanRIO cho biết Rio 3.5 đã được huấn luyện đặc biệt để tận dụng điều này, và những cải tiến đó xuất hiện trong các con số điểm chuẩn.

Các con số tự báo cáo thật đáng chú ý. Terminal-Bench 2.1—đo lường khả năng thực thi lệnh terminal tự động, được tính bằng phần trăm nhiệm vụ hoàn thành—đạt 70.8% cho Rio 3.5, vượt qua Qwen 3.7 Plus với 70.3% và DeepSeek v4 Pro mạnh mẽ với 67.9%.

Trên IMOAnswerBench, một điểm chuẩn toán Olympic được tính bằng phần trăm đúng, Rio 3.5 đạt 89.5%. Trên HLE—Humanity's Last Exam (Kỳ thi cuối cùng của nhân loại), một bộ kiểm tra chuyên môn đa lĩnh vực gần như không thể giải được, được tính bằng phần trăm—Rio 3.5 đạt 36.5%, vượt trước Qwen 3.7 Plus với 34.7%.

Một chính quyền thành phố đánh bại các mô hình hàng đầu quan trọng nhất trên các điểm chuẩn chất lượng có ý nghĩa nhất: Đó là tiêu đề đã lan truyền, đặc biệt sau khi Thị trưởng Rio de Janeiro tweet về nó.

“Một mô hình AI mở được huấn luyện ở Rio và được tài trợ công khai trong năm qua bởi [Chính quyền thành phố Rio] vừa vượt qua tất cả các mô hình khác,” Eduardo Cavaliere viết. “Hôm nay, thế giới đang nói về một mô hình AI mở được huấn luyện ở Rio.”

🇧🇷 Modelo de IA aberta treinada no Rio com financiamento público ao longo do último ano pela @Prefeitura_Rio superando todos os outros modelos. Inteligência artificial não é uma coisa distante, estrangeira, de laboratório bilionário…não existe só pra fazer texto, imagens… https://t.co/GK1ThytVV9

— Eduardo Cavaliere (@CavaliereRio) June 14, 2026

Rồi Nex xuất hiện

“Được huấn luyện ở Rio” hóa ra không hoàn toàn chính xác.

Nex-AGI, một liên minh AI mã nguồn mở có trụ sở tại Thượng Hải, đã đăng trên X vài ngày sau khi phát hành. Mở đầu: "Mô hình Rio 3.5 đã làm bùng nổ internet tuần này. Điều bất ngờ là sao? Nó về cơ bản là mô hình mã nguồn mở của chúng tôi, Nex N2 Pro, nhưng mang một cái tên khác."

Họ đã phân tích các trọng số. Toán học cho thấy chính xác: Rio 3.5 ≈ 0.6 × Nex N2 Pro + 0.4 × Qwen 3.5. Một script xác minh và một báo cáo GitHub đầy đủ đã được theo sau.

The Rio 3.5 model broke the internet this week. The plot twist? It’s essentially our open-source model, Nex N2 Pro, wearing a different hat.

🤯 We analyzed the weights, and the recipe is exact: Rio 3.5 ≈ 0.6 * Nex N2 Pro + 0.4 * Qwen 3.5

It even literally introduces itself… pic.twitter.com/yHRRu37aut

— Nex (@NexEcosystem) June 14, 2026

Bằng chứng được đưa ra dưới hai phần.

Đầu tiên, hành vi. Nex đã loại bỏ lời nhắc hệ thống "Bạn là Rio" được mã hóa cứng từ mô hình đã triển khai và gửi cho nó 120 câu hỏi nhận dạng. Không có "mặt nạ", Nex báo cáo rằng mô hình tự xưng là "Nex, từ Nex-AGI" 79.2% số lần. Nó tự xưng là "Rio" chính xác 0% số lần. Nex cho biết mô hình cũng kể lại câu chuyện riêng biệt của công ty một cách nguyên văn, đề cập đến "Viện Đổi mới Thượng Hải" và "một liên minh hệ sinh thái mô hình lớn." Đó là dữ liệu huấn luyện của chính Nex, xuất hiện trong mô hình của người khác.

Thứ hai, toán học. Trong một sự hợp nhất trọng số thực sự, mọi tham số trong mô hình mới nằm trên một đường thẳng giữa hai mô hình nguồn. Nex đã đo lường tính chất cùng hàng này trên tất cả 60 lớp. Kết quả trả về là 0.993. Hai mô hình không liên quan trong cùng không gian tham số có điểm gần bằng 0 một cách ngẫu nhiên. Đạt 0.993 trên mỗi lớp không phải là sự trùng hợp. Tỷ lệ trộn duy trì ở mức α ≈ 0.571, ổn định đến ba chữ số thập phân.

Về cơ bản, nó gần như 60% Nex, phần còn lại là mô hình Qwen cơ bản.

"Mọi tensor trọng số trong Rio đều là, đến hàng nghìn độ lệch chuẩn, cùng một hỗn hợp 0.6/0.4 của Nex và Qwen—trên tất cả 60 lớp và mọi thành phần của mạng," Nex viết. "Không có lời giải thích nào vô tội."

Source: Nex Ecosystem
Nguồn: Nex Ecosystem

Các con số cũng kể một câu chuyện nhẹ nhàng hơn. Nex N2 Pro, được phát hành chỉ vài ngày trước Rio 3.5, đạt 75.3% trên Terminal-Bench 2.1—cao hơn 70.8% của Rio. Trên GDPval, một điểm chuẩn dự báo kinh tế được tính theo xếp hạng kiểu Elo, Nex đạt 1.585 so với 1.533 của Rio. Nếu Rio là 60% Nex, thì bạn sẽ mong đợi nó đạt điểm thấp hơn Nex trên chính các điểm chuẩn của Nex. Và đúng là như vậy.

Source: Nex Ecosystem
Nguồn: Nex Ecosystem

IplanRIO phản hồi

IplanRIO đã cập nhật thẻ mô hình Hugging Face—bảng điểm chuẩn đã bị xóa và quyền tác giả đã thay đổi.

"Mô hình được xây dựng thông qua việc hợp nhất nex-agi/Nex-N2-Pro và Qwen/Qwen3.5-397B-A17B, trước đó là phân tách chính sách (On-Policy Distillation) từ một mô hình mạnh hơn," readme cập nhật cho biết. "Chúng tôi đã phát hiện một lỗi tải lên không chính xác trong phiên bản trước, nơi phiên bản hợp nhất cơ bản đã được tải lên thay vì mô hình đã được phân tách cuối cùng. Chúng tôi xin lỗi vì sự nhầm lẫn và xin lỗi sâu sắc."

Không có tuyên bố công khai nào khác từ IplanRIO được đưa ra. Nex hiện đã được ghi nhận.

Lời giải thích về "lỗi tải lên không chính xác" là tuyên bố chính. IplanRIO nói rằng phiên bản được phát hành dự kiến là một phiên bản đã được tinh chỉnh của cơ sở hợp nhất—chứ không phải là bản hợp nhất thô. Phân tách chính sách (On-policy distillation) có nghĩa là một mô hình "giáo viên" mạnh hơn tạo ra các đầu ra, và mô hình "học sinh" được huấn luyện dựa trên những đầu ra đó đồng thời tự tạo ra các đầu ra của riêng mình. Nó đắt hơn so với việc hợp nhất thô, nhưng vẫn rẻ hơn so với việc huấn luyện từ đầu. Nếu bước đó là có thật, thì nó sẽ thể hiện ít nhất một số công việc gốc được thực hiện trên cơ sở hợp nhất.

Điều thực sự được phát hành, theo IplanRIO, là cơ sở hợp nhất mà không có bất kỳ tinh chỉnh nào thêm vào.

Các nhà quan sát cộng đồng chia rẽ về ý nghĩa của điều này. Bình luận viên công nghệ Rafael Quintanilha đã đưa ra một cách hiểu nhân văn: Vì Nex N2 Pro bản thân nó được xây dựng trên Qwen, nhóm có thể đã ghi nhận kiến trúc cơ bản và dừng lại ở đó. Ông cũng chỉ ra rằng mô hình đã trở nên lan truyền trong một trận đấu World Cup, "không nhất thiết là 'sẵn sàng để công chúng sử dụng'."

about the Rio 3.5 situation

merging two ~400B-class models and then applying policy distillation isn’t trivial

that said, they made two mistakes:

- a technical error (probably caused by a lack of attention to detail)

- and a communication one (we can debate the integrity of…

— montano (@lucas_montano) June 15, 2026

Nhà phát triển và YouTuber AI Lucas Montano lưu ý rằng "hợp nhất hai mô hình lớp ~400B và sau đó áp dụng phân tách chính sách không phải là chuyện nhỏ"—đồng thời thừa nhận cả lỗi kỹ thuật và lỗi giao tiếp.

Nhà nghiên cứu AI Diego Ambrosio ít rộng lượng hơn. Lần ra mắt ban đầu mô tả Rio 3.5 là kết quả của "huấn luyện sau tự động và tinh chỉnh độc quyền"—khung đó ngụ ý nghiên cứu gốc, không phải là sự hợp nhất.

Hợp pháp? Có. Đạo đức? Vâng...

Việc hợp nhất mô hình hoàn toàn hợp pháp. Nex N2 Pro là Apache 2.0—bạn có thể sử dụng, sửa đổi và phân phối lại nó, miễn là bạn ghi nhận nguồn. Qwen 3.5 cũng có giấy phép mở. Không ai sẽ kiện tụng ở đây.

Vấn đề là việc trình bày kết quả như một công trình được phát triển độc lập mà không nêu tên tất cả các mô hình nguồn. Cộng đồng mã nguồn mở đã từng chứng kiến điều này trước đây. Đầu năm nay, Composer 2 của Cursor bị phát hiện được xây dựng trên Kimi K2.5 của Moonshot mà không tiết lộ. Phản ứng dữ dội nhanh chóng và ảnh hưởng đến danh tiếng—không có luật sư, chỉ có ảnh chụp màn hình.

was messing with the OpenAI base URL in Cursor and caught this

accounts/anysphere/models/kimi-k2p5-rl-0317-s515-fast

so composer 2 is just Kimi K2.5 with RL
at least rename the model ID https://t.co/MQOuEuF3Pd pic.twitter.com/fyUWbo1InF

— fynn (@fynnso) March 19, 2026

Việc xây dựng dựa trên các mô hình mở hiện có là điều bình thường. Như Decrypt đã đưa tin, việc xếp chồng và hợp nhất các trọng số mở thực tế là một tiểu văn hóa riêng. Quy tắc không phải là "đừng xây dựng trên công trình của người khác." Quy tắc là: Hãy nói rõ bạn đã sử dụng cái gì.

Điều khiến vụ việc này ồn ào hơn một lỗi ghi nhận thông thường là "vỏ bọc" thể chế. Một nhà phát triển ẩn danh phát hành một mô hình "Frankenstein" dưới tên riêng của mình là một chuyện. Một chính quyền thành phố sử dụng nó để tuyên bố chủ quyền AI khu vực công—trong thời điểm World Cup—lại là chuyện khác. “Đó là một sự lãng phí nguồn lực,” một bình luận viên người Brazil viết.

Nex đã không biến nó thành một cuộc chiến. "Chúng tôi rất hân hạnh khi Thành phố Rio đã sử dụng công trình của chúng tôi để đạt được hiệu suất SOTA," công ty viết trên X. "Nhưng trong thế giới mã nguồn mở, việc ghi nhận nguồn là quan trọng."

IplanRIO đang nỗ lực tải lên mô hình đã được sửa đổi, tinh chỉnh với đầy đủ quyền tác giả. Khi điều đó xảy ra, các kiểm tra tương tự sẽ chạy lại—và cộng đồng sẽ biết liệu quá trình tinh chỉnh có thực sự thay đổi điều gì không, hay nó vẫn chủ yếu là Nex với một lời nhắc hệ thống khác.