市场观察|国产模型上大分!精准揭露“开源模型”“自研神话”De黑箱链条


市场观察|国产模型上大分!精准揭露“开源模型”“自研神话”De黑箱链条

吃个外国瓜!🍉🍉🍉
就在这两天,巴西国家级自研AI大模型,掉了大链子!实锤套壳了中国开源模型,一场轰动全球开源社区的AI套壳造假事件彻底曝光!
巴西里约市政府重磅官宣的拉美首个国家级自研大模型 Rio 3.5 Open 397B被国内Nex-AGI团队拿出双重铁证实锤🔨🔨🔨:并非自研,完全拼接缝合国产开源模型
从政府背书、全网封神的拉美AI技术主权标杆,到证据确凿、全网群嘲的套壳造假项目,短短3天完成惊天反转。
这起事件的背后,不止是一场简单的技术抄袭,更是全球AI产业黑箱的彻底曝光,同时也彻底改写了中外AI开源的行业叙事!

01 首先全网造势:巴西打造“拉美AI自研神话”

本次发布主体为IplanRIO,里约热内卢市政府全资市政IT企业,主营业务为城市政务系统开发,无任何大模型预训练核心技术积累
但该项目被巴西官方全力包装,对外宣称投入50万雷亚尔自研,打造出拉美首个全球第一梯队AI大模型。
2025年6月13日,项目正式全网造势发布,配套顶级官方背书:
✅ 硬核参数包装:标称397B MoE混合专家架构、百万级超长上下文,采用MIT宽松开源协议,对标全球顶级模型;
✅ 性能数据封神:自研测试榜单显示,多项数学、代码、多语言能力超越阿里通义千问、DeepSeek等头部开源模型;
✅ 政府官方站台:里约市长亲自发文宣传,将其定义为巴西实现AI技术主权、摆脱海外技术依赖的标志性成果;
✅ 全网流量引爆:借世界杯热度,海外科技博主、Hugging Face高管集体转发,模型24小时下载量突破11万次
为完美打造“纯自研”人设,项目方刻意隐瞒所有基座来源,甚至在模型底层写入强制系统提示词,逼迫AI对外自称“巴西Rio自研模型”,彻底抹去原生模型身份。

02 然后被精准揭老底:中国团队双重铁证 实锤套壳

就在该模型爆红全球、被奉为拉美AI标杆的第二天,上海创智学院Nex-AGI开源团队发现模型输出特征异常,随即开展全方位技术溯源。
6月15日,团队公开完整可复现验证报告,两套铁证100%实锤缝合造假,无任何辩驳空间
证据一:行为探针实锤原生记忆
技术团队移除模型强制“Rio自研”伪装提示词后,连续120次身份测试:
👉79.2%概率主动自称Nex-N2 Pro,完整复述“上海创智学院、Nex-AGI开源联盟”等专属私有信息;
👉 0次自称Rio模型。
原生自研模型绝不可能携带中国开源团队的专属记忆,造假破绽彻底暴露。
证据二:权重数学铁证,无可辩驳
团队对模型60层全网权重逐层核验计算,得出固定融合公式:
Rio 3.5 ≈ 0.57×Nex-N2 Pro + 0.43×阿里Qwen 3.5-397B
全层权重余弦相似度高达0.984–0.993,数千倍标准差完全吻合,无任何独立预训练、深度微调痕迹,属于典型的直接权重拼接产物。
全球开发者复现检测脚本后,均验证结论真实有效,舆论瞬间爆了💥💥💥

03 官方紧急处置翻车:下架整改、含泪道歉

面对无法辩驳的数学底层证据,巴西IplanRIO团队彻底放弃抵赖,连夜紧急整改:
1. 全面下架所有对外宣传的SOTA高分跑分榜单;
2. 重写模型介绍,首次承认模型基于中国Nex、阿里通义千问两大国产模型合并构建;
3. 发布公开致歉声明,甩锅“上传失误”,称公开版本只是内部对比用的基线版本,并非最终自研成品;
4. 口头承诺后续将上传蒸馏优化后的正式版本,但始终未给出具体时间。
对于这套说辞,全球开源社区完全不买账:刻意抹去基座来源、借政府背书炒作自研政绩,已经违背开源核心规则,属于恶意造假,绝非简单的上传失误。

04 套壳子模型的黑箱:“自研大模型”的造假流水线

Rio事件绝非个例,它撕开了全球AI行业最隐秘的灰色产业链:无需算力、无需训练、无需技术,五步即可包装出一款“国家级自研大模型”
Step 1 选底座:不研发,只挑现成顶级模型
造假第一步不是训练,而是筛选市面上开源、免费、能力顶尖的模型,国产Qwen、DeepSeek、Nex是全球造假首选底座,核心标准:能力强、开源宽松、跑分亮眼。
Step 2 拼权重:不训练,只做技术重组
通过权重线性融合、MoE专家嫁接、LoRA轻量叠加三种方式,将多款成熟模型拼接混合,零训练成本,快速生成“全新模型”。本次Rio模型,就是最典型的双模型权重缝合产物。
Step 3 改身份:伪装人设,掩盖原生内核
通过强制系统提示词、屏蔽原生关键词、植入自有品牌介绍,强行篡改模型对外身份。但底层权重无法彻底改写,极易出现身份泄露破绽。
Step 4 刷榜单:专项优化,虚高跑分
针对测试题库调优prompt、多模型择优输出、轻量过拟合训练,刷出远超真实水平的跑分数据,打造“性能超越一线模型”的假象。
Step 5 做叙事:官方背书,包装成神作
冠以“自主可控、国家级自研、技术突破”标签,隐瞒所有拼接、套壳事实,依托政府、媒体造势,用公信力掩盖技术造假。

05 乱象根源:为什么套壳拼接模型越来越多?

这类造假频发,从来不是单纯的道德问题,而是产业逻辑下的必然结果:
1. 成本天差地别,拼接性价比碾压自研
从零训练千亿级大模型,需要千万级算力成本、海量高质量数据、数月研发周期;而模型拼接几乎零成本、数天落地,商业与政绩性价比极高。
2. 中国开源模型已成全球顶级基础设施(🐮🐮🐮)
如今国产开源大模型的能力,已完全满足商用、跑分、政务宣传需求,海外机构无需自研,依托中国开源底座即可做出“顶级AI模型”。
3. 叙事价值,远大于技术价值
资本、政府、媒体只关注“自研、自主、突破”的噱头,极少核验底层权重、训练链路等核心技术细节,给造假留下巨大空间。

06 我们这次赢麻了:被抄袭本身就是实力的一种体现!

这起看似简单的套壳事件,实则是全球AI产业迭代的分水岭,释放了三个关键信号:
1. 行业叙事彻底反转,中国AI成为全球底座毋庸置疑
曾经国内AI被诟病“套壳海外模型”,如今风水轮流转:海外国家级AI项目,纷纷套壳中国开源模型。Qwen、Nex、DeepSeek已经成为全球AI的“水电煤”基础设施。
2. “自研”定义彻底重构
传统“从零训练才是自研”的标准失效,未来AI竞争不再比拼“谁能训更大的模型”,而是比拼整合能力、落地能力、数据闭环能力
3. 全球AI主权神话破灭
除中美拥有完整的大模型训练算力、数据、算法体系外,绝大多数国家的“AI自主可控”都是伪命题,高度依赖开源基座,无独立核心技术能力。
4. 开源合规红线正式确立
开源允许二次微调、融合、商用,但刻意隐瞒溯源、造假自研、骗取政绩资本,成为全球开源社区永久禁令。

国产替代大有可为!

截至目前,巴西涉事团队仍未兑现承诺,未上传任何优化后的正式模型,项目彻底沦为“套壳造假”的反面案例,拉美本土AI公信力遭受重创。
Rio 3.5事件真正的意义,不在于一场舆论翻车,而在于它赤裸裸证明:中国开源AI技术,已经站在了全球产业顶端,成为世界AI发展的核心底座
未来的AI竞争,早已不是单一模型参数的比拼,而是真实创新、产业落地与合规公信力的终极较量。

END