当前位置: 首页 > news >正文

破大防!日本最大高性能“乐天AI3.0”被扒出基于DeepSeekV3架构


3月17日,日本乐天集团高调发布号称“日本国内最大规模高性能AI大模型”的Rakuten AI 3.0,宣称依托日本GENIAC国家项目支持、7000亿参数量实现日语场景性能突破,多项基准测试超越GPT-4o。然而发布仅数小时,这款被寄予“日本AI自主突破”厚望的模型,就被全球技术社区扒出核心真相:其底层架构完全基于中国深度求索公司的开源大模型DeepSeek V3,一场精心包装的“自主研发”大戏,瞬间沦为全球网友的吃瓜闹剧。

以下是部分国外网友对此事的锐评:





此次争议的核心证据,来自AI模型开源社区Hugging Face上的公开配置文件。有开发者查阅Rakuten AI 3.0的config.json文件时发现,架构字段明确标注为“DeepseekV3ForCausalLM”,模型类型直接显示“deepseek_v3”,隐藏层维度7168、中间层维度18432、61个隐藏层等核心参数,与DeepSeek V3原版配置完全一致。更具讽刺意味的是,模型页面自动生成的标签栏中,“deepseek_v3”标识清晰可见,这场“换皮式发布”毫无技术遮掩,任何普通用户都能轻松核验。

从技术合规性来看,乐天的操作并未违反开源规则。DeepSeek V3采用Apache 2.0开源许可证,允许商业使用、二次开发与微调,乐天基于该模型进行日语数据适配、场景优化,属于行业通行做法。但争议的焦点从未脱离宣传伦理与身份叙事:乐天在官方通稿、媒体发布等所有公开渠道中,全程强调“日本自主研发”“本土高性能突破”,对DeepSeek V3的核心支撑作用只字不提,刻意模糊开源底座来源,将二次微调包装成从零到一的原创成果,这种“只享成果、不提源头”的操作,彻底点燃了舆论怒火。

事件发酵后,日本网友的反应堪称“大型吃瓜现场”。社交平台上,质疑与自嘲声浪席卷评论区:“花着国家补贴,用中国开源模型冒充日本自研,这就是日本AI的底气?”“一边警惕中国AI安全风险,一边偷偷换皮使用,双标太明显”“所谓自主可控,原来是开源换名”。不少日本科技从业者直言,乐天此举不仅消耗了企业信誉,更让日本AI产业的“自主化”目标沦为笑柄,原本期待依托本土模型打破海外技术垄断的愿景,彻底落空。

这场风波的戏剧性,还在于与日本此前对中国AI模型的警惕态度形成强烈反差。2025年DeepSeek V3凭借高效性能全球出圈时,日本政府曾以“信息安全”为由,要求公务员谨慎使用该模型;丰田、三菱重工、软银等日本巨头纷纷出台禁令,限制员工访问与使用DeepSeek相关服务,日本媒体甚至将其比作“AI界的黑船事件”,渲染外来技术冲击。如今本国头部企业却悄悄采用同款模型打造“国家标杆AI”,前后矛盾的操作,让日本的技术安全叙事不攻自破。

更深层次来看,乐天AI3.0争议,折射出全球AI竞争中自主研发与开源协作的失衡困境。近年来,日本政府大力推进GENIAC等项目,投入巨资扶持本土大模型研发,试图摆脱对中美AI技术的依赖,构建自主可控的AI生态。但底层技术积累不足、算力成本高企、研发周期漫长等现实难题,让日本企业难以快速实现原创突破。依托全球开源底座快速落地产品,成为兼顾效率与市场的捷径,可又不愿放弃“自主研发”的舆论光环,最终陷入“开源换皮、虚假宣传”的尴尬境地。

而中国大模型的此次“意外出圈”,也印证了中国AI技术的全球竞争力。DeepSeek V3作为中国开源大模型的代表,凭借先进架构、高效性能与开放态度,成为全球开发者的优选底座,即便被刻意隐去品牌,其技术标识依然无法掩盖。这不仅是中国AI从“跟跑”到“领跑”的有力证明,更彰显了开源生态的强大力量——技术创新无国界,真正优质的底层技术,终将突破地域与叙事的束缚,成为全球AI发展的共同基石。

截至目前,乐天集团尚未就模型来源争议作出正式回应,仅在模型介绍中模糊提及“基于开源社区模型开发”。这场闹剧尚未落幕,但已经给全球科技企业敲响警钟:开源不是“遮羞布”,自主研发更不能靠“包装”实现。在AI技术全球化的今天,尊重开源协议、坦诚标注来源,才是企业立足的根本;而真正的技术自主,只能依靠长期研发投入与核心技术突破,而非投机取巧的换皮游戏。

对于日本AI产业而言,此次争议是一次深刻的警示:放下执念、拥抱开源协作,同时沉下心补齐技术短板,才是实现自主突破的正道。对于全球AI行业来说,乐天AI3.0的翻车故事,也让人们重新思考:在技术竞争与合作并存的时代,如何平衡国家叙事、商业利益与开源伦理,才是推动AI健康发展的核心命题。

http://www.cnnetsun.cn/news/1361601.html

相关文章:

  • ANOMALYCLIP: OBJECT-AGNOSTIC PROMPT LEARN-ING FOR ZERO-SHOT ANOMALY DETECTION
  • M2LOrder企业级应用案例:呼叫中心语音转文本后情感打标实战
  • 直播回放下载的技术突破与完整指南:解决三大核心难题的实战方案
  • 帝国CMS 7.5编辑器在导入Word文档时如何处理跨平台格式差异?
  • 巧用国内镜像源,一键破解Pyppeteer的Chromium安装难题
  • 腾讯云使用OpenClaw接入个人微信
  • 安卓手机秒变Linux开发机:Termux+Tmoe一键安装KDE桌面全记录
  • 自动驾驶与手动驾驶混合流仿真:基于Matlab的连续型元胞自动机交通流模型源代码解析与可视化研...
  • 实训3 建库、数据处理并导入库
  • 大模型学习干货:一图看懂传统 RAG 与 Agentic RAG 实战差异,小白也能秒理解
  • STM32与51单片机最小系统对比:为什么你的32项目必须加稳压电路?
  • 每日算法题 10
  • Bebas Neue:开源无衬线字体的商业价值挖掘与全场景应用方法论
  • 如何用picacomic-downloader打造个人漫画图书馆?3步轻松搞定离线阅读
  • OP-CEPH02-在OpenEuler 22.03 LTS-SP4上构建高可用CEPH集群实战
  • 技术拆解:AI低代码架构设计与全链路落地实现
  • 科晶生物双擎AI驱动,解锁“蛋白/核酸”大分子定向设计新范式
  • 深度剖析SWAP模型,从SWAP模型源代码编译到AI大语言模型辅助建模
  • COMSOL专业模型在激光熔覆与选区熔融仿真中的应用
  • python学习笔记——列表的内置方法
  • 怎么给 Windows 电脑的 C 盘扩容?教你 6 招,一劳永逸释放空间
  • MySQL中between and的基本用法、范围查询
  • ArrayList之模仿电影系统综合案例
  • @SpringBootApplication 与 SPI 机制的终极解密
  • 和BS架构宠物健康咨询系统信息管理系统源码-SpringBoot后端+Vue前端+MySQL【可直接运行】
  • 决胜2026:10大智能拓客系统硬核横评,帮老板精准选对获客工具
  • JavaEE零基础入门指南
  • 嵌入式AI开发必看:杜绝幻觉,才是工业级IDE的核心底气
  • MCP服务开发与AI集成
  • 开源TOP20项目(2026.03.09-2026.03.15)