作者:
sxy67230 (charlesgg)
2026-03-24 08:04:40※ 引述 《takaai》 之銘言:
: 社群普遍認為,這些技術細節如同模型「指紋」,足以證實Rakuten AI 3.0並非從零開發
: ,而是以DeepSeek-V3為基礎進行日語優化的版本。事實上,在人工智慧產業中,基於開
: 源模型進行微調屬常見做法,可有效降低成本並提升特定語言或領域表現。
: 爭議焦點主要集中在授權與揭露問題。DeepSeek-V3採用MIT授權,允許商業使用與修改,
: 但需保留原始版權聲明。樂天最初發布時,未附上相關授權資訊,並改以Apache 2.0名義
: 重新釋出,被開源社群質疑有「洗授權」之嫌。隨著輿論升溫,樂天已更新相關儲存庫文
: 件,補上版權聲明並承認使用DeepSeek技術。
阿肥外商碼農阿肥啦!
阿肥看拔掛蠻少人在深挖這件事情的,樂天當前負責這個專案的AI首席官是一位叫蔡婷的美
籍華人,曾經任職微軟PM Leader、谷歌Director,有可能是美籍移二代。
不過其實這件事情也凸顯樂天底下組織嚴重的管理問題,雖然MIT是所有開源License 當中
最鬆散的,他甚至不主張專利許可、可商用、也可不開源,只要你不要拿掉最初模型開發人
員的製作聲明就可以了。(相比Apache 2.0還保留專利許可跟不可變更License)
這次真正的爭議其實就是樂天把開源社區License 的規範當地墊一樣踩,不遵守規矩想前人
種樹後人拔樹,那問題就大了。不然微調商用甚至發佈並不壞規矩就是了,只要附註說我們
是DeepSeek微調出來的就好了。
不過阿肥自己猜可能的劇本是這樣的,本來團隊就打算用DS V3微調,畢竟當前開源參數夠
大夠聰明的去年差不多時間的也只有V3。大概做了一年研究跟微調(畢竟要微調這麼大的模
型也不是小事,算力群集建置也是要花時間的。樂天的資源更不可能做完整的預訓練開始(
Train by scratch))。
不過發佈在即的時候有鑑於整個日本社會現在對中國的態度,樂天高層為了避免國內輿論選
擇避重就輕要刻意掩埋模型是中國模型就要求重做,但時程上根本做不到大聰明團隊只能選
擇把跟DS V3相關訊息刪除,故意在發佈的時候模糊說自己是從開源模型來但不提是哪個模
型。不然刻意詐欺其實有時間準備其實不會傻到連命名都不改?
差不多4講