8月6日,據澎湃新聞援引字節跳動內部人士訊息,創始人張一鳴在近期內部會議中罕見發聲,明確表示做模型要堅持長期主義、延遲滿足感,而不是用別人的輸出換取一時的榜單排名。這一表態正值國內AI大模型競爭白熱化之際,引發業內廣泛關注。

據澎湃新聞報道,今年國內競爭對手開源模型的快速發展給字節跳動帶來更大壓力。幾乎每隔幾天就有新模型釋出,每當有強大的開源新模型出現,字節跳動內部關於蒸餾的爭論就會升溫。張一鳴很少在Seed團隊的會議上發言,但此次明確表態,字節跳動“應該願意為長期目標犧牲一部分短期收益”。

據瞭解,字節跳動內部對開源模型嚴禁蒸餾,甚至通過API檢測等方式在內部加強相關限制。張一鳴認為,蒸餾會干擾真正意義上的長期技術突破。這一立場與部分同行形成鮮明對比——在競爭壓力下,不少公司選擇通過蒸餾快速提升模型能力,以在榜單上佔據優勢。

值得注意的是,就在張一鳴表態的同一天,DeepSeek釋出公告,計劃近期整體上調DeepSeek API服務的定價,預計漲幅較大,具體方案以正式通知為準。此前7月31日,DeepSeek宣佈DeepSeek-V4-Flash正式版API上線公測,該版本模型結構、尺寸與預覽版保持一致,僅重新進行後訓練。業內人士分析,此次漲價可能意味著DeepSeek即將上線V4-Pro正式版,將對整體算力呼叫產生影響。

字節跳動與DeepSeek的動向,折射出國內大模型行業的兩條路線:一方強調自主研發、拒絕捷徑,另一方則通過市場化定價和快速迭代搶佔市場。張一鳴的“拒絕蒸餾”表態,或為行業樹立新的標杆,但能否在激烈的競爭中堅持長期主義,仍有待觀察。