东升国际官网

商湯「日日新V6」多模態能力為國内最強、成本業內最低 讓AI融入「苍生之日用」

商湯科技品牌中心4 分钟阅读

商湯科技SenseTime在上海、丽江等多地舉辦2025技術互换日活動 ,沉磅推出全新升級的「日日新SenseNova V6」(「日日新V6」)大模型體系 ,通過多模態長思維鏈訓練、全局記憶、強化學習的技術突破 ,形成領先的多模態推理能力 ,並突破成本邊界 。

「日日新 V6」模型能力顯著提升 ,在長思維鏈、推理、斅讽、全局記憶方面擁有顯著優勢 ,多模態推理能力國內第一 ,對標OpenAI o1 ,數據分析能力大幅領先GPT-4o 。同時 ,其高效力與低成本美满結合:多模態訓練整體效能對齊語言訓練實現業內最低、推理成本均實現業界最低;全新的輕量級全模態交互模型SenseNova V6 Omni帶來了國内最強的多模態交互能力;涵蓋國内首個支持10分鐘中長視頻深度解析的大模型 ,對標Gemini 2.5 Turbo ,達同類型最強 。


Screenshot 2025-04-11 at 3.04.31?PM.png


商湯科技董事長兼首席執行官徐立暗示:「 AI之路 ,在於苍生之日用 。商湯日日新V6已逾越多模態邊界 ,釋放推理與智能的無限可能 。」


Screenshot 2025-04-11 at 3.04.44?PM.png


多模態長思維鏈、強化學習、全局記憶 ,日日新V6率先實現多模態下深度思虑

作為擁有超6,000億參數的混合專家架構(MoE)原生多模態通用大模型 ,「日日新 V6」實現了多項技術突破 ,憑藉單一模型就能够实现文本、多模態等各類任務:

  • 長思維鏈:超過 200B 高質量多模態長思維鏈數據 ,最長 64K 思維鏈;
  • 斅讽能力:數據分析能力大幅領先 GPT-4o;
  • 推理能力:多模態深度推理國内第一 ,對標 OpenAI o1;
  • 全局記憶:率先在國内突破長視頻理解 ,支持10分鐘的視頻理解及深度推理 。


Screenshot 2025-04-11 at 3.04.56?PM.png


在權威的推理能力及多模態能力評測中 ,「日日新 V6」在多個維度獲得SOTA (State-of-the-Art):


Screenshot 2025-04-11 at 3.05.09?PM.png

【主题指標】純文本任務綜合机能優秀 ,比肩國際一線模型;多模態机能領先 ,各方面机能凸起;純文本推理與多模態推理能力均對標GPT-4.5和Gemini 2.0 Pro等國際一流模型的水平


Screenshot 2025-04-11 at 3.06.29?PM.png

【強推理能力】日日新融合模型從 5.5 到 V6 / V6 Reasoner ,推理能力顯著提升 。在獨立評測中 ,多模態和語言深度推理任務上同時超過了OpenAI的o1和Gemini 2.0 flash-thinking的水平

基於超過200B高質量多模態長思維鏈數據 ,商湯通過多智能體協作進行長思維鏈合成和驗證 ,「日日新 V6」形成了凸起的多模態推理能力 ,能够支持合成最長 64K 的多模態長思維鏈 ,支持模型長時間思虑能力 。

針對真實環境存在的複雜問題 ,「日日新 V6」強大的混合圖文理解推理能力 ,能夠幫助用戶解決各類問題 。

在複雜文檔繁瑣的文檔處理場景中 ,「日日新 V6」同樣能夠以多模態強推理能力解決用戶難題 ,可於商湯辦公幼浣熊體驗:https://xiaohuanxiong.com/office

以保險理賠場景為例 ,日日新 V6」可根據商業醫療保險理賠资料 ,判斷提供资料是否切合理賠要求 ,檢查是否存在亂開藥、亂檢查、资料缺失或者资料不齊等問題 。


Screenshot 2025-04-11 at 3.07.51?PM.png

幼額理賠雖然金額幼但往往耗費時間長(3-7天) ,而交予「日日新 V6」 ,它能自主檢測到風險提醒 ,自主進行交叉驗證 ,最後再給予用戶极度細緻、多維的結論 ,实现模型到客戶使用的最後一公里

得益於多模態強化學習的突破 ,商湯構建了面向多種圖文任務的混合增強學習框架 ,基於分歧難度分級和多獎勵模型的強化學習訓練 。

國内率先於視頻理解突破10分鐘限度 ,超長內容實現秒級推理拆解

憑藉「全局記憶」能力 ,「日日新 V6」突破了傳統模型僅支持短視頻的限度 ,可支持10分鐘級視頻全幀率解析 。

基於強大的理解能力 ,「日日新 V6」還能够對視頻的杰出內容進行智能剪輯輸出 ,幫助用戶保留珍貴瞬間 。


Screenshot 2025-04-11 at 3.08.19?PM.png

針對一段《黑神話》遊戲錄屏 ,遊戲玩家們可將日常積累的遊戲錄製、實況 ,輸入「日日新 V6」理解杰出內容和值得記錄的時間 ,剪輯出高光時刻 ,同時可自定義天生解說案牍 ,幫助分享遊玩經驗和遊戲內的杰出操作

商湯自研技術可將視覺信息(畫面)、聽覺信息(語音、音效)、語言信息(字幕、口語)、時間軸邏輯對齊 ,形成多模態統一時序表徵 。在此基礎上 ,通過細粒度級聯信息壓縮和內容敏感的動態過濾 ,實現長視頻的高比例壓縮 ,10分鐘視頻能够壓縮到16K tokens ,依然保留關鍵語義 。

真正像人一樣交互 ,「SenseNova V6 Omni」發佈即實現多行業落地

伴隨日日新SenseNova V6的發佈 ,商湯日日新實時交互融合大模型升級至「SenseNova V6 Omni」 ,在角色表演、翻譯點讀、文旅導遊、講解繪本、數學講解等場景下進行了深度優化 。


Screenshot 2025-04-11 at 3.08.48?PM.png


以翻譯點讀場景為例 ,「SenseNova V6 Omni」讓用戶通過手指就能實現精準地位的空間交互 ,並精準理解部门信息與全局信息的關係 ,帶來更切合人類天然直觀的指讀交互體驗 。

「SenseNova V6 Omni」擁有更像人的感知和表達能力、感情理解能力 ,並已在具身智能等領域實現多行業、多場景落地 ,成為國内首個商業化的全模態實時交互模型 。

滿血版「协商」全量上線 ,現已開放內測

整合「日日新SenseNova V6」全数能力 ,商湯协商也迎來全面升級 ,並推出全新协商APP 。用戶通過一個入口 ,即可體驗文字、圖像、視頻等多種模態流式交互體驗 。

协商APP已啟動內測 ,「日日新 V6」目前可於协商Web端體驗 。


發佈1億元現金券 ,全棧賦能場景落地

商湯科技還颁发投入人民幣1億元專項補貼 ,聚焦具身智能、AIGC等多個前沿領域 ,通過多維度的精準搀扶 ,為企業提供從專家諮詢到模型訓練、推理驗證的全流程AI服務支持 ,打造「高效能、低成本、端到端」的一站式賦能规划 。

#新聞#SenseTime
【网站地图】