header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

DeepSeek 終於要上多模態了?全新視覺模型已進入官方 Harness

動察 Beating AI 快訊,DeepSeek 一個新的視覺模型 deepseek-v4-flash-vision-exp 開始浮出水面。社區已經有人通過 API 跑通,可以直接傳圖提問。更直接的信號是,DeepSeek Harness 今天已經把這個模型加入預設模型目錄,並明確標記為支援圖片輸入。對應程式碼 PR 的標題就叫「publish the vision model」。目前 DeepSeek 還沒有正式官宣,官方 API 文件裡也暫未出現。

DeepSeek 其實早就能識圖。網頁和 App 已經上線識圖模式。此前 DeepSeek 視覺團隊公開的研究基於 V4-Flash,讓模型把點和邊界框直接插進推理鏈,相當於一邊「指」著圖片,一邊完成視覺 CoT 推理。

這次發布也早有伏筆。兩天前的 DeepSeek Harness RC.8 剛給官方 DeepSeek 適配器補上原生圖片輸入。實現筆記當時已經寫出 deepseek-v4-flash-vision-exp,但特意沒有放進預設模型目錄,理由是要等模型端點準備好。

兩天後,這個限制被正式拿掉。Harness v0.1.1-rc.1 已經把 deepseek-v4-flash-vision-exp 列為預設視覺模型。此前還是「等端點準備好」,現在已經直接進入官方模型列表,新視覺模型即將發布。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成