DeepSeek-V4-Flash-Vision-Exp实测,Agent的眼睛是DeepSeek给的?
- 内容介绍
- 文章标签
- 相关推荐
凌晨两点半,盯着终端里滚动的日志,手里的冰美式早就凉透了。 DeepSeek 在 GitHub 上悄悄挂上 deepseek-v4-flash-vision-exp 的 tag 时 我甚至没来得及发推,先在群里甩了个截图:“兄弟们,它终于睁眼了。”,补救一下。
不是发布会, 是偷偷塞给你的钥匙
官方文档依陈旧是那种克制到让人发慌的风格:“测试性质、非 GA、模型标识设为 deepseek-v4-flash-vision-exp”。没有铺天盖地的海报, 没有“超越 GPT-4o”的较大字报,就连定价页都懒得单独拉一行出来——依然沿用 V4-Flash 的市场价格体系,输入缓存命中 0.014 元/百万 tokens,未命中 0.14 元,输出 2.8 元。这就很有意思了:视觉能力仿佛只是个“附赠”的副作用。

参数量没变, 依然是总参数 284B、激活参数 13B 的 MoE 架构;依陈旧 1M tokens;最较大输出甚至涨到了 384K。仅有的改变是更多了一双“眼睛”,而且这双眼睛还自带压缩算法——单张图片固定消耗约等于384 个视觉 token。换算一下:一张较高清截图进去,顶天也就是几百字上下文的开销。这意味哪些?意味着你能够在一次对话里塞进六百张图而不爆,来日方长。。
第一次实战:把报错堆栈扔给它看
触发点很真实实。前端控制台吐着红色的 TypeError: Cannot read properties of null , 堆栈有四十更多行,夹杂着 webpack 混淆后的较短变量名。以前我会把堆栈复制出来贴进对话框, 再配上组件代码、路由配置、甚至 `package.json` 的依赖版本——token 费得心疼,关键是我也懒得整理,哈基米!。
凌晨两点半,盯着终端里滚动的日志,手里的冰美式早就凉透了。 DeepSeek 在 GitHub 上悄悄挂上 deepseek-v4-flash-vision-exp 的 tag 时 我甚至没来得及发推,先在群里甩了个截图:“兄弟们,它终于睁眼了。”,补救一下。
不是发布会, 是偷偷塞给你的钥匙
官方文档依陈旧是那种克制到让人发慌的风格:“测试性质、非 GA、模型标识设为 deepseek-v4-flash-vision-exp”。没有铺天盖地的海报, 没有“超越 GPT-4o”的较大字报,就连定价页都懒得单独拉一行出来——依然沿用 V4-Flash 的市场价格体系,输入缓存命中 0.014 元/百万 tokens,未命中 0.14 元,输出 2.8 元。这就很有意思了:视觉能力仿佛只是个“附赠”的副作用。

参数量没变, 依然是总参数 284B、激活参数 13B 的 MoE 架构;依陈旧 1M tokens;最较大输出甚至涨到了 384K。仅有的改变是更多了一双“眼睛”,而且这双眼睛还自带压缩算法——单张图片固定消耗约等于384 个视觉 token。换算一下:一张较高清截图进去,顶天也就是几百字上下文的开销。这意味哪些?意味着你能够在一次对话里塞进六百张图而不爆,来日方长。。
第一次实战:把报错堆栈扔给它看
触发点很真实实。前端控制台吐着红色的 TypeError: Cannot read properties of null , 堆栈有四十更多行,夹杂着 webpack 混淆后的较短变量名。以前我会把堆栈复制出来贴进对话框, 再配上组件代码、路由配置、甚至 `package.json` 的依赖版本——token 费得心疼,关键是我也懒得整理,哈基米!。

