一、这次到底新在哪我翻了官方技术说明,V4.1 Flash是552B参数的MoE混合专家模型,用了全新的非对称Causal Encoder-Decoder架构。对比上一代V4 Flash,它把视觉能力从独立实验模型并进主模型,调用不用分两个接口——输入时只激活8B参数、输出激活16B,所以跑起来又快又省。最关键是原生多模态:以前看图要单独开Vision实验模型,现在一个deepseek-flash模型名就能一并处理文字和图片(JPEG、PNG、GIF、WebP都行)。我理解,这不是简单升级,是把会写和会看合并成一个助手。 二、对普通人意味着啥落到你身上,三件事最实用。一、写稿改文案:公众号、小红书、工作总结,丢给它出初稿、改口语化,比上一代更跟手;二、看图答疑:拍张单据、说明书、错题、商品图,直接问,它看得懂;三、做图辅助:配合其他生图工具,用它写提示词、理思路。我核实了,它Agent和写代码能力也强(Terminal-Bench、Codeforces多项跑分靠前),搞自动化的朋友能拿它搭工作流。一句话:免费网页版和App已经能用,开发者调deepseek-flash即可。具体怎么用:写公众号先让它出10个标题备选、把长稿改口语化;拍一道错题照给它,它讲思路不直给答案;做PPT前让它列大纲、写逐页讲稿;配合生图工具,让它写精准提示词。我理解,Flash档主打快和跟手,日常创作够用,不用追求最大参数。 三、便宜了多少官方把运行成本压下来了——新架构让KV缓存只占上一代1/4的HBM、1/8的SSD存储,调用成本明显降低,API定价同步下调。更实在的是峰谷分时:闲时价格只有高峰的一半,灵活任务错峰跑能再省一笔。我理解,对个人用户,免费版够日常用;对开发者,成本下降直接体现在账单上。新计价9月10日12点生效。对重度用户更明显:旧架构跑长上下文时KV缓存是成本大头,这次压到1/4,等效同样预算能多跑好几倍请求,自动化批量任务直接降本。 四、和之前比,有啥变化两个动作要知道:旧版V4 Flash、V4 Flash Vision Exp已经下线,模型名会临时路由到V4.1 Flash(平滑过渡);V4 Pro这边有波折——官方9月10日曾公告拟从9月14日起把v4-pro请求路由到V4.1 Flash并按其计费,9月11日又应需求撤回,决定继续保留V4 Pro、计费方式不变。我理解,官方更推荐用更便宜的V4.1 Flash,但V4 Pro没退役、仍在。我提醒,如果你在别的应用里调模型,把模型名改成deepseek-flash最稳,别再写老名字。 五、普通人怎么上手不用懂技术:一、打开DeepSeek网页版或App,直接对话,要它写、要它看都行;二、想让它看图,上传图片再问;三、开发者在API里把model设成deepseek-flash;四、批量任务放闲时跑更便宜。我理解,国产大模型这波把能力加成本一起打下来,对咱普通用户是利好——好用不贵。 六、几个提醒一、V4.1 Flash是快而省的Flash档,不是参数最大的旗舰,极难任务可等V4.1 Pro;二、免费版有额度,重度使用看API计费;三、看图上传注意隐私,别传敏感单据到公共对话;四、模型名首选deepseek-flash;V4 Pro未退役、确需它时调deepseek-v4-pro,别写已下线的老名;五、别神化AI,重要决策自己核对,长文档先拆成几段再问,一次喂太多反而答不精 七、接上期的科技线把这事和上期连起来:上期聊折叠屏三巨头(#446,硬件)、这期是国产大模型(软件)。一个壳一个脑,都是中国科技在往上走。对咱普通人,AI口诀就一句:会写会看还便宜,DeepSeek这波真能用上。 结语 · 你平时用DeepSeek写啥?写稿、改文案,还是让它看图答疑?这波原生多模态你打算怎么玩?评论区聊聊,给想上手的朋友提个醒。 |