作者 | 博雯
编辑 | 赖捷
蓝色大肥鱼终于不近视了!
就在今天,DeepSeek官方正式发布DeepSeek V4.1 Flash模型,具备原生多模态视觉理解能力,最新API已全面接入WorkBuddy、CodeBuddy和OpenCode等第三方Agent工具。
当然,DeepSeek也不是首次拥有视觉能力,此前官方app和网页端就有识图功能,今年8月也上线了视觉模型DeepSeek-v4-Flash-vision-exp,只不过当时识图效果是这样的:
错把自家老板认成杨植麟和雷军的蓝色大肥鱼
究其原因,是此前的识图功能属于“外挂式”,本质上是在DeepSeek模型的纯文本底座上,外接了一个视觉编码器和对齐器。
而这一轮DeepSeek做出了更多改变。
盘点DeepSeek新版亮点:
治好了近视,加快了速度
这一次的V4.1 Flash,则是出场自带原生视觉理解能力。再去测试,就会发现不管是蓝色大肥鱼的Q版形象,还是西格玛猛男梁叔叔的梗图,它全都能识别出来:
对于更复杂的图,理解起来也没问题。我们把AI产品榜最新一期周榜图丢过去让它分析,结果不管是每个榜单的涨幅冠军,还是其它涨幅明显的产品,它都分析得非常准确。
当然,这次更新不仅仅是治好了近视眼,还放出更多功能。
最显眼的更新,是官方APP与网页端原有的三个对话模式(快速、专家、识图)已经合并,用户不需要再来回选不同模式。不过目前APP端和网页端,还没全量接入V4.1 Flash模型,在识图功能上的表现并不太稳定。
再看模型最核心的性能和速度,这次表现也相当不错。
在DeepSeek官方发布的基准测试中,V4.1 Flash在软件工程(DeepSWE v1.1)、网络安全环境(CyberGym)和自动化任务(Automation-Bench)三项任务中,都拿下了最高分,超越kimi-k3,GLM-5.3、Opus 5和GPT-5.6 Sol,在终端操作(Terminal-Bench)上则稍显落后。
而在速度方面,有用户表示,哪怕是跑歪了赶紧中断,V4.1 Flash都已经花了1块钱了……
官方在通告里表示,由于V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro,所以在9月14日12:00之后至未来V4.1 Pro上线之前,V4 Pro模型的请求都会被路由到V4.1 Flash,并按Flash的价格计费。
要知道,按照大模型惯常的命名规则,Flash一般是速度快但弱,Pro是速度慢但性能强,但现在的4.1 Flash却直接在性能上干掉了Pro,不可谓不强。
总之,这一波“加量不加价”的消息一出,刚刚因为DeepSeek涨价而限时体验“牢梁”称号的梁文锋,眨眼间又变成了梁圣。(梁文锋梗图大盘点)
前端设计能力直逼GPT-6 Astra?
网友们都用V4.1玩了什么
海内外社区的网友们立刻开始了一波实测。
X博主@Mia 用DeepSeek v4.1 Flash生成了100个HTML文件,以此评估模型的创造力以及前端设计能力。他认为在最后的效果上,v4.1 Flash甚至比GPT-6 Astra还要好一些。
比如一个多米诺骨牌的互动网页,点击其中任何一个牌都可以达成连锁反应:
下着雨的雨夜,鼠标点击哪里,哪里就会落下一道雷光:
还有故障反应,拖动不同的控制条,可以获得不一样的艺术风格:
也有虽迟但到的经典“鹈鹕骑车”测试,这是一位国外老哥在24年提出的测试任务,其难点在于——大模型不仅要用SVG代码把自行车和鹈鹕都给画出来,还要把一个本来不适合骑车的体型准确安排在各个位置上,比如翅膀怎么搭着车把,脚能不能踩到踏板上等。
而V4.1 Flash在这项测试上的表现明显有进步,且用时只有V4 Flash的一半还不到,图像清晰程度也更高。
图源 博主@雪瑜
还有博主用13个DeepSeek V4.1 Flash Beta Agent全自动建模、写脚本、渲染、看图,最终肝了一个1:1还原的地中海海岛。他感叹这完全是“用Flash档在干旗舰活”,已经能当建模施工队,而不是玩具。
图源 博主@SuSu_酥酥
事实上,或许是因为DeepSeek一贯的便宜开源的风格,能感觉到这次社区中在对V4.1 Flash进行实测时,处处都透露着一股“这么便宜还要啥自行车”的感觉。
比如有博主通过代码生成树形结构,再用GPU渲染出花瓣效果,让其在不同光影效果下进行变换,同时要辅以360°摄像头交互功能。
最后生成的产品美术效果不错,但摄像头交互功能并未被实现。不过博主也认为,V4.1 Flash整体速度快、成本低且效率高,对那些复杂任务而言它达不到最佳水平,但对大多数任务来说性能已经足够好。
也有博主提出,现在的大多数基准测试,都是在测试模型的极限性能,但对绝大多数普通用户来说,更真实的需求其实是模型在日常设计任务中的表现。
海外博主@OpenDesign 设计了一款测试基准OpenDesign Arena,围绕Web应用、移动端App、桌面客户端、看板与管理后台、官网与落地页等五类生成任务进行评测。
基于这套新基准,V4.1 Flash的性能达到了GPT-6 Astra的98%,成本仅为后者的1.4%。
而在速度上,在与GPT-6 Astra和Claude性能基本持平的前提下,DeepSeek V4.1 Flash的响应时间仅为5.3分钟,还不到GPT-6 Astra或Claude所需时间的一半。
而在成本上,DeepSeek V4.1 Flash不仅更便宜,性能也优于绝大部分模型,只有GPT-6 Astra在性能上略胜一筹,没有掉入“斩杀线”。
当然,这项基准主要比拼的是前端设计能力以及性价比,在代码能力和后端能力上,V4.1 Flash与最顶尖的那一批模型还是存在一定差距。
而比起参数性能大讨论,更吸引普通用户的,是伴随着DeepSeek再一次更新,AI圈又有了新梗。
网友纷纷感叹,蓝色大肥鱼终于能认出自己,也能认出自己的老板了;还有网友发现,V4.1 flash跑任务时,思维链里充满了欢乐轻松的语句,酷似迪士尼风格歌曲,所以调侃这是因为干掉了V4 Pro,开心到“一边干活一边唱歌”。
当然,治好近视只是个开头。等V4.1 Pro登场,这条鱼还能长出什么新本事谁都说不准。而以DeepSeek的更新节奏,AI圈的下一个梗,大概已经在路上了。
欢迎分享、点赞、推荐
一起研究AI
![]()
![]()
![]()
![]()
欢迎分享、点赞、推荐 一起研究AI








