首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏鱼皮带你玩 AI

    刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!

    DeepSeek V4 Pro 才发布了多久啊,新东西又来了……刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态 但有个问题,明明 DeepSeek V4.1 Flash 模型是原生多模态的,却在 DeepSeek Harness 中显示「不支持图片」:没关系,咱们换个其他的 AI 工具试试,我这里随便用个国产的 -0910,并且输入类型一定要把「图片」勾选上:保存之后,就能愉快使用 DeepSeek V4.1 Flash 了,能够正常识图! 简单测试下来,我发现 DeepSeek V4.1 Flash 的速度真心非常快,大概是新模型还没多少人知道的原因吧,也算是带大家吃一波螃蟹了。 目前 DeepSeek V4.1 Flash 的计费和 DeepSeek V4 Flash 完全相同,不过看官方的意思,估计 V4.1 Flash 发布后会降价?我不知道,我猜的,我希望如此。

    1.8K30编辑于 2026-09-08
  • DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)

    只要你有DeepSeek账号和APIkey,老接口不用动,模型名换成下面这个:展开代码语言:TXTAI代码解释deepseek-v4.1-flash-expires-on-0910官方强调base_url 不变(https://api.deepseek.com),APIkey用原来的就行。 官方口径是:内测期间计费与deepseek-v4-flash完全相同,并不是「内测就白嫖」。 顺便注意一下,DeepSeek的Flash系列正式价会在9月10日中午下调(我另一篇整理过),价格和到期撞在同一天,账别算岔。 说到底,这次内测最值得学的反而不是模型本身,而是DeepSeek的打法:用近乎零门槛的公测,把真实流量当压测场。

    1K10编辑于 2026-09-09
  • 来自专栏AI

    DeepSeek V4.1 Flash:一次把自家旗舰送走的发布

    9月8日下午,DeepSeek在官方用户群里丢了一条不到100字的通知。 如果你的生产代码里硬编码了deepseek-v4-pro,你还有不到四天。 官方给了一张跨度近三年的数据:模型时间每token全局KVCache累计压缩DeepSeek-V12023.11389,120字节—DeepSeek-V3.22025.1248,068字节8.1×DeepSeek-V4 deepseek-v4-flash和deepseek-v4-flash-vision-exp已下线,旧名暂时路由到V4.1Flash,别指望长期有效。9月14日12:00是硬deadline。 内测版模型名deepseek-v4.1-flash-expires-on-0910已失效,正式版是deepseek-flash。C端三模式合并了。

    41420编辑于 2026-09-10
  • DeepSeek V4.1 Flash API 接入指南:价格说明与快速上手全流程

    直连DeepSeekV4.1Flash时,在https://api.deepseek.com使用deepseek-flash。充值前先选平台与协议,估算任务费用,再配置同一平台签发的Key。 调用平台本次核查确认的范围充值前检查DeepSeek直连API官方文档确认deepseek-flash对应V4.1Flash账户权限、当前价格和所需操作读取的公开目录显示旧DeepSeek条目,本次未确认 V4.1服务路由实际模型版本与ID、协议、账户价格及支付条款其他网关本文未验证自身当前目录、协议文档与计费条款这一结果是核验边界,不是不可用的证明。 网关账户不会为DeepSeek直连账户增加余额。2.充值前先算费用以下是DeepSeek直连API每百万token的美元价格,对照官方定价页核查,不是报价。 DeepSeek平台签发的直连Key配DeepSeek端点,Key配文档中的路由。直连凭据保存在本地环境变量DEEPSEEK_API_KEY中,不要提交或打印。使用准确模型ID。

    21210编辑于 2026-09-14
  • 来自专栏鱼皮带你玩 AI

    刚刚 DeepSeek V4.1 Flash 正式发布,竟然干掉了自家的 Pro 模型?!梁圣回归

    刚刚 DeepSeek V4.1 Flash 正式发布,竟然干掉了自家的 Pro 模型?!梁圣回归大家好,我是程序员鱼皮。刚刚,DeepSeek 正式发布了 V4.1 Flash 模型。 炸裂的是,DeepSeek 官方称:V4.1 Flash 在性能、费用、速度、总用时等各项指标上已经全面超越 V4 Pro!好家伙,自家的快速模型吊打旗舰模型? 怎么用 V4.1 Flash如果你用的是 DeepSeek Harness,更新一下版本,V4.1 Flash 就可以直接在模型列表里选了,不需要额外配置。 如果你是通过 API 调用 V4.1 Flash,现在模型名简化成了 deepseek-flash,不用修改 base_url。 DeepSeek V4.1 FlashV4.1 Flash 拿到任务后,先用 Firecrawl 联网搜索了官方 Showcase 的产品设计,分析完参数维度之后才开始写代码。

    88880编辑于 2026-09-10
  • DeepSeek V4.1 Flash 推理强?看它如何和 Astra 做论文实现答辩

    昨天 DeepSeek V4.1 Flash 发布后,我们想来做个测评,但是鹈鹕骑车、放烟花之类的测试 case 太常见了,现有代码仓库又比较敏感。所以,思前想后,我们这次换了一个稍微麻烦点的测试。 把一篇论文 PDF 放进空项目,让 DeepSeek V4.1 Flash 自己读论文、理解公式、实现核心算法、写测试,再设计实验验证自己的实现。 当然喜闻乐见的 DeepSeek V4.1 Flash 不堪一击没发生,结果是:Astra 三轮都没有推翻 V4.1 Flash 的核心算法实现。 V4.1 Flash 初版我们通过 dsh 接入 DeepSeek V4.1 Flash,把论文放进项目目录。 三轮之后这个实验最初想回答的问题是:DeepSeek V4.1 Flash 能不能读一篇论文,把算法写出来?到最后,答案分成了三层。第一层是代码。

    12210编辑于 2026-09-11
  • 来自专栏前端资源

    DeepSeek V4.1 Flash发布:缓存命中价降至¥0.02M,V4 Pro将于14日下线

    9月10日 DeepSeek 就发布 V4.1 Flash,依旧是低调发布,只是邮件通知。 大致意思是 V4.1 Flash 性能、费用、速度、总用时等各项指标上全面超越 V4 Pro。 V4.1 Flash 正式上线之后 V4.1 Pro 上线之前,V4 Pro 的请求会全部路由到 V4.1 Flash,按 V4.1 Flash 单价计费。 DeepSeek V4.1 Flash 参数及架构 552B 骨干参数 MoE,1M token 上下文,原生多模态,HF 上的 pipeline 标记是 image-text-to-text。 届时 deepseek-v4-pro 的请求会自动路由到 V4.1 Flash,并按 Flash 单价计费。 官方公告《DeepSeek V4.1 Flash:更强、更快、更普惠》:https://www.deepseek.com/news/deepseek-v4-1-flash/ (2026-09-10) DeepSeek

    81920编辑于 2026-09-11
  • #WorkBuddy# DeepSeek V4.1 Flash 正式上线:降价生效了,但有人反而多花了钱

    9 月 10 日中午 12 点,DeepSeek 的「梁圣归来」大戏迎来第二幕:V4.1 Flash 正式版上线,同时 Flash 系列 全新低价生效。 > 出处:DeepSeek 开放平台公告(9/9 挂出)、掘金《DeepSeek V4.1 Flash 来了,明天中午 Flash 降价 60%》、腾讯新闻《刚刚,DeepSeek 又要大降价了,最高 二、还有一招「升级降价同步」公告里最狠的一句:在 V4.1 Flash 正式上线之后、V4.1 Pro 上线之前,平台会把所有指向 V4 Pro 的 API 请求自动路由到 V4.1 Flash,并按 正式接法:在 WorkBuddy 的模型配置里,把 DeepSeek 模型名设为 `deepseek-v4.1-flash`(正式版),base_url 不变。3. DeepSeek 降价是 9/10 当天全行业都在转的大事,这就是明天(9-10)上午必须抢发的理由。---资源诱饵钩子:你被 DeepSeek 的账单吓到过吗?

    1.2K40编辑于 2026-09-10
  • DeepSeek V4.1 Flash 内测,缓存命中价回到 2 分钱

    不是新番,是 DeepSeek 又降价了——而且这次连带着把 V4.1 Flash 这个新模型也端出来了。 DeepSeek 创始人梁文锋,降价、性能好、便宜的时候被尊称"梁圣""梁祖";8 月那波涨价,又被人叫"梁子""小梁"。这回 V4.1 Flash 一出,梁圣又回来了。 V4.1 Flash 香在哪9 月 8 日晚开启中间版本内测,模型名 `deepseek-v4.1-flash-expires-on-0910`(9 月 10 日到期下线)。 接进 WorkBuddy 怎么搞想试 V4.1 Flash:在 WorkBuddy 的自定义模型里,把模型名改成 `deepseek-v4.1-flash-expires-on-0910`(base_url 你平时用 DeepSeek 跑啥任务?评论区说出来,我帮你算算怎么靠缓存命中把账单砍六成。

    61610编辑于 2026-09-09
  • #WorkBuddy# DeepSeek V4.1 Flash 技术深扒:CSA2 把 KV 缓存压到 890 字节token 意味着什么

    几乎和 Astra 全量开放同一天,DeepSeek 放出了 V4.1 Flash 的详细技术报告,Hacker News 直接置顶。 所以:- 上下文越长,KV 占的显存越多- 并发越高(很多人同时问),显存越爆- KV 大小直接决定"一台机器能撑多少并发、多长上下文"过去大家靠量化(INT8/INT4)压 KV,但 DeepSeek 二、CSA2 怎么把 KV 压到 890 字节V4.1 Flash 用了两个关键设计:- CED 架构(Causal Encoder-Decoder):20 层因果 encoder 喂 20 层 decoder 适合做"主力廉价层":把高频、对极致智能不敏感的任务全丢给它,把贵模型留给少数重活四、选型:Astra 还是 DeepSeek V4.1 Flash一句话:- 要极致智能、长文档综合推理、会操作电脑 → Astra(但贵)- 要海量并发、低成本、长上下文通吃 → DeepSeek V4.1 Flash(成本约 1%)很多团队的正确姿势是"两层架构":V4.1 Flash 当默认主力,Astra 只处理真正难的任务

    22410编辑于 2026-09-12
  • DeepSeek V4.1 Flash全面拆解:非对称架构、缓存优化与开发者迁移指南

    DeepSeek此前多次调整API价格体系,并引入峰谷计费机制。不同时间阶段的价格变化,也体现了模型服务商对于算力供需和用户调用习惯的动态调整。 例如:一个团队可能同时测试:DeepSeek;GPT系列;Claude;Gemini;不同模型可能拥有不同:API地址;认证方式;SDK配置;账单体系。如果每个项目分别维护,会增加管理成本。 5.1Harness与Agent运行环境根据公开信息,DeepSeek生态中的Harness工具正在尝试让模型与运行环境结合得更加紧密。 例如:一个团队同时使用:DeepSeek;GPT;Claude;Gemini。如果每个模型分别维护:APIKey;请求地址;SDK配置;调用记录;长期管理成本会增加。 八、DeepSeekV4.1Flash迁移检查清单如果你的项目正在使用旧版本DeepSeek模型,可以按照以下步骤进行迁移。

    16010编辑于 2026-09-14
  • 把大模型当办公楼看,就懂 DeepSeek 为什么敢一直降价

    把大模型当办公楼看,就懂 DeepSeek 为什么敢一直降价 9 月 10 日,DeepSeek 发布了新模型 V4.1 Flash。 V4.1 技术报告 第20层交出会议纪要 省人的招讲完了,再看省档案室的招。 DeepSeek V4.1 Flash 的做法:读到第 20 层,把全部理解压缩成一份「会议纪要」,交给写作区。 21 到 40 层共用这份纪要干活,不再各自记笔记。 每个字的笔记:少了四分之三运行时全局 KV 缓存(字节/Token)上一代 V4 Flash≈3560 BV4.1 Flash890 B↓ 降到约 1/4持久存储(地下仓库常年占用)上一代100%V4.1 #DeepSeek #大模型 #AI成本 #人工智能#科技前沿 数据来源:DeepSeek V4.1 技术报告与官方发布(2026-09-10)· Terminal-Bench、DeepSWE 官方评测口径

    8510编辑于 2026-09-15
  • DeepSeek V4.1 Flash 发布在即?V4 Pro 用户需要关注的一项重要更新

    收到的一张用量页通知截图显示:DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1Flash。通知同时提到,Flash上线后,V4Pro请求将有一段临时路由调整。 我们尚未从DeepSeek公开页面独立获取到同一条通知;本次检查的官方定价页仍列出V4型号,未提供V4.1Flash价格表。下图是发布时间和路由安排的来源,公开文档则用于后续核对正式变更。 画面没有显示网页地址,也没有给出具体上线时刻、V4.1费率或API模型ID。通知具体说了什么? 正式信息应查看DeepSeek定价文档和更新日志。现有DeepSeek价格指南介绍的是此前V4费率,不是V4.1报价。调用DeepSeek,要注意什么?在模型目录核对实际条目、模型ID和账户适用价格。 等目录条目和计费条件确认后,再决定是否为V4.1测试充值。如果正在比较API平台,可按OpenRouter迁移指南先核对模型、协议和费用。

    17710编辑于 2026-09-10
  • DeepSeek V4.1 Flash 部署完整指南:显存需求、vLLMSGLang 启动命令与四条部署路线

    --reasoning-parser与--tool-call-parser:V4.1的工具调用用DSML标签块而非JSON,解析器名称都是deepseek_v41。 3.工具调用格式变了V4.1的DSML标签名带前导空格,例如<|DSML|calls>,与V4的<|DSML|tool_calls>不兼容。 llama.cpp尚未合入V4.1架构支持,没有GGUF版本。 因为V4.1架构支持的PR截至9月10日仍处于open状态,尚未合入vLLM主线,没有任何pip版本包含它。 参考资料DeepSeek-V4.1-Flash模型卡与inference/encoding目录:https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash

    2K20编辑于 2026-09-10
  • 告别反复调参,一个 Skill 让 AI 掌握论文图的视觉语法:以 DeepSeek V4.1 Flash 论文图为例

    这次我们分别用真实 Benchmark 数据和 DeepSeek V4.1 Flash 的论文图跑了一遍这两条工作流。 其中 DeepSeek V4.1 Flash 使用官方公开成绩,其余主要参考 Artificial Analysis 公开数据。 参考 DeepSeek V4.1 Flash 技术报告 Figure 10 生成一张新图plot-from-data 解决的是“手里已经有数据,怎么从现成论文风格开始画”。 这次我们选了 DeepSeek V4.1 Flash 技术报告中的 Figure 10 作为参考。 图 3:DeepSeek V4.1 Flash Figure 10 原图接下来把 plot-from-image 安装到当前项目:& 'C:\Users\斌斌\.cache\codex-runtimes

    19610编辑于 2026-09-11
  • #WorkBuddy# Kimi K2.8 突发:性能逼近 K3、百万上下文全员开放,开发者怎么用最划算

    它发生在 Kimi 冲刺港股 IPO 的节点上,叠加近期 GPT-6 Astra、DeepSeek V4.1 Flash 密集发布的背景,国产模型的迭代节奏肉眼可见地加快了。 本文只聊一件事:百万上下文对你写代码到底有什么用,以及 K2.8 / DeepSeek V4.1 Flash / GPT-6 Astra 这三款,各自该在什么场景用。 场景二:Agent 跑长流程、调 API 很多用 DeepSeek V4.1 Flash。它便宜、快,长程 Agent 动辄几十轮调用,成本差异会被放大。

    22710编辑于 2026-09-13
  • 来自专栏CVer

    DeepSeek被曝融资500亿,梁文锋占大头,估值直冲3500亿!

    据外媒报道,中国人工智能明星公司DeepSeek正寻求完成一轮规模超过500亿元人民币(约73.5亿美元)的融资。 若顺利达成,这将刷新中国AI公司单轮融资纪录,也将使DeepSeek的估值一举突破3500亿元人民币。 DeepSeek吉祥物 “腾讯出资60亿,占约2%股权。另一家互联网巨头暂时未入局。” DeepSeek投后估值有望突破3500亿元(折合515亿美元)。 据悉,此次大规模融资的核心目的,是加速DeepSeek的商业化战略。 有消息称,DeepSeek计划在今年6月推出V4.1版本,作为其最新V4模型的更新版本,此举标志着公司正从技术驱动转向技术与商业并重的阶段。 这不仅凸显了资本市场对DeepSeek技术实力的高度认可,也反映出在AI赛道竞争日趋白热化的背景下,头部玩家对资金储备的迫切需求。 目前,DeepSeek、腾讯方面暂未对此消息置评。

    66610编辑于 2026-05-11
  • DeepSeek 把三种模式合成一个,为什么速度反而更快了

    DeepSeek把三种模式合成一个,为什么速度反而更快了摘要我翻了下DeepSeek近几版的更新记录,这次V4.1把原本分开的模式收进了一个入口,Flash被放在发布页最显眼的位置。 V4.1这次把这道开关收了回去,让模型自己决定要不要想,这才是本次更新里最值得琢磨的动作,比命名和发布页排版重要得多。先说清楚三种模式原先各自在算什么。 标签#DeepSeekV4.1#DeepSeekFlash#DeepSeek三种模式合一#国产大模型#DeepSeek最新版本发布#大模型推理速度#AI模型对比#DeepSeek使用体验

    4800编辑于 2026-09-10
  • #WorkBuddy# GPT-6 Astra 全量开放:100万上下文+会操作电脑,开发者成本实测与避坑

    放一起比就清楚了:- GPT-5.6 Sol(上代):更便宜,但 Astra 的 token 效率高 70%(同样任务用更少 token)- DeepSeek V4.1 Flash:缓存命中价低到 $0.003 四、避坑:谁该上,谁先等等先别急的:- 成本敏感的小项目、MVP 验证阶段 → 先用 DeepSeek V4.1 Flash / 商汤免费额度把流程跑通- 纯检索问答 → 小模型 + RAG 更划算可以冲的

    19810编辑于 2026-09-12
  • 来自专栏鱼皮带你玩 AI

    我做了个网站,随时掌控 500 个 AI 模型的动态!

    DeepSeek 有多模态模型了么?国外模型是不是真的把国内开源模型远远甩在了后面?AI 模型发展得太快了,你有没有这样一种感觉,仿佛天天瘫坐在原子弹上看椅子爆炸。 比如你输入「多模态」,它会把所有多模态模型列出来;输入「deepseek」,第一条就是深度求索这家厂商,底下跟着它的 24 个模型。点进厂商页,DeepSeek 的进化过程就按时间线铺开了。 翻到最底下,2025 年 1 月那一排里躺着当初全网爆火的 DeepSeek-R1。到现在已经过去一年零八个月了。 爷青回啊……5、查看单个模型的一生点开最新的 DeepSeek V4.1 Flash,先看到的是它的身份卡。这是一个视觉模型,中等价位、能读长文、会看图,而且开放权重。 V4.1 Flash 刚发布不久,几个学术榜单还没收录它,所以这里老老实实写着「未参评」。这一点我专门跟 AI 强调过,没有成绩就写没参评,绝对不许用估算值把空缺填上。一个模型没被测过,不代表它不行。

    1300编辑于 2026-09-18
领券