95
9
15
9
举报
发布时间:2026-05-14 10:21
查看AI文稿
小七看国际
小七看国际

粉丝3.6万获赞219.0万

相关视频

  • Token 价格又开始两极分化了。
    01:08
    查看AI文稿
  • DeepSeek V4 编程打赢GPT,价格只要1% #DeepSeek  #DeepSeekV4  #AI编程  #大模型  #开源
    01:29
    查看AI文稿
  • DeepseekV4Flash真正实现token自由
#deepseekv4 #deepseekv4flash #v4flash #claudecode #ai新星计划 # hermes
# 小龙虾 # 视频日记 # 日更 # token自由 
intj openwebui 爱马仕
    00:35
    查看AI文稿
  • 能劝一个是一个#AI #老嗷嗷高 #本地部署
    01:52
    查看AI文稿
  • DeepSeekV4 Flash版是企业落地最佳选择? #DeepSeekV4 #AI #本地部署 #GPU #数码科技 @DOU+小助手
    01:07
    查看AI文稿
  • 性价比之王deepseekV4flash 我的小程序项目已经都改成v4 flash了,整体效果还是非常不错的。
#deepseekv4 #大模型 #程序员 #独立开发者 #网站开发
    01:03
    查看AI文稿
  • DeepSeek V4让国产替代链路打通
    04:03
    查看AI文稿
    1.3万也读书
  • DeepSeek V4发布 #DeepSeek #DeepSeekv4 #深度求索 #掘金计划2026   #燃起来了大国重器
    07:37
    查看AI文稿
  • DeepSeek V4 五件事速懂 DeepSeek V4 发布了,百万上下文直接标配!Flash 版价格只有 Pro的1/12,实测效果居然差不多?五件事帮你快速搞懂这个模型,该不该换,看完就有答案。     
#DeepSeek  #AI开箱  #大模型  #人工智能   #DeepSeekV4
    02:51
    查看AI文稿
  • .DeepSeek与OpenAI双雄对决
OpenAI悄悄上线GPT-5.5,API定价最高冲到了每百万Token输出180美元(Pro版)。几小时后,DeepSeek V4出来了,V4-Flash的输出定价2元人民币,折合美元不到0.3。
同一天,同一个赛道,相差了快600倍。
闭源的在涨价,走的是“精英特供”;开源的在降价,走的是“农村包围城市”。
 #deepseek #GPT #定价 #AI #大模型
    01:58
    查看AI文稿
  • 单卡 5090 就能给你私有化部署 Deepseek-V4- Flash,CMG 油藏数值模拟工作站#diy装机 #5090显卡  #deepseek #AI大模型 #Enine亿玖服务器定制
    00:44
    查看AI文稿
  • 要迁移到DS v4么?
我来聊聊:硬件选型和价格预算
    06:36
    查看AI文稿
  • 4 卡PRO6000生物科研计算服务器,支持Deepseek -V4-Flash INT8的模型部署#diy装机#pro6000显卡 #deepseek#AI大模型#Enine亿玖服务器定制
    00:40
    查看AI文稿
  • DeepSeek V4炸场!1.6万亿参数,价格只有竞品1% 就在昨天,DeepSeek扔出年度王炸。
V4正式发布,1.6万亿参数,100万上下文,MoE+稀疏注意力架构。
两个版本:Pro版做复杂推理,Flash版快速响应。
但最狠的是——价格只有主流竞品的1%。
代码能力开源全球第一,训练全面转向华为昇腾芯片。
从追赶者到规则制定者,DeepSeek正在重写全球AI竞争格局。
你怎么看?
#deepseek #AI大模型 #国产大模型 #DeepSeekV4 #科技
    02:10
    查看AI文稿
  • DeepSeek-V4-Flash 本地部署,H20*2 两块 H20,96G 显存,本地跑 DeepSeek V4 Flash,能跑通吗。大家好,我是AI学习的老章。Flash 版权重 160G,原始 Safetensors 接近 149G,AMD 全军覆没,消费级英伟达也不配,门槛先把一半人劝退。我用 vLLM 官方 Docker 镜像 deepseekv4-cu129 启动,按默认配置一启就 OOM,连续翻车好几次。最终生效的脚本是这套,开 FP8 KV cache,启用专家并行 EP,单卡权重压到 77.6G,max-model-len 砍到 7K,gpu-memory-utilization 拉到 0.95,再叠 enforce-eager,才算是稳住了。256 个专家分两路,每张卡背 128 个,KV cache 只剩 9.29G,并发能力 3.72 倍,撑死也就 4 路同时跑。说性能,思考模式打开,平均 8.33 token 每秒,慢得让人怀疑这是不是 H20。把 DP 改成 TP,再关掉 enforce-eager,速度直接翻倍到 20。最猛的是关闭思考,单轮生成能飙到 70 多。我的判断很直接,2 张 H20 跑 Flash 是省着跑,不是爽快跑。Flash 这个名字,本地部署这边是真不 Flash。要的是体验,老老实实充 API
    01:29
    DeepSeek-V4-Flash 本地部署,H20*2 两块 H20,96G 显存,本地跑 DeepSeek V4 Flash,能跑通吗。大家好,我是AI学习的老章。Flash 版权重 160G,原始 Safetensors 接近 149G,AMD 全军覆没,消费级英伟达也不配,门槛先把一半人劝退。我用 vLLM 官方 Docker 镜像 deepseekv4-cu129 启动,按默认配置一启就 OOM,连续翻车好几次。最终生效的脚本是这套,开 FP8 KV cache,启用专家并行 EP,单卡权重压到 77.6G,max-model-len 砍到 7K,gpu-memory-utilization 拉到 0.95,再叠 enforce-eager,才算是稳住了。256 个专家分两路,每张卡背 128 个,KV cache 只剩 9.29G,并发能力 3.72 倍,撑死也就 4 路同时跑。说性能,思考模式打开,平均 8.33 token 每秒,慢得让人怀疑这是不是 H20。把 DP 改成 TP,再关掉 enforce-eager,速度直接翻倍到 20。最猛的是关闭思考,单轮生成能飙到 70 多。我的判断很直接,2 张 H20 跑 Flash 是省着跑,不是爽快跑。Flash 这个名字,本地部署这边是真不 Flash。要的是体验,老老实实充 API
    查看AI文稿
  • 顶级程序员手把手教你安装最新 openclaw 2026.4.25版本,配合 DeepSeek v4 flash 使用,性价比炸裂
    03:44
    查看AI文稿