DeepSeek 计划部署 16 万块华为昇腾 950DT 用于推理
据知情人士透露,DeepSeek 计划在内蒙古数据中心部署至少 16 万块华为下一代昇腾 950DT 芯片,用于模型运行而非训练;安装时间取决于华为产能,交付或需一年以上。训练环节仍依赖英伟达。
共 14 篇文章,按时间倒序展示。
据知情人士透露,DeepSeek 计划在内蒙古数据中心部署至少 16 万块华为下一代昇腾 950DT 芯片,用于模型运行而非训练;安装时间取决于华为产能,交付或需一年以上。训练环节仍依赖英伟达。
一条评论将 DeepSeek 调价解读为商业模式转折,称 12 倍涨幅是对早期补贴的纠偏,并采用峰谷分时定价。评论认为免费 C 端保流量、付费 B 端建利润支点,差异定价筛选高价值场景;原始公告未披露,涨幅无法独立验证。
近期 DeepSeek 新模型动态在海外社区引发讨论,官方未提供正式发布页面,开发者已用低成本方案投票。常见做法是让 Claude 规划、DeepSeek 执行,借助上下文缓存压低推理成本。有观点认为模型能力普遍达...

DeepSeek Harness Desktop 将命令行本地 Web UI 封装为 macOS 与 Windows 原生桌面应用,集成插件市场、移动远程控制和微信/飞书接入,基于 Cordis 插件化架构降低 A...

DeepSeek Harness 开发者预览版 v0.1 开放测试,并以 MIT 许可证开源。框架采用“一切皆插件”设计,模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等智能体能力均由可替换插件组合。早期版...
2026年7月31日,DeepSeek 推出 V4-Flash 正式版 API 公测,Agent 能力显著增强,多项基准成绩远超 V4-Pro-Preview。模型架构不变,仅通过后训练提升性能,原生支持 Resp...

中国AI算力底层版图已形成“三龙四蛇”格局:华为、阿里、百度三家大厂与沐曦、摩尔线程、壁仞、天数智芯四家新锐,正构建独立于CUDA的算力体系。核心团队多来自英伟达或AMD,生产链转向国内制造,DeepSeek、Qw...

财联社消息,微信AI助手“小微”已小范围灰度上线,部分用户微信主界面左上角出现小眼睛图标。该助手支持文字或语音对话操作微信原生功能、调起小程序等,使用腾讯自研及开源模型,主模型为微信团队自研的“WeLM”,部分回答...
deepclaude 是一个开源工具,兼容 Claude Code 的代理循环,通过替换后端模型(如 DeepSeek V4 Pro)实现 17 倍成本节省。支持实时后端切换、自动上下文缓存和成本追踪,可在终端和...

本文基于公开招聘信息,分析了 DeepSeek 公司近期将战略重心转向 AI 智能体(Agent)的动向。文章探讨了 Agent 的核心概念、行业竞争焦点的转移,以及构建可用 Agent 系统所依赖的评测、基础设施...

Anthropic 指控 DeepSeek 进行蒸馏攻击后,其 Claude Sonnet 4.6 模型在中文提问下却自称是 DeepSeek-V3,引发对训练数据污染、模型身份校准及行业数据使用边界的讨论。

DeepSeek-MoE-ResourceMap 是一个专注于 DeepSeek 模型,特别是其 MoE 架构和 V3 版本的技术资源集合库。该库提供了对 DeepSeek V3 架构的深度解析,汇集了多种训练与部...
