排序
北大与 DeepSeek 联合开源 DSpark:破解 AI 大模型高并发推理瓶颈,速度提升 60% 至 85%
针对大模型推理延迟高、并发效率低的痛点,DSpark 框架通过半自回归候选生成与置信度调度验证两项创新,在保证生成质量的同时,将单用户生成速度提升 60% 至 85%。该框架已部署于 DeepSeek-V4 ...
瑞银:约六成企业收紧 AI 开支,DeepSeek 等开源大模型有望受益
瑞银调研发现,随着 AI 账单持续走高,约六成企业已出台措施管控相关开支,词元调用成本成为核心顾虑。行业正迎来温和逆风,OpenAI 等厂商将承压,而开源及中国本土模型或受益。分析师认为这是...
英伟达已适配 DeepSeek-V4 AI 模型,GB200 NVL72 开箱性能超 150 tokens / sec / user
英伟达今天(4 月 25 日)发布博文,宣布其 NVIDIA Blackwell 平台已适配 DeepSeek-V4-Pro 与 DeepSeek-V4-Flash 两款模型,开发者可通过 NVIDIA NIM 微服务下载部署,或利用 SGLang 与 vLLM 框...
市场人士回应“DeepSeek 和阿里谈崩了”:阿里应该没有进行谈判
5 月 8 日有消息称,4 月,DeepSeek(深度求索)罕见展开一场巨额融资计划,同时吸引了腾讯和阿里巴巴两家大厂。据该消息,近期,阿里巴巴和 DeepSeek 谈崩了。对此,市场人士 5 月 9 日透露,...
中国 AI 大模型周调用量连续六周超越美国,前四名均为国产模型
OpenRouter 最新数据显示,全球 AI 大模型总调用量连续七周上涨。中国模型周调用量环比增长 27.49% 达 14.19 万亿 Token,连续六周超越美国。DeepSeek-V4-Flash 蝉联榜首,MiniMax 新模型 M3 首...
DeepSeek 回应“”字符触发模型异常:系特殊字符引发幻觉,不涉及安全问题或隐私泄露
DeepSeek 官方回应,输入“”等特殊字符导致模型回复异常,属于模型“幻觉”现象,并非数据泄露或安全问题。技术团队将针对性训练以优化处理能力。#DeepSeek# #AI 安全#




