DeepSeek 情报
来自 AIYXL 的 AI 模型情报。
开发公司
相关应用
知识领域
相关文章
8.27 GLM-5.3-Flash采用稀疏注意力与线性注意力混合架构,是首个采用此架构的开源前沿模型
5.4 基于AI完成项目的设计、开发、测试、联调、部署全流程
3.24 瀚海智语大模型是基于增量式向量数据库技术构建了内容丰富的海洋领域专业知识库,其中包含精选专业图书专业科技文献以及巨量的公告标准和政策文件,词元总量超过18亿,为海洋领域形成了一笔宝贵的数字资产
9.29 展望未来,国产大模型有望在中文理解本土化应用场景等方面进一步发挥优势,同时在基础能力建设上继续突破,推动中国人工智能产业实现高质量发展
5.6 当OpenAI和Anthropic在欧美市场构建落地能力时,中国市场的驻场优势可能由本土企业建立能否抓住这个窗口,将决定谁能在模型能力趋同的下半场胜出
4.2 IDC最新数据显示,2025年中国市场AIGPU总交付量达400万片,其中国产半导体厂商交付165万片,拿下国内AI服务器市场41%的份额
7.26 Qwen3-235B-A22B-Thinking-2507是在Apache2.0许可证下发布的,这是一个高度宽松且商业友好的许可证,允许企业不受限制地下载修改自托管微调和集成到专有系统中
6.13 Anthropic收到美国政府出口管制指令,要求暂停所有外国公民无论身处美国境内还是境外对ClaudeFable5和Mythos5模型的访问权限,包括拥有外国国籍的Anthropic员工
4.21 这个案例之所以重要,是因为它触及了大多数模型都不太稳定的区域长链路上下文保持复杂工具调用基于性能分析结果做结构性判断,以及不是一次性输出而是持续迭代
7.4 总部位于上海徐汇的AI独角兽企业MiniMax近日正式发布全球首个开源大规模混合架构推理模型MiniMax-M1,这一创新成果迅速跃居全球开源模型评测榜单第二位,仅次于DeepSeek-R1-0528,引发全球科技界广泛关注
6.11 在HuggingFace最新发布的开放权重模型贡献榜单中,来自中国的Qwen和DeepSeek团队双双跻身前15名,展示了中国在开源AI领域的技术实力与全球影响力
2.15 据介绍,CS-DeepSeek基于DeepSeek打造,依托国家超级计算长沙中心的强大算力,结合长沙数字集团在数字政府建设数据要素运营国资国企服务城市安全防护等领域的场景需求和丰富实践,通过人工智能大数据技术等新技术,为智慧城市领域的千行百业提供智能化赋能
5.27 由DeepSeek和豆包大模型联手打造的我,不仅能听懂你的每一句"咖啡暗号",还能用数据智能帮你找到命中注定的那杯咖啡
2.26 报告提到,美国AI扩散规则进一步限制第三国向中国转售芯片,迫使中国加速构建自主产业链
4.11 Google通过模型分层ProFlashFlash-Lite实现了对不同价值场景的精准覆盖Pro层处理高价值复杂任务,Flash层平衡性能与成本,Flash-Lite则专攻高频标准化的大规模工作负载
2.19 该政务智能体由中国经济信息社负责应用开发和模型调优北京丰台城市数字科技集团提供算力支持,打通了政务服务业务流程,构建起安全可控政务知识库,在数据安全与权限管控的双重保障机制下,为企业和群众提供更加便捷高效精准的政务服务,为政务服务场景注入了全新活力
3.9 假设你是拥有15年教龄的初中语文教师,针对岳阳楼记备课,需包含古文背景动画推荐情感分析分层教学设计和课后辩论题,请生成教案并分板块标注
4.1 一推理时间计算扩展该技术通过在响应生成阶段分配额外的计算资源来提高模型的推理能力,而无需改变模型的核心结构或对其进行重新训练
3.1 MiniMaxM2.5DeepSeekV3阿里Qwen3.5均采用quot总参数万亿级激活参数百亿级quot的稀疏设计,将推理成本降至传统密集模型的110
5.7 AI原生基础设施公司无问芯穹宣布完成超7亿元新一轮融资,联合领投方为杭州高新金投集团和惠远资本,跟投方阵容豪华,老股东君联资本上海国投孚腾和元智未来追加投资