DeepSeek 情报
来自 AIYXL 的 AI 公司情报。
相关模型
相关应用
相关知识
相关文章
10.9 凌晨,蚂蚁集团正式发布并开源了万亿参数通用语言模型Ling-1T,这是蚂蚁百灵大模型Ling2.0系列的首款旗舰模型,也是该团队迄今规模最大能力最强的非思考大模型
2.26 报告提到,美国AI扩散规则进一步限制第三国向中国转售芯片,迫使中国加速构建自主产业链
3.9 假设你是拥有15年教龄的初中语文教师,针对岳阳楼记备课,需包含古文背景动画推荐情感分析分层教学设计和课后辩论题,请生成教案并分板块标注
5.14 GPT-5.6的泄露曝光,揭示了一个残酷现实当中国AI公司还在以季度半年为单位迭代时,OpenAI已经进入月更节奏
2.24包括人工智能在内,中国在芯片制造华为昇腾天数智芯大模型阿里Qwen字节豆包智谱GLM应用场景春晚机器人医疗AI等多领域同步推进,试图构建独立于英伟达生态的技术体系
4.14 昆仑万维表示,此次发布的Skywork-OR1系列采用业界最高透明度的开源策略全面开源模型权重训练数据集和完整训练代码,所有资源均已上传至GitHub和Huggingface平台
5.6 当OpenAI和Anthropic在欧美市场构建落地能力时,中国市场的驻场优势可能由本土企业建立能否抓住这个窗口,将决定谁能在模型能力趋同的下半场胜出
9.2 独立第三方测评机构SuperCLUE团队于2025年8月4日发布的报告显示,海外模型在推理任务上优势显著,国产模型则在智能体幻觉控制等任务中表现突出,开源模型领域中国已实现领先
3.25 1、从图灵测试到DeepSeek; 2、DeepSeek 技术前沿与应用; 3、智能变革-智能思维。
5.9 文心5.1的核心看点不在于参数规模,而在于效率6%的训练成本13的总参数,却能在Agent和搜索等关键能力上超越大参数模型
7.17 月之暗面展示了一个概念验证KimiK3在48小时连续自主运行中,独立使用开源电子设计自动化工具完成了一颗4平方毫米芯片的完整设计流程从架构设计到优化验证,最终实现了100MHz的时序收敛,模拟解码速度超过每秒8700个token
7.7 该智能体凭借出色的推理和检索能力,在权威智能体评测集BrowseComp上超越DeepSeekR1Grok-3等知名模型,位列开源网络智能体榜单首位
3.1 MiniMaxM2.5DeepSeekV3阿里Qwen3.5均采用quot总参数万亿级激活参数百亿级quot的稀疏设计,将推理成本降至传统密集模型的110
8.27 GLM-5.3-Flash采用稀疏注意力与线性注意力混合架构,是首个采用此架构的开源前沿模型
推理与工县使用在推理和工具调用方面,Grok-2通过强化学习进行了大幅优化,尤其是在代码生成逻辑推理科学计算等任务上表现优异
3.19 当诸多AI人工智能模型工具横空出世,大家还在讨论着哪些职业将被取代时,接入DeepSeek的全国首个出生健康管理大模型CHANGE在上个月刚刚发布,到4月中旬,浙江所有新生宝宝的检测数据都将被录入这个由国家儿童区域医疗中心浙江大学医学院附属儿童医院发布的大模型,它会为孩子们筛查出心脏基因代谢等32种疾病
4.7 与创意写作或逻辑推理相比,能生成准确可用代码的AI能直接转化为生产力工具自动化复杂流程,并嵌入软件开发的核心工作流
5.2 产品价格语音AgentAPI(语音到语音)3美元小时(0.05美元分钟)文本转语音TTS4.20美元百万字符语音转写STT(实时流式)0.20美元小时语音转写STT(批量)0.10美元小时
5.7 AI原生基础设施公司无问芯穹宣布完成超7亿元新一轮融资,联合领投方为杭州高新金投集团和惠远资本,跟投方阵容豪华,老股东君联资本上海国投孚腾和元智未来追加投资
2.16 人工智能AI作为21世纪最具颠覆性的技术之一,正在重塑全球的经济社会政治和文化格局