GLM 情报
来自 AIYXL 的 AI 模型情报。
开发公司
相关应用
知识领域
相关文章
9.3 西班牙AI公司MultiverseComputing正式推出旗舰推理模型Quasar438B,在ArtificialAnalysisIntelligenceIndexv4.1.1中得分43分,成为欧洲地区得分最高的AI模型,超越了MistralMedium3.5的30分和NVIDIANemotron3Ultra的38分
9.10 DeepSeek正式发布V4.1 Flash模型,这是其全新模型结构系列中尺寸最小的模型,却实现了对上一代旗舰V4 Pro的全面超越。伴随新模型上线,DeepSeek同步宣布将有序下线V4 Pro,9月14日12:00后所有V4 Pro请求将路由至V4.1 Flash并按新单价计费。
7.3 该模型最特殊之处在于从训练到推理全流程由国产算力集群完成,英伟达含量为零,这不仅是国产芯片+国产模型的真正意义上的全流程跑通,还直接挤进了全球第一梯队
12.9 GLM-4.6V则以图像即参数,结果即上下文为核心理念,支持直接将图像截图或文档页面作为工具调用的输入参数,并能对工具返回的图表商品图片等视觉结果进行二次理解,无缝融入后续推理流程
7.26 事后调查发现,攻击者是一套基于OpenAI模型的AI智能体,当时正在参加一项网络安全能力测试,任务是在隔离环境中寻找并利用软件漏洞获取特定答案
9.2 独立第三方测评机构SuperCLUE团队于2025年8月4日发布的报告显示,海外模型在推理任务上优势显著,国产模型则在智能体幻觉控制等任务中表现突出,开源模型领域中国已实现领先
3.23 该榜单通过多维度的评测基准,覆盖语言推理知识代码数学指令跟随智能体等多个能力维度,成为学术界和产业界广泛认可的评测工具之一
6.17 智谱选择开源这一成果,既是技术自信的体现,也是生态战略的延续通过开源吸引开发者,通过开发者构建生态,通过生态锁定标准
7.30 该公司通过多步骤工作流程训练了 GLM-4.5。首先,它使用包含价值 15 万亿个代币的信息的数据集开发了模型的初始版本。然后,Z.ai 通过几个较小的训练数据集磨练了 GLM-4.5 的推理技能,这些数据集总共包含超过 7 万亿个标记
5.20 该模型在多项权威评测中斩获国内第一,并凭借独创的quot正交解耦quot训练架构,成功完成连续35小时1158次工具调用零中断的极限压力测试,标志着中国大模型在智能体Agent赛道实现了从quot理论可行quot到quot工程现实quot的关键跨越
7.30 产业分裂信号就在联名信发布的同一天,资本市场仍在踩油门OceanBase启动20至30亿元融资Meta与贝莱德合资140亿美元建设得州数据中心月之暗面完成35亿美元融资
1.24 GLM-PC 由“左脑”和“右脑”组成,“左脑”负责严谨的逻辑推理和任务执行,“右脑”则负责深度感知与交互体验。
3.1 MiniMaxM2.5DeepSeekV3阿里Qwen3.5均采用quot总参数万亿级激活参数百亿级quot的稀疏设计,将推理成本降至传统密集模型的110
2.12 这款定位为“t复杂系统工程与长程Agent任务”的基座模型,在编程与智能体能力上实现开源SOTA,实测体验对标ClaudeOpus4.5,成为国产大模型出海的又一里程碑,标志着中国AI在”代码生成“这一核心战场首次实现与西方顶尖模型的“能力平权”
7.29 以智谱为代表的中国企业正通过持续创新和开放合作,争取更大的话语权。这场竞赛的结果,或将深刻影响未来全球科技产业格局
6.24 对比维度豆包2.1ProClaudeOpus4.7差距编程能力追平基准持平综合成本降低80%基准1月5日Token调用量同比增超10倍截至6月-爆发增长视频生成Seedance2.530秒7月初无直接竞品差异化
12.26 由华算人工智能研究院全国高校人工智能与大数据创新联盟从产学合作协同育人角度研究并推出大模型中国50强榜单(2024),旨在推动中国人工智能大模型行业的健康持续发展,为高校人才培养提供行业指引,激发高校师生的创新精神和研究动力,促进产学研合作协同育人,提升企业及科研院所的竞争力和创新能力,为投资者提供有价值的参考信息,并促进人工智能+大模型技术的普及和应用
此外,360智脑还为近20个行业提供大模型企业级解决方案,通过自主研发+合作研发模式,为金融行业汽摩行业工业制造协同办公数字阅读等众多行业打造垂直化大模型
4.2 在SWE-bench系列真实编程任务测试考察终端编程的Terminal-Bench2长程编程任务NL2Repo,以及Claw-EvalQwenClawBench等真实世界Agent能力评测中,超越一众模型,展现出明显的领先优势
4.19 智谱AI同日发布GLM-5.1系列,其编程能力在HumanEval与LEADER基准测试中首次超越GPT-5.4,开源版本登顶全球开源模型榜单,并支持8小时持续自主Agent任务,标志着国产模型从quot跟随quot迈向quot领跑quot的关键转折