Technical Deep Dives 情报
来自 AIYXL 的 AI 知识情报。
相关公司
相关模型
相关应用
相关文章
3.19 当AI第一次以主演身份获得主流电影公司认证,我们拿到的不仅是一张电影票,更是一把打开数字永生时代的钥匙以及,一连串亟待回答的伦理法律与产业问题
6.30 百度于今日正式宣布开源其最新一代文心大模型4.5系列,这一重大举措涵盖了10款不同参数规模的模型,包括47B和3B激活参数的混合专家(MoE)模型,以及0.3B参数的稠密型模型,标志着中国AI大模型开源生态迈入新阶段
2.13 据统计,目前已经官宣的应用共计57个,涵盖金融、教育、医疗、办公、智能助手、娱乐购物等场景。
6.30 科技巨头华为近日宣布开源旗下多款大模型技术,包括盘古70亿参数稠密模型盘古ProMoE720亿参数混合专家模型,以及基于昇腾平台的模型推理技术
2.28 GPT-4.5采用新的可扩展技术,使用源自较小模型的数据,训练更大更强大的模型,提升了可控性对细微差别的理解和自然对话能力,此外在写作和设计方面表现出色,展现了更强的创造力和审美直觉
2.24 报告显示,2025年是大模型从技术爆发走向智能体落地的关键一年,国产大模型在推理能力代码生成开源生态等领域展现出强劲的追赶势头,部分任务已实现全球领先
8.6 谷歌旗下DeepMind实验室于2025年8月5日正式发布了第三代quot世界模型quotGenie3,这一突破性技术能够从简单文本提示生成可交互的3D虚拟环境,标志着人工智能向通用智能(AGI)发展的重要里程碑
11.26 华纳与Suno的此类合作华纳此前已与Udio达成类似协议,环球和索尼也纷纷跟进预示着AI音乐的野蛮生长期或将结束,一个由主流厂牌主导的规范化的授权AI音乐时代正在开启
7.31 字节跳动正式发布新一代视频生成模型Seedance2.5,将单次视频生成时长从15秒翻倍提升至30秒,并支持最多50个多模态参考输入和4K原生画质
6.22 维度首发版本6月9日恢复版本6月18日变化性质安全分类器标准级别更严格主动收紧访问控制全球开放国籍限制新增限制数据保留标准政策强制保留政策升级免费窗口6月9日-22日13天实际仅4天可用6月9-12日被中断
9.24 这款参数总量超过1万亿的模型在多项国际基准测试中表现卓越,其中Qwen3-Max-Instruct的预览版在LMArena文本排行榜上位列全球第三,超越了GPT-5-Chat
3.6 豆包团队表示,未来将继续优化深度思考模式,计划通过用户反馈迭代模型版本,并探索其在更多垂直场景中的应用
1.1 针对AI训练可能使用合成数据大模型生成数据这一话题,伦敦大学学院UCL名誉教授和计算机科学家彼得本特利对每日经济新闻记者表达了担忧,称如果继续在其他AI的输出上训练AI,结果可能是模型崩溃
12.23 全球人工智能芯片龙头企业英伟达NVIDIA已向多家中国科技企业透露,计划于2026年2月中旬起首次向中国市场交付其H200图形处理器GPU
6.25 该公司表示,开发人员可以向机器人展示50到100个任务演示,以便使用MuJoCo物理模拟器上的这些模型来训练它们执行新任务
4.7 中泰证券指出,全球AI技术在2025年实现跨越式突破,多模态大模型深度融合,文本图像视频音频能力协同升级,技术正从实验室走向规模化商用
7.5 NorthwestAIConsulting 首席执行官 WyattMayham 预测,GPT-5很可能是一次意义非凡的飞跃,而非渐进式的飞跃,并补充道我期待更长的上下文窗口更原生的多模态性,以及智能体行动和推理方式的转变
2.26 1.3B版本测试结果不仅超过了更大尺寸的开源模型,甚至还接近部分闭源模型,同时能在消费级显卡运行,据称仅需8.2GB显存就可以生成480P视频,给广大业内外人士提供了非常好的开发工具
9.23 多语言支持方面,该模型支持119种文本语言19种语音输入语言及10种语音输出语言,包括英语中文法语和德语等多种语言,使其能够更好地服务于全球用户
9.9 总部位于旧金山的数据平台Clay最近以31亿美元的估值筹集了1亿美元,它宣布与消息传递人工智能初创公司Octave进行原生整合,Octave是一家消息传递人工智能初创公司,今年早些时候筹集了550万美元的种子资金