Gemini 情报
来自 AIYXL 的 AI 模型情报。
开发公司
相关应用
知识领域
相关文章
9.18 该模型可同时处理文本图像音频和视频输入,支持100万Token上下文,在保持同尺寸文本模型能力的同时,全模态能力较上一代实现显著跃升
6.18 这一突破标志着中国科技企业在生成式AI领域的竞争力进一步提升,同时也为内容创作者影视制作和数字营销等行业带来了更高效低成本的视频生产解决方案
2.25 这一战略转向标志着OpenAI从单纯提供模型能力,升级为提供“从战略到上线运营的端到端支持”,企业AI落地的瓶颈从“技术能力”转向“组织变革流程重构与系统数据集成”
12.15 英语母语者可学习德语,而孟加拉语荷兰语印地语意大利语罗马尼亚语瑞典语等母语者则可练习英语
2.19 维度GoogleLyria3Sunov5Udio单次时长30秒Beta限制8分钟15分钟扩展音频规格48kHz24-bit44.1kHz高保真过渡中多模态输入文本+图片+视频仅文本仅文本商业授权条款待明确Pro版明确授权标准版授权训练数据声称基于授权内容WMG授权合作中UMG授权合作中集成生态Gemini+YouTube独立平台独立平台
9.9 总部位于旧金山的数据平台Clay最近以31亿美元的估值筹集了1亿美元,它宣布与消息传递人工智能初创公司Octave进行原生整合,Octave是一家消息传递人工智能初创公司,今年早些时候筹集了550万美元的种子资金
4.13 这种“快慢分离”的架构,实质是将o系列推理模型的能力融入主产品线,但用户无需理解技术细节系统自行判断何时“深度思考”
2.24 报告显示,2025年是大模型从技术爆发走向智能体落地的关键一年,国产大模型在推理能力代码生成开源生态等领域展现出强劲的追赶势头,部分任务已实现全球领先
11.11 人工智能软件公司商汤科技正式发布并开源其SenseNova-SI系列空间智能大模型,旨在填补这一关键空白,并宣称其在多项权威评测中不仅大幅领先同类开源模型,甚至超越了GPT-5和Gemini2.5Pro等国际顶尖闭源模型
5.1 本周,谷歌与通用汽车接连发布重磅消息:Google Gemini AI助手将正式进入搭载Google built-in系统的汽车,覆盖通用汽车旗下约400万辆2022款及更新的凯迪拉克、雪佛兰、别克和GMC车型 。这不仅是谷歌在车载AI领域最大规模的一次部署,更标志着智能座舱从“功能时代”向“生成式AI时代”的范式转移
8.4 ChatbotArena链接httpsopenlm.aichatbot-arena
6.10 这是该公司首次将"Mythos 级"(神话级)能力推向公众视野,也是当前大模型竞赛中一次极具标志性的"双轨制"发布
12.5 hatbotArena链接httpsopenlm.aichatbot-arena
7.26 Qwen3-235B-A22B-Thinking-2507是在Apache2.0许可证下发布的,这是一个高度宽松且商业友好的许可证,允许企业不受限制地下载修改自托管微调和集成到专有系统中
5.15 对于首席信息官们而言,信号明确在价值50美元的模型和3美元的模型之间的智能差距已大幅缩小,智能路由将困难任务交给昂贵模型,简单任务交给廉价模型已成为主流架构
3.13 虽然一些组织正在将较大的模型提炼成较小的版本,但像Google这样的模型提供商继续发布小型语言模型SLM作为大型语言模型LLM的替代方案,大型语言模型LLM可能会花费更多时间而不牺牲性能或准确性
2.17 与此前“t语言模型+视觉模块”t的两段式架构不同,Qwen3.5直接把视觉感知和语言推理塞进了同一个训练框架,在文本和视觉的混合数据上预训练,实现了视觉理解能力的质变
11.18 该模型集成了视觉操作深度推理与任务规划三大核心能力,用户只需随手拍摄一张照片,即可触发一系列智能响应自动判断空间结构放大模糊文字绘制辅助线,甚至生成可执行的行动计划
2.15 AI界竞争加剧,AI搜索老大哥Perplexity,刚刚也推出了自家的DeepResearch随意给个话题,就能生成深度研究报告,免费向所有人开放
1.22 上海quot文心Momentquot大会上,百度正式发布文心大模型5.0正式版,基于原生全模态建模架构,总参数量达2.4万亿,支持文本图像音频视频等多种信息理解与生成