谷歌Gemini 3.8 Live虚拟人上线:实时唇形同步+自然表情,无缝切换97种语言
9月24日,谷歌正式宣布推出带有Live Avatar功能的Gemini 3.8 Live,为原生实时对话模型带来接近实时的视觉呈现效果。该功能将低延迟视频生成与语音相结合,打造能倾听、观察并以动态视觉形象交流的企业级交互体验,目前已在Gemini Enterprise上线。
阅读文章AIYXL NEWS
追踪全球最值得关注的 AI 模型、公司、产品与产业动态。
9月24日,谷歌正式宣布推出带有Live Avatar功能的Gemini 3.8 Live,为原生实时对话模型带来接近实时的视觉呈现效果。该功能将低延迟视频生成与语音相结合,打造能倾听、观察并以动态视觉形象交流的企业级交互体验,目前已在Gemini Enterprise上线。
阅读文章此前的Flash以120于GLM-5.3的价格树立了性价比标杆,如今的FlashX则通过速度溢价满足了不同开发者的差异化需求追求极致成本可继续使用Flash,追求极致响应速度则可选择FlashX
阅读文章9.18 该模型可同时处理文本图像音频和视频输入,支持100万Token上下文,在保持同尺寸文本模型能力的同时,全模态能力较上一代实现显著跃升
阅读文章ABot-Earth0.7开创性地采用3D原生技术路径,使用涵盖空间时间等信息的时空数据训练模型,使其建立对三维空间的原生理解,从而端到端一次性生成3DGS三维高斯泼溅格式的城市场景
阅读文章9.10 DeepSeek正式发布V4.1 Flash模型,这是其全新模型结构系列中尺寸最小的模型,却实现了对上一代旗舰V4 Pro的全面超越。伴随新模型上线,DeepSeek同步宣布将有序下线V4 Pro,9月14日12:00后所有V4 Pro请求将路由至V4.1 Flash并按新单价计费。
阅读文章9.8 用户只需一句话描述岗位需求,QoderWake即可生成一份角色文档,确认后便能招聘一位理解工作职责协作关系和工作权限的数字员工
阅读文章9.4 当地时间9月3日,OpenAI正式发布新一代旗舰模型GPT-6 Astra,这是该公司迄今为止最强大、对齐程度最高的模型。OpenAI总裁格雷格·布罗克曼在发布会最后留下一句话:“欢迎来到AGI时代。”
阅读文章9.3 西班牙AI公司MultiverseComputing正式推出旗舰推理模型Quasar438B,在ArtificialAnalysisIntelligenceIndexv4.1.1中得分43分,成为欧洲地区得分最高的AI模型,超越了MistralMedium3.5的30分和NVIDIANemotron3Ultra的38分
阅读文章9.3 当地时间9月2日,Meta推出迄今为止最强大的AI模型Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计。Meta首席AI官Alexandr Wang表示,新模型在编码能力上超越OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1表现持平。
阅读文章9.2 两款模型采用完全相同的基础模型,区别仅在于安全防护等级Fable5.1面向所有用户开放,Mythos5.1仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供
阅读文章9.2 WorldLabs称,Atlas是一个多模态自回归扩散Transformer,从零开始预训练,原生处理文本图像视频相机位姿与3D深度信息,并在同一模型中完成世界生成重建和时空模拟
阅读文章