视频模型厂商正从生成单段画面转向交付完整成片,快手推出视频Agent切入这一赛道,面临入场时机的讨论。
谷歌正式发布 Gemini 4,跑分表现亮眼,但评测者对其真实能力持谨慎态度。该模型在写作任务上强于代码生成,成为少见的偏文科型前沿模型。
火山引擎发布全新语音内容编辑模型,支持像编辑文字一样修改语音内容,可替换、增删语音片段并保持音色与韵律自然,面向语音合成与音频后期场景。
AI MediaKit 推出视频字幕无痕擦除能力,可自动识别并移除画面中的硬字幕,同时补全被遮挡的背景,适用于二次剪辑与素材复用场景。
阶跃发布 StepAudio 3 系列五款语音模型,覆盖实时交互、识别、语音生成与音乐创作,多款在 Artificial Analysis 榜单登顶全球第一,现已上线开放平台。
全国数十个 AI OPC 社区覆盖 10 余城。广东计划 2028 年建成百个社区;北京经开区每年算力券/数据券/模型券最高 3 亿元;苏州规划 10 个以上百万㎡标杆社区。