研究揭示文本到图像生成中免训练安全防护的全局不安全假设存在覆盖度与选择性的权衡,提出CALM方法,通过提示局部反事实校正,在抑制不安全内容的同时更好保留良性提示的生成能力。
MintFlow 是一种免训练的约束采样框架,把约束满足转化为对预训练流轨迹的最小干预,通过闭式解避免迭代优化,在满足约束的同时更好保留预训练生成分布。
视频模型厂商正从生成单段画面转向交付完整成片,快手推出视频Agent切入这一赛道,面临入场时机的讨论。
一家新影视公司凭借自研视频生成模型冲上全球 AI 视频榜单第二名,显示影视行业玩家正直接切入视频模型赛道,与科技大厂同台竞争。
肖恩·帕克正围绕音乐方向重组 Stability AI,并已获得唱片公司的支持与资金。此举意味着这家以图像生成闻名的 AI 公司可能转向音乐生成赛道。
作者使用 Vidu S2 视频生成模型复现乔布斯形象并进行对话,体验其「边看边改」的实时编辑能力,展示 AI 视频生成在人物还原与交互创作上的进展。
阶跃发布 StepAudio 3 系列五款语音模型,覆盖实时交互、识别、语音生成与音乐创作,多款在 Artificial Analysis 榜单登顶全球第一,现已上线开放平台。
AI短剧市场增长见顶,视频生成模型Seedance宣布降价,反映行业竞争加剧、盈利困难,对AI短剧创作者和视频生成工具用户有直接影响。