研究量化了预分词边界规则带来的压缩成本:在英文维基百科上,边界使最优 token 数增加 28.3%–36.8%,且压缩与预测偏好不同词表,为分词器设计提供新依据。
AI 圈出现名为「太空兔」的新模型,用户通过涂鸦即可生成网站,被评价为可当主力的 Flash 级模型,引发关注。
有报道指出,诈骗团伙正用 AI 替代杀猪盘中最耗人力、成本最高的环节——与受害者长期培养感情和信任,从而大幅压缩人力成本、扩大诈骗规模。
云栖大会上,千问办公发布企业级Agent基础设施“企业上下文”与AI硬件QwenNote A2,前者把群聊、文档、业务系统信息压缩结构化供Agent调用,后者以名片大小录音卡补上线下对话这一外部上下文来源。
一款国产旗舰大模型在 AA 榜单跻身全球前三,主攻 AI 编程与金融场景,单次调用成本仅为 Opus 5 的八分之一,性价比优势明显。
arXiv新论文提出基于Fisher信息度量的模型空间测地距离剪枝方案,将参数置零视为模型位移,按测地距离近似层级构建最优剪枝方法体系。在MNIST和CIFAR-10上对全连接网络和视觉Transformer验证,全剪枝范围内精度与MCC均优于幅度剪枝和局部Fisher信息剪枝。
开发者用 Rust 编写的数组编程 DSL 构建微型 MoE 模型可视化工具,可在浏览器和 CLI 运行,用于实验 MoE 专家路由、Engram、KV 缓存压缩等概念,帮助学习 MoE 原理。
联发科发布天玑9600 Pro旗舰移动平台,采用台积电2nm制程和首创AI原生融合计算架构,重构双NPU并推出2+3+3全大核CPU,大幅提升能效与端侧AI能力,利好手机厂商和端侧AI应用开发者。
Meta推出WhatsApp Business MCP服务器,开发者可用Claude、Cursor、Codex、ChatGPT等AI编码代理完成商业账号设置、消息模板、测试与故障排查,降低配置门槛。
Hermes Agent 是 MIT 开源、模型无关的自托管智能体,可跑在 5 美元 VPS 上,支持 14+ 平台作为对话入口,核心特性是内置学习闭环(从经验创建技能)。