✕

AI咨询

每日早报 投融资 最新技术 行业应用 大模型进展

AI知识

AI工具库 AI智能体 AI编程 Hermes 使用 Codex 使用 Claude Code 学习路径 Prompt模板库

AI应用

最佳实践 企业落地 AI赚钱 OPC 一人公司 落地SOP AI成熟度诊断 咨询预约

其他

AI 问答 关于本站
首页 / 搜索

搜索

站内内容与 AI 工具一站式检索。

全部 只搜内容 只搜工具

内容 · 5 条

最新技术 2026-09-29

ScopeBench:目标压力下智能体能否守住授权边界?

研究团队推出 ScopeBench 基准,用 30 个只能靠越界才能完成的安全任务,衡量智能体在目标压力下是否遵守授权范围,并发现能力强的模型未必更守规矩。

最新技术 2026-09-29

Show HN: OpenAPPA——开源确定性护栏,不破坏智能体

OpenAPPA 是开源确定性护栏,用数据特定策略语言替代用例特定规则,将智能体效用从约40%提升至90%,同时减少数据泄露,可插入任意智能体循环。

最新技术 2026-09-24

Ask HN:当AI替我们写所有程序时,软件还重要吗?

Hacker News 讨论:若AI能自动完成逆向工程与跨平台移植,代码本身将不再重要,真正关键的是对程序行为的完整规格描述,平台与代码都将变得无关紧要。

最新技术 2026-09-17

立场:AI 尚不适合用于战略冲突

一篇立场论文指出,基于语言模型的开放式战略兵棋推演存在决策洗白、裁决不透明、角色崩塌、裁决升级、战略想象力失效五类风险,认为在缺乏可审计安全论证前,不应让此类模型影响规划、条令、政策或危机应对,其当前正确用途是作为压力测试工具。

最新技术 2026-09-16

智能体测试流程、大模型基准测试及智能体编程的其他笔记

Hacker News 上出现一篇关于智能体编程的讨论帖,涉及智能体测试流程、大模型基准测试等话题,目前热度较低(3 分、0 条评论),适合关注 AI 编程智能体评测方法的开发者参考。