跳到正文

全部 AI 动态

今日 31 条

9月22日

星期二
  1. TypeSafe AI 发布 Jev,推出 System One 决策模型

    TypeSafe AI 上周发布 Jev,称其为“System One 模型”这一新类别模型的首个实例,作者更认同“决策模型”这一叫法。Jev 接受文本输入,输出的是对应类别、是/否问题、评分的浮点数及置信度,只按输入计费,首个模型输入价格为每百万 token 0.042 美元。作者认为它适合分类任务,如垃圾邮件检测、打标签、排序,也尝试用于搜索重排,并指出它不擅长数字、日期和对抗性内容。

9月21日

星期一
  1. NVIDIA:AI 安全是工程问题——如何在 Agent 栈的每一层解决它

    NVIDIA 提出 AI 安全应按工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。

  2. Import AI 473:美国的超级智能战略、人脑组织小鼠与机器诠释学

    RAND 发布长文,建议美国在通往超级智能的不确定路径上采取"自由行动"战略,通过投资 AI 安全、构建 AI 安全架构、改造国家安全体系、提升公民应对能力来保留所有选项。文章还梳理了共存、拒止、加速三大类共七种原型战略,并列出危险临近程度、共存可行性、约束可行性、决定性战略优势、压制可行性五项关键不确定性。

  3. MIT Technology Review 如何绘制首张美国边境“虚拟墙”沿线死亡地图

    MIT Technology Review 与 Times of San Diego 用 15 个月完成首张美国边境监控塔附近死亡的综合地图与分析,梳理 2015 年以来的移民死亡案例。团队向得州 17 个县警长办公室申请记录,从 14 个县获得超 4000 页文件,并用 Anthropic 的 Claude(通过 API)提取遗骸发现地点坐标,再人工抽样核验。

  4. 工程师描述大公司内部一切由 Claude Code 生成的现状

    一位入职大公司半个月的工程师称,团队里的规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队中没有人喜欢这种方式,但被要求尽可能多地交付。他表示从高层多次听到推送代码不是瓶颈,人们每天工作 12 到 13 个小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没有人阅读任何内容。

  5. MCP 是否已经过时?Simon Willison 回应质疑:MCP 的价值被低估

    Simon Willison 反驳了“MCP 已是坏主意”的观点,认为在 Claude Code、Codex 等拥有无限制互联网访问的终端智能体之外,MCP 仍有不可替代的价值。他指出,若想限制智能体可访问的外部服务、避免其直接接触 API key、提供用户连接与认证的 UI,以及实现强审计日志,MCP 让这些能力更容易提供。仅因完整编码智能体不需要 MCP 就认定其过时,会忽略其他可构建的场景。

9月20日

星期日

9月19日

星期六

9月18日

星期五
  1. GitHub Podcast 拆解五大 AI 热梗:该不该读 AI 代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决的是不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口,二者可组合使用。RAG 并未消亡,它为模型提供训练数据之外的相关信息,与 Agent、Skills、MCP 可共存于同一工作流。

9月17日

星期四

9月16日

星期三