跳到正文

#OpenAI

今日 0 条

9月29日

星期二

9月23日

星期三

9月22日

星期二

9月8日

星期二

9月7日

星期一

8月12日

星期三
  1. Google Research 研究:召回而非编码是大模型事实性瓶颈

    Google Research 提出知识画像框架,用 2,150 条 Wikipedia 事实的 WikiProfile 基准评测 13 个 LLM,发现 Gemini-3-Pro 和 GPT-5 已编码 95–98% 的事实,却仍有 26–34% 无法直接召回,开启思考后仍有 11–12% 失败。研究认为前沿模型的事实错误更多源于知识可及性不足,而非知识缺失,瓶颈正从知识获取转向知识利用。

6月22日

星期一