论文英文
levels-of-agi-2023
Levels of AGI for Operationalizing Progress on the Path to AGI
摘要、第 3 节六项原则、第 4 节广度×表现分级,以及第 6 节能力与自治;没有逐条复核全部引用或把作者框架当成行业标准。
按表现水平和广度分级讨论 AGI,并把能力与自治区分开的研究框架;不是行业统一标准。
打开原始来源一题一页 · 能力目标 · 也叫 通用人工智能、Artificial General Intelligence
指能像人一样处理各种不同任务的 AI。它是一个目标和讨论话题,不是某个产品或模型,各家对「算不算达到」的定义并不一致。
此刻在看:静态解释,这一页的 5 个部分都是这一种。
主张依据 2 类:原始论文、编辑解释。
核实状态:这一页没有需要核实的结论,所以这一维是空的。
表示此刻展示方式,不是准确性等级。
可多选,每种都有实际引用;「本站实验」需有记录。
附范围、时间及必要原因,不等于全页绝对正确。
这一页没有需要核实的结论,所以这一维是空的——不会因为它挂着论文就替它标一个「已核对」。
有人说「某模型已经达到 AGI」,另一人坚决不同意。两人往往不是在争模型的表现,而是各自对 AGI 的定义不同。
前面两个词,OpenClaw 是能安装的软件,harness 是软件里的机制,它们都是「实物」。AGI 不是。它是一个关于「AI 要强到什么程度才算通用」的目标,像「登月」之于航天,而不是像「火箭」。
因为「通用」没有公认的量法。一种常见的分法是从两个方向看:在单个任务上有多强,能覆盖多少种任务。一个模型可以在考试题上超过大多数人,同时在订一张机票时出错。它算不算通用,取决于你把哪一头看得更重。
看到「AGI 来了」这类说法,先问三个问题:说话的人用的是哪个定义?证据是哪些任务上的表现?有没有把某个软件的热度当成了能力的证据?
levels-of-agi-2023
摘要、第 3 节六项原则、第 4 节广度×表现分级,以及第 6 节能力与自治;没有逐条复核全部引用或把作者框架当成行业标准。
按表现水平和广度分级讨论 AGI,并把能力与自治区分开的研究框架;不是行业统一标准。
打开原始来源