怎样系统性地理解AI的技术名词?一个框架

怎样系统性地理解AI的技术名词?一个框架

AI 资讯 来源:新闻/公众号 发布时间:2026-08-26 更新于 2026-08-29 预计阅读 3 分钟

怎样系统性地理解AI的技术名词?一个框架

AI领域的造词速度已经到了一个夸张的水平,各种概念眼花缭乱。从龙虾、Agent、循环工程(Loop Engineering),到现在前沿的持续学习和RSI(递归自我改进)。不管是对于初步了解行业还是跟踪AI行业的人,这都是一件比较头疼的事情。

怎样系统性地理解这些概念?笔者尝试提供一个框架。

首先,最重要的一点是,AI这两年的所有技术演进,始终围绕着一个终极目标:提升模型的智能水平。对我们普通人来说,具体就体现在AI能写出更好的代码、更好的文章、做更漂亮的PPT/网页等。

提升模型的智能水平的方式,可以分成两类:改变模型权重 vs 不改变模型权重(如下图)。

1 类型A:改变模型权重的方式,包括预训练和后训练。

预训练是模型的基础。通过大规模互联网文本数据上进行无监督学习,铸造模型的底层世界知识和语言直觉。由于高质量文本数据消耗殆尽以及物理算力的瓶颈,单纯依赖“堆参数”的预训练缩放正在逼近物理饱和点。

后训练通过监督微调和人类/AI反馈强化学习,教导模型理解如何理解指令、保持安全、对齐人类偏好,并以结构化的格式进行输出。这两年后训练的变化主要体现在推理模型,o1、Gemini Thinking、DeepSeek-R1等推理模型就是在这一层用强化学习训练出来的。

2 类型B:不改变模型权重的方式,主要包括推理时扩展(Inference-time Scaling)和Harness

推理时扩展的核心逻辑是在模型参数不变的前提下(不更新权重),通过分配更多的推理算力(生成更多思考Token、搜索更多路径)来换取更高的解答准确率。

Harness:Harness的原意是马具。大模型(Model)就像一匹力气很大的马,而 Harness 就像马鞍和缰绳,决定了AI这匹马往哪个方向走、如何受控。提示词工程、上下文工程、RAG、记忆、工具、MCP、Agent、Harness、循环工程、龙虾(OpenClaw)都属于这个类别。

3 新范式:持续学习、RSI

模型产生的输出与基于此得到的反馈,又会变成新的训练原料,从而成为一个闭环,从而我们可以引出持续学习和RSI等新兴范式(如下图)。

持续学习、RSI强调的是对整个闭环范式的改变。持续学习强调解决灾难性遗忘,每次模型与外界交互获得的经验可以内化到模型中,成为智能的一部分,从而构建AI长期+动态的学习能力。

RSI全称Recursive Self-Improvement,递归自我改进,关键在于递归,递归的本质是自己调用自己;AI改进的是“自己改进自己的能力",形成复利式的增长。

文章来自于"Luis Lens",作者 "Luis"。

标签: AI 资讯 AI

更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速

世界模型专家刘宇加盟理想,机器人基座模型研发提速

理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。

2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启

AI办公赛道巨头混战,Agent创业窗口反而开启

2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。

2026-09-05
AI报告读着累?新指标用隐喻率量化可读性

AI报告读着累?新指标用隐喻率量化可读性

Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。

2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%

AI科学家K Pro上岗,全球最大药企研发提速70%

Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。

2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。

2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明

AI攻克费马大定理:Claude 11天写出1300万行证明

Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。

2026-09-05
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部