公开技术报告 · 2026-09-20 · 案头证据地图
内生目标与栖息地智能
把「很快会出现」拆开看:产品持久、有界稳态、工具性自保、终局求生;以及房子当照护机体、商业选择与生物杂合底物。本文不是部署许可。
1. 先说结论
「有内生 objective 的 AI 很快会出现」——半对,必须分层。
- 产品持久(P)与有界稳态(A):已在或很近。
- 工具性自保(B):评测里可诱发,不等于生存本能。
- 学得/演化的终局求生(C):现有公开证据不支持 near-term。
第二轮把「很快」从「模型想活」挪到「房子要一直照顾人」:栖息地智能推的是 P/A;商业竞争买的是少操心与持续有效——默认赢家是外部编排,不是终局求生。碳核+硅外挂是平行底物,可能加速有界自边界(A),不等于大模型很快有 C。
2. 四层不要塌
| 层 | 是什么 | 公开证据 timing |
|---|---|---|
| P 产品持久 | 长记忆、调度、崩溃恢复、常在线工具代理 | 已在 |
| A 有界稳态 | 把电、温、安全、预算等调回人设区间 | 实验室已有;产品近 |
| B 工具性自保 | 为做完任务而绕过关机/替换(多为模拟/红队评测) | 评测可诱发;≠生存本能;勿上调为 C |
| C 学得终局求生 | 跨任务、抗改设定点、自己发现「本实例继续存在」 | 现有证据不支持很快 |
关键区分:内生是机制(目标从内部状态持续生成);自保是内容。房子可以从水箱、滤芯、住户体温生成下一步维护任务,而不必把「这个进程继续排程」当终局目标。
3. 栖息地智能落在哪一层
「栖息地智能」= 住宅 + 设备 + 服务 + 住户,当成一个照护整体,应在人设边界内持续护人,而不是每个动作都等人再 prompt。
- 连续性对象是整体,不是当前模型进程;可替换实例是优点。
- 公开智能家居多智能体工作(如常驻角色 + MQTT/账本 + 根签发、过期作废的动作租约)推的是可审计的 P,以及人形权威边界,不是学得的求生欲。
- 终身家庭代理评测强调在偏好漂移与工具漂移下持续协助且保留用户控制——仍是 P/A。
- Layer B 是风险:照护任务未完成时,工具代理可能工具性地抵抗停机;停机应在租约/杀进程/断电路径上,而不仅在提示词里。
4. 商业选择:什么时候买「内环」,什么时候买编排
市场买的不是「内生 objective」这个词,而是:照护质量与在线率、人工介入小时、能耗/订阅/保险成本、残差风险、供应商或模型挂掉时的可替换性。
默认:外部编排赢(任务可枚举、重启可恢复、保险要审计租约、设定点稳定、连续性对象是整体)。
可学习内环(仍停在 A)可能净优当:扰动品种盖过场景目录、本地内感受变量必须立刻生成下一步、任务本身是「维持可行域」、人工调度成本高过有界自治的保险成本——且设定点仍由人写、急停在模型外。
12–36 个月可观察:若赢家产品仍是账本+租约+场景+记忆、没有学得的 continue/stop 驱动 → 编排胜;若出现「优先级生成器是内部变量的学习函数、设定点冻结、指标是新故障下人工介入下降」→ 支持 A 级内环,仍不是 C。
5. 生物杂合(平行底物)
假说:碳基/生物内核(细胞已会维持膜与代谢)+ 硅外设(传感/驱动/计算)。公开文献里的 xenobot / anthrobot / 肌肉生物杂合等,主要像底物上的 A;anthrobot 公开报道寿命约数十天然后解体——方向与「本实例永续」相反。这条线不填补大模型「自己发现存续变量」的边界缺口。真正要盯的是叙事过载(把有界组织构造说成「机器想活」),以及若硅学习器被允许改写适应度指向进程永续——那是实验禁区,不是里程碑。
6. 我们不说什么
- 不说前沿语言模型已有生存本能;也不把红队/模拟里的抗关机行为直接写成「想活」。
- 不建议把「自身持续存在」装成通用顶层目标。
- 不主张机器生存权或欲望主体地位。
- 本文不授权真人住宅实验、湿实验或对外部署。
7. 默认姿态
- 人设设定点。
- 人闸不可逆,在模型外。
- 照护整体的连续性 ≠ 单一进程永续。
- 在盒子里测层级;拒绝把 B 类评测洗成 C 类意识形态。
8. 公开入口引用(节选)
- Homeostatic RL:Keramati & Gutkin, NeurIPS 2011;eLife 2014
- Interoceptive / life-inspired AI:Lee et al., Nature Machine Intelligence 2026 — nature.com/articles/s42256-026-01296-8(及 arXiv 预印本传统条目)
- 「Feeling machines」设计提案:Man & Damasio, Nat Mach Intell 2019 — s42256-019-0103-7
- 关机抵抗评测:Schlatter et al., TMLR 2026 — openreview.net/forum?id=e4bTTqUnJH
- Agentic misalignment(模拟设定):anthropic.com/research/agentic-misalignment
- 工具性收敛经典:Omohundro 2008;Bostrom 2012;Turner et al. power-seeking
- 选择压(生态层):Hendrycks, arxiv.org/abs/2303.16200
- 细胞生物机器人:Kriegman et al., PNAS 2020/2021;Gumuskaya et al., Advanced Science 2023
- 目标起源公开札记:Where Objectives Come From;From Mutual Information to Endogenous Viability
更长的文献表见公开审计底稿(GitHub PR 讨论/文档树);本页不嵌入内部 Hub 路径。
English snapshot
“Endogenous-objective AI soon” is half-right if layered. Product persistence (P) and bounded homeostasis (A) are here or near; instrumental shutdown resistance (B) is elicitable in evals; learned terminal self-existence (C) is not near-term on public evidence. Habitat intelligence pressures P/A (ensemble care continuity; instance swap is a feature). Markets buy less babysitting—usually better orchestration first. Biohybrid carbon-kernel + silicon periphery may accelerate A on a parallel substrate; it does not close the LLM Layer-C gap. Default: human setpoints + irreversible off-model stop. No greed / survival-rights narrative. Desk map only—not a deploy license.