ZHOU CHENG / SYSTEMS PORTFOLIO
BOOTING RUNTIME TRACE FIRST LOAD / SKIPPABLE / REDUCED-MOTION SAFE
跳到内容
ZHOU CHENG / SYSTEMS & AGENT ENGINEERING

让 AI从一次回复,变成持续在场

PERSISTENT MULTIMODAL VIRTUAL BEING SYSTEM

我把感知、记忆、情绪状态、语音与实时虚拟人表现拆成可独立验证、持续集成的工程系统。这个网站提供简历无法容纳的架构、项目边界、失败记录与当前进度。

项目起点《银翼杀手 2049》里的 Joi —— 记得你、随时在场、有自己的情绪,却没有肉身的 AI 伴侣 —— 是这个工程的灵感来源。现有方案往往分别解决聊天、记忆、感知或数字人表现,真正把这些模块做成可持续运行的统一系统仍然困难。

工程边界架构按职责拆成开发基础设施、离线模型适配与 Evie Runtime。底层使用开源生态,原创工作集中在多 LLM 路由、状态管理、多模态 dispatch、Perception 探测与 Emotion→Blendshape 映射;当前正在集成最小端到端闭环。

01 / WHY

人越来越孤独, 而 AI 还停在一问一答

独居、远程与弱关系让持续陪伴的需求更显眼。多数 chat 产品仍以用户发起会话为中心: 回复可以很强, 但跨会话状态、主动感知与具身表达往往分散在不同模块里, 关掉窗口也不等于系统仍在运行。

问题不只是模型够不够强。更长的 context 仍然不等于生命周期、可恢复状态和主动性, 也不会自动得到一张能看你、回应你的脸。把感知、记忆、人格与表达装成一个可持续运行的系统, 才可能从"会回话的接口"走向"持续在场的对象" —— 这条路能否走通, 正是要验证的。

02 / SYSTEM

三层架构, 六个组件

把架构按职责拆成三块: 开发 Evie 的工具系统 (A), 给 Evie 提供身份资产的离线管线 (B), Evie 本体运行时 (C). 每个组件链接到详情; 状态分为 live / mvp / building / exploring, 各页保留自己的最近验证日期与已知限制.

03 / EMOTION DATA

情感数据 — 评测与 Badcase 归因

情感陪伴能力不用形容词声称, 用数据说. 首批已公开: 七模型同题受控横评 (1 个固定五轮场景 × 单采样, 35 条最终回复). 进行中: 多采样稳定性、记忆漂移 / 人格漂移专项与 Badcase 归因整理 — 完成并复核后在本板块增量更新, 未完成的部分不提前放数字.

emotion-eval

/emotion-eval
首批结果

七模型情感交互横评 (初步受控) — GPT / Claude / Gemini / Grok / DeepSeek 七个模型接入同一套单模型双调用运行时, 跑同一段五轮多模态对话: 结构稳定性、成本延迟与共情质地的同题对比, 含代表性场景原文与实验限制. 多采样与漂移专项完成后增量更新.

Multi-model Eval 首批结果 →

badcase-log

/badcase-log
进行中

Badcase 归因台账 — 从产品真实迭代中整理设定遗忘 / 语气漂移 / 情绪反馈不足 / 输出 schema 不稳定等问题, 按指令位置 / 上下文结构 / 输出 schema / 兜底策略四维归因, 记录修复与验证. 逐条人工核对后发布.

Failure Analysis 归因框架 →

character-cards

/character-cards
实卡节选

角色卡是给模型的可执行规格: 身份锚 / 人格基调 / 语气指纹 / 世界书 / 关系边界 / 情绪触发逐项显式约束, 配反同质化生产流程. 页内逐层拆解一张实际运行使用的卡 (Joi, 研究性改编) 的节选.

Card Design 设计框架 →

state-schemas

/state-schemas
原型 · 冒烟通过

结构化情感表示与状态运行时 — 情绪是状态不是文案: 模型提出候选, 确定性代码管理持久状态. 单模型双调用 / 私密-公开隔离 / 情绪生命周期 / 行为意图确定性编译; 当前受控冒烟测试: 14 项硬检查在 2 个模型后端上均通过.

State Modeling 建模框架 →
04 / WHERE

现在到哪了

哪一段已经在跑、哪一段在做、哪一段还在试, 以及我们怎么看接下来。

  1. live · 已经在跑

    talking-with (Evie Runtime · Interaction) — 本地 JSON 打包 → Cloudflare Workers edge runtime → LLM API 上游请求, 4 provider 路由 + 三层缓存 (sw.js / CDN / IndexedDB), PWA 部署在线。
    agent-harness (Development Infrastructure) — 共享 vault 记忆 + 原生契约适配 + 自研 skill, 跑在 Claude Code × Codex 上的开发工作台 (不是 Evie 运行时一部分)。

  2. mvp / building · 骨架到位, 还在打磨

    lora-tts-studio (Offline Model Adaptation, mvp) — LoRA 训练 + TTS 声音克隆端到端编排, 桌面应用 + 远程 pod 训练。故障自愈和参数自适应尚未完成。
    evie-agent (Evie Runtime · Cognition, building) — Runtime 主体. MLLM router + persona state + 跨模态 dispatch 跑通, emotion model 仍为 mock, 长期记忆和持续在场尚未接通。
    perception (Evie Runtime · Perception, building) — 视觉/人脸跟随/VAD 语音检测, 框架在常驻 daemon 里跑通, 灵敏度调参与 Cognition 决策闭环仍在打磨。

  3. exploring · 还在验证假设

    ue-realtime (Evie Runtime · Embodiment, exploring) — MetaHuman 表情驱动原型. 表情数据走 UDP (LiveLink, 延迟优先), 文本走 TCP (可靠优先) — QoS 分层传输. 评估预渲染表情库与 WebTransport / WebRTC 云端方案.

  4. 下一步

    在 Evie Runtime 内把 Cognition (evie-agent) 与 Embodiment (ue-realtime) 接起来, 跑通一次"用户说话 → 状态更新 → LLM 回复 → TTS + 表情同步"的端到端闭环。下一阶段同步补 Evidence Pack: 90 秒无剪辑 Demo、Runtime Trace、P50 / P95 延迟表、失败案例与原创贡献矩阵。

这套三层架构是适配当下模型能力的一个解。出现真正带连贯记忆的大模型架构时, 架构会推翻重写。

05 / CONTACT

讨论工程、岗位或合作

IDENTITY / 01

周程ZHOU CHENG

SYSTEMS & AGENT ENGINEERING
DIRECT / EMAIL
写一封邮件
STATUS / 03

OPEN TO TALK

杭州 UTC+8