Case Study / Version Intelligence

派蒙三千问

Paimon Asks Everything

MAIN · EFDABA8 · 2026.07.27

一个面向《原神》国际化发行场景的双语版本理解 Agent:先按地区与旅行者身份组织预热,再用受控检索和原生 Web Search 回答玩家,把匿名信号整理成制作动作,最后用增量实验判断“给谁看什么、哪些渠道真正带来变化”。五条工作流被统一进一套游戏内情报界面。

  • TypeScript
  • Next.js
  • DeepSeek Web Search
  • Evidence Retrieval

Overview

它不只回答一个问题,而是连接一次版本发布的两端

玩家一端需要无剧透地接回复杂世界观,制作组一端需要知道大家究竟在哪里没看懂、哪项动作真的带来增量。PAIMON 把这些问题做成同一条回路:个性化预热建立语境,证据问答解决理解断点,关系图帮助继续探索,匿名信号形成发行建议,再由随机实验与 Uplift 模型验证目标人群和渠道贡献。

Interface System

把工具箱收进一套像“游戏里真的会出现”的情报界面

main@efdaba8 将首页、预热、问答、洞察和增量实验收进同一条任务导航。可折叠身份栏、路由编号、至冬观测状态、居中的语言控件与移动端底栏共享一套界面语法;深海蓝档案层负责沉浸,象牙白内容层保证长文本、矩阵和置信区间仍然清楚。

派蒙三千问当前线上游戏内指挥台:首页包含五站任务导航、至冬版本倒计时、派蒙小纸条和新版轮播影像。
MAIN · EFDABA8 游戏内指挥台 / 共享导航、状态栏与版本语境
  • 01 五站任务导航
  • 02 路由级情报状态
  • 03 桌面与移动端一致回退

Problem

版本越大,真正稀缺的不是内容,而是被正确理解的路径

新玩家、回归玩家和剧情党需要不同的背景深度;统一导览既容易剧透,也容易漏掉关键上下文。

任务文本、官方前瞻、Wiki 与社区讨论混在一起时,流畅回答很容易把推测写成设定。

发行侧看到点击与问题数量,却不一定知道该补哪段时间线、谁最受影响、两周内能做什么。

Live System

把个性化、检索与实验边界做成明确参数

08

地区导览

从蒙德到至冬,每个地区都有独立阵营、剧情脉络与后续引子。

03

旅行者身份

新玩家、回归玩家、剧情党看到真正不同的内容深度与证据层级。

02

检索路径

自研受控检索与 Anthropic 原生 Web Search 可按次切换并有界回退。

02

增量实验场景

PV × 玩家估计分群增量,达人 × 展会拆解独立、协同与联合贡献。

Product Journey

五站任务线,把“看懂版本”推进到“验证增量”

这不是五个彼此独立的 Demo 页面。它们从建立上下文开始,经过查证、探索与制作决策,再用受控实验验证动作是否真的有效,形成一条可回溯的信息路线。

01 Context / Preheat

先认识旅行者,再决定讲到哪里

地区与身份不只改变标题,而是决定阵营入门、剧情回顾、时间线、证据和关系图的开放程度。

  • 八地区独立导览
  • 三套角色化视图
  • Level 3 剧透二次确认
新版版本预热页面:深蓝任务简报下方提供八个地区与新玩家、回归玩家、剧情党三类身份选择。
Context / Preheat 版本预热 / 地区 × 旅行者身份
02 Ask / Evidence

先查证,再让派蒙开口

问题先经过意图识别、别名扩展与剧透门控,再进入可切换的两条搜索链路;来源去重、分级并通过引用校验后才生成回答。

  • 自研检索 / 原生 Web Search
  • 真实 URL 与来源分级
  • 失败时一次有界回退
新版问派蒙页面:深蓝提问任务头、问题输入、两种搜索模式、地区与剧情专题建议。
Ask / Evidence 问派蒙 / 可切换搜索与上下文建议
03 Explore / Atlas

在至冬图鉴里追踪席位、状态与伏笔

图谱被重构为一张可操作的皇家地理志:星图视图强调关系,席位视图强调角色与状态;档案侧栏、关系筛选和文本线索把每次探索重新接回证据。

  • 星图 / 席位双视图
  • 角色状态与档案侧栏
  • 双节点关系追踪
至冬皇家地理志界面,展示星图与席位视图切换、关系节点、角色状态和冰之女皇档案侧栏。
Explore / Atlas 至冬皇家地理志 / 从关系星图进入角色档案
04 Decide / Release

把匿名信号变成下一步动作

决策台不止汇总次数,而是给出玩家需求切片、机会与风险分数,以及带负责人、排期和验收标准的制作动作。

  • AI 中文制作组简报
  • 确定性机会 / 风险评分
  • 证据越界自动回退规则版
新版发行洞察页面:深蓝任务头与“各国神之心流转”两到四周发布建议卡。
Decide / Release 发行洞察 / 从信号到可审核制作动作
05 Measure / Incrementality

先估增量,再决定给谁看什么

增量实验室把发行建议变成可检验决策:多处理 T-Learner 比较剧情、角色、玩法 PV 与不触达控制,2×2 随机实验再拆分达人、展会与协同贡献;置信区间不越过业务阈值时,系统明确建议不触达。

  • 分群 CATE 与 95% 置信区间
  • 1 pp 阈值 + 10% Holdout
  • 2×2 归因与 Shapley 分摊
发行增量实验室页面:PV 与玩家分群决策、预计 D30 留存增量、置信区间及增量矩阵。
Measure / Incrementality 增量实验 / 从发行建议到可验证因果决策

Evidence Chain

每个结论都要沿原路走回证据

默认路径从用户偏好开始,到证据回答、制作建议和增量验证结束;只有最小匿名信号与实验分流进入发行侧。模型不可用、引用越界、搜索不完整或实验区间不确定时,系统会显式降级,而不是用更自信的语气遮住失败。

  1. 01 身份与地区
  2. 02 主题编排
  3. 03 受控检索
  4. 04 来源治理
  5. 05 引用校验
  6. 06 匿名决策信号
  7. 07 随机分流
  8. 08 增量验证

Reliability

可信度不是一句承诺,而是失败路径也经过设计

  • 官方、可信 Wiki、社区与未知网页分层处理,社区推测不会被包装成官方设定。
  • 无最终正文、来源无关、请求超时或截断时,每次请求最多回退一次,并清理无法映射的引用编号。
  • 原始问题默认不保存;没有模型密钥时仍可运行确定性证据回答,没有 Supabase 时切换到本地事件存储。
  • 固定种子合成实验只验证方法链路,不宣称真实业务效果;Vitest 与 Python unittest 同时约束引用治理、特征泄漏、置信区间、Holdout 和 2×2 归因算术。

Current State

已经上线,也把边界写在产品里

截至 main@efdaba8,个性化预热、双搜索链路、引用治理、发行决策台、双视图至冬图鉴与发行增量实验室都已进入公开 Demo。增量实验室目前使用固定种子合成随机数据,只能证明方法和产品闭环可运行;真实留存提升仍需线上随机 Holdout 或地域实验验证。Vercel 冷启动、站外趋势未接入与社区 Wiki 覆盖边界也会被明确展示。