在线版常见问题¶
只讲 socioverse.fudan-disc.com 相关的问题。 框架本身的问题见通用常见问题。
上手¶
第一句话该怎么写?¶
说问题,不要说机制。讲清楚谁(哪个人群)、什么在变(干预或冲击)、 多长时间、你想测什么。比如:
食堂涨价 20% 会怎样改变某中国高校学生一个学期内的就餐结构?是把他们推向外卖还是 推向自己做饭?
这一句话就给了路由、时间跨度、人群和指标各自的着力点。「模拟一个食堂」给不了。
第一句话同时固定了之后整段对话(包括报告)的语言。
为什么参考 study 不能直接改?¶
因为它是所有派生研究的对照基线,而且是共享的。你提出修改,得到的会是一个 fork —— 一个带着原产物和锚定账本的新 study。原件保持完整,这也意味着你可以拿自己的版本 去和它对比。
能上传我自己的数据吗?¶
目前界面上还不行。如果你的 study 需要服务够不到的数据,把它讲给助手 —— 把某个数值
作为明确声明的假设并写清理由,是一个正当且留痕的选项。如果你需要真正基于文件的
人群数据,把 study 放到本地 clone 跑,那里 provider_ref: file.personas 可以读你
提供的 CSV 或 Parquet。
跑的过程中¶
跑批时能关掉页面吗?¶
能。跑批会在服务器上继续。重新打开这个 study 会回放对话并显示进度。
助手好像卡住了,怎么回事?¶
绝大多数情况是有一张提问卡你还没回答 —— 流程无法越过它。往上翻,找那张没作答的卡。
如果服务在有待答提问时重启过,那张卡可能不在回放的历史里了。说一句「继续」,助手会 重新问。
怎么中止?¶
助手工作时,发送按钮会变成停止按钮,按它会中断当前这一轮。对话记录里会标记这一轮 是被中断的,而不是正常完成的。
能同时跑两个 study 吗?¶
每个 study 有自己的对话,你可以来回切换,但请一次只推进一个。尤其是模拟跑批不要并行 —— 它们共用你工作区的 2 个 CPU,结果只会两个都变慢。
图为什么是空的?¶
study 只画它声明要展示的指标。如果你关心的指标不在里面,提出来加上 —— 那是一次迭代, 并且需要重跑才能有数据。
结果¶
结果在哪,能导出吗?¶
在你工作区里该 study 的目录下,和本地 clone 一模一样:一个 DuckDB 存储,每个 agent
每一步一行面板数据、逐步的聚合指标、触发过的事件,外加 Parquet 导出和渲染好的
report.md 及其图片。
目前还没有下载按钮。要把一个 study 带走,可靠的路径是在本地 clone 开源包重建 —— study 目录格式完全一致,而报告里已经包含了数字和锚定账本。
结果可复现吗?¶
规则型和确定性跑批:完全可复现,端到端有种子。真实 LLM 跑批:不可 —— 采样每次都不同。 但每次跑过的结果都永久留在它自己的存储里,而热启动的迭代会精确回放父版本已存的动作, 而不是重新问模型。见通用常见问题。
我又跑了一遍,数字不一样,是坏了吗?¶
不是,那是 LLM 实时采样。如果你想要一次受控对比,请用新版本迭代,而不是重跑: 版本闸门会保留之前的轨迹,指标时间线可以把两者叠加起来看。
花钱¶
这会花我多少钱?¶
个人不花钱。你的账号带两份配额 —— 一份给助手自己的推理,一份给模拟和外部数据 —— 默认各 $10。见额度与计费。
余额掉得比我预期快。¶
通常是两个原因:人群规模 × 时间跨度太大(每个 agent 每一步都是一次决策),或者做了 一次人群问卷调用 —— 它按每个模拟受访者一份问卷计费,因此直接随受访人数增长。 每笔扣费在对话里都有一行记录,往回翻读一下。
用完了怎么办?¶
找团队追加,两个平面可以分别提额。这期间你的 study 和结果都不受影响。
本地版 vs 在线版¶
什么时候该转到本地 clone?¶
当你需要规模(成千上万个 agent、很长的时间跨度)、需要直接操作文件、需要用自己的模型 供应商,或者这个 study 的跑批本就属于某条外部管线时。study 目录在两边是一样的,所以 迁移是复制,不是重写。从安装开始。
在线版比开源版旧吗?¶
两者跑的是同一套运行时和同一条工作流。在线版多了账号、隔离的工作区、计量额度和对话 面板;少了直接编辑文件和不受限的跑批规模。