课题

把一个科研问题交给多个模型分工推进几个小时到几天:写任务书、确认计划、进行中随时修改、阶段与分诊、带出处的记录、候选报告的两两对决与人审、综合汇总与引用查询、团队共享与分支合并、实验回填、多次独立运行,以及花费怎么算。

查看 .md

课题是网页端里和 Chat 并列的功能:把一个科研问题交给多个模型分工推进,一跑几个小时到几天。和一轮对话比,它多了几样东西:

  • 先出计划,确认了才开跑。 提交任务书后只跑「规划」这一步;阶段与第一批任务摆在计划卡上,你改完、确认,才开始执行。
  • 执行与审阅分开。 每个任务由一个模型写计划、做事,另一个模型审它的计划和结果。
  • 会自己长出任务。 工作中冒出来的追问先进「待分诊」,放行了才做,驳回要写理由。
  • 结果写成记录,报告交人审。 发现、否定结论、方法、问题与数据整理成带出处的记录;最后写几份候选报告,两两对决排出先后,交你审。

入口:登录后右上角用户菜单(手机上是菜单)里的「课题」。也可以在 Chat 里点「升级为课题」:这段对话最后一次回答的开头与附件摘录会作为材料附进任务书,研究问题留空时默认用对话里最后一条提问。

看不到入口,说明当前环境还没有开放课题。

一个课题怎么走

状态在做什么你能做的
规划中规划模型读任务书,拆阶段与第一批任务取消
待确认计划计划卡等你确认改阶段、删改任务、调预算,确认开跑;取消
待审批团队课题的预算超过了团队审批线团队 owner / admin 批准或驳回;取消
研究中按阶段执行任务、分诊追问、整理记录暂停、收尾出报告、取消;放行或驳回追问
已暂停在跑的步骤跑完后不再发新的继续、收尾出报告、取消
写报告 / 报告对决从记录里挑素材写候选报告,再两两对决取消
待人审等你审报告接受、要更多证据、驳回;回填实验结果;结束人审;取消
已结束 / 失败 / 已取消——查看;已结束的课题仍然可以审报告、回填实验、改标题与预算、再要一版综合汇总、审分支交来的合并

结束之前随时可以「编辑」(见下文「进行中修改」);看得到课题的人都可以从它「引申分支」(见下文「共享、分支与合并」)。

任何状态下都可以把整个课题导出成 Markdown(任务书、阶段、分支关系、最新一版综合汇总、报告与名次(含引用的摘要比对)、全部记录、收到与发出的合并(逐条结论与理由)、修订记录、自动生成的方法段)。

计划出来之后默认 7 天不确认就作废。作废不花钱,确认之前只花了规划那一步。

新建:写任务书

栏目写什么
研究问题(必填)要回答的问题。写得越具体,拆出来的任务越贴题
标题留空用研究问题的第一句(整句;第一句超过 200 字时要自己写一个标题)
背景已知的情况、做过的尝试、相关的数据或文献
范围 / 不做的要做的物种、数据库、方法、时间窗口;明确排除的方向,免得任务跑偏
想要的产出一份带证据的结论、一张候选列表、可以落地的实验设计……

各栏的长度上限:标题 200 字,研究问题与其余各栏各 2 万字,材料 20 万字。超了会提示,不会被悄悄截掉。

其余几项:

  • 阶段:默认由规划模型拆。也可以自己定,每个阶段写目标与完成检查(至少做完几个任务、至少几条发现、发现是否要带出处已核对的证据);勾了「检查点」的阶段结束后会暂停,等你看过再继续。
  • 工具:科研工具(序列、结构、数据库检索)、查文献、出处核对、联网搜索,各自可以关掉。
  • 规模:任务上限、同时进行的步数、时限。留空用部署的默认值;上限是 200 个任务、同时 16 步、72 小时。
  • 独立运行次数:1 次或 3 次,见下文「多次独立运行」。
  • 预算:见下文「花费」。

确认计划

计划卡上是规划模型拆出的阶段与第一批任务。可以改阶段的标题、目标、检查与检查点,删掉不要的任务,改任务目标,调预算。

计划卡上的估算是上界:每一步按它的上限算(输入按字数估、输出按上限满额,动作多的步骤按它的预算硬顶算),实际花费通常低得多。追问会在工作中长出来,不在这份估算里;研究阶段的预算硬顶兜住它们。

团队课题花的是团队配额。预算(多次运行按几次合计)超过团队审批线时,确认之后要团队 owner / admin 批准才开跑;审批线的默认值是 5000 万配额,平台可以调;等审批时页面上会写明这个课题用的是哪条线。发起人本身是团队 owner / admin 时直接开跑。

进行中修改

课题结束之前随时可以点「编辑」改:

  • 标题、任务书的各栏(研究问题、背景、范围、不做的、想要的产出);
  • 预算:不能少于已经花掉的加上在跑的步骤预占的;加的部分从账户扣,团队课题加过审批线要团队 owner / admin 来调;
  • 截止时间:开跑之前改时长,开跑之后改截止时刻(要在现在 5 分钟以后,从开跑算起不超过 72 小时);
  • 任务上限(不能少于已经放行的任务数)、同时进行的步数;
  • 阶段:走完的阶段不能改,正在跑的阶段可以改内容但不能删,没开始的可以改、删,新阶段加在最后。

研究阶段结束之后,截止时间与阶段就不再起作用、不能改了;课题正常结束之后只能改标题与预算(预算留给分支合并之后再写综合汇总)。

每次保存记一条修订(谁、什么时候、改了什么、改前改后的全文、理由),在总览的「修订记录」里。模型从下一步起按新版执行:开跑之后改了任务书,之后每一步的提示里都会写明「任务书改过」和你写的理由;已经做完的任务不重跑。两个人同时改时,后保存的那个会被提示「刚被别人改过」,刷新后在新版上再改,不会悄悄盖掉别人的修改。

研究阶段

每个任务走同一条流水线:

  1. 执行者写计划;
  2. 监督审计划(通过、要修改、否决);
  3. 执行:查文献、读原始序列窗口、核对标识符、找先例……按你开的工具来;
  4. 监督审结果(接受、要返工、否决),可以提追问;
  5. 整理者把结果写成记录,包括否定结论。

追问与分诊。 追问先进「待分诊」。分诊步骤成批放行或驳回,驳回写理由;你也可以在「任务」页手动放行或驳回。研究阶段结束之后不能再放行。

阶段的完成检查由程序判定,不靠模型自己说完成了。 没满足的先补一轮任务,仍不满足就标「未完成」、写明差在哪(比如「带出处已核对证据的发现 0 条,要求至少 2 条」),继续往下一个阶段走。

研究阶段在这几种情况下结束,转去写报告:任务都做完了、研究预算用完、到了时限、到了任务上限、你点了「收尾出报告」。

  • 暂停:在跑的步骤跑完后不再发新的,点「继续」接着跑。
  • 收尾出报告:不再发新任务,在跑的做完后开始写报告。
  • 取消:在跑的步骤会停下,不再出报告。已经花掉的配额不退。

记录与证据

记录分五类:发现、否定结论、方法、问题、数据。每条有状态(待确认、已确认、被推翻、已被取代),你可以改写、改状态、锁定;锁定的记录要先解锁才能改。

记录上的证据标两种:

  • 出处已核对:程序查过出处在这个课题里确实存在——读过的序列窗口确实读过、引用的课题记录确实存在、文献或网页的标识符确实出现在这个任务的检索结果里。
  • 出处未核对:程序对不上,或这类证据程序核对不了(工具结果一律标未核对)。

「出处已核对」只说明出处对得上,不说明结论正确。结论对不对,要靠人审和实验。

文献与登录号类的证据还会标源头的查询结果(见下文「引用在源头的查询」):查到此文、查无此文或未能查询。源头说查无此文的,即使检索结果里出现过这串字,也不算出处已核对。

记录还可能标着来处:继承自主课题(分支建立时带过来的快照,只读参考,不算这个分支自己的发现,不进它的报告)、由分支并入(写着来源分支与贡献者)。

总览里的「漏斗」只数程序能确定的:带证据的发现是至少带一条出处已核对证据的发现;「实验支持」只来自你标的实验结论。

报告、对决与人审

研究阶段结束后,从记录里挑几个主题写候选报告(默认最多 8 份),每份固定几节:一句话发现、证据、与已有工作的比较、新颖性(检索词与数据库;没有实际检索过文献的会写明「新颖性只是模型的判断」)、局限、建议的实验(对照、预期、出现什么情况即被否定)、读过的序列窗口。报告先过程序检查与编辑审阅,没过的问题会写在报告上。

对决:评委模型两两比较报告,每一对正反两个顺序各比一次,看影响、新颖、可靠与可操作四项。结果是一张胜负矩阵,不只是名次。排序决定你先看哪份,不决定哪份是对的。

人审队列:排名靠前的几份,再从其余里随机抽几份(排第一的不一定是最值得看的那份)。每份可以:

  • 接受;
  • 要更多证据:写清还缺什么,会开一个补证据的任务,课题回到研究中,做完后重写这份报告;
  • 驳回:写理由。

队列里的报告都审完,或你点「结束人审」,课题结束。

研究阶段没有留下候选发现时不出报告,课题直接结束;记录里的否定结论与待解问题仍然可以查看,也会写综合汇总。

报告正文里的文献与登录号都回源头查过:查到的列在「引用出处」里,可以点开;查无此文与未能查询的不留在正文里,正文那个位置标「〔未能查到的引用 n〕」,点它跳到报告下方的附录第 n 条,附录写着原因。程序检查会把这件事写在报告的问题里,编辑审阅时可以退回重写。

综合汇总

研究阶段结束、课题进入人审(或者没出报告就结束了但有记录)时,自动写第一版综合汇总:把课题记录、候选报告与人审结论、实验回填、多次运行的并集、分支并进来的记录写成一份——总体结论、主要发现、否定与排除、分歧、待解问题、局限、下一步,另外列出各分支的贡献。

程序守着三道闸,不靠模型自觉:

  1. 每条论断都带证据指向:课题记录、候选报告、读过的原始序列窗口,或源头查到了的文献与登录号。点记录、报告的指向会跳到对应标签页里那一条。指向在课题里找不到的会被去掉,一条指向都不剩的论断不进正文,列在最后的「没有证据指向的论断」里。
  2. 引用必须在源头查得到:查无此文与未能查询的剔出正文,写进附录并注明原因。
  3. 措辞写到证据为止:不把模型的判断写成定论;「实验支持」只来自你标的实验结论。

材料很多、一步放不下时(大课题、并进来很多分支),会按阶段分批写:每一批只看那一批记录的全文写一份小汇总,都写好之后再合成一份;页面上能看到分了几批、每批写到哪了。任何一批两次都没写成,这一版就记为没写成(写明是哪一批),不拿缺了一批的材料去合成。

每写一次是一个新版本,旧版本都留着,可以切换查看。写完之后课题又有了新记录、人审、实验结论或合并时,页面会提示「可以再要一版」;能操作课题的人随时可以点「再要一版」(研究阶段结束之后)。分支合并通过后,如果主课题的研究已经结束,也会自动再写一版。综合汇总花的是这个课题的预算。

引用在源头的查询

报告、综合汇总与记录证据里的每一条引用,都回它的源头查一遍:

引用去哪查
PMIDPubMed
DOI、arXivCrossRef、arXiv、Semantic Scholar
GenBank / RefSeq 登录号NCBI(这个课题里实际读过原始记录的登录号直接算查到)
UniProtUniProtKB
PDBRCSB PDB
网址没有统一的登记处可查:只认这个课题检索到或读过的

结果只有三种说法:查到此文(只说明源头有这条记录,不说明它支持那句话)、查无此文、未能查询(没有开启、超时、限流,或者一次引用太多)。后两种都不进报告与综合汇总的正文。「未能查询」不等于有问题,只是这一次没能确认,所以同样不放进正文。

摘要比对

「查到此文」只说明源头有这篇。再往下一层:报告写好、综合汇总写好之后,查到了的文献(PMID、DOI、arXiv)会再取一次摘要原文,交给另一家模型(避开写报告、写汇总的那一家),把摘要和引用它的每一句话逐对比:

  • 摘要与这句话一致:摘要里有直接说到这句话的内容;
  • 摘要与这句话不一致:摘要里的说法与这句话相反,或对象、数值对不上;
  • 摘要里看不出:摘要没写到(可能在正文里)。

「一致」和「不一致」都必须逐字抄出摘要里的那一句,系统在摘要原文里找得到才算数,找不到的一律按「看不出」并写明原因。结果显示在引用出处下面:论断原文、结论、摘要里的那一句,摘要全文可以展开看。报告里有「不一致」的,问题清单里会多一条,给人审时看。

比对只说摘要里写没写——摘要不代表全文,也不说文献证明了什么。源头没有给出摘要的(很多出版社不交摘要),写「没做比对」。比对是另起的一步,花这个课题的预算,不挡课题往前走。

团队课题按团队的「外部检索」设置:设为「全部关闭」时一条引用都不往外发,全部是「未能查询」、不进正文(这个课题里实际读过的登录号、检索到的网址不用往外发,照常算查到);「只核对」及以上照常去源头查。

共享、分支与合并

共享给团队:个人课题的发起人可以把它共享给自己所在的一个团队。团队成员能看、能从它引申分支;编辑、暂停、人审、审合并这些操作仍然只有发起人能做。可以换一个团队或取消共享,已经引申出去的分支不受影响。团队工作区里发起的课题本来就归团队,不用共享。

引申分支:看得到课题的人都可以点「引申分支」,从整个课题,或者从其中一条记录(记录上的「从这条引申分支」)、一份报告(「从这份报告引申分支」)开一个新课题:

  • 分支有自己的研究问题与预算,花的是你当前工作区的配额,照常规划、确认、研究、出报告;
  • 任务书没写的栏沿用主课题;主课题的研究问题与引申的起点写进材料;
  • 主课题的记录(被推翻、被取代的除外)作为继承的快照带过来:只读参考,不算分支自己的发现(主课题本身也是分支时,它从上一级继承来的快照不再往下带);
  • 你是主课题所在团队的成员时,分支自动共享给那个团队,大家都看得到谁在往哪个方向引申。

从主课题同步:分支建立之后,主课题还在跑、还会有新发现。分支页顶上的「从主课题同步」把主课题之后新有的记录继承过来(同样是只读快照);主课题后来推翻或取代了的记录,分支里的快照跟着改状态,免得还拿它当依据(正文不变)。每次有变化都记一条修订。

发起合并:分支的研究告一段落(暂停、写报告、待人审或已结束)之后,在分支的「分支与合并」里点「发起合并」,把分支自己的记录(不含继承的快照、不含被推翻或取代的)交给主课题。主课题已有同样内容的记录会自动标出、不用审。同一个分支同时只能有一次在等审。

审合并:主课题的发起人(团队课题还有 owner / admin)在主课题的「分支与合并」里逐条审:接受,或驳回并写理由;每一条都要给结论才能提交。接受的记录并入主课题,写明来源分支、来源记录与贡献者。主课题的研究已经结束的,并完会自动再写一版综合汇总,「各分支的贡献」里列出谁并入了哪几条。发起合并与审完都会通知对方。

实验回填

对一份就绪的报告,写下做了什么、看到了什么。模型会对照报告里的预期写一份解读;结论由你来标:实验支持、实验否定或不确定。界面上的「实验支持」只来自这一步。

多次独立运行

选 3 次时,同一份阶段独立跑三遍,各自规划任务,最后合并三遍的发现:一条发现出现在几次里就标「m/3 次出现」;只出现一次的标「只在 1 次中出现(未复现)」。只出现一次的更可能是偶然。

预算平分给三次:每一次能用的约为只跑 1 次时的三分之一。计划卡上调的是每一次运行的预算,三次各用这么多。

会话记录

每一步的完整会话记录都留着:系统段、输入、每一轮的动作与原样的工具结果、产出。「会话记录」页可以按关键词在全部记录里查找(至少 2 个字),也可以把某一行标成「关键时刻」,链到一份报告。

课题结束(已结束、失败或已取消)7 天后,会话记录压缩存放。查看与查找照常,只是打开时可能慢一点。

方法卡

执行者写计划时可以引用方法卡:怎么做、要查的数据库、要避开的坑。

  • 平台方法卡随平台版本发布,只读。
  • 团队方法卡只在团队课题里用,由团队 owner / admin 新建、修改、删除;团队成员可以看。改卡、删卡不影响已经跑过的任务。

花费

  • 预算是整个课题最多花的配额,其中一部分(默认 20%,总览的「预算」卡上有当前比例)留给写报告与对决,研究阶段花不到它——前面花光了照样出得了报告。
  • 留空用默认值:1 亿配额与账户现在能花的取较小者。
  • 每一步开跑时按它的上限预占,结束后按实际用量结算;总览里「在跑的预占」就是这部分。
  • 个人课题花个人配额,团队课题花团队配额。
  • 取消课题不退已经花掉的配额。

权限

  • 个人课题只有发起人能看、能操作;共享给一个团队之后,那个团队的成员也能看、能引申分支,操作仍然只有发起人。
  • 团队课题:团队成员都能看、能引申分支;发起人与团队 owner / admin 能操作(包括编辑、审合并);审批只有 owner / admin。
  • 分支属于引申它的人;主课题看不到的人打开分支时只看到主课题的 id。
  • 平台后台的课题一览只看得到「形」:谁发起、在哪个工作区、共享给哪个团队、是谁的分支、几个分支、几个等审的合并、几版综合汇总、预算与花费;看不到题目、任务书与任何研究内容。

请验证你的身份

为了保护你的账户,这个操作需要再验证一次。

验证码已发送到你绑定的手机号。5 分钟内的其他敏感操作不会再问。

Cookie 偏好

您可以随时回到这里修改。页脚有常驻入口。

必要

维持登录状态、记住主题与语言偏好。没有它们本站无法正常工作,因此无法关闭。

统计

了解哪些功能有人用、用户在哪一步流失。只收集维度(页面、操作类型、计数),不收集您输入的任何内容。

本站不加载任何第三方统计脚本,也不做会话录屏。完整说明