跳到主要内容

功能与支持的输入

Open-Science 将研究项目的对话、原始文件、文献记录和生成结果放在本地工作区中。配置好的模型负责推进任务,需要计算或访问服务时,再调用 Notebook、工具或连接服务。可以从手头已有的材料选择入口。

根据输入选择起点

已有材料第一步希望得到的结果使用结果前检查
一个研究问题和几个 DOI创建项目,查询标识符,审核文献库 Inbox 候选核对过来源的阅读集合对照出版方检查标题、完整作者、年份和标识符
一批论文或导出的参考文献使用文献库导入和集合管理分类后的文献集合及可获得的 PDF导入警告、重复记录和附件匹配
CSV 或 TSV 数据在会话中附加文件,请求 Notebook 分析数据审计、结果表和图缺失值、单位、分母和实际保存文件
PDF 或稿件附加文档或在 Files 打开针对具体段落的解释或修改方案是否读取全文,以及引用页是否支持结论
序列或分子结构打开支持的 FASTA、PDB 或分子文件预览、校验报告或适用工具的分析输入规范、方法要求和工具可用性
经常复用的步骤创建或导入 Skill方法说明和配套文件是否启用、依赖是否满足、已知输入试跑结果
明确的研究角色创建 Specialist 并分配能力有明确职责和访问范围的角色Skills、Connectors 选择和委派工作结果

论文中的图片和表格可用本地 PDF 提取;复用方法可从 Skill 市场查找。需要核对捕获的结果时使用复现检查,需要交接会话和证据时使用 .science 研究包

文件能在预览器打开,不代表模型已经读取。附加文件后,会话可以使用这一来源;还需要检查读取记录、工具调用和输出证据,确认实际使用情况。扩展名和大小限制见文件格式与限制

理解工作区里的对象

对象保存什么与其他对象的关系
Project研究目的、长期 Agent Context、会话和项目文件将一项研究放在一起
Session请求、回复、工具活动和对话分支属于一个项目
Upload原始材料的托管副本与衍生结果分开保留
Artifact生成的报告、图、表或其他文件版本关联其生成时的证据
Literature reference书目信息、标识符和附件可加入集合并关联项目
NotebookPython 或 R 执行及输出用于检查计算和实时变量
Skill方法指令和配套文件启用后可在输入框选择
Specialist角色、指令和选定能力按角色需要配置和调用
Connector外部工具或数据服务入口取决于配置、凭据和策略

项目 Description 用于识别项目。需要模型遵守的指令应放进 Agent Context,它会进入模型上下文,不应用来存放凭据。

按任务准备依赖

发送对话需要可工作的代理框架和模型连接。Python 计算还需要启用 Python Notebook 运行时。查询服务需要对应 Connector、网络和必要凭据。即使列表里已经有 GPU 方法的 Skill,也可能需要另一台机器、软件环境和模型权重。

模型、运行环境和数据服务分别配置。连接模型后,仍需检查计算要求的软件包;缺包时先安装依赖,或明确选择能用现有环境完成的方法。

分别参阅模型接入Python 和 R 运行时网络设置。模型连接测试成功不能证明所有下游服务均可用。

判断结果能否使用

打开保存的输出,对照请求检查。表格要检查行数、单位和缺失值处理;参考文献要核实标识符和完整作者;代码生成的结果要查看 Provenance 和 Notebook。看到环境记录不完整或证据不可用时,应先确认缺失范围,再判断可复现程度。

正式案例使用公开研究材料:

  • PRISMA 阅读集合:三篇真实论文、审核过的文献记录,以及出版方 PDF。
  • GSE60450 RNA-seq 分析:27,179 个基因、12 个样本、独立核对的质控指标、原始计数图和产出代码。

远程计算展示了同一 RNA-seq QC 在 Direct SSH 上的执行、结果回收、重启恢复和取消。Slurm 计算已在服务器确认完成,但记账查询未启用,应用尚无法回收结果。同一章节还验证了在独立 CUDA 环境中用 A100 完成小型 ProteinMPNN 序列设计及输出核对。

本地保存与外部处理

应用在本地保存工作区。向托管模型发送请求时,相关指令和内容会发送给模型提供方;Connector 和远程作业也可能向配置的服务传输数据。请根据实际选择的提供方和工具活动判断执行位置。本地保存不等于离线处理。

源码核对:产品说明项目字段预览路由。上述两个案例章节分别包含实操记录和英文截图。