Chat Code for Bioinformatics · v0.1.0
对话即分析。
环境、代码、执行交给平台,科学判断留给你。
cc-bioinfo 把大语言模型的推理能力与专业生信计算环境结合在一个多用户平台里:你提出科学问题、把关每一步判断,AI 负责建环境、编码、执行、出图、整理稿件初稿——全过程留痕、可审计、可复现,结论成不成立由你判断。它装在你机构的服务器或你自己的电脑上:多人共用、各自隔离、文件与分析留在院内。
一分多钟看懂 cc-bioinfo · 从提问到结果的完整流程
cc-bioinfo 是什么?
形态上,它是一套装在 Linux 服务器上、通过浏览器访问的多用户分析环境——就像 RStudio Server,只是你不写代码,改成用中文对话。本机什么都不用装,打开浏览器就能用;分析跑在服务器上,关掉浏览器也不中断。
cc-bioinfo(Chat Code for Bioinformatics)是一个多用户、私有化部署的 AI 原生生物信息学分析平台:科研人员用自然语言描述分析意图,平台自动生成并执行 R/Python 代码,产出可复现的生信分析工作流与论文初稿。它预装两个核心 skill:bio-design 负责课题设计,bio-analyze 负责分析执行——这两个 skill 也可以单独装进 Claude、ChatGPT 这类 AI 里使用;平台为它们补上多用户隔离、每课题独立的分析环境与全程留痕。
- 服务端 Ubuntu 24.04+ LTS;客户端任意现代浏览器,无需安装
- v0.1.0(2026-07-09 发布)— 首个正式版本,多用户服务器架构 + 双 skill 流水线实战验证
- 6 个独立完成的真实科研课题端到端验证,含如实报告的阴性结果
- 4 条 IM 渠道(微信、钉钉、飞书、Telegram)全部端到端测试通过
怎么获取?个人版与企业版如何购买?
先免费试,觉得合适再买。三条通道对应三种情况:
| 你的情况 | 怎么做 | 说明 |
|---|---|---|
| 想先看看好不好用 | 打开体验平台(无需登录) | 无需安装、无需配环境、不用先准备数据;要专属试用环境可邮件 tangmoogmoogtang@gmail.com 申请 |
| 个人版(单一研究者) | 通过小红书直接下单(标价以店铺为准) | 交付为网盘分发的 WSL 系统镜像,预装 bio-design 与 bio-analyze;一个人用,文件与分析留在本机 |
| 企业版(科室 / 实验室 / 机构) | 邮件至 tangmoogmoogtang@gmail.com 咨询报价(含部署支持) | 交付为服务器安装包;私有化部署、多用户隔离、机构账号认证 |
海外用户请经 Gumroad 购买(美元结算),见英文版购买说明。
个人版适合谁
- 自己一个人做课题,不需要多人共用
- 数据敏感:文件与分析留在本机,只有发给模型的对话内容经过你选的服务商(选 Ollama 则全部本地)
- 不想、也不需要另配一台服务器
- 机器配置跟得上:16 GB 内存能用,32 GB 更稳——分析全在本地跑
- 安装与配置全程有视频:个人版部署指南
企业版适合谁
- 科室、实验室、医院与高校的共享分析平台
- 需要每个成员数据互相隔离,但共享一套算力与模型资源
- 因合规或 IT 管控要求部署在自有服务器上
- 环境要求:Ubuntu 24.04+ 专用服务器或虚拟机;WSL2 仅用于评估,不建议生产使用
个人版 vs 企业版,差在哪
| 个人版 | 企业版 | |
|---|---|---|
| 价格与渠道 | 小红书直接下单(标价以店铺为准) | 邮件咨询报价(含部署支持) |
| 用户数 | 1(无登录) | 多用户,系统级隔离 |
| 部署形态 | 本机 Linux / WSL2 / 虚拟机,一键安装 | 专用服务器全栈部署(nginx+TLS+systemd) |
| 登录认证 | —— | PAM(真实系统账户)+ Go auth-service |
| 用户管理 | —— | cc-bioinfo-admin CLI |
| 全量备份 / 恢复脚本 | ✅ 手动运行 | ✅ 手动运行 |
| 定时自动备份 | —— | 账号库每日自动(保留 30 天) |
| Bio-Design + Bio-Analyze | ✅ 预装 | ✅ 预装 |
| IM 集成(Telegram / 飞书 / 钉钉 / 微信) | ✅ | ✅ |
| 多模型供应商(Anthropic / Bedrock / DeepSeek / Kimi / Ollama) | ✅ | ✅ |
| 授权 | 按研究者授权,本人 ≤2 台机器 | 单台生产服务器(用户数不限,允许换硬件 / 迁 VM) |
| 更新 | 随版本发布提供更新镜像(机制待确认) | 随版本发布提供更新包 |
平台的产品介绍与公开文档可在 cc-bioinfo 公开仓库查看(README、更新日志、功能说明);部署包与安装支持在购买后提供。购买前请阅读授权与退款条款。
它和 ChatGPT、Claude Code、Biomni Lab、RStudio Server 有什么不同?
cc-bioinfo 不是聊天套壳,也不是又一个 skill:它是装在你机构的服务器或你自己电脑上的多用户分析工作台,两个核心 skill(bio-design、bio-analyze)在它上面跑。skill 在别的舞台也能演,差异在舞台本身——下面按你现在可能在用的东西逐个说,每一行都先写对方更合适的情形。
| 你现在用的 | 它已经能做到的 | 这个舞台多给你的 |
|---|---|---|
| 直接和 AI 对话(ChatGPT / Claude 网页) | 设计方案、写代码、解释结果都行——只是给建议,不能执行 | 真的建环境、跑代码、出图,每一步产物落盘可查 |
| Claude Code / Codex 这类编程 Agent + skill | 会用终端的人一人一套,做一次性探索完全够用,我们自己也这么用 | 不碰终端也能用;每课题隔离的常驻环境;一个科室共用、系统级隔离 |
| Biomni Lab / Claude Science 这类托管工作台 | 模型与工具生态更强,探索性分析、数据可上云的先看它们 | 自托管、文件与分析留在院内、中文界面、一路到投稿初稿 |
| RStudio Server / Jupyter | 完全自由,会写代码的人灵活性最高 | 不写代码;质量门禁、预注册锁、审计留痕内置 |
| 在线分析平台 / Galaxy | 低门槛、免费算力 | 工具链不受限,可用任何 R/Python 包;文件不上传 |
它是服务器端多用户平台:科研人员通过浏览器访问,本机不装任何软件;关闭浏览器后,运行中的分析、定时任务与 IM 消息收发都不中断——数小时的全流程分析可以无人值守完成。多用户之间以 Linux UID 做进程级隔离、PAM 认证登录,共享一套算力与模型资源而互不可见。
Anthropic · Bedrock · DeepSeek · Kimi · Ollama
微信 · 钉钉 · 飞书 · Telegram
Linux 账户 + PAM 认证
6 端到端 + 1 被人否决
更细的逐项对照——含通用技能库、自己写脚本、以及不该用本平台的场景——见怎么选。
一个课题在平台上怎么走完?
按课题推进的顺序看功能,而不是看清单:① 开题 → ② 建环境 → ③ 执行 → ④ 盯进度(含审阅 AI 的每一处代码改动)→ ⑤ 扩展;每一项都出现在它被用到的那一步。交付物本身——图表、稿件初稿、投稿包——由 ③ 里的 bio-analyze 一路做到。
- ① 开题 · bio-design 课题设计上游设计 skill:文献拆解 + 启发式设计对话,382 个已拆解案例、6,235 条决策模式支撑。
- ② 建环境 · 零环境配置自动为每个项目建独立 Conda 环境、缺包即装,连 Conda 都没有时从零自举 Miniconda——环境地狱这一关不用你过。
- ② 建环境 · 多模型生态原生深度集成 Claude API;统一路由切换 AWS Bedrock、DeepSeek、Kimi 与 Ollama——选 Ollama 时推理完全在本地。
- ② 建环境 · 三层配置架构项目层 > 用户全局层 > 框架层;实验室特有 marker 基因表与内建知识合并而非替换。
- ③ 执行 · bio-analyze 自主执行下游执行 skill:Step 0–7 全流程,无人值守完成数小时分析,一直做到 SCI 稿件初稿。
- ③ 执行 · 对话驱动代码“帮我用 DESeq2 做差异表达分析”——系统自动编写代码、安装缺失依赖、准备运行环境;报错一键交给 AI 诊断堆栈并给出修复代码。
- ③ 执行 · 浏览器内置终端每用户独立 tmux 终端,装包、建环境、跑脚本都在网页里完成,不需要配 SSH 客户端。
- ④ 盯进度 · IM 多渠道接入微信、钉钉、Telegram、飞书四渠道端到端测试通过:权限审批、项目切换、流式结果卡片,出门诊间隙也能拍板。
- ④ 盯进度 · 沉浸式 IDE 体验完整 Web UI:左侧 AI 对话、右侧代码改动与 Diff 视图;多项目管理含会话历史与分支。
- ⑤ 扩展 · 插件生态Web UI 或 CLI 安装社区插件:PubMed 检索、scRNA-seq QC、Open Targets、Consensus 等。
多用户架构与数据安全如何设计?
cc-bioinfo 采用三层多用户架构:nginx 反向代理(含 Lua)→ Go 认证服务(Linux PAM + 会话 + 审计)→ 每用户独立的 Bun 进程(systemd 模板单元管理)。
- 进程级隔离:每个用户会话以其自身 Linux UID 运行,配 PrivateTmp、内存限制与 CPU 配额。
- Unix socket 路由:请求经每用户独立套接字路由,用户之间无法访问彼此会话;已通过双用户并发的真实跨用户隔离测试。
- 机构账号认证:认证服务直接走 Linux PAM,用机构已有的用户名密码登录,无需另建账号体系。
- 服务端常驻:用户进程由 systemd 管理,不依赖浏览器连接;系统重启后服务自动恢复。
数据合规口径:原始数据仅在服务器本地 R/Python 环境中读取;是否有数据出内网取决于管理员配置的 LLM 服务商。需要完全数据驻留时,可配置 Ollama 等私有化 LLM——平台本身不含“数据不出内网”的技术强制,这一点我们如实说明。
cc-bioinfo 适合谁?不适合谁?
如何开始使用?
- 第 1 步 · 打开体验平台:体验平台 test.cc-bioinfo.com(无需登录);要专属试用环境可邮件联系 tangmoogmoogtang@gmail.com。用起来就是浏览器里直接用中文对话,两个推荐的入口:丢一篇你领域的文献让 bio-design 拆解,或拿一份公开 GEO 数据让 bio-analyze 跑段质控与聚类。
- 第 2 步 · 选版本:个人自用选个人版,科室或机构选企业版,详见购买说明。
- 第 3 步 · 部署与开通:个人版跟着个人版部署指南走即可,三段视频覆盖全过程;企业版在你们自有服务器上部署,安装向导会自动安装全部依赖、配置 TLS,并在完成后运行 17 项自检。部署包与安装支持在购买后提供。
| 环境要求 | 企业版(服务器) | 个人版(自己的电脑) |
|---|---|---|
| 操作系统 | Ubuntu 24.04+ LTS | Windows + WSL2(导入 Linux 镜像) |
| CPU | 2 核起,推荐 4 核以上 | 4 核以上 |
| 内存 | 4 GB 起,推荐 8 GB 以上 | 16 GB 起,推荐 32 GB |
| 磁盘 | 10 GB 起,推荐 20 GB 以上 | 建议 300 GB |
两列数字差距很大,是因为量的不是同一件事:企业版那栏只是平台本身的开销,真实分析跑在机构的算力上;个人版所有事都在你这台机器上完成——平台、Conda 环境、原始数据、分析计算全都在本地,所以要按跑得动单细胞、空间转录组来准备。部署指南里有镜像获取与安装的完整说明。
有哪些真实完成的研究案例?
以下 6 个课题在 cc-bioinfo 平台上端到端完成:由 AI 临床医生角色与 AI 生信科研者角色协作,人类只在开头说一句话。全部使用公开真实数据,含如实报告的阴性结果。完整过程档案见 真实案例 页。
- 孟德尔随机化
统计遗传学房颤 → 心衰的因果结构与蛋白中介基于 IEU OpenGWAS 汇总统计量,AF→HF OR 1.34(p=3×10⁻⁵⁹),1,915 个血浆蛋白全扫、中介交集为零——一句话指令产出 8,060 词英文投稿手稿。 - 单细胞 + 空间
心血管颈动脉斑块 SMC 稳定性五层证据闭环20,909 个 SMC 谱系细胞 + Xenium 120,164 细胞空间验证;数据不支持预设时,AI 把整篇论文的命题推翻重建。 - 药物基因组学
对比研究CAVD vs CAD 因果图谱对比与药物重定位300 靶点双结局 MR、26 小时 7 条并行证据线——用遗传学解释“他汀为什么治不好瓣膜钙化”。 - 机制药理
分子对接七氟醚 × 心肌缺血再灌注 × 铁死亡撞上预注册闸门后诚实换向:对接分数全部未过线,结论如实框定为“非单靶点抑制”。 - 循证医学
伞式综述HFpEF 药物治疗证据版图体检102 篇 Meta 分析:96.1% AMSTAR-2 评级 Critically Low,全语料重叠度 16.7%——“这个领域需要的不是更多 MA,而是更好的 MA”。 - 生殖医学
自主选题反复着床失败内膜受容窗口三轮连续研究AI 自己出题、三轮层层收缩、三次诚实关门——每一轮都关闭了一个被广泛假设成立的机制。
两份互为镜像的过程记录:案例一全自动实录——人只说了一句话,两个 AI 零介入交回 8,060 词投稿手稿,四个诚信机关怎么运转、人还负责什么;案例七完整复盘——人介入 17 次、最终否决了课题,AI 什么时候会自己跑偏。一个成功、一个失败,都完整公开。
常见问题 FAQ
cc-bioinfo、bio-design 和 bio-analyze 是什么关系?
三者是一个平台加两个核心 skill的关系,不是三个平行产品。bio-design 与 bio-analyze 是可安装的 AI skill——既能直接装进 Claude、ChatGPT 这类 AI 单独使用,也预装在平台里。一句话记住:cc-bioinfo 是舞台,bio-design 是编剧,bio-analyze 是导演和全体演员——编剧和导演也能去别的剧场演出,但舞台设施只有这里有。
| 名称 | 它回答的问题 | 你什么时候用它 | 你拿到什么 |
|---|---|---|---|
| cc-bioinfo | 在哪里跑? | 全程——它是承载另外两个的环境 | 浏览器里的分析工作台、内置终端、多用户隔离、关浏览器不中断 |
| bio-design | 做什么课题? | 开题前、拿到数据前 | design.md 方案书(能直接给导师看)+ TOPIC.yml 机器可读契约 |
| bio-analyze | 怎么把它跑出来? | 设计定了、数据到手后 | 分析结果、出版级图表、技术报告、SCI 稿件初稿 |
两个 skill 不锁在平台里:可以直接安装到 Claude、ChatGPT 这类 AI 下单独使用——只想把课题想清楚,用 bio-design;已经有现成方案和数据,直接用 bio-analyze。装进平台则多了舞台设施:多用户隔离、每课题独立的分析环境、全程留痕。串起来才是完整闭环:执行完成后用 /bio-design review 把结果反向映射回设计,产出修订版再喂回执行 skill——设计与执行互相校准,而不是一次性输出。
怎么购买?有哪些版本?
正式版本分两种:个人版面向单一研究者,通过小红书直接下单(标价以店铺为准),交付为预装 bio-design 与 bio-analyze 的 WSL 系统镜像;企业版面向科室、实验室与机构,含私有化部署与多用户隔离,邮件至 tangmoogmoogtang@gmail.com 咨询报价(含部署支持)。海外用户请经 Gumroad 购买(美元结算),见英文版购买说明。详见购买说明。
使用 cc-bioinfo 需要会写代码吗?
不需要。研究者用自然语言描述分析意图,平台自动生成并执行 R/Python 代码,并自动搭建 Conda 环境。但关键科学判断(细胞类型注释确认、分析方向选择、图表审核)仍需研究者本人决策。
我不会配环境、不会用命令行,也能用吗?
能。环境配置是生信的第一道坑,也是大多数人真正倒下的地方。平台把终端做进了浏览器,无需配 SSH 客户端;更常见的用法是根本不碰终端——bio-analyze 自动为每个项目建独立 Conda 环境、缺包即装,连 Conda 都没有时从零自举 Miniconda。详见生信痛点 QA。
数据会离开我们的服务器吗?
原始数据(h5/rds/FASTQ/BAM 等)仅在平台所在服务器的本地 R/Python 环境中读取。是否有数据出内网取决于管理员配置的 LLM 服务商;平台支持配置私有化 LLM 以实现完全数据驻留,但平台本身不含数据不出内网的技术强制。
和直接用 ChatGPT 或 Claude 聊天有什么区别?
聊天机器人只能给建议,不能执行。cc-bioinfo 是一个类似 RStudio Server 的持久化计算环境:AI 生成的代码直接在服务器上运行、报错自动诊断修复、结果落盘为可复现的工作流,关闭浏览器后分析仍在服务端继续。
和 Cowork、Codex、OpenClaw 这类 AI Agent 工具有什么区别?
解决的问题不同。那一类是装在个人电脑上的通用智能体:能力很强,但默认你自己会配环境、看得懂命令行,而且是单人单机。cc-bioinfo 面对的现实是:生信工具链几乎全部长在 Linux 上、靠命令行驱动,而大多数科研人员日常用 Windows、没有 IT 背景——工具在河这边,人在河那边。所以平台做成 Linux 服务器软件、浏览器访问:命令行那一侧整个交给平台,科研人员只面对浏览器和中文对话;多用户各自隔离,bio-analyze 为每个课题单独配置一套 Conda 分析环境,课题之间互不污染。这些都不是通用 Agent 工具要解决的问题。
AI 生成的分析结果可信吗?
平台以工程手段而非承诺来约束可信度:预注册判定规则先于结果写死、数据真实性铁律禁止模拟数据与捏造统计值、五维度质量审计在解读前强制拦截、结论措辞被锁定在证据强度之内。最终科学责任仍在研究者:稿件为初稿,需人工核实。
我想先试试,从哪里开始?
直接打开体验平台 test.cc-bioinfo.com——无需登录,点开即用;要专属试用环境可邮件联系 tangmoogmoogtang@gmail.com。用起来就是浏览器里直接用中文对话,不需要安装软件、不需要配环境。两个推荐的第一步:丢一篇你领域的参考文献进去让 bio-design 拆解,或拿一份公开 GEO 数据让 bio-analyze 跑段质控与聚类。
本页最后更新: