一支规模很小、范围很明确的团队
我们是一支小型研究团队,横跨两件事:做需要严谨性的研究,写需要稳定性的代码。
研究线集中在智能测量与评测、计算基因组学;工程线围绕 AI Agent 工具链与开源生态。两者不是两批人在做两件事——研究需要工具支撑,工具需要研究把关,这是我们保持小规模的原因。
履历与联系方式见「成员」一栏。
四条研究线
-
01
AI for Science
基因组序列建模与分子表型预测——关注跨分布泛化与基准的严谨性。
-
02
智能测量与评测
自动作文评分、LLM 评分理由、生成文本检测——把「如何评估智能」当工程与统计问题做。
-
03
AI Agent 系统与工具链
记忆、工具调用(MCP)、工作流自动化——让 Agent 进入真实的工作流程。
-
04
开源工程
浏览器扩展、Web UI 插件体系、规格驱动开发——自己先用,顺手开源。
正在公开维护的工作
开源工程 Open source
Star 数实时读取自 GitHub。
-
dsh-web6,394
DeepSeek Harness 的 Web 插件生态:任务板、Git 图谱、皮肤中心等 30+ 插件。
-
deepseek-pp1,702
DeepSeek 网页端增强:MCP 工具、长期记忆、Skills 与自动化。
-
spec_driven_develop975
面向 AI 编程 Agent 的规格驱动开发工作流:架构先行、任务分解、Issue/PR 跟踪。
-
minister142
把 Claude Code / Codex 接入飞书,作为团队协作的辅助角色。
学术成果 Publications & work in progress
-
Tokenization 与数据集规模对 AI 文本检测的影响
Frontiers in Artificial Intelligence · 一作
-
ChatGPT 作文检测:机器学习与 LLM 的比较
IMPS · 一作;后续系列工作见成员页
-
低成本生成式摘要用于规模化作文评分
arXiv 预印本 · 独作
-
教育测量与 AI 评测研究线
与马里兰大学合作 · 进行中
-
计算基因组学
西湖大学 · 进行中
两个人,两条线
现役 Current
-
华浩炜 · Jack Hua研究
普林斯顿大学神经科学本科;研究教育测量、AI 文本检测与计算基因组学。
-
Solitude工程
AI 工具链与开源生态开发者;deepseek-pp、dsh-web 维护者。
-
新成员招募中
欢迎在 AI for Science 或 AI Agent 方向有独立作品的同行者加入,写信给我们。
做事的原则
- 严谨
- 结论可复现:公开数据、如实记录失败、不做没有对照的实验。
- 开放
- 代码与成果默认公开;修 bug 与写论文同等重要。
- 长期
- 项目按年维护,不追热点;停止维护会明确宣告。
- 小而专注
- 少接活,多深耕;每件事都有人负责到底。
下一步
近期:deepseek-pp 与插件生态的稳定化;教育测量线投稿。
中期:把 Agent 工作流模板化,反哺科研流程——实验编排、文献整理。
长期:吸收新成员,形成小型合作网络;论文、开源与社区并行。