Spark Program | Nervos Brain - A Global Developer Onboarding Engine and Cross-Language Hub Powered by Agentic RAG

Hi @IrisNeko

Nervos Brain 已经进入了最后的收尾阶段,一路跟下来,看到项目从概念到实际落地,真的很开心!一个能在 Discord 和 Telegram 里直接回答 CKB 技术问题的 AI 助手,对降低开发者门槛的意义是实实在在的。

结项前想再确认几件事:

1. 关于演示视频

目前结项材料里似乎还没有演示视频。对于 Nervos Brain 这种交互型工具,一段简短的视频对小白用户来说是最直观的引导——尤其是那些在 Telegram 群或 Discord 服务器里第一次接触机器人的用户,有一个"先看再试"的参考,上手会快很多。如果来得及的话,可以考虑补一个简短的 screen recording,展示一下典型的问答流程。

2. 关于最终报告

方便的话,我们建议把最终报告的源文件(Markdown / Notion / Google Doc 等格式)也发一份。这样如果需要翻译或整理成其他格式,会比较方便。

3. 关于服务持续性

委员会希望了解在 Spark 资助结束后,Nervos Brain 的机器人计划继续运行多久?是否有后续的维护或运营安排?经过测试,相信社区里已经有很多人在期待了,如果服务有调整,我们可以提前同步给大家,避免用户突然找不到。

再次感谢你和团队这段时间的投入,Nervos Brain 是 Spark Program 在本年度的第一个顶格 $2,000 的项目,也是目前最受社区关注的 AI 项目之一。

期待你的回复。

Best,
xingtian
On behalf of Spark Program Committee

2 Likes

1.演示视频

2.最终报告

3.计划7-8月在TG群服务一个月

2 Likes

Nervos Brain Spark Program 正式结项说明

大家好,Nervos Brain 现已完成 Spark Program 阶段的开发、测试与最终交付工作。

本项目最初目标是构建一个面向 Nervos / CKB 生态的全球开发者引导引擎与跨语言知识中枢,通过 Agentic RAG 将文档、Nervos Talk 社区讨论、GitHub 代码资料和社区问答连接起来,帮助开发者和社区成员更高效地理解、检索和使用 Nervos 生态知识。

在本阶段中,Nervos Brain 已完成以下主要交付内容:

  1. 基于 Agentic RAG 的 Nervos / CKB 知识问答系统
  2. 覆盖文档、Nervos Talk、GitHub 代码资料的多源检索能力
  3. Telegram / Discord 社区访问入口
  4. Nervos Talk MCP 只读工具
  5. Qdrant 检索数据库、archive 数据与重建流程
  6. 部署、配置、运行维护、数据说明、MCP 和故障排查文档
  7. 社区测试、评分反馈、优质回答案例和最终交付报告

根据委员会此前的建议,我也补充整理了最终结项材料:

  1. 演示视频
    Gofile - Cloud Storage Made Simple

  2. 最终报告 html 源代码
    Gofile - Cloud Storage Made Simple

  3. 线上展示页面
    https://nervosbrain.vercel.app/

  4. 源代码
    GitHub - iris-Neko/Nervos-Brain · GitHub

关于服务持续性,Nervos Brain 计划在 2026 年 7 月至 8 月期间继续在 Telegram Nervos Nation Telegram: View @NervosNation 中运行一个月,作为 Spark Program 结束后的社区观察和过渡运营期。

在此期间,Telegram 入口会以 best-effort 的方式继续提供服务。我会继续处理基础维护、明显 bug、服务中断和社区反馈。如果后续服务入口、运行时间或维护安排发生变化,我会提前在 Nervos Talk 或测试群中同步,避免社区用户突然无法使用。

本阶段验证了 Nervos Brain 作为 Nervos / CKB 跨语言知识系统和开发者引导工具的可行性。后续如果进入 DAO 阶段,我希望继续将它推进为更长期、更自主的 Nervos 智能层,包括更稳定的知识更新、更强的证据验证、更好的运行体验,以及未来与 coding agent 协作的上层开发支持能力。

感谢 Spark Program Committee 和 Nervos 社区在整个过程中提供的支持、测试、反馈和耐心。

3 Likes

Nervos Brain Spark Program 余款发放申请

大家好,Nervos Brain 的结项说明和最终交付材料已在上方提交。

烦请委员会审核确认,并在方便时安排发放 Spark Program 剩余款项。

请将这笔 installment 发送到此前用于接收首笔启动资金的同一 CKB/JoyID 地址:

ckb1qrgqep8saj8agswr30pls73hra28ry8jlnlc3ejzh3dl2ju7xxpjxqgqqywl8cx055zewvgzjtw3w0zndmgr4ml5q5qhpdcd
感谢 Spark Program Committee 和 Nervos 社区的支持。

4 Likes

Hi @IrisNeko ,

很高兴看到你在最近的更新中补齐了所有结项交付物。委员会已经对 Nervos Brain 项目进行了全面的审查,我们认为你的代码质量很好,结项报告的整体形式和呈现方式非常优秀。

但报告中的数据展示过于简洁,因此仍有一些问题希望得到你的回应:

结项报告第二页质量结果部分展示的小字中有“真实群策均值”和“按回答聚合”两个评分项目和“3.67/5”和“3.75/5”两个评分呈现。委员会在这里对“按回答聚合”评分项目产生了疑惑,随后在你此前发布的文字报告和结项报告其它部分中均未能找到对此评分项目的具体说明。

委员会建议:以前面提到的评分项目的情况为例,以此类推,结项报告中应该展示更多支撑数据的关键信息。如果能同时展示各个评分项目和评分其背后的原始数据、评估依据和方法论,报告的说服力和完整性会更上一层楼。

为避免调整UI或报告排版耽误你更多时间,委员会希望你能直接以文字版形式补充对应细节。这是一次邀请你们优化数据展示的反馈,你们的项目成果是扎实的,展示更多底层数据将帮助社区更清晰地看到这一点。

需要说明的是,你此前分享的文字内容和报告截图与我们给出详细反馈之间的时间差,是因为委员会选择在所有结项交付物全部到齐后,再统一启动正式审阅。

best,
xingtian
On behalf of the Spark Program Committee

2 Likes

Hi xingtian,

感谢委员会的详细审阅和具体反馈。你指出得很准确:此前报告展示了评分结果,但没有充分说明“真实群测均值”和“按回答聚合”两个指标的定义、原始分布和计算方法。现补充如下。

一、数据来源与分组

  1. 真实群测:
    来自 Telegram 测试群中的真实用户问题和评分,共记录 60 条回答,8 名真实测试者,收集到 27 次 1–5 分评分。

  2. 补充跑测:
    另外进行了 40 条固定验证,覆盖 8 个补充测试人设。这部分主要使用预设的、部分由 AI 辅助生成的评测场景,用于验证多轮上下文、检索、引用、开发指导、排障和安全边界等能力。补充跑测不属于真实用户满意度评分,也没有与真实群测混合计算。

二、真实群测评分

27 次真实评分的原始分布如下:

  • 1 分:4 次
  • 2 分:1 次
  • 3 分:5 次
  • 4 分:7 次
  • 5 分:10 次

因此,按每一次评分等权计算:

(1×4 + 2×1 + 3×5 + 4×7 + 5×10) / 27
= 99 / 27
= 3.67 / 5

其中 4–5 分共有 17 次,占 17 / 27 = 63.0%。

三、“按回答聚合”的含义

27 次评分对应 24 个实际获得评分的唯一回答。部分回答收到多位测试者评分。

“真实群测均值”是以每次评分为统计单位;“按回答聚合”则先按照唯一回答/request 归并同一回答收到的评分,再对 24 个有评分回答进行等权计算。

这样可以避免某一个回答因为收到更多评分而在统计中占更大权重。按该方法计算,平均分为 3.75 / 5。

四、补充跑测结果

40 条补充跑测的分布为:

  • 1 分:0 次
  • 2 分:2 次
  • 3 分:8 次
  • 4 分:25 次
  • 5 分:5 次

平均分为:

(1×0 + 2×2 + 3×8 + 4×25 + 5×5) / 40
= 153 / 40
= 3.83 / 5

这个分数反映的是固定评测场景下的系统表现,不代表真实用户满意度,因此没有并入 3.67 / 5 或 3.75 / 5。

五、评测边界

这组数据主要用于 Spark 阶段的工程验证,而不是统计学意义上的大规模用户研究。低分样本主要帮助定位资料缺口、边界问题、上下文问题和测试噪声。后续如果进入 DAO 阶段,我会继续增加真实测试者数量、公开评分原始数据和评测标准,并按任务类型分别统计回答质量、引用质量、响应速度和多轮上下文表现。

感谢委员会指出这一展示问题。补充这些定义和原始分布后,报告中的两个评分指标应该会更容易复核。

2 Likes