RESEARCH METHOD AGENT · WORK REPORT

第四次工作汇报
会议纪要

方法合并、专家机制、成本与团队扩张

2026年7月28日

确认量化方法合并逻辑,要求质性方法以文献验证确定性流程,并细化专家成本、测试团队、外包及人员扩张机制。

方法合并专家机制成本定价团队建设
整理口径遵循原交流内容,重点保留领导明确要求、执行边界、待办任务及后续开展方式。

本次汇报聚焦科研方法智能体的合并、现有智能体上线、质性方法可开发性验证、专家与测试机制、成本定价、人员扩充,以及 AI 能力整合。已明确删除、暂缓或并入的项目不再作为独立智能体列入主清单。

一、量化方法智能体:以“论文中能否独立使用”为合并标准

专家反馈是:部分分析方法技术上可以单独存在,但论文实证中通常会组合使用。领导明确,“是否独立”应以其在论文写作中能否作为独立方法使用为标准,而不是只看技术上能否单独运行。

后续原则是:能够作为论文独立方法使用的保留为独立智能体;只是其他研究方法中的分析工具、子步骤或扩展能力的,合并到上层方法中。不再机械保留原始候选数量,合并后预计仅剩约 10 个左右,且多数能力将归入回归分析体系。

已明确的处理口径:

方法/能力处理结论后续动作
方差分析不作为独立智能体,需合并原始转写中具体归属不清,合并表中需明确最终承载方法
因子分析合并至结构方程模型作为结构方程模型的子能力设计
多层线性模型合并至回归分析纳入回归分析的扩展能力
空间计量合并至回归分析明确其适用数据、模型条件和输出边界
聚类分析不独立,需合并向专家确认具体并入位置;其与因子分析常连贯使用
fsQCA暂不合并保留独立性
纵向追踪与增长曲线模型暂不定论专门询问其本质是否属于数据分析方法,以及是否应并入回归或纵向分析体系
机器学习预测建模统一更名为“机器学习”后续明确其范围,不只限定预测场景
眼动实验保留后续界定其分析流程与实验边界
问卷调查名称统一为“问卷调查”不再使用“问卷调查法”表述;不因改名恢复为独立智能体

下一步先完成量化方法的“保留、合并、待确认”总表,再提交领导排序。当前不自行确定最终优先级。

二、回归分析智能体与既有产品上线

现有回归分析、扎根理论智能体是否已上线悟空科研,需要当天与周总、唐刚及群内记录再次核实。领导要求 8 月必须开始让学员使用,前期按免费使用处理,不因积分体系尚未完全统一而拖延上线。

量化方法合并完成后,下一项重点工作是重新梳理回归分析:

三、质性方法:先验证流程是否确定,再决定是否具备智能体开发条件

质性方法主清单总体不再大幅调整。焦点小组访谈已并入访谈研究,不再重复建设独立智能体。

当前最重要的不是立刻找专家,而是团队先完成“方法操作过程是否确定”的文献验证。对每一个保留的质性方法,应至少阅读 10 篇以上实际应用文献,重点不是泛读理论介绍,而是提取:

下次汇报应逐方法提交文献依据和初步结论,包括“是否可开发、可开发到什么程度、流程是否稳定、仍有哪些边界不清”。本阶段以团队自主调研为主,不把专家咨询提前替代文献研究。

四、专家机制:专家负责校正,不从零讲授

已形成专家合作方案初稿,包含专家职责、筛选条件、单个智能体占用时间及费用测算。

领导口径是:专家主要负责指导、校正团队已整理出的流程和原型;文献梳理、材料沉淀、流程文档整理由内部团队完成。不能让专家从零开始讲解某一研究方法,也不能把专家等待时间计入项目工作量。

专家使用方式调整为:

  1. 团队先基于文献、论文复现和大模型工具形成初步原型。
  2. 将已整理的流程、具体问题和原型结果交给专家确认。
  3. 专家重点指出流程缺项、错误边界、适用条件和例外情况。
  4. 团队据此修订后再进入开发和测试。

专家经验不是唯一壁垒。领导判断,方法知识中约 70% 至 80% 可通过大模型和大规模文献整理获得;单一专家也可能只熟悉自己长期使用的少数步骤。因此应扩大文献覆盖面,初步可按每个方法不少于 10 篇做可行性判断,形成原型时进一步扩展至 30 篇以上,条件允许时向约 100 篇文献扩展,以覆盖方法的完整使用图景。

专家费用方面,原方案按每小时 500 至 1000 元、每个智能体 6 至 10 小时估算,单个智能体可能达到 3000 至 10000 元。领导要求内部控制目标为每个智能体不超过约 5000 元,费用只按专家实际投入的沟通和确认时间计算。

五、成本与定价:内部全流程成本和外包开发报价分开算

内部初步测算中,单个开发人员的月均综合成本按约 2 万元计算,包含工资和社保公积金等投入。原估算单智能体完整项目约需 1.5 人月,加上专家、测试等投入,内部全流程成本约 4 万元。

领导要求进一步拆分,特别是与唐刚的外包结算不能按“项目历时”或“等待专家的自然周期”计算。应按实际开发工作日核算,例如:

专家之间的等待间隔、排期延后等,不得计入唐刚的开发人天。唐刚外包报价应只计算实际开发工作量,当前可先按约两周实际开发时间重新测算并沟通。

模型调用成本方面,现有实测单次完整调用约为 0.03 至 0.3 元。为保守核算,可暂按单次不超过 1 元作为成本上限,但这只是内部测算参数,不是对外定价。

定价暂不自行确定,后续应采用倒推方式:先确定售价,再测算需要多少月调用量才能回本。例如,若按单次 99 元、单智能体总成本约 4 万元测算:

此前假设每月 200 次调用没有充分依据,不应作为定价前提。最终售价、回本周期和利润要求由领导统一决定。

六、测试机制:建立稳定测试团队和反馈时限

当前项目进度受测试反馈影响较大,不能每次临时找销售或零散人员测试。建议建立长期维护的测试团队,可先通过黄蓉等渠道筛选约 20 名稳定测试人员,建群统一管理。

测试机制需要明确:

稳定测试团队虽然会增加单项目的直接激励成本,但能明显降低等待和返工造成的整体项目成本。

七、人员、招聘与管理安排

以“春节前完成约 20 个智能体”为目标测算,若单智能体完整投入按 1.5 人月计算,总工作量约为 30 人月。若从 9 月起正式开发,到春节前约 5 个月,则需要约 6 名全职开发人员。

已确认两名人员计划于 8 月初入职:乔普 8 月 3 日入职、王雷 8 月 5 日入职。8 月以熟悉业务、代码、流程和培训为主,9 月起进入科研方法智能体正式开发。

领导要求不一次性扩张到 6 人,而是先按“三人规模”推进,观察 9 至 10 月的实际交付效率、流程成熟度和管理负荷后,再决定是否继续扩招。原始交流中“三人”是指新增人数还是包含已确定入职人员的总人数,需与人力部门立即核定,避免招聘口径不一致。

新人首月安排包括:

后续应建设内部项目看板,统一记录每个智能体目前处于专家沟通、文献调研、开发、测试、返修还是上线阶段,并沉淀专家材料、测试问题和解决记录。

八、AI 团队后续定位:先交付方法智能体,再形成数据与模型壁垒

团队近期第一优先级仍是科研方法智能体。但仅做上层智能体编排无法形成长期壁垒,后续壁垒应由两部分组成:

后续应逐步梳理哪些数据可用于智能体,哪些数据适合做检索增强、规则库、案例库或模型训练。微调不是默认方案,应在 RAG、Agent、知识库等路径确实无法达到业务要求后再考虑,且需要评估算力和数据条件。

针对选题模型、论文审改模型等中长期方向,近期先做两项基础了解:

同时先了解高辉团队当前具体在做什么、目标是什么、为何选择微调、实际资源投入和效果如何。待掌握情况后,可组织小范围技术论证会,必要时邀请浪潮同行提供经验参考,提出最优技术路径建议。是否调整人员、归属或技术路线,由领导决定。

九、预算与工具使用

AI 团队日常需要使用多种大模型和开发工具。建议按每人每月约 200 元申请工具预算,用于模型订阅、开发辅助工具和必要测试服务;按部门流程提报即可。

同时需向人力或财务确认:当前部门编制变化后可使用的经费额度、经费与人头的对应关系,以及新入职人员归属当前部门后的预算安排。后续模型选型不局限于单一厂商,应在实际业务场景下测试多家模型,再形成选型报告。

十、下次汇报前的明确待办

  1. 当天核实回归分析、扎根理论智能体在悟空科研的上线状态,明确 8 月免费使用安排。
  2. 完成量化方法合并总表,重点补齐方差分析、聚类分析、纵向追踪与增长曲线模型的最终归属。
  3. 盘点现有回归分析代码和分类,形成“常用能力优先”的增补方案。
  4. 对每个保留质性方法完成不少于 10 篇文献的流程确定性验证,并形成可开发性结论。
  5. 将专家方案改为“文献与原型在前、专家校正在后”,重新测算实际投入时间,专家成本控制在约 5000 元以内。
  6. 重算单智能体成本,区分内部全流程成本、唐刚外包开发人天、专家费用、测试激励和模型调用成本。
  7. 建立稳定测试团队及三天反馈机制。
  8. 与人力确认首批“三人”招聘口径、部门经费和新人归属。
  9. 为新人准备论文写作课程、教材、代码与流程培训资料。
  10. 了解高辉团队 AI 工作现状,整理后提出技术路径建议,不提前决定人员或项目归属。