AGENT · LLM RESEARCH · AI PRODUCT · DELIVERY
钟尚坤
- 珠海复旦创新研究院Agent 大模型科研助理
- 广州兴灏科技有限公司AI 产品经理 · 慧守超项目负责人
医药背景出发,做 Agent、多模态与 RAG 系统的产品设计与工程落地。习惯把模糊问题拆成可验证的链路:先跑通最短闭环,再用固定样本、回归测试和可视化报告,让结果经得起复查。
AGENT · LLM RESEARCH · AI PRODUCT · DELIVERY
医药背景出发,做 Agent、多模态与 RAG 系统的产品设计与工程落地。习惯把模糊问题拆成可验证的链路:先跑通最短闭环,再用固定样本、回归测试和可视化报告,让结果经得起复查。
在珠海复旦创新研究院围绕 Agent 与大模型应用做科研支持:Agent 工作流、评测流水线与科研自动化工具;同时在兴灏科技负责零售视觉核验与健康档案 Agent 两条产品线的交付。
把方法调研、实验设计、评测口径与流水线搭建做成可复现、可交接的科研工具。
组合 LLM、VLM、OCR、RAG 与 Agent 能力,重视证据链、失败边界与成本。
用真实输入、离线回归和可视化报告证明结果,而不是只展示界面。
SELECTED SYSTEMS
只写方向、做法与我的角色;客户、数据、参数、架构细节与源码均不公开。
面向零售自助收银的漏扫与走单问题。用“屏幕账单 OCR + 台面商品视觉”双证据交叉核验、交易状态机与异常留证,替代单一视觉模型的直接判定;边缘端 ARM 开发板无人值守运行,云端 VLM 只在语义不确定时介入,配套人工复核台、设备集群监控与双机位测试台。
把体检与检测报告(PDF、扫描件、照片)变成可检索、可回溯的结构化事实:VLM 版面识别 → 分块转录 → 带坐标事实 → 分诊与人工核对 → 健康档案 → 带原文引用的问答。精确问题走确定性查询,解释类问题走 RAG;不确定的内容 Fail-closed,宁可送审也不错误入档。
从一批 PDF 到符合目标期刊要求的投稿稿:双通道数据抽取核对、纳入分诊、Meta 分析与影响诊断、R 出图、中英文写作、文献池构建与引用核实、期刊推荐与投稿改稿。九个阶段,每个阶段都有人工签字关卡。配套 LivingEBM 选题批量评估、文献批量获取与 SPSS 语法生成器。
为科研团队每日自动巡检多地官方渠道的课题与基金机会:LLM 通过函数调用操控搜索、官方网页读取、去重与证据保存工具,区分“新发布 / 新检出 / 状态变化”,只采信官方原文并留存哈希证据;选定机会后生成申报书骨架与 Word 简报。
本地量化研究、回放与仿真控制台:策略、风控、账本、网关、回放与报告分层;TEST / REPLAY / LIVE_LOCKED 三态,真实下单默认锁死。配套多 Agent 市场情报服务:证据链、事件流、品种影响与成本复盘,LLM 只做证据与否决,不决定数量与价格。另有 A 股模拟盘、自主选股智能体等系列实验。
以“打电话”的方式做企业 AI 需求访谈:流式 ASR、访谈式对话大脑、语音断句启发式、TTS 与视觉理解串成低延迟通话链路;大脑支持云端模型与本地 vLLM 自动切换,本地不通自动回退。配套产品原型与融资路演材料。
COMPLETE PORTFOLIO
去重后 26 个自研项目,按六个方向分组。同一产品线下的子系统、测试台、运维工具与材料归入所属项目的“组成部分”,不单列;第三方开源项目与学习性克隆不计入。只写方向、组成与状态,不披露商业实现细节。
屏幕账单 OCR 与台面商品视觉双证据核验,边缘端无人值守运行
项目负责人,0 → 1 统筹规划、方案、实现与试点真实门店原型部署与预测试
手机连拍直传、云端识别、条码解码、一键导出 Excel
独立设计与实现已部署服务器,持续迭代
报告 → 带坐标事实 → 人工核对 → 健康档案 → 带引用问答
产品负责人,全链路方案、评测机制与验收完成 B 端交付
诊疗录制、语音转写、案例结构化、知识库问答与多平台内容生成
产品负责人,产品架构、Agent 方案与路演可运行原型;“互联网+”大赛省级二等奖项目
把前沿论文的嵌入空间逻辑做成浏览器可交互演示,并用 PyTorch 复现核心机制
独立设计与实现已开源,可在线访问;标注为教育性重构,不用于诊疗
从一批 PDF 到符合目标期刊要求的投稿稿,九阶段流水线
独立设计与实现真实投入使用
选题评估、文献获取、论文初稿与统计作业的桌面级自动化
独立设计与实现真实投入使用,子系统成熟度不一
论文统计与图像异常信号筛查,仅供人工复核
独立设计与实现已开源(MVP)
函数调用巡检官方来源,留证去重,生成申报骨架与简报
独立设计与实现本地可运行,定时任务每日执行
院校库构建、岗位采集、可视化报告与申请信生成
独立设计与实现持续使用
专用芯片架构建模、性能仿真与研究报告
独立研究报告已完成
PDF ↔ Word 字体度量、间距测量与逐页对比
独立设计与实现实验进行中
策略 / 风控 / 账本 / 回放分层,真实下单默认锁死;多 Agent 情报证据链
独立设计与实现研究与仿真验证;不构成投资建议,不宣称收益
多源采集、多路推理、分级推荐、模拟交易复盘
独立设计与实现已部署原型;不宣称有效性与收益
低价股筛选策略、模拟账户与日报,桌面 GUI
独立设计与实现可运行原型
剧本 → 角色与场景 Bible → 分镜关键帧 → 视频生成 → 拼接
独立设计与实现试制集已产出
音乐生成演示与本地验收报告
独立设计与实现可运行 Demo
散图合成参考板并调用图像模型,可打包 EXE
独立设计与实现可运行
逐帧动画、配图生成、渲染 QA 与批量出稿
独立设计与实现持续使用
Logo、名片、宣传册与推广物料的脚本化多轮出稿
独立设计与实现已交付多套
流式 ASR、访谈式大脑、TTS 低延迟通话
独立设计与实现本地可运行 Demo
让 Agent 操控真实 Chrome:导航、点击、输入、快照
独立设计与实现可运行
自定义 Skills、本地推理服务与平台互通脚本
独立设计与实现持续迭代
消息回调、加解密与异步回复
独立设计与实现可运行
文档投喂、向量化、本地部署与客户移交
需求与方案、实施与移交(实习期间)已交付 3 家企业
采集、撰写、版式套用与定时发布
流程设计与落地(实习期间)稳定运行,实习期累计 120+ 篇
该分类下暂无项目。
EXPERIENCE
围绕 Agent 与大模型应用方向为课题组提供科研与工程支持,把研究想法快速变成可运行、可评测、可复现的系统,并沉淀为团队可复用的工具与技能。
负责零售视觉核验与健康档案 Agent 两条产品线的需求拆解、方案设计、快速实现、模型评测与部署验收;统筹专利、软著与创赛申报。
围绕企业知识资产化与运营提效,参与企业智能知识助手(B 端 ChatBot)从需求访谈、知识库建设、RAG 问答到本地化部署与客户移交的完整过程。
围绕公众号内容运营提效,设计并落地一条无人值守的全自动内容生产与发布 Agent。
医药专业背景,跨领域自学 AI 工程与产品;“互联网+”大学生创新创业大赛省级二等奖。
WORKING METHOD
确认使用者、真实输入、失败代价和验收口径,不让模型能力替代产品判断。
优先打通完整闭环,再逐层提高准确率、性能、可维护性和体验。
固定样本、客观指标、离线回归、端到端测试与浏览器可见证据;一次只改一个变量。
代码、运行方式、风险边界和验证结果一起交付,减少后续接手成本。
TOOLCHAIN
日常以多 Agent 编程平台协作开发,但以可执行脚本、版本记录和实际验收结果作为交付依据。
CAPABILITY MATRIX
需求拆解、方案设计、实验设计、评测口径、文献与方法调研、路演与申报材料。
Agent 工作流、Function Calling、RAG 与证据引用、VLM / OCR 文档理解、结构化输出与反幻觉机制。
Python、Node.js、FastAPI / Flask、React / TypeScript、原生 Web、边缘设备部署、本地推理服务。
固定样本、离线回归、端到端测试、客观打分、HTML 验收报告、隐私与凭据边界。
LET'S BUILD
关注 Agent、多模态系统、科研自动化与可验证交付。欢迎交流科研合作、产品项目与工作机会。