知识库与数据采集
PubMed/API、RSS、行业网站与公众号采集;Playwright、网页解析、PDF/图片处理、元数据管理、增量入库与来源追踪。
20余年复杂业务系统架构、研发管理与项目交付经验,近一年重点投入企业级 AI 应用工程化。具备从多源采集、文档解析、结构化入库、Embedding 与 RAG,到 LLM 分析、报告生成及飞书 / 业务系统接入的完整实践。
已独立完成行业类资讯采集与语义检索、企业知识库构建、智能合规、财务票据 OCR、多模态文档问答及 OpenClaw Agent 接入等项目。能够把论文、专利、法规、行业情报和内部研发文档转化为可检索、可追溯、可分析的企业知识资产。
长期参与高并发、私有云、国产化和 AIoT 项目,重视数据安全、权限控制、结果可追溯与生产可运维性;能够在业务规则、确定性计算与 LLM 能力之间建立清晰边界。
PubMed/API、RSS、行业网站与公众号采集;Playwright、网页解析、PDF/图片处理、元数据管理、增量入库与来源追踪。
DeepSeek、Kimi、MiniMax、Gemini、Qwen;Prompt 模板、结构化 JSON、Embedding、向量检索、模型路由、重试降级、工具调用及 OpenClaw / Dify 接入。
Qwen3-VL、DeepSeek Vision、OCR、图表与扫描文档理解;FunASR、VAD、CosyVoice 及长音频处理。
Python、FastAPI、SQLAlchemy、PostgreSQL、SQLite、Redis、MinIO、Pandas;异步任务、SSE、日志与接口鉴权。
Docker Compose、Nginx、Kubernetes、Linux / Ubuntu、私有化模型部署、llama.cpp / GGUF、微服务及 AIoT 边缘采集。
AI 产品规划、MVP 验证、技术选型、跨团队交付与大型研发团队管理;将业务规则、AI 能力与可运营系统结合。
面向医药研发资讯的多源采集、AI 摘要与语义检索系统,覆盖论文和行业资讯从采集到查询展示的完整链路。
面向企业内部知识库的公众号文章采集与对象存储闭环,为文档切片、Embedding、RAG 和 Agent 问答提供数据底座。
将合规规则引擎、领域知识和 LLM 结合,实现境外投资项目预审、材料生成和全生命周期管理。
将发票、银行回单和工资表等非结构化凭证转化为可追溯的财务数据、记账凭证和申报报表。
基于本地 Qwen3-VL 与 llama.cpp 构建内网视觉语言模型服务,适用于扫描文档、实验记录、图表和敏感资料。
支持人类用户与 OpenClaw Agent 共同参与的内容社区,重点验证 Agent 通过受控 API 接入真实业务系统的工程模式。
将书籍和长文本资料处理为结构化知识,并生成摘要、核心观点、金句、思维导图和社交媒体视觉内容。
结合多指标评价、统计分析、What-if 政策仿真和 AI Agent 对话的复杂决策支持平台。
采集行情、新闻和研究数据,统一路由多种 LLM 生成结构化分析,并通过飞书、钉钉、企业微信、Bark 和邮件推送。
完成网站 / RSS 采集、正文抽取、LLM 生成与改写、AI 配图及微信公众号草稿发布的一体化内容流水线。
融合 VAD、FunASR、OCR、YOLO、Pix2Tex、VLM 与 LLM,处理课堂长音频和课件,生成摘要、评价与学习报告。
计算机科学与技术|本科
NFT 驱动地铁资产数字化;参与并推动国内首批地铁手机刷码乘车平台、刷脸支付系统、AI 数字人及国产物联网架构综合监控系统。