首页
李**模板 的头像

李**模板

AI全栈架构师 / 大模型应用工程师

北京 · ***@gmail.com · 175-**-0482https://*.asia

个人简介About

5年+全栈研发经验的 AI 全栈架构师,速影互连创始人,聚焦「AI Native 应用」赛道,独立孵化两款 AI 影像产品(氢映影像智能筛修工作台、猎影多视频同屏播放器)并实现商业化落地。 深耕大模型应用工程化领域,精通 2026 年主流 AI 技术栈:基于 LangGraph + DeepAgents 构建生产级多智能体系统,熟练运用 MCP 协议标准化工具调用生态,具备 RAG 2.0 系统(混合检索、多轮对话、Rerank 重排)从0到1搭建经验。 掌握大模型全链路工程能力:从模型选型(DeepSeek-V3/Qwen2.5-72B/Claude 4/GPT-5)、Prompt Engineering、Function Calling/Tool Use,到 LoRA/QLoRA/DPO 领域微调,再到 vLLM/SGLang 高性能推理部署与 Ollama 本地私有化部署。 具备 Spring Cloud/Alibaba 微服务架构设计能力,熟练使用 Java/Python/Go 多语言后端技术栈,结合 Vue3/React/Electron 实现跨端应用,可独立完成 AI 产品从需求分析、架构设计、模型调优到上线运营的完整闭环。 专业追焦摄影师背景,将 AI 计算机视觉(YOLOv8/ Grounding DINO/ SAM 2)与影像处理深度结合,打造垂直领域 AI 工具产品。

工作经历Experience

  1. **互连(个人创业)

    2024.01 - 至今

    创始人 / AI全栈架构师

    • 创立速影互连个人技术品牌,独立负责 AI 产品规划、技术选型、架构设计与全链路研发,聚焦「AI + 影像处理」垂直赛道
    • 独立设计研发「氢映影像智能筛修工作台」——基于 YOLOv8 + Grounding DINO + SAM 2 多模态视觉模型的 AI 影像智能筛修桌面产品,覆盖「AI 智能筛片→主体跟随裁切→AI 批量调色→DNG/JPG 双格式导出」全流程,产品已上线 https://zhuijiao-zhixiu.lics.asia/
    • 独立设计研发「猎影多视频同屏播放器」——基于 Electron + Chromium 内置引擎的多视频同屏与网页视频嗅探下载工具,内置 AI 字幕提取与内容总结能力,产品已上线 https://lieying.lics.asia/
    • 基于 LangChain + RAG 技术构建产品智能助手,支持自然语言操作软件功能、问答式使用指南
    • 结合 8 年追焦摄影实战经验,将摄影师真实痛点转化为 AI 产品需求,用计算机视觉模型解决糊片筛选、主体识别、构图裁切等行业难题
    • 负责产品全生命周期:市场调研、用户需求分析、AI 模型选型与调优、前后端架构设计、Electron 桌面端打包、Windows 安装包制作、数字签名、产品官网搭建、用户运营与持续迭代
  2. 中科***研究中心有限公司

    2023.06 - 至今

    AI全栈工程师 / 技术负责人

    • 主导信息安全综合服务平台微服务架构设计与全栈研发,基于 Spring Cloud/Alibaba(Nacos + Gateway + Sentinel + Seata)构建 8 大业务子系统的微服务集群,支撑千万级数据量与高并发业务场景
    • 基于 LangChain/LlamaIndex + LangGraph 构建企业级 RAG 2.0 知识库问答系统,采用「稀疏检索(BM25) + 稠密检索(BGE-M3 Embedding) + Milvus 向量数据库 + BGE Reranker 交叉重排」的混合检索架构,实现政策法规与技术文档的精准语义检索,检索准确率达到 92%,支撑智能合规咨询场景落地
    • 设计并实现基于 DeepAgents 架构的多智能体协同工作流(Multi-Agent Collaboration):规划 Agent(任务拆解)→ 工具调用 Agent(MCP 协议工具集)→ 审核 Agent(结果校验)→ 执行 Agent(业务操作),落地测评流程智能编排、密码合规自动检测等场景,人工介入率降低 70%
    • 落地 MCP(Model Context Protocol)协议工具生态,将业务系统的 30+ 核心接口封装为标准化 MCP Tools,实现大模型与业务系统的无缝对接,支持动态工具注册、权限控制与调用审计
    • 集成 DeepSeek-V3/Qwen2.5-72B/Claude 4/GPT-5 等主流大模型 API,设计多模型路由策略(基于任务类型与成本的智能调度),结合 Prompt Engineering、Few-shot Learning、Chain-of-Thought 等技术优化推理准确率
    • 基于 Ollama + vLLM 搭建本地私有化大模型推理集群,部署 Qwen2.5-14B/72B、DeepSeek-R1-Distill 等开源模型,实现敏感数据不出域;运用 LoRA/QLoRA + DPO 技术对 Qwen2.5-7B 进行密码领域微调,领域任务准确率提升 35%
    • 基于 Activiti7 低代码流程引擎 + MongoDB 动态表单 + FormCreate 表单设计器实现可配置业务流程,支持项目管理/文档管理/订单管理/报价管理/许可证管理全生命周期可视化配置
    • 设计 RBAC + ABAC 双权限模型,集成国密算法 SM2/SM3/SM4 实现数据传输存储全链路加密,基于 AOP 切面实现字段级自动加解密,满足等保三级与密码行业合规要求
    • 基于 MinIO 实现大文件断点续传与秒传功能,结合 Redis 多级缓存策略与 ElasticSearch 搜索引擎优化查询性能,核心接口 QPS 提升 40%,平均响应时间降低至 50ms 以内
    • 运用 Docker + Docker Compose + Nginx 完成服务容器化部署与灰度发布,使用 Arthas 进行 JVM 在线诊断与性能调优,JMeter 压力测试保障系统稳定性,线上服务可用性达到 99.9%
  3. **技有限公司

    2022.03 - 2023.05

    Java后端开发工程师

    • 参与公司核心业务系统的 Java 后端开发,基于 SpringBoot + MyBatis-Plus 构建高可用 RESTful API 服务
    • 使用 Dubbo + Zookeeper 搭建分布式微服务架构,实现服务注册发现、负载均衡与容错降级,提升系统扩展性
    • 负责 MySQL 数据库设计与索引优化,结合 Redis 缓存热点数据,解决高并发场景下的数据访问性能瓶颈
    • 运用 Scrapy/WebMagic 分布式爬虫框架完成海量网络数据采集,突破主流站点 JS 反爬机制,结合 Playwright 处理动态渲染页面,通过逆向分析定位加密接口
    • 配合前端团队完成接口联调、Swagger 接口文档维护与线上部署,保障项目按期高质量交付

专业技能Skills

LLM 大模型应用开发95%
RAG 系统架构设计95%
AI Agent / Multi-Agent90%
大模型微调与部署85%
Prompt Engineering90%
MCP 协议与工具生态90%
多模态 AI 应用85%
Electron 桌面应用开发85%
数据采集与爬虫85%

项目经历Projects

氢映影像智能筛修工作台

独立设计研发的 AI Native 影像智能筛修桌面工具,专为追焦摄影师打造,覆盖「AI 智能筛片→主体跟随裁切→AI 批量调色→DNG/JPG 双格式导出」全流程工作流。 基于 YOLOv8 目标检测 + Grounding DINO 开放词汇检测 + SAM 2 视频分割的多模态视觉模型 pipeline,实现批量智能筛片,精准识别糊片、轻微虚焦、眨眼、表情失控、主体不全、焦平面偏移等12类问题照片,支持人/摩托车/汽车/自行车/宠物等多类别主体识别与主体关系判断,筛片准确率达到96%。 集成 AI 智能裁切功能:基于主体检测结果自动计算最佳构图位置,支持三分法构图、居中构图、黄金比例构图等多种裁切规则,支持整组照片跟随主体位置批量裁切,完美保留追焦序列的叙事完整性。 集成 AI 批量调色功能:基于参考图色彩迁移算法实现一键调色,支持调色参数保存为预设并整组复用,支持RAW格式解析与DNG无损导出。 基于 Electron + Vue3 + Python FastAPI 构建混合架构桌面应用,前端负责UI交互与图片预览,后端Python微服务负责AI模型推理与图像处理,支持CPU/GPU自动切换推理,1000张照片筛片仅需3分钟。 独立完成从用户需求调研、AI模型选型与调优(YOLOv8自定义数据集训练mAP@0.5达到0.94)、全栈架构设计、产品UI设计、前后端开发、Electron打包、Windows代码签名、产品官网搭建到上线运营的完整闭环,产品已迭代至v1.2.0版本。

YOLOv8Grounding DINOSAM 2PythonFastAPIPyTorchOpenCV色彩迁移ElectronVue3TypeScriptElement PlusRAW格式处理

猎影多视频同屏播放器

独立设计研发的多视频同屏播放与网页视频嗅探下载桌面工具,主打「多视频同屏同步播放」与「AI辅助内容消费」两大核心功能。 内置Chromium浏览器内核,访问B站、YouTube、抖音、Vimeo等主流视频站点时自动嗅探页面视频/音频资源,支持M3U8流媒体、MP4、WebM等多种格式,支持4K/8K超高清,提供一键预览与下载功能,支持断点续传与批量下载。 多视频同屏播放支持1-16路视频自由排列、同步播放控制(同时播放/暂停/倍速/进度条联动)、自由缩放与拖拽布局,适用于课程学习对比、影视剪辑拉片、多机位素材同步预览、多剧集同时追剧等多场景。 集成AI辅助功能:基于Whisper模型实现视频语音转文字(ASR),结合大模型实现视频内容智能总结、章节自动划分、字幕导出SRT;支持视频内容问答,用户可针对视频内容提问。 基于Electron + Vue3 + TypeScript构建,使用ffmpeg实现视频格式转码与音频提取,内置用户激活码系统与自动更新机制,提供绿色免安装版与安装版两种分发方式。 负责产品全链路研发与运营,持续迭代至v0.0.8版本,累计下载量5000+,付费转化率15%,获得摄影师与剪辑师群体良好口碑。

ElectronChromiumVue3TypeScriptElement PlusffmpegWhisper ASRLLM内容总结视频嗅探M3U8流媒体下载

AI 智能合规审查与知识库问答平台

项目技术负责人,主导密码行业国家级AI综合服务平台的架构设计与核心功能研发,覆盖政策法规知识库、AI合规咨询、智能测评、项目管理、文档安全等8大业务子系统。 基于LangChain/LlamaIndex + LangGraph构建企业级RAG 2.0问答系统,采用「BM25稀疏检索+BGE-M3稠密向量检索+Milvus向量存储+BGE Reranker交叉重排」的混合检索架构,设计文档智能分块策略(语义分块+滑动窗口),实现10万+政策法规与技术文档的毫秒级精准语义检索,检索准确率92%,回答采纳率达到85%。 基于DeepAgents架构设计多智能体协同工作流系统:规划Agent(接收用户需求进行任务拆解与规划)→检索Agent(调用RAG系统与搜索引擎获取信息)→工具调用Agent(通过MCP协议调用业务接口)→合规审核Agent(依据密码行业标准进行合规性校验与风险评估)→报告生成Agent(自动生成结构化审查报告),实现密码方案合规性自动检测、测评报告智能生成等场景,人工工作量降低70%,报告生成时间从2天缩短至30分钟。 落地MCP(Model Context Protocol)协议生态,将平台30+核心业务接口(项目查询、文档检索、标准查询、合规计算、报告生成等)封装为标准化MCP Tools,支持动态工具注册、基于RBAC的工具权限控制、完整调用链路审计,实现大模型与业务系统的安全无缝对接,成为公司内部AI应用的标准基础设施。 多模型路由与私有化部署:设计基于任务类型与成本的多模型智能路由策略,集成DeepSeek-V3(代码与推理)、Qwen2.5-72B(中文通用)、Claude 4(复杂文档分析)、GPT-5(多模态处理)等大模型API;基于Ollama + vLLM搭建本地推理集群,部署Qwen2.5-14B/72B、DeepSeek-R1-Distill等开源模型,敏感数据完全本地处理;运用LoRA/QLoRA + DPO技术在Qwen2.5-7B基础上微调密码领域垂直模型,使用5000+密码行业问答对进行SFT训练,领域评测准确率从52%提升至87%。 基于Spring Cloud/Alibaba微服务架构,使用Activiti7 + MongoDB动态表单实现低代码流程编排,MinIO支持大文件断点续传,Redis多级缓存优化热点数据,ElasticSearch实现全文检索与日志分析,AOP切面+国密SM2/SM3/SM4实现字段级自动加解密。

Spring Cloud/AlibabaLangGraphDeepAgentsRAG 2.0MCP协议MilvusBGE-M3/BGE RerankerLangChain/LlamaIndexvLLM/OllamaLoRA/QLoRA/DPO微调DeepSeek/Qwen/Claude/GPTActiviti7国密SM2/SM3/SM4MinIORedisElasticSearch

多模态 AI 内容创作平台

项目负责人,主导多模态AI内容创作平台的架构设计与核心功能研发,集成大语言模型、文生图模型、TTS语音合成、视频合成等多模态AI能力,面向新媒体内容创作者提供一站式AI创作解决方案。 基于LangChain构建小说推文视频全自动生成AI工作流:用户输入小说文案→大模型自动分镜脚本生成(场景描述+旁白文本+画面提示词)→Stable Diffusion XL + ControlNet生成高清连贯性分镜图片→百度TTS/Edge TTS合成情感化解说音频→FFmpeg/JavaCV自动添加字幕、转场特效、背景音乐,最终合成完整的竖屏短视频,整个流程无需人工干预,10分钟即可生成一条高质量推文视频,内容生产效率提升20倍。 设计AI Agent创作助手,基于Function Calling实现自然语言控制创作流程:用户用自然语言描述需求(如"帮我生成一个关于科幻题材的推文视频,风格偏电影感"),Agent自动完成模型选择、参数调整、素材生成、视频合成全流程。 基于Redis-Stream实现AI生成任务的异步排队与分布式调度,支持任务优先级、失败重试、进度实时推送,单节点支持50+并发SD文生图任务,任务成功率98%。 集成Dify可视化工作流编排能力,支持用户自定义创作模板、Prompt版本管理、模型参数配置,提供拖拽式AI工作流设计界面。 基于Vue3 + UniApp实现Web端与微信小程序跨端统一,SpringBoot后端提供RESTful API,使用MongoDB存储用户创作项目与素材,MinIO存储生成的图片、音频、视频文件。

SpringBootLangChainStable Diffusion XLControlNetTTS语音合成FFmpeg/JavaCVRedis-StreamDifyFunction CallingVue3UniAppMongoDBMinIO

国家科技管理信息系统监督平台(AI辅助评审)

核心开发工程师,基于SpringBoot + ElasticSearch构建国家级科研大数据监督平台,支撑科技监督、评估评价、科研诚信、项目评审等国家级核心业务,服务全国数万科研人员。 设计并实现分布式科研数据采集与整合系统:基于WebMagic + Selenium动态抓取知网、万方、Web of Science、PubMed等海量学术期刊论文、专利、项目数据,集成RabbitMQ异步消息队列解耦数据采集/清洗/入库流程,FastDFS存储PDF原文与附件,累计整合千万级学术数据。 探索AI辅助科研评审场景:基于RAG技术构建科研项目评审知识库,利用多模态大模型实现:①论文与申请书自动摘要与创新点提取;②科研成果相似性检测与学术不端初筛;③基于评审标准的申请书符合性自动检查;④辅助评审专家生成初评意见,评审效率提升40%。 基于AOP+非对称加密(RSA/SM2)封装自动加解密注解,实现科研敏感数据传输存储全链路安全;基于ElasticSearch构建多维度科研人员画像与学术关系图谱,支持学科领域、个人经历、学术任职、成果产出、合作关系等多维度检索与可视化分析。 开发项目申报、评审专家管理、会议评审、结果公示等核心业务模块,对接国家科技管理信息系统公共服务平台实现数据互通共享。

SpringBootElasticSearchRabbitMQWebMagicFastDFSRAG多模态大模型学术数据采集数据可视化AOP数据加密

OA 系统 AI 智能化升级

核心开发工程师,主导传统OA系统的智能化升级改造,涵盖统一身份认证升级与AI智能办公助手两大模块。 扫码登录模块:基于OpenResty + Lua开发OA反向代理服务器,拦截传统SSLVPN双次口令认证流程并改造为扫码登录,使用Redis存储二维码状态与用户认证会话,实现PC端扫码、手机端确认的安全便捷登录体验,登录成功率99.9%,用户体验大幅提升。 AI智能审批助手:基于LangGraph构建审批Agent,集成RAG技术加载单位规章制度、审批历史案例库,实现:①审批申请内容智能解析与必填项校验;②基于历史数据与规则的审批合规性自动检查与风险预警;③为审批人提供审批建议与参考意见;④常见审批问题智能问答。审批流转效率提升35%,退单率降低50%。 AI办公助手集成:基于MCP协议将OA系统的请假、报销、用印、公告、日程等20+功能封装为AI工具,用户通过自然语言即可完成办公操作(如"帮我查一下我这周的待办审批"、"帮我提交一个明天的请假申请"),打造对话式AI办公体验。

OpenRestyLuaRedis扫码认证LangGraphRAGMCP协议AI Agent智能审批对话式办公

核心优势Custom

  • AI全栈架构能力:具备「大模型应用层+AI Agent编排+模型微调和部署+后端微服务+前端桌面端」全栈技术能力,能够独立完成从0到1的AI产品研发落地
  • 大模型工程化实战经验:深入掌握RAG 2.0混合检索、Multi-Agent多智能体协同、MCP协议工具生态、LoRA/QLoRA模型微调、vLLM高性能推理等核心技术,有国家级AI平台落地经验
  • 独立产品创业经历:具备产品思维与商业化能力,独立开发并商业化运营2款AI Native桌面产品(追焦智修/猎影播放器),从产品设计、技术研发到用户运营全链路操盘
  • 全栈技术广度:精通Java/Python/Go/JS/TS多语言后端,熟悉Spring Cloud微服务、Vue3/React/Electron前端、MySQL/Redis/MongoDB/ES/Milvus全栈数据存储方案
  • 持续学习能力:紧跟AI技术前沿,快速落地DeepAgents、MCP协议、RAG 2.0等最新技术栈,具备将前沿AI技术转化为实际业务价值的能力

教育背景Education

  1. 2019.09 - 2022.06

    计算机应用技术 · 专科

个人亮点Custom

  • 7年全栈开发经验,3年AI方向深耕,从传统Java后端到AI全栈架构师的完整成长路径
  • 拥有独立产品商业化经验,付费产品用户5000+,具备技术+产品+商业的复合能力
  • 熟悉密码行业合规业务与国家级科研数据平台建设,有ToG/ToB大型项目经验
  • 个人技术博客持续输出AI工程化实践文章,GitHub有多个开源AI工具项目
  • 可接受AI全栈工程师、大模型应用工程师、AI Agent开发工程师、AI架构师等岗位