顺德韭菜星
码龄9年
求更新 关注
提问 私信
  • 博客:1,190,468
    1,190,468
    总访问量
  • 4,484
    原创
  • 820
    排名
  • 36
    粉丝
  • 2,000
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:安徽省
加入CSDN时间: 2017-05-06

个人简介:以解决疑难杂症为乐。具备敏锐的数据分析能力与逻辑思维,擅长从海量数据中发现规律,解决业务痛点。

博客简介:

weixin_29050271的博客

查看详细资料
个人成就
  • 获得15,131次点赞
  • 内容获得0次评论
  • 获得20,980次收藏
  • 代码片获得370次分享
创作历程
  • 4412篇
    2026年
  • 1篇
    2025年
  • 3篇
    2024年
  • 137篇
    2021年
  • 18篇
    2020年
成就勋章
创作活动更多

【多重好礼】鸿蒙心迹 · 开发录原创征稿活动

鸿蒙开发者的实战经验,值得被记录。从踩坑排查到项目复盘,从工具脚本到学习笔记,每一段真实的开发经历,都是社区最宝贵的技术资产。「鸿蒙心迹 · 开发录」正式启航,不限主题、随时可写,只要是鸿蒙开发相关的真实经验都欢迎投稿。 本活动为 [HarmonyOS 7.0 创新内容共创季](https://builderx.csdn.net/activity-site/harmonyos/activity2026)双轨征文之一,与[「共创季 · 稿事节」](https://harmonyosdev.csdn.net/6a97f0de2b83d06f0ecadec5.html)深度征文互补——「稿事节」写深度技术长文,「开发录」写日常开发实战笔记。 「开发录」每月一期,12月截止,本季共三期,投稿即有机会获得京东卡、CSDN博客流量券、亿万Token、社区定制周边好礼!

126人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

hindsight 项目实战:基于 MCP 与 Docker 构建 Agent 长期记忆系统

在 LLM 应用开发中,Agent 记忆机制是实现长期陪伴型助手的关键技术。其核心原理是通过分层存储与向量检索,将对话历史压缩为可检索的事实库,并利用 MCP 协议将记忆服务标准化封装,使 Agent 能主动调用。Docker 则解决了向量数据库等依赖的环境隔离与部署问题。该方案适用于需要跨会话保持上下文的场景,如智能客服、个人助理等。hindsight 项目正是这一思路的完整实践,结合 MCP 与 Docker 提供了可复用的 Agent 记忆架构。
原创
博文更新于 9 小时前 ·
58 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

Model-Optimizer:模型交付前的工程化优化阶段

模型优化并非单一工具或算法,而是AI模型从训练完成走向生产部署的关键工程阶段。其核心原理在于通过结构剪枝、知识蒸馏、量化感知训练(QAT)和推理引擎编译四步闭环,协同满足硬件适配、性能达标与运维可控三大刚性约束。技术价值体现在降低推理延迟、压缩显存占用、保障跨平台一致性,广泛应用于边缘智能、金融风控、工业质检等对实时性与稳定性要求严苛的场景。本文聚焦Model-Optimizer阶段的本质定义、不可绕过的技术动作顺序及硬件差异带来的策略重构,深入解析剪枝与QAT在实际落地中的关键作用与典型误用。
原创
博文更新于 9 小时前 ·
70 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

AI Agent鲁棒性提升:用PID/ADRC实现动态闭环控制

AI Agent作为实时闭环系统,其稳定性远不止依赖大模型能力,更取决于对环境扰动(如API延迟、输入噪声、工具失败)的动态响应能力。控制论中的PID与自抗扰控制(ADRC)提供了一套成熟、轻量、可工程落地的反馈调节范式——通过持续观测执行偏差、估计未知扰动、实时调节LLM温度、重试策略等运行参数,显著提升任务成功率、压缩响应波动、增强决策一致性。该方法不改变Agent认知逻辑,而是为其注入‘肌肉反射级’的底层韧性,已在客服、风控、供应链等真实业务场景中验证有效性。本文聚焦AI Agent调度层的控制论重构
原创
博文更新于 9 小时前 ·
47 阅读 ·
2 点赞 ·
0 评论 ·
3 收藏

模型优化器实战:从量化剪枝到部署的完整指南

模型优化器是深度学习工程中平衡精度、速度与显存的关键技术。其核心原理是通过量化、剪枝与算子融合等手段,在保持模型精度的前提下压缩模型体积并提升推理效率。技术价值在于显著降低部署成本,使大模型能在边缘设备或低功耗硬件上运行。典型应用场景包括计算机视觉中的图像分类、目标检测,以及自然语言处理中的BERT等模型部署。量化作为性价比最高的方案,通过训练后量化或量化感知训练实现INT8推理,配合校准集与敏感层保护策略,可有效控制精度损失。剪枝则针对参数冗余,结合结构化与非结构化方法优化模型结构。这些技术共同构成了模型
原创
博文更新于 9 小时前 ·
57 阅读 ·
1 点赞 ·
0 评论 ·
4 收藏

从零搭建AI工程链路:告别调包,掌握核心机制

AI应用开发中,模型推理与工程部署常被混淆。理解数据管道、批处理调度、服务封装等基础工程原理,是保障线上稳定性的关键。通过分片缓存、动态批处理与超时控制,可显著提升吞吐并降低延迟。这些技术广泛应用于文本分类、图像识别等在线推理场景。本文以文本分类服务为例,完整演示从数据层到观测层的最小可用AI工程链路搭建过程,帮助开发者建立对推理调度与性能调优的掌控感。
原创
博文更新于 9 小时前 ·
66 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

模型优化器实战:从3秒到300毫秒的推理加速与量化剪枝指南

模型优化器是一类在保持精度前提下提升推理速度、降低内存占用的工具框架。其原理涵盖计算图重写、数值精度压缩、结构化剪枝及内存调度优化,通过算子融合、INT8量化、通道剪枝等手段,显著降低延迟与功耗。技术价值在于让大模型适配云端高吞吐、端侧低功耗等多元场景。例如在视频理解任务中,结合图优化、剪枝与混合量化,可将推理时间从3秒压缩至300毫秒,精度损失仅0.7%。本文基于实际项目经验,系统拆解模型优化器的核心手段、选型策略与踩坑记录,助你实现从“能跑通”到“跑得好”的跨越。
原创
博文更新于 9 小时前 ·
167 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

模型优化四步法:压缩-编译-调度-验证实战指南

模型优化是将训练完成的深度学习模型适配真实硬件的关键工程环节,其本质是在精度约束下系统性降低计算开销、内存占用与推理延迟。核心原理涵盖结构级压缩(如通道剪枝、知识蒸馏)、算子级编译(如TensorRT层融合与自动调优)、运行时调度(如内存复用与异步流)及闭环验证(精度/延迟/功耗联合压测)。该技术路径不仅支撑边缘部署、端侧AI和嵌入式落地,更直接决定模型能否在Jetson、车载芯片或手机等资源受限设备上稳定运行。本文聚焦Model-Optimizer这一工业级实践范式,结合YOLOv5s在Jetson AG
原创
博文更新于 9 小时前 ·
176 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

Model-Optimizer:面向GPU推理交付的工程方法论

模型优化不是调用quantize()或trtexec的简单操作,而是覆盖编译器、硬件微架构、内存拓扑与调度策略的协同决策过程。其本质是构建可复现、可审计、可迁移的优化决策日志系统,以支撑低延迟、高吞吐、小显存等确定性SLA目标。关键技术价值在于将‘模型→engine’转换升维为包含硬件画像、归因分析与降级预案的全链路工程闭环。典型应用场景包括TensorRT-LLM的指令级静态编译、vLLM的运行时动态调度,以及驱动-CUDA-TensorRT三角兼容性治理。本文深入解析从PyTorch checkpoin
原创
博文更新于 9 小时前 ·
127 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

YOLOv11多摄像头协同追踪与异常检测实战指南

目标跟踪是计算机视觉在安防、交通等场景落地的核心技术,其本质是结合检测、特征提取与时空建模的系统工程。传统单摄像头跟踪易受遮挡、尺度变化和光照干扰影响,而多摄像头协同追踪通过跨视角轨迹关联与运动一致性约束,显著提升ID稳定性与场景覆盖能力。YOLO系列因推理高效、部署灵活成为边缘端主流检测基座,但标准版本缺乏对多源视频同步、轻量ReID替代、小目标增强及边缘适配的深度优化。本文聚焦真实园区安防需求,详解基于YOLOv11定制化架构的协同追踪方案——涵盖动态ROI输入、HCANet特征融合、CrossCamT
原创
博文更新于 9 小时前 ·
50 阅读 ·
2 点赞 ·
0 评论 ·
1 收藏

AI工程实战:从零搭建模型服务的完整闭环

AI工程与算法科研不同,它关注的是如何让模型在真实业务场景中稳定运行。一个可落地的AI系统,不仅需要模型训练,更依赖数据管线、服务化封装、性能监控与持续迭代等工程能力。以中文情感分类任务为例,从数据清洗、预训练模型微调,到基于FastAPI封装推理接口,再到应对数据漂移和版本回滚,完整展示了AI应用从Notebook走向生产环境的关键路径。掌握这些工程化方法,能有效缩短从实验原型到线上服务的距离,适用于智能客服、内容审核、舆情分析等业务场景。一条从零开始的AI工程路线图,能帮助开发者避开常见坑点,建立起系统
原创
博文更新于 9 小时前 ·
115 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

DeepSeek领域适配全流程:从PDF解析到Adapter-Mixing实战

大语言模型领域适配本质是让通用基座理解垂直行业语义结构。其核心原理在于数据、模型、训练三要素的协同重构:高质量领域语料需突破PDF解析失真、语义去重失效、增强逻辑断裂等瓶颈;微调阶段必须超越LoRA等通用方法,转向适配DeepSeek架构特性的Adapter-Mixing动态路由与分层插入;技术价值体现在显著提升上线稳定性与领域推理精度,避免测试集高分、线上高错的工程陷阱。典型应用场景覆盖金融财报解析、医疗实体推理、法律条文关联等强结构化任务。本文聚焦DeepSeek-v2系列在真实业务中跑通的55个关键节
原创
博文更新于 9 小时前 ·
202 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

给Dify Agent装上Hindsight:事后反思纠错回路实操指南

事后反思(Hindsight)最初源于强化学习中的经验回放机制,目的是让智能体从失败轨迹中学习修正信号。在LLM Agent应用中,这一思想转化为对输出结果的评估与重试回路,显著提升任务成功率。将这一机制落地到Dify这类可视化工作流平台,可以低成本实现Agent的自我纠错:通过代码节点做硬性格式校验,再用独立LLM评估语义质量,失败后触发反思修改节点重试。针对JSON输出、工具调用等高频错误场景,设计合理的重试次数与上下文压缩策略,能让Agent生产可用度大幅提升。本文结合真实改造案例,给出一套可在Dif
原创
博文更新于 10 小时前 ·
104 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

全景拼接核心:特征匹配质量决定结果上限的优化策略

在计算机视觉与图像处理领域,图像拼接是连接多视角场景到全景图的关键技术,其本质是几何配准与像素融合的协同过程。而特征匹配作为拼接链路的第一步,直接决定了后续单应矩阵估计与图像对齐的精度。SIFT、ORB等特征算法通过提取尺度不变的关键点与描述子,实现跨图像对应点查找,但真实场景中的纹理稀疏、重复结构、光照变化等问题极易导致误匹配,进而引发重影与错位。工程实践中,需结合最近邻距离比、RANSAC鲁棒估计、光束平差全局优化以及多频段融合等方法,从源头提升匹配质量。该技术广泛应用于无人机航拍、街景重建、VR内容制
原创
博文更新于 10 小时前 ·
58 阅读 ·
2 点赞 ·
0 评论 ·
3 收藏

YOLOv9+Flask构建目标检测Web应用全流程实战

目标检测模型训练完成后,如何将权重文件转化为可交互的服务,是工程落地的关键一步。YOLOv9凭借可编程梯度信息(PGI)与GELAN结构,在精度和模型体积之间取得平衡,成为高效的目标检测选择;Flask作为轻量级Web框架,能够将模型推理快速封装成HTTP接口,实现浏览器上传图片、后端实时返回目标框与置信度的完整流程。这种组合适合快速搭建演示系统、内部工具或毕业设计,也适用于需要轻量部署的算法服务场景。从环境配置、推理模块封装、前后端绑定到参数调优与常见故障排查,本文围绕YOLOv9+Flask的Web应用
原创
博文更新于 10 小时前 ·
114 阅读 ·
3 点赞 ·
0 评论 ·
2 收藏

AI工程从零实战:构建可靠可交付系统的完整路线

AI工程常被误解为算法竞赛或API调用,实际上它是一整套确保系统稳定、可控、可迭代的工程方法论。从数据准备、模型训练到评估部署,每个环节都需要体系化的思维与工具支撑。理解数据闭环、掌握Docker与版本管理、建立监控日志,是AI工程师区别于调包侠的核心能力。无论是要构建RAG问答系统还是文本分类服务,端到端的项目实践都是最快成长路径。本文结合真实踩坑经验,拆解从零开始AI工程化的四个里程碑,帮你避开数据集泄漏、评估失真等常见陷阱,让模型真正从notebook走向生产环境。
原创
博文更新于 10 小时前 ·
66 阅读 ·
4 点赞 ·
0 评论 ·
3 收藏

企业级RAG管道设计:从知识获取到智能调度的工程实践

RAG(检索增强生成)是当前AI Agent实现可信推理与私域知识利用的核心技术范式,其本质是构建大模型与结构化/非结构化业务数据之间的语义桥梁。原理上,它通过检索层召回、重排层精筛、生成层约束三阶段协同,解决幻觉、时效、权限等落地瓶颈;技术价值在于无需微调大模型即可适配动态更新的企业知识库,显著降低合规风险与开发成本;典型应用于客服问答、合同审查、SOP执行等强业务耦合场景。本文聚焦RAG作为AI Agent‘知识获取管道’的工程化实现,深入解析PDF解析、语义切分、混合检索、角色感知重排及安全溯源等关键
原创
博文更新于 10 小时前 ·
36 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

Agnes AI接入实战:本地化代码理解层与VS Code深度集成指南

AI 编程助手正从泛化补全迈向深度代码理解,其核心在于将大模型能力嵌入IDE的AST解析与语义校验流程。Agnes AI并非传统LLM API调用,而是以可编程代码理解层(programmable code comprehension layer)形态存在,通过cc-switch协议路由、Claude Code插件封装和OpenCode沙箱环境协同工作,实现函数契约推断、框架感知补全与单元测试生成等工程级能力。这种架构显著提升类型安全、上下文一致性与团队规范适配性,适用于中大型前端/后端项目、内部AI基建选
原创
博文更新于 10 小时前 ·
206 阅读 ·
2 点赞 ·
0 评论 ·
3 收藏

多模态大模型落地实践:从表征统一到工程约束的深度解析

多模态大模型通过统一表征空间实现原生跨模态理解,其核心原理是将图像、文本等模态映射到同一维度进行注意力交互,从而支持端到端推理与零样本迁移。这一技术价值在于打破传统拼装架构的割裂性,使模型能动态回看图像细节并处理模态缺失。在应用场景上,文档语义解析、GUI自动化与视频时序推理等任务从“做不了”变为“能做”,但工程落地需直面token成本、推理延迟与隐蔽幻觉等现实约束。开发者技能栈随之迁移,提示工程、评估设计与数据策展成为关键能力。
原创
博文更新于 10 小时前 ·
57 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

OpenCV图像倾斜校正:VC++实现与避坑指南

在计算机视觉中,图像倾斜校正是OCR预处理的关键步骤,直接影响文字识别准确率。其原理是通过霍夫变换或最小外接矩形等算法检测图像倾斜角度,再利用仿射变换旋转图像实现校正。该技术能显著提升OCR识别率,广泛应用于票据识别、档案电子化等场景。OpenCV提供了完整的API支持,但在VC++环境下实现时,需注意角度符号、边界填充和性能优化等问题。本文深入探讨了基于OpenCV的倾斜校正技术,涵盖霍夫变换、最小外接矩形等算法,并提供了VC++代码示例和避坑指南,帮助开发者将校正精度稳定控制在±0.5度以内。
原创
博文更新于 10 小时前 ·
161 阅读 ·
3 点赞 ·
0 评论 ·
1 收藏

从手写循环到LangGraph:Agent状态图迁移实战与避坑指南

在构建AI Agent时,控制流管理与状态持久化是核心挑战。传统手写循环将业务逻辑与流程控制耦合,导致代码难以维护和扩展。LangGraph通过StateGraph抽象,将Agent执行流程建模为有向图,节点代表计算步骤,边定义流转规则,并借助reducer机制实现状态的自动合并与持久化。这种图结构不仅让控制流显式化,还原生支持条件路由、断点续跑和人工介入,显著提升复杂Agent的可观测性与可测试性。对于需要多轮工具调用、分支决策或状态记忆的场景,迁移到LangGraph能有效降低维护成本,并为多Agent
原创
博文更新于 10 小时前 ·
37 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏
加载更多