徐卓菲
码龄10年
求更新 关注
提问 私信
  • 博客:1,233,442
    视频:3
    1,233,445
    总访问量
  • 4,575
    原创
  • 743
    排名
  • 41
    粉丝
  • 2,000
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:甘肃省
加入CSDN时间: 2017-01-17

个人简介:懂工程的算法工程师。擅长 C++/CUDA 高性能编程,解决模型推理的高延迟与高资源占用问题。致力于实现算法的极致性能,降低业务成本。

博客简介:

weixin_29038303的博客

查看详细资料
个人成就
  • 获得15,438次点赞
  • 内容获得0次评论
  • 获得21,462次收藏
  • 代码片获得235次分享
创作历程
  • 4497篇
    2026年
  • 1篇
    2025年
  • 3篇
    2024年
  • 135篇
    2021年
  • 15篇
    2020年
成就勋章
创作活动更多

【多重好礼】鸿蒙心迹 · 开发录原创征稿活动

鸿蒙开发者的实战经验,值得被记录。从踩坑排查到项目复盘,从工具脚本到学习笔记,每一段真实的开发经历,都是社区最宝贵的技术资产。「鸿蒙心迹 · 开发录」正式启航,不限主题、随时可写,只要是鸿蒙开发相关的真实经验都欢迎投稿。 本活动为 [HarmonyOS 7.0 创新内容共创季](https://builderx.csdn.net/activity-site/harmonyos/activity2026)双轨征文之一,与[「共创季 · 稿事节」](https://harmonyosdev.csdn.net/6a97f0de2b83d06f0ecadec5.html)深度征文互补——「稿事节」写深度技术长文,「开发录」写日常开发实战笔记。 「开发录」每月一期,12月截止,本季共三期,投稿即有机会获得京东卡、CSDN博客流量券、亿万Token、社区定制周边好礼!

126人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

SAP计划策略40实战:带最终组装的预测消耗与MRP配置

生产计划的核心矛盾在于预测与客户订单的冲突:预测备货多了变呆滞库存,少了交不出货;按单生产交期又太长。SAP中的计划策略40(带最终组装的计划)是一种介于MTS与MTO之间的折中方案,它允许在成品层按预测排产,当真实订单进入后自动消耗预测,并通过MRP计算净需求,使计划量始终贴近实际需求。本文从预测消耗的基本原理出发,逐步讲解策略组的配置、物料主数据关键字段设置、MD61维护独立需求、MRP运行及销售订单消耗验证,并结合常见问题(如预测未消耗、计划时界失效、策略切换旧订单残留等)给出排查方法,可作为SAP
原创
博文更新于 5 小时前 ·
33 阅读 ·
1 点赞 ·
0 评论 ·
4 收藏

工业Agent实时控制是伪命题?解析毫秒级闭环与秒级优化的技术边界

工业自动化中,实时控制要求确定性响应,而大模型推理存在非确定性延迟,两者在时间尺度上存在数量级鸿沟。从传感器数据采集到PLC扫描周期,每一跳都可能引入抖动与失真,导致Agent难以满足硬实时与软实时的闭环控制需求。当前工业Agent的可行路径是聚焦准实时与非实时场景,如能耗优化、故障诊断辅助与排产建议,通过建议-验证-采纳闭环释放价值。厘清实时控制与优化建议的边界,是工业Agent落地的关键。
原创
博文更新于 5 小时前 ·
25 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

CIFAR-10图像分类实战:数据集解析与TensorFlow模型训练指南

图像分类是计算机视觉的基础任务,其核心挑战之一是如何高效处理数据并构建可靠的模型。在深度学习实践中,数据集的格式解析与预处理往往成为初学者入门的第一道门槛。CIFAR-10作为经典的小型图像数据集,包含10个类别共60000张32×32彩色图像,适合验证卷积神经网络(CNN)的算法效果。通过理解pickle数据格式、掌握数据切分与归一化、使用tf.data构建高效数据管道,配合适当的数据增强与学习率调整,可以快速训练出准确率超过80%的基线CNN模型。本文围绕CIFAR-10数据集的完整使用流程,从文件结构
原创
博文更新于 5 小时前 ·
40 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

AI Engineering从零构建:生产级AI系统底层工程实践

AI Engineering 是指将人工智能作为新型基础设施进行全生命周期设计、验证与运维的系统性工程范式,其核心在于突破模型调优层面,深入硬件协同、数据确定性、服务韧性与深度可观测性四大维度。它强调从Linux内核、CUDA编译、GPU显存管理到Flink水印机制、TensorRT熔断策略等底层细节的亲手验证,解决PyTorch benchmark误触发、Protobuf事件时间偏移、Tokenizer动态padding瓶颈等真实产线问题。该方法论支撑千万级日活AI服务稳定运行,广泛应用于金融风控、工业质
原创
博文更新于 5 小时前 ·
44 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

Superpowers实战:给AI编程助手装技能扩展层

AI编程助手正从“你说一句它做一步”的交互模式,转向“你说一个目标它走一套流程”的自主执行。要支撑这种协作方式,需要一套标准化的技能扩展层——用可复用的技能文件把工程师的调试、规划、审查等方法论固化为Agent的执行逻辑。这种机制不仅让Codex CLI、Claude Code等终端代理的产出质量更稳定,还能通过技能编排和自定义能力,将团队规范沉淀为Agent的默认行为。在涉及根因定位、回归测试、大规模重构等场景中,技能驱动的工作流能显著降低上下文遗忘和跳步操作的风险。围绕这套框架,真实项目完整演示了Sup
原创
博文更新于 5 小时前 ·
52 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

从零搭建AI工程能力:目录结构、数据管道与推理服务实战指南

AI工程化是将机器学习模型从实验环境推向生产系统的关键过程,其核心在于建立可复现、可监控、可迭代的工程体系。通过模块化目录结构、依赖锁定、数据版本控制与特征存储,保障训练与推理的一致性;借助实验追踪、模型注册和动态批处理推理服务,提升系统稳定性与资源效率。在推荐、搜索、风控等场景中,AI工程能力直接决定模型上线效率与业务效果。本文围绕从零搭建AI工程能力,拆解数据管道、模型训练、推理服务与监控迭代等环节的工程细节,提供可落地的目录结构与配置示例。
原创
博文更新于 5 小时前 ·
21 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

superpowers:给AI编码工具装上工程化工作流,让Codex稳定交付

大语言模型驱动的AI编码助手正在重塑软件开发流程,但在真实项目中,缺乏约束的AI常常出现计划外改动、风格漂移等问题。superpowers以工程化为核心,为Codex等终端AI编码工具提供了一套标准化工作流与技能包:通过PLAN/TASK状态文件拆分阶段任务,引入项目级上下文收集机制,并设计人机协作检查点,让AI从“偶然惊艳”变为“稳定交付”。这本质上是提示词工程在工程实践中的深化,将AI的不确定性约束在可控轨道内。适用于日常开发、Bug修复、代码审查、多模块项目协作等场景,帮助开发团队减少返工、提升效率,
原创
博文更新于 5 小时前 ·
41 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

Dify Agent 线上问题定位难?hindsight 链路回溯与重放系统实践

AI Agent 应用与传统软件最大的区别在于,其行为由模型推理驱动,线上出现错误答案时,往往难以判断是提示词、知识库召回还是工作流编排出了问题。可观测性设计因此成为 Agent 工程落地的关键环节,它要求系统能记录每一次模型调用、节点输入输出和配置环境。通过结构化事件追踪与链路重放,团队可以在测试环境复现历史执行过程,快速定位根因并验证修复效果。本文以 Dify 生态为例,介绍如何自建 hindsight 复盘系统,实现从事件采集、存储建模到差异对比的完整方案,为复杂 Agent 应用的线上运维与回归测试
原创
博文更新于 5 小时前 ·
52 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

Model-Optimizer实战:模型量化、剪枝与蒸馏的推理加速指南

模型推理优化是深度学习工程落地的关键环节,其核心在于平衡模型精度与推理成本。通过量化、剪枝、知识蒸馏及算子融合等技术,可显著降低模型内存占用与推理延迟。量化将FP32权重压缩至INT8甚至INT4,配合校准集与敏感度分析可控制精度损失;结构化剪枝直接移除计算单元,配合微调恢复精度;蒸馏则让小模型模仿大模型输出分布。这些技术广泛应用于云端服务、边缘设备及大模型部署场景,帮助算法工程师与MLOps团队构建标准化、可复现的模型优化流水线,实现从训练到部署的高效衔接。
原创
博文更新于 5 小时前 ·
53 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

Model-Optimizer实战:模型压缩与推理加速全解析

模型压缩与推理加速是深度学习部署的核心环节,其原理是通过量化、剪枝、算子融合等手段降低模型计算量和内存占用。量化将FP32权重映射为INT8,剪枝移除冗余通道,算子融合减少内核启动开销,这些技术能显著提升推理性能并降低部署成本。在计算机视觉、自然语言处理等场景中,合理运用模型优化工具链可实现在精度损失可控的前提下,将推理延迟降低数倍。Model-Optimizer作为面向推理部署的优化工具,通过系统化的流程编排和参数调优,帮助开发者跨越从实验室到生产环境的性能鸿沟。
原创
博文更新于 5 小时前 ·
53 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

DeepSeek多模态识别在建筑工地材料管控中的落地实践

多模态识别是实现建筑工地材料数字化管理的核心技术,其本质是融合视觉、语音、结构化数据与物理约束的联合建模。相比传统单模态CV方案(如YOLO),它能突破光照干扰、规格混淆与形变鲁棒性等工程瓶颈,显著提升钢筋型号识别、锈蚀等级判断等关键任务准确率。该技术的价值在于将‘哑材料’转化为带时空坐标、批次号与置信度的结构化数字实体,支撑实时库存快照与动态采购计划生成。典型应用场景包括总包项目部的账实不符治理、EPC模式下的BIM深度应用,以及基于12类约束的整数规划求解。DeepSeek-R1凭借建筑业词表、跨模态对
原创
博文更新于 5 小时前 ·
56 阅读 ·
1 点赞 ·
0 评论 ·
1 收藏

基于YOLOv11的教师教学行为检测系统全链路实战

目标检测是计算机视觉的核心技术,通过边界框定位与分类实现场景理解。YOLOv11作为最新一代实时检测算法,在特征融合与遮挡处理上显著提升,尤其适合小目标和复杂场景。在教育领域,教师行为检测成为智慧校园的关键应用,通过识别板书、讲授、巡视等行为,量化教学互动与课堂节奏。基于YOLOv11构建的检测系统,覆盖数据标注、模型训练、推理优化到边缘部署全流程,结合行为平滑与时长统计,输出可视化分析报告,助力教学评估与反思。
原创
博文更新于 6 小时前 ·
33 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

智能体落地最后一公里:从算力选型到评测闭环的工程化实战清单

大模型推理与智能体编排正从概念验证走向工程化落地,但工具调用失败、上下文管理混乱、评测缺失等问题让多数项目卡在最后一公里。核心原因在于智能体不是单一模型,而是一套需要算力底座、工具接口、评测闭环与部署形态协同的工程系统。边缘NPU推理可满足高频短交互的低延迟需求,而云端集群更适合低频长推理场景;工具接口的清晰描述与参数约束直接决定智能体能否正确调用API。通过分层架构、自动化评测与灰度发布,开发者可将智能体从Demo推进到生产环境,实现可观测、可回滚、可规模化的业务价值。
原创
博文更新于 6 小时前 ·
25 阅读 ·
2 点赞 ·
0 评论 ·
3 收藏

RIFE中间流估计原理与4K实时插帧工程实践

视频插帧是提升视觉流畅度的基础技术,其核心在于光流建模与运动预测。传统方法依赖全量光流计算,面临高显存占用与长延迟瓶颈;而RIFE通过引入中间流估计机制,在双分支架构下实现残差式光流精细化修正,兼顾精度与效率。该设计融合物理约束(如光流可逆性、时间编码)、多尺度一致性及运动先验学习,显著提升4K场景下的亚像素运动建模能力。在安防监控、智能交通、工业检测等对实时性与稳定性要求严苛的领域,RIFE需结合色彩空间适配、运动强度感知与时序一致性微调等场景化工程手段,方能达成端到端37ms延迟、94%以上伪影抑制率等
原创
博文更新于 6 小时前 ·
67 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

Model-Optimizer:从量化剪枝到蒸馏的模型压缩工程化指南

深度学习模型在部署到生产环境前,往往面临体积大、推理慢、精度敏感等挑战。模型压缩作为解决这些问题的关键技术,主要通过量化、剪枝和知识蒸馏等手段,在保持模型性能的同时降低计算开销。量化通过将FP32权重转为INT8减少存储与加速推理,剪枝则剔除冗余通道,蒸馏利用大模型指导小模型学习。这些技术的工程化落地,不仅需要理解其原理,还需构建包含模型体检、方案自动搜索、效果评估的完整闭环。本文以Model-Optimizer为例,介绍如何将量化、剪枝、蒸馏等优化手段封装为可配置流水线,实现模型上线前的自动化瘦身与性能评
原创
博文更新于 6 小时前 ·
45 阅读 ·
3 点赞 ·
0 评论 ·
1 收藏

AI Agent 知识获取管道:RAG 检索增强生成实战与避坑指南

检索增强生成(RAG)通过检索外部知识并注入提示词,解决大模型私有知识缺失与幻觉问题。其原理是结合向量检索与生成模型,技术价值在于低成本更新知识、可溯源、避免灾难性遗忘。在 AI Agent 开发中,RAG 管道用于企业知识库问答、文档助手等场景。TypeScript 生态下可选用 LangChain.js 或自研管道,核心环节包括文档解析、文本分块、向量化、检索与重排序。本文深入拆解 RAG 管道设计与实操要点,助你搭建可用的知识获取管道。
原创
博文更新于 6 小时前 ·
60 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

RAG、Agent、MCP实战:大模型应用开发核心概念与代码实现

在大模型应用开发中,RAG知识库、Agent智能体与MCP协议是绕不开的三个核心概念。RAG通过检索增强生成解决模型私有知识缺失与事实幻觉问题,Agent利用函数调用让模型具备任务规划与工具执行能力,而MCP则提供了一套标准化接口协议,统一外部工具的接入方式。三者互补组合,构成了现代AI应用的常见技术底座。理解数据如何切分向量化、工具如何被发现调用、接口如何标准化,是快速上手工程实践的关键路径。本文从基础概念出发,结合环境搭建与可运行代码,提供了一条从零到一的系统化学习路线,覆盖流式输出、知识库检索、工具调
原创
博文更新于 6 小时前 ·
29 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

RAG检索增强生成实战:为企业知识库搭建可靠问答Agent

大模型在专业领域问答中常因知识缺失产生“幻觉”,尤其在企业内部知识库场景,模型对私有文档一无所知却强行作答,可靠性堪忧。检索增强生成(RAG)通过为模型外挂可检索知识库,将问题检索、证据增强与答案生成组合成一套完整管道,让每次回答都基于真实文档片段,从根本上提升可信度。相比微调与超长上下文,RAG在成本、时效和可控性上更具优势。该技术已广泛应用于企业知识库问答、智能客服、内部文档检索等场景。本文围绕RAG展开,从文档切分、向量检索到提示词构造,结合LangChain实战,系统拆解检索增强生成的完整链路,为构
原创
博文更新于 6 小时前 ·
46 阅读 ·
1 点赞 ·
0 评论 ·
0 收藏

WorkBuddy+腾讯乐享:构建业务场景驱动的智能知识协作者

知识管理正从静态检索迈向动态协同,核心在于将知识嵌入真实业务动作发生的‘零点时刻’。基于Agent架构与企业协作平台深度集成,实现知识调用与业务事件(如消息发送、流程触发、文档更新)的实时耦合,显著降低认知摩擦。WorkBuddy提供意图理解与执行编排能力,腾讯乐享承载真实业务语境与结构化数据,二者结合支撑可解释、可追溯、可降级的智能辅助——适用于销售线索分级、客服情绪预判、项目进度校验等高价值场景,让知识真正成为一线员工的‘工位协作者’而非待查档案。
原创
博文更新于 6 小时前 ·
54 阅读 ·
1 点赞 ·
0 评论 ·
1 收藏

分布式AI系统实战:并行策略、通信优化与故障排查全解析

分布式训练是构建大规模AI模型的核心手段,但多卡协同的复杂度往往成为工程瓶颈。理解数据并行、张量并行、流水线并行等并行策略的适用场景,掌握集合通信如NCCL AllReduce的底层原理,是优化分布式系统性能的基石。通过合理选择并行度、估算通信量并配置集群拓扑,可显著提升训练吞吐。在大模型训练中,针对梯度同步、大Batch学习率缩放、断点续训等实践问题,需要系统的故障排查方法。从系统架构视角出发,深入剖析分布式训练中的关键机制与常见坑点,为工程师提供可落地的工程参考。
原创
博文更新于 6 小时前 ·
59 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏
加载更多