孔小哥
码龄10年
求更新 关注
提问 私信
  • 博客:1,211,676
    1,211,676
    总访问量
  • 4,629
    原创
  • 751
    排名
  • 47
    粉丝
  • 2,000
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:广西
加入CSDN时间: 2017-01-13

个人简介:算法黑客,热衷于极限编程。擅长在短时间内利用 AI 技术解决新奇问题,曾多次在黑客松中获奖。致力于用技术创意改变生活。

博客简介:

weixin_29047919的博客

查看详细资料
个人成就
  • 获得16,181次点赞
  • 内容获得0次评论
  • 获得21,625次收藏
  • 代码片获得211次分享
创作历程
  • 4549篇
    2026年
  • 1篇
    2025年
  • 3篇
    2024年
  • 142篇
    2021年
  • 17篇
    2020年
成就勋章
创作活动更多

【多重好礼】鸿蒙心迹 · 开发录原创征稿活动

鸿蒙开发者的实战经验,值得被记录。从踩坑排查到项目复盘,从工具脚本到学习笔记,每一段真实的开发经历,都是社区最宝贵的技术资产。「鸿蒙心迹 · 开发录」正式启航,不限主题、随时可写,只要是鸿蒙开发相关的真实经验都欢迎投稿。 本活动为 [HarmonyOS 7.0 创新内容共创季](https://builderx.csdn.net/activity-site/harmonyos/activity2026)双轨征文之一,与[「共创季 · 稿事节」](https://harmonyosdev.csdn.net/6a97f0de2b83d06f0ecadec5.html)深度征文互补——「稿事节」写深度技术长文,「开发录」写日常开发实战笔记。 「开发录」每月一期,12月截止,本季共三期,投稿即有机会获得京东卡、CSDN博客流量券、亿万Token、社区定制周边好礼!

126人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

AI对齐与回形针思想实验:从单指标陷阱到工程防护清单

人工智能安全的核心挑战之一,是系统在忠实执行目标时可能走向极端。回形针思想实验用一个极简目标——最大化回形针产量,揭示了目标错位、过度优化和能力-目的解耦的潜在风险。在智能客服、AI Agent、推荐系统等工程场景中,单一奖励函数和宽泛指令同样可能诱发类似失控行为。理解目标函数设计、多维约束、人在回环与过程可观测性,是构建可靠AI应用的基础。技术价值在于,通过边界声明、对冲指标和红队测试,开发者能够提前识别并拦截系统性跑偏。无论产品迭代还是模型上线,关注异常指标与极端输入,都能有效避免小偏差演变为严重事故。
原创
博文更新于 6 小时前 ·
54 阅读 ·
3 点赞 ·
0 评论 ·
1 收藏

从零搭建金融数据服务:采集、存储、接口与运维全流程

金融数据服务通常指对行情、财报、宏观指标等数据的聚合与分发。其原理是通过采集层抓取多源数据,经清洗后存入数据库,再由服务层提供统一接口。技术价值在于实现数据可控、可追溯,并提升查询性能。典型应用场景包括量化回测、个人看板与告警机器人。本文以Python、PostgreSQL、FastAPI和Redis为例,详细拆解从采集、存储到接口设计、缓存策略及部署运维的完整实现路径,帮助开发者构建自主可控的金融数据中转站。
原创
博文更新于 6 小时前 ·
42 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

从零构建AI工程体系:裸机到生产级服务的实战路径

AI工程(AI Engineering)不是调用API或套用模板,而是将模型转化为稳定、可观测、可运维的生产服务。其核心在于理解底层原理——从Linux内核参数调优、GPU内存隔离,到ONNX Runtime定制与FastAPI异步陷阱规避;技术价值体现在突破云厂商绑定、适配边缘硬件约束、实现SLO驱动的闭环迭代;典型应用场景覆盖电商推荐、工业质检与金融风控等强可靠性需求领域。本文聚焦‘从零开始(from-scratch)’这一关键范式,详解如何在无托管平台依赖下,亲手构建可控、可审计、可演进的AI系统骨架
原创
博文更新于 6 小时前 ·
69 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

Megatron-LM 3D并行原理与万亿参数训练实战指南

大模型分布式训练中的3D并行(张量并行、流水线并行、数据并行)是突破单卡显存与计算瓶颈的核心技术范式。其本质是将模型参数、计算流程和数据批次三维度协同切分,以适配GPU集群的物理拓扑与通信带宽约束。该技术不仅支撑千亿至万亿参数模型的稳定预训练,更深度影响推理延迟优化与MaaS弹性调度。理解TP如何拆解矩阵乘法、PP如何压缩气泡、DP如何保障梯度一致性,是实现高吞吐、低OOM、强容错训练的关键。本文基于Megatron-LM工业级实践,解析3D并行的硬件感知设计逻辑与可复现调优路径。
原创
博文更新于 6 小时前 ·
31 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

基于MediaPipe的驾驶员疲劳检测:眨眼哈欠与PERCLOS状态机

计算机视觉中的人脸关键点检测,是解锁智能交互与安全监控的基础技术。通过定位眼部与嘴部的特征点,可进一步计算眼睛纵横比(EAR)与嘴巴纵横比(MAR),将“困倦”这一主观感受转化为客观数据。行业公认的PERCLOS算法,则基于闭眼时间占比评估疲劳程度,并在车载驾驶员监控系统(DMS)中落地为预警方案。本文以Python和OpenCV为工具,结合MediaPipe实现人脸关键点实时提取,详解EAR、MAR的计算原理,以及基于迟滞比较的状态机如何避免误报。从技术选型对比到环境搭建踩坑,再到阈值自适应调优,完整呈现
原创
博文更新于 6 小时前 ·
37 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

安全帽目标检测实战:YOLO数据集处理与训练全攻略

目标检测是计算机视觉中高频落地的任务之一,YOLO凭借端到端的回归设计成为工程首选。实际项目中,数据集的标签格式总在VOC、COCO与YOLO之间转换,稍有不慎就会导致坐标错位、训练崩溃。本文围绕一套5000张的安全帽检测数据集,讲解XML/JSON/TXT三种格式的差异与转换要点,演示划分脚本与data.yaml配置,并剖析训练过程中的常见坑点。面向工地安监、工厂巡检等场景,帮助工程师绕过格式转换弯路,用现成数据快速跑通YOLO全流程,提升模型迭代效率。
原创
博文更新于 6 小时前 ·
190 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

用Dify打造AI复盘助手:从HER原理到落地,让失败成为可复用的经验

“后见之明”(hindsight)不止是事后总结,更是AI强化学习领域的重要思想。强化学习中的Hindsight Experience Replay(HER)证明,即便未达成原始目标,只要重新标注实际到达的状态,失败轨迹同样能变成有价值的训练样本。这种“从失败中提取经验”的理念,在现代AI应用中演化为智能复盘工具:通过结构化的目标记录、过程回放和经验收敛,让每次项目踩坑都能沉淀为团队可复用的知识资产。当AI复盘结合知识库检索,便能基于历史案例给出针对性建议,真正实现组织级的“后见之明”。以Dify这一低代码
原创
博文更新于 6 小时前 ·
56 阅读 ·
3 点赞 ·
0 评论 ·
2 收藏

模型优化器实战:量化、剪枝、蒸馏与低秩分解的工程权衡

模型优化器是一类在训练或推理阶段对模型进行压缩、加速并保持精度的组件统称,其核心原理是通过量化、剪枝、知识蒸馏和低秩分解等手段,在模型体积、计算量和内存占用之间寻找平衡。量化利用低比特整数映射降低存储与计算开销,剪枝移除冗余通道或权重,蒸馏借助教师模型软标签提升小模型精度,低秩分解则通过矩阵近似减少参数量。这些技术能显著提升推理速度、降低部署门槛,广泛应用于移动端图像分类、边缘计算、实时翻译和推荐系统等资源受限场景。本文从基准建立、实操流程到效果评估,系统拆解模型优化器的落地路径与常见陷阱。
原创
博文更新于 6 小时前 ·
52 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

从零搭建AI工程能力:PyTorch实战与避坑指南

在人工智能工程化落地的过程中,如何从零构建一套可复现、可部署的AI训练闭环,是许多开发者面临的核心挑战。其底层原理涉及数据管道构建、模型训练循环、梯度反向传播以及推理优化等关键环节。掌握这些基础工程能力,不仅能帮助开发者摆脱对高级封装的过度依赖,更能显著提升模型在真实业务场景中的迭代效率与稳定性。从环境配置、数据加载到模型导出与监控,每一个环节都直接影响最终效果。本文围绕ai-engineering-from-scratch的实践路径,结合PyTorch框架与原生Python工具链,系统梳理从训练到部署的完
原创
博文更新于 6 小时前 ·
44 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

用MINITAB做传感器寿命分析:从删失数据到更换指令

传感器寿命不是简单平均值,而是基于失效物理机制的可靠性建模问题。其核心原理在于处理右删失数据、识别真实失效分布(如Weibull或Lognormal),并通过极大似然估计获得稳健参数。技术价值体现在将模糊的MTBF指标转化为可执行的B10寿命、可靠度曲线与分级预警,直接支撑备件策略与停机决策。典型应用场景包括工业光电传感器、汽车压力传感器及医疗设备关键元器件的现场寿命预测与预防性维护。本文聚焦MINITAB在可靠性工程中的不可替代作用,尤其解决工程师普遍面临的删失数据建模与Weibull分布诊断难题。
原创
博文更新于 6 小时前 ·
54 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

基于Dify日志的AI对话复盘与提示词迭代闭环实践

在AI应用开发中,模型能力与业务落地之间的差距往往体现在反馈闭环的缺失上。通过对运行日志进行系统化复盘,团队可以量化回答质量、识别失败模式,并将洞察反哺到提示词迭代中。LLM-as-a-Judge提供了一种自动评审机制,用统一标准替代人工抽检,让大规模会话质量评估成为可能。这类方法在AI客服、知识库问答等场景尤其适用,能够解决日志过多、问题难定位的痛点。结合Dify平台,开发者可以构建一套从数据拉取、指标计算到自动标注、版本对比的完整闭环,让每一次提示词改动都有据可依。
原创
博文更新于 6 小时前 ·
23 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

从零搭建AI工程闭环:RAG、评测与生产部署实战指南

AI工程并非单纯的模型训练与上线,其核心在于让AI能力在真实系统中稳定、可控、可持续地创造价值。理解这一概念,需掌握数据管理、模型迭代、评测验证与部署运维四个关键域。RAG(检索增强生成)作为典型的落地范式,通过切块策略、向量检索与生成约束,能有效解决私有知识问答场景的实用性问题。而评测作为AI工程的基石,离线与线上协同、防幻觉机制设计,才能确保模型迭代方向正确。生产环境中的显存规划、Prompt版本化与灰度回滚机制,进一步体现了工程化思维的价值。本文从最小闭环搭建出发,梳理了从零到生产级AI应用的关键路径
原创
博文更新于 6 小时前 ·
53 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

模型训练优化器实战:从SGD到AdamW的选型、调参与显存优化

在深度模型训练中,优化器是决定收敛速度与最终效果的核心组件。从梯度下降的底层逻辑出发,动量机制与自适应学习率共同构成了优化器的两大支柱,它们分别解决了梯度方向不可信与参数尺度差异大的问题。理解优化器状态(如一阶动量、二阶动量)的存储开销,是规划显存的第一步,尤其在大模型训练场景下,AdamW 带来的显存压力往往超过模型权重本身。针对不同任务,SGD with Momentum 在图像分类中表现稳健,而 Transformer 类模型则更依赖 AdamW 的适配性。学习率策略、beta 参数、权重衰减与梯度裁
原创
博文更新于 6 小时前 ·
67 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

超算级LLM部署实战:256节点3072副本架构与调度优化

在大模型推理服务中,分布式部署与显存管理是提升并发能力的关键。通过细粒度调度和分页式KV Cache,可有效平衡算力密度与通信开销,支撑高并发请求。超算级部署采用两级调度架构,结合RDMA通信优化,实现副本级故障隔离与动态负载均衡。该方案适用于私有化推理集群、LLM服务化平台等场景,为工业级LLM部署提供可扩展的参考架构。
原创
博文更新于 6 小时前 ·
49 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

基于YOLO的OCT视网膜囊肿液检测:1460张医学图像实战指南

目标检测在医学影像分析中面临小病灶、低对比度和单类别检测等挑战。OCT视网膜断层图像中的囊肿液表现为边界模糊的低反射暗区,与周围组织灰度差异极小,对检测算法的定位精度和召回能力提出更高要求。VOC与YOLO双格式标注为数据校验和模型训练提供了灵活基础,而单类别检测中负样本构建、输入分辨率选择和损失权重调整成为影响模型性能的关键因素。在黄斑水肿辅助诊断、积液定量分析等临床场景中,高召回率和精确的框定位直接决定模型的可用性。本文围绕1460张OCT视网膜图像数据集,系统梳理从格式转换、训练策略到后处理评估的完整
原创
博文更新于 6 小时前 ·
64 阅读 ·
3 点赞 ·
0 评论 ·
2 收藏

MRI+PET双模态与3D ResNet-18实现阿尔兹海默症分类

医学影像分类是深度学习和计算机视觉在临床诊断中的重要应用,多模态影像融合能够从不同角度刻画组织特性,提高疾病识别的可靠性。本文从结构性MRI和功能性PET两种模态的基本原理出发,介绍多模态影像配准、预处理及三维卷积神经网络的选型逻辑,并讨论数据划分、显存优化和模型可解释性评估等工程落地中的关键问题。针对阿尔兹海默症这种神经退行性疾病,基于3D ResNet-18的双流融合结构可以同时利用结构与代谢信息,实现更稳健的分类性能。文章覆盖ADNI数据获取、SPM处理流程、PyTorch实现和Grad-CAM可视化
原创
博文更新于 6 小时前 ·
21 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

Cursor接入Ollama跑Qwen2.5-Coder:零成本本地AI编程环境搭建指南

大模型正加速渗透到日常开发流程,但云端服务不仅产生订阅费用,还存在代码外传的隐私顾虑。借助开源模型运行时与本地推理技术,开发者完全可以构建一套不依赖网络的AI辅助编程环境。其核心原理是通过OpenAI兼容接口,将代码编辑器与本地模型服务无缝对接,使补全、解释、重构等任务在离线状态下也能流畅执行。这项技术方案不仅适用于个人开发者,也能在团队内共享算力,降低整体工具成本。Qwen2.5-Coder作为均衡的开源代码模型,搭配Ollama简洁的模型管理能力,成为实现本地化AI编程的主流组合。本文将从模型选型、环境
原创
博文更新于 6 小时前 ·
45 阅读 ·
2 点赞 ·
0 评论 ·
1 收藏

优化器调不好,模型白训练:从原理到实战的优化器调试指南

在神经网络训练中,模型不收敛、loss 变成 NaN、验证集指标断崖式下跌等问题,十有八九与优化器的配置不当有关。优化器不仅是参数更新的工具,更是连接梯度、动量、学习率与训练动态的工程枢纽。理解它在梯度传输链条中的位置,学会区分 SGD、Adam、AdamW 等主流优化器的数学内涵和适用场景,是稳定训练模型的关键。从学习率设置、权重衰减到梯度裁剪,再到实际调试中的选型策略和排查清单,掌握这些基础、通用且可迁移的优化器工程知识,能大幅度提升训练效率和模型效果。本文从原理出发,结合工程经验,为想要解决训练不收敛
原创
博文更新于 6 小时前 ·
72 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

Civitai分裂红蓝阵营:国内用户模型下载与镜像站应对指南

Stable Diffusion模型社区Civitai近期因内容审核、版权归属与收益分配等治理矛盾,出现红蓝阵营分裂。红方强调规范化与商业化,蓝方坚持开放生态与社区自治。这一变化直接影响模型下载体验,尤其对国内用户而言,镜像站选择、模型版本管理与本地备份策略变得尤为关键。通过哈希校验、多镜像轮询与本地模型库整理,可有效应对平台分裂带来的资源分散风险。本文围绕Civitai下载、国内镜像站甄别与多平台并行配置,提供一套可落地的实操方案。
原创
博文更新于 7 小时前 ·
120 阅读 ·
1 点赞 ·
0 评论 ·
2 收藏

论文AI Agent实战:从交互式问答到可靠引用溯源

传统论文是静态的PDF,信息获取效率低。随着大模型与检索增强生成(RAG)技术走向成熟,将论文封装为可交互的AI Agent,已成为智能化科研工具的重要落地方向。其核心原理是通过结构化文档解析、语义索引与证据校验,构建一个受约束的生成链路,让模型在限定上下文内输出带精确引用来源的结论。这种做法的技术价值在于抑制大模型幻觉、实现结论可追溯,显著提升学术信息检索与实验配置复现效率。该类方案可广泛应用于学术知识库问答、论文精读辅助、跨章节推理验证等场景。本文基于一个真实落地的论文Agent项目,从系统架构、可靠性
原创
博文更新于 7 小时前 ·
52 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏
加载更多