01
我是内蒙古大学计算机技术专业的研究生,中共党员。
热爱 深度学习、计算机视觉 与 语音处理,
在扎实基础上稳中求进。
02
内蒙古大学 · 计算机科学与技术 · 本硕连读 · GPA 3.6+
03
滴滴出行 · 算法实习生(语音方向) · 2025.12 — 2026.04
04
实习方向 · ASR · KWS · 机器翻译 — 让机器听见、唤醒、理解
从通用识别到方言/口音专项,推进到端侧可用的延迟水平。覆盖通用、粤语与繁中场景。
为 Plaud 卡片录音设备设计端侧低功耗唤醒,串起完整语音交互链路。
把大模型翻译能力压到能上线的水位 — 模型蒸馏 + 数据增强 + 指标三件套。
05
4 项核心能力 · 算法 · 训练 · 部署 · 工程
主流架构到大模型微调,算法是基本盘。
让大模型变小变快,不掉点。
模型从 notebook 走到能用的服务 — 跑在端侧,跑在云上。
研究能力要落到能交付的系统里。
06
4 个落地作品 · 音乐源分离 / 情绪识别 / 看图说话 / 松果菁英班 · 滚动查看
音乐源分离 · BSRNN 框架
在 BSRNN 框架上引入音频–MIDI 双模态条件,把符号音乐先验注入子带级时序建模。
情绪识别 · FER2013
基于 FER2013 完成清洗、增强、训练与实时识别系统集成,把 CNN 分类模型落到 OpenCV 实时推理。
看图说话 · CNN+Transformer
参与开发基于 CNN 与 Transformer 的 AI 中文看图说话系统,完成模型训练与系统性测试优化。
人才培养 · 百度松果菁英班
系统完成机器学习、计算机视觉与自然语言处理等核心课程学习,并通过项目实践与结业考核。
07
班长 / 党支部书记 / 算法社团负责人 — 三年学生工作
08
5 项奖学金 · 3 项竞赛 · 6 项综合荣誉 · 12 项证书
09
论文方向:音乐源分离(BSRNN 框架,在研) + 实习方向:ASR / KWS / 机器翻译(滴滴出行 2025.12—2026.04),让我兼顾学术研究深度与工业落地经验。
硕士论文聚焦 BSRNN 音乐源分离方向,将 MIDI 符号先验注入子带级时序建模;同期在滴滴出行完成 ASR 轻量化(Conformer → Zipformer)、翻译模型蒸馏(HY-MT1.5 + LoRA)与粤语/繁中方言优化三项工业落地工作。熟悉 PyTorch、k2-fsa、ESPnet 等训练栈,掌握 ONNX / TensorRT 端侧推理与 INT8 量化,能够独立完成从数据构建、模型训练调优到端侧部署与线上服务的全流程。
多年学生工作与团队项目经历,锻炼出较好的沟通协调、统筹规划与团队协作能力。具备良好的自主学习、问题解决与抗压能力,能够快速适配岗位技术需求,在算法研发、模型优化及项目推进中为团队创造价值。