JialeYang

AI 工程师 运维背景 推理加速 容器 & Linux 区块链关注者

运维/网络工程师出身,现转型 AI 工程方向。在职期间完整参与 TTS 推理加速并发架构设计、去字幕 / OCR / 数字人 / 换脸等 AI 推理服务落地。熟悉 Docker、Linux;Python 熟悉;Kubernetes 有实际项目运行经验;正在自学 Rust。

01 / Inference TTS、OCR、数字人等推理服务工程化
02 / Infra Docker、Linux、Nginx、K8s 运行经验
03 / Direction 从运维可靠性切入 AI 服务性能优化

从运维视角理解系统底层,进入 AI 工程后快速切入推理服务链路,能独立完成模型部署 → 并发服务化 → 性能调优的完整工程落地。持续关注国内 AI 动态(GLM、MiniMax、Qwen 系列),有主动探索新技术的习惯。适合节奏快、技术迭代密集的 AI 工程团队。

北京国安信息科技有限公司杭州分公司 技术工程师
2026.06 — 至今

技术工程师,工作地点杭州,聚焦大模型私有化部署、国产化环境适配与企业级 AI 应用落地。

技术定位:围绕 Qwen 等国产大模型进行部署、服务化与推理环境建设,支撑企业内部 AI 能力落地
工程方向:面向国产化软硬件环境的模型适配、Linux / Docker / Nginx 部署、服务治理与问题排查
焦点视界(杭州)人工智能有限公司 AI 工程师
2025.05 — 2026.05

AI 推理服务工程化落地,主要方向:

TTS 推理加速:IndexTTS 1.5 / 2.0 开源模型推理加速与并发架构设计,优化吞吐与延迟
推理框架:vLLM、SGLang 实际部署,理解其调度与批处理机制
AI 服务集成:去字幕、OCR(DeepSeek OCR 等主流方案)工程化落地
数字人 & 换脸:硅基数字人系统集成,换脸服务工程化部署
模型服务化:NVIDIA Triton Inference Server 使用与服务部署
语音合成:微软开源 VoiceTube 系方案调研与集成
本地模型:Ollama 管理,Qwen 3.5 深度使用,Agent 场景探索
杭州思福迪信息技术有限公司 运维 / 技术工程师
2023.03 — 2025.04

云原生自动化运维平台开发 + 堡垒机与日志审计系统运维

可用性:Docker Compose 多节点编排,Nginx 反向代理 + WebSocket 长连接,可用性 99.9%
数据库优化:PostgreSQL 索引策略优化,告警日志查询效率提升 50%
堡垒机:JumpServer 部署与维护,44+ 服务器资产全链路审计(录像回放、命令记录)
日志审计:浪潮云 API 对接,Filebeat + Logstash 日志采集,Python / Shell 脚本开发
安全基线:SSH 密钥登录、防火墙白名单、数据库高危操作实时告警(DELETE* / DROP TABLE)
运维平台:K8s 集群管理、Ansible 配置管理、Jenkins CI/CD、Prometheus + Grafana 监控中心
杭州海宴科技有限公司 技术支持 / 销售
2022.06 — 2023.03
负责音探 AI 安防设备技术支持、现场部署安装与客户培训,兼顾销售推广
熟练掌握
Docker Linux Python Shell Arch Linux
较熟悉
Nginx PostgreSQL Git 网络工程 / ISP
实战经验
Kubernetes vLLM SGLang NVIDIA Triton Ollama ONNX Runtime
AI 推理落地
TTS 推理加速 OCR / DeepSeek OCR 去字幕 数字人 换脸 Agent
了解 / 学习中
Rust ↗ Ansible Jenkins Prometheus Grafana
Anthropic
Claude Pro / Max
智谱
GLM Max
MiniMax
MiniMax Ultra
OpenAI
GPT Pro
2018.09
— 2022.06
新疆农业大学
计算机科学与技术 · 本科
计算机网络 · 数据库 · 数据结构 · 网络安全 · 云计算 · Java / C 语言