Staff/Sr. ML Infrastructure / Platform Engineer
英文職缺・已幫你整理成中文
- Taipei
- 資深
- 9/29 刊登
職缺摘要
趨勢科技徵求 Staff/Sr. ML Infrastructure / Platform Engineer,負責建構與維運企業級 GPU 加速的大型語言模型(LLM)服務平台,涵蓋 Kubernetes 集群管理、多 GPU…
摘要由 AI 依英文原文整理成中文,不是逐字翻譯,以官方職缺為準
職缺內容
工作內容
- 操作多模型 LLM 服務基礎架構並調整自動擴展政策,平衡 GPU 成本與延遲 SLA。
- 維運具備 NVIDIA GPU 節點的生產環境 K8s 集群,並處理 GPU 節點生命週期。
- 維護 Prometheus 與 Grafana 監控堆疊,建立 GPU 利用率、KV…
必備條件
- 具備模型服務與推論經驗,操作多模型 LLM 基礎架構。
- 具備 Kubernetes 與 GPU 基礎架構經驗,操作生產環境 K8s 與 NVIDIA GPU 節點。
- 具備基礎架構即程式碼(IaC)經驗,編寫 Terraform 與 Helm charts。
- 具備可觀測性與效能維護能力,使用 Prometheus 及 Grafana。
加分條件
- 具備 LoRA / PEFT 微調工作流程經驗。
- 具備 MLflow 實驗追蹤、模型註冊與自動化適配器部署經驗。
- 具備建立 LoRA 適配器 CI/CD 管道經驗。
- 具備 SGLang 或 NVIDIA NIM 等替代推論框架經驗與參數調校能力。
由英文原文整理成中文的重點,不是逐字翻譯。 看原始職缺的完整內容
技能
- Kubernetes
- Terraform
- AWS
- Google Cloud
- 監控與可觀測性
- 大型語言模型應用
時間軸
官方刊登
2026-09-29(來源提供)・3 天前
第一次在官方頁發現
追蹤開始前已刊登
最後一次確認仍在官方頁
2026-10-02 09:28・20 分鐘前
相關職缺
趨勢科技的其他職缺
「職缺雷達」的職缺資訊擷取自各公司官方徵才頁面,CareerOS 與各刊登公司無隸屬、合作或代理關係;職缺是否仍開放與其內容,以各公司官方頁面為準。 若您是職缺刊登方並希望移除,請來信 申請移除職缺。
頁面上的公司名稱與 logo 為各公司所有之商標,僅用於辨識,不代表合作或背書關係。