CareerOSCareerOS

Staff/Sr. ML Infrastructure / Platform Engineer

英文職缺・已幫你整理成中文

  • Taipei
  • 資深
  • 9/29 刊登

職缺摘要

趨勢科技徵求 Staff/Sr. ML Infrastructure / Platform Engineer,負責建構與維運企業級 GPU 加速的大型語言模型(LLM)服務平台,涵蓋 Kubernetes 集群管理、多 GPU…

摘要由 AI 依英文原文整理成中文,不是逐字翻譯,以官方職缺為準

職缺內容

工作內容

  • 操作多模型 LLM 服務基礎架構並調整自動擴展政策,平衡 GPU 成本與延遲 SLA。
  • 維運具備 NVIDIA GPU 節點的生產環境 K8s 集群,並處理 GPU 節點生命週期。
  • 維護 Prometheus 與 Grafana 監控堆疊,建立 GPU 利用率、KV…

必備條件

  • 具備模型服務與推論經驗,操作多模型 LLM 基礎架構。
  • 具備 Kubernetes 與 GPU 基礎架構經驗,操作生產環境 K8s 與 NVIDIA GPU 節點。
  • 具備基礎架構即程式碼(IaC)經驗,編寫 Terraform 與 Helm charts。
  • 具備可觀測性與效能維護能力,使用 Prometheus 及 Grafana。

加分條件

  • 具備 LoRA / PEFT 微調工作流程經驗。
  • 具備 MLflow 實驗追蹤、模型註冊與自動化適配器部署經驗。
  • 具備建立 LoRA 適配器 CI/CD 管道經驗。
  • 具備 SGLang 或 NVIDIA NIM 等替代推論框架經驗與參數調校能力。

由英文原文整理成中文的重點,不是逐字翻譯。 看原始職缺的完整內容

技能

  • Kubernetes
  • Terraform
  • AWS
  • Google Cloud
  • 監控與可觀測性
  • 大型語言模型應用

時間軸

  1. 官方刊登

    2026-09-29(來源提供)・3 天前

  2. 第一次在官方頁發現

    追蹤開始前已刊登

  3. 最後一次確認仍在官方頁

    2026-10-02 09:28・20 分鐘前

相關職缺

「職缺雷達」的職缺資訊擷取自各公司官方徵才頁面,CareerOS 與各刊登公司無隸屬、合作或代理關係;職缺是否仍開放與其內容,以各公司官方頁面為準。 若您是職缺刊登方並希望移除,請來信 申請移除職缺。

頁面上的公司名稱與 logo 為各公司所有之商標,僅用於辨識,不代表合作或背書關係。