- どんな仕事か
-
中途_LLM基盤開発エンジニア (Fixstars)
【概要】
LLM、VLMなどのAIモデル推論基盤の高速化
LLMの学習・推論基盤の構築や運用には、膨大なリソースを必要とします。
そのため、GPUサーバーのハードウェアコストの削減と、ユーザーエクスペリエンス(UX)の向上が急務となっています。
本プロジェクトでは、システム内のボトルネックを徹底的に調査して高速化を図るとともに、使用するハードウェアの特性に合わせたパラメータのチューニングを行います。
【具体的な職務内容】
・学習・推論基盤におけるボトルネックの調査・プロファイリングの実施
・学習・推論ソフトウェア・アーキテクチャの最適化と高速化
・ハードウェア特性に合わせたパラメータのチューニング
【プロジェクトのやりがい】
・AIの最先端かつ最難関の領域に、泥臭い低レイヤの技術で挑む面白さ
・莫大なコストを削減し、プロダクトを『実用化』へ導く決定的な役割
・世界的に枯渇している『AIインフラ/MLOpsエンジニア』としての唯一無二の経験
【開発環境】
開発環境:Linux, Windows
開発言語:Python, PyTorch, C++
開発支援ツール:Git, GitLab, GitHub
開発手法:チケット駆動開発、アジャイル開発等 - 求められるスキルは
-
必須 【必須】
Python、PyTorchでの開発経験
【歓迎】
vLLM、SGLang、C/C++、CUDA、NSight Systems、Slurm、Kubernetes、AWS
【求める人物像】
・技術への高い探究心:LLMやディープラーニング領域の最新論文・技術トレンドを自発的にキャッチアップし、業務に取り入れられる方
・全体最適な視点と現場感:ハードウェアの制約や現場の課題を理解し、システム全体を俯瞰してコスト削減やUX向上を見据えた最適な設計ができる方
・課題解決への主体性:正解のないボトルネックの調査や課題に対して、自ら仮説を立てて泥臭く検証を回し、解決まで導ける方
・オープンな協調性:異なる専門性を持つメンバーと円滑にコミュニケーションが取れる方 - 雇用形態は
- 正社員
- どこで働くか
- 東京都
- 給与はどのくらい貰えるか
- 600~1010万円
NEW
掲載期間26/07/23~26/08/05
求人No.MYN-10692576





