メインコンテンツにスキップ

テクニカルスタッフ(推論サービング) at ai&

部門:Engineering

言語
勤務形態
ハイブリッド
所在地
横浜市、神奈川県、日本 · 東京、日本
雇用形態
フルタイム
レベル
senior
掲載

説明

ai& は、異種ハードウェア上で高性能なマルチテナント推論サービング・スタックを構築し、最適化するための Inference & Serving Engineer を募集しています。 この役割では、推論フレームワークの選定とチューニング、disaggregated prefill/decode、speculative decoding、continuous batching などの手法によるレイテンシとスループットの改善、ならびに小規模クラスターからマルチノード導入までのアーキテクチャのスケールに焦点を当てます。 責務には、メモリおよび KV-cache の最適化、Day 0 モデル対応、クロススタック統合、本番デバッグ、そしてハンズオンのテクニカルリードが含まれます。 このポジションには、推論エンジンの深い経験、multimodal generative AI に関する知識、分散システム・エンジニアリングの実績が求められます。

求職者向け

実際にぴったりの役割を見つける準備はできましたか?

履歴書をアップロードし、求人検索スレッドを開始すると、Metaintro が実際の求人をあなたの経験に基づいてランク付けします。その後、検索からオファーまでをガイドします。

マッチ

公開中の求人を、いまの実績と照合します。

ポジション

実績プロジェクトを職種ごとの応募に落とし込みます。

改善

市場のフィードバックでスキル計画を最新に保ちます。

ナビゲーションに戻る