エンジニアフルリモート

【フルリモート/週5】Python 生成AI・LLMアプリケーションエンジニア(自律型AIエージェント基盤と高度なRAGアーキテクチャの構築)

【フルリモート/週5】Python 生成AI・LLMアプリケーションエンジニア(自律型AIエージェント基盤と高度なRAGアーキテクチャの構築)

案件要件

職種
エンジニア
業務内容
システム開発・運用
SES
報酬目安
4,400 ~ 4,800円/時
稼働時間目安
週5日 (時間目安 160時間)
はたらく場所
フルリモート
スキル

【フルリモート/週5】Python 生成AI・LLMアプリケーションエンジニア(自律型AIエージェント基盤と高度なRAGアーキテクチャの構築)

お任せしたいこと

自社で展開するBtoB SaaS、または全社の生産性を劇的に向上させる社内プラットフォームにおいて、Pythonを用いた大規模言語モデル(LLM)の社会実装と、プロダクションレベルの生成AIアプリケーションの設計・開発をお任せします。
「流行りのOpenAI APIをとりあえず繋いでチャットボットを作りました」といったPoC(概念実証)レベルのお遊びを徹底的に排除し、エンタープライズの複雑な業務ドメインを自律的に解決するマルチエージェントシステムの構築や、独自データとLLMを掛け合わせた極めて精度の高いRAG(検索拡張生成)パイプラインを、ハルシネーション(幻覚)の壁と戦いながら泥臭く本番運用へと落とし込んでいくコアポジションです。

具体的な業務内容

・Python 3.x および FastAPIを利用した、非同期処理(LLMの長い推論待ち時間)を前提としたスケーラブルで低遅延なAI推論APIの設計・開発
・LangChain、LlamaIndex、またはLangGraphを駆使した、複雑な業務ワークフローを自律的に遂行するAIエージェント(関数呼び出し、ツール利用)の実装
・Qdrant、Pinecone、または pgvector(PostgreSQL)等を利用したベクトルデータベースの設計と、ハイブリッド検索(セマンティック検索+キーワード検索)によるRAGの検索精度向上
・PDFや社内ドキュメント等の非構造化データに対する、泥臭いテキストクレンジング、チャンク分割(Chunking)の最適化、およびエンベディング(埋め込み)パイプラインの構築
・RagasやTruLens等を用いたLLM出力の定量評価(Evaluation)基盤の構築と、プロンプトエンジニアリングによる精度の継続的なチューニング
・vLLM等を利用したオープンソースLLM(Llama 3等)のローカルホスティング、および必要に応じた小規模なファインチューニング(PEFT / LoRA)の検証・実装
・CeleryやRedisを活用した重い生成タスクの非同期キューイング、およびストリーミングレスポンス(Server-Sent Events)の実装
・APIコスト(トークン消費量)とレイテンシの極限の最適化、および入力プロンプトに対するセキュリティ(プロンプトインジェクション対策)の設計

必須スキル・経験

・Pythonを用いたバックエンドWebアプリケーション、またはデータパイプラインの開発実務経験(目安として3年以上)
・OpenAI API、Anthropic API等のLLMを利用したアプリケーションの開発、およびプロンプトエンジニアリングの経験
・LangChain、LlamaIndex等の生成AIフレームワークを利用した実装経験
・FastAPI、Django等を用いたRESTful APIの設計・開発経験
・Git / GitHubを用いたプルリクエストベースでのチーム開発経験

歓迎スキル・経験

・高度なRAG(Retrieval-Augmented Generation)アーキテクチャの構築、および検索精度(Recall/Precision)の改善経験
・LangGraphやAutoGen等を用いたマルチエージェントシステムの設計・開発経験
・ベクトルデータベース(Pinecone, Milvus, Qdrant等)の運用経験
・LLMOps(LLMの評価、監視、デプロイメント)に関する実務経験
・AWS(Bedrock, SageMaker等)、またはGCP(Vertex AI等)を利用したクラウドネイティブなAIインフラ構築経験

開発・業務環境

開発言語:Python 3.x
AI/LLMフレームワーク:LangChain, LlamaIndex, LangGraph
API・Webフレームワーク:FastAPI
LLMモデル:GPT-4o, Claude 3.5 Sonnet, OSS LLM
データベース:PostgreSQL (pgvector), Qdrant, Redis
インフラ・コンテナ:AWS または GCP, Docker, Kubernetes
非同期処理:Celery, RabbitMQ
テスト・品質・評価:pytest, Ragas, LangSmith (または Trulens)
コミュニケーション・管理:GitHub, Jira, Slack, Zoom

プロジェクトチームについて

生成AIのポテンシャルを「実社会のビジネス価値」へと変換する、AIアプリケーション(LLMコア)チームへの配属となります。
「LLMがよしなに解決してくれる」という魔法のような期待を極めて嫌い、非決定的なAIの出力をエンジニアリングの力でいかにコントロール(決定論的なシステムと統合)するかに執念を燃やす手堅いカルチャーです。回答精度が上がらない際にも、「プロンプトの微調整」というお祈り駆動開発に逃げるのではなく、ドキュメントのパース処理やチャンク分割のロジック、検索クエリの拡張といった泥臭いデータの前処理に立ち返り、論理的に課題を解決していく実直なメンバーが集まっています。

求める人物像

・「最新のAI論文を読むこと」自体を目的とせず、「その技術を使ってユーザーの業務時間を何時間削減できるか」というビジネス価値の創出に圧倒的な当事者意識を持てる方
・数週間単位で破壊的アップデートが起こる生成AI界隈の進化スピードに対して文句を言うのではなく、前向きにキャッチアップし、既存のコードを捨てることを楽しめる方
・LLMの華やかな出力の裏側にある、PDFからのテキスト抽出やチャンキングといった「極めて泥臭く地味なデータ処理」から逃げずにやり切れる知的好奇心を持った方

仕事の魅力

世界中の企業が「生成AIのPoCの壁」を越えられずに苦しむ中、最新のLLMエコシステムを駆使してエンタープライズの要件に耐えうる本番品質のAIエージェントを最前線で構築する、極めて難易度が高くエキサイティングなポジションです。不確実性の高いAIモデルと、堅牢なソフトウェアエンジニアリングを融合させる高度な経験を通じて、単なる「Pythonが書けるエンジニア」を完全に凌駕し、これからのAI時代においてメガベンチャーから全産業の企業が喉から手が出るほど欲しがる「生成AI・LLMアプリケーションアーキテクト」としての圧倒的な市場価値を築くことができます。

働き方

リモート環境

[フルリモート] 基本的にフルリモートで働いていただけます。


SNSでこの案件をシェア

株式会社Kaizen Tech Agent

株式会社Kaizen Tech Agent

株式会社Kaizen Tech Agentは、「人と技術をつなぐ」ことを企業理念に掲げ、日々向上していく『技術』と『人』を最適な形でむつび付け提供することで、
お客様にとって真にプラスとなる価値でありたいと考えております。
私たちはそれぞれの個性を尊重し、ほっとする和みの社風でありながら、変化する時代に対して受け身にならず、未来への挑戦心を宿しています。
事業領域は、WEBアプリ開発、業務システム開発、スマホアプリ開発、インフラ構築など幅広く展開しており、
フリーランス様に対して最適な案件をご提案させて頂いております。どんな些細な事でも結構ですので是非いつでもお気軽にご相談ください。

案件を公開しました

案件をシェアしませんか?(SNSシェアをすることで、求職者の応募数アップが期待できます。)

案件を公開しました

この案件は限定公開です。案件のURLを知っている人のみが案件情報を見ることができます。

応募が完了しました

アピールしたいポイントがあれば積極的にメッセージを送ってみましょう。