仕事内容:
テーブル・時系列解析分野
テーブルデータや時系列データのEDAを通じて、データの前処理、フィーチャーエンジニアリング、予測モデルの開発を実施します。
【募集背景】
現在、株式会社Hakkyでは受託開発としてデータ活用支援・AI開発・データ基盤構築を行い、自社のプロダクトの開発として「AIモデル開発の自動化ツール:aigleApp」及び「オンライン定性調査ツール:FindVox」を開発しております。また、最近では自社の「データ・AIに関するナレッジシェアを目的としたポータルサイト | Hakky Handbook」を生成AIを活用して完全自動で月あたり数千〜数万の記事の作成を行うことにも挑戦しております。
Hakkyにおいて、データサイエンティストは全事業・プロダクトの中心の一つです。マーケティング、営業、開発、サポートに至るまで、AIが関わらない分野はないと言っても良いほどにAIの活用に積極的に投資しています。
また、Hakkyでは「データでプロダクトを価値あるものに」をミッションに掲げ、自社のプロダクトはもちろん、受託開発で様々なデータやAIに関するプロダクトの開発プロジェクトも行っております。複数のプロダクト開発のプロジェクトに関わることができるのが弊社で働くメリットの一つになります。
ぜひ、最先端のAI技術を用いたプロダクトを開発したい方はご応募ください。
【ミッション】
データ解析・AI開発のフロントランナーとして、業界をリードする効果的な解析手法と実践的な適用を通じて、企業の成長と業界の発展をサポートすることで持続的な技術革新を追求し、データドリブンな未来を築くパートナーとしての地位を確立するとともに、自社のプロダクトにおける付加価値向上を実現します。
【職務内容】
顧客のビジネス課題に合わせた実験やPoCの設計を行い、プロトタイプの開発をサポートします。
最新研究など、トレンドも踏まえた形でのAIのモデル開発をします。
テーブル・時系列解析/音声解析/言語処理/大規模言語モデル/プロンプトエンジニアリング/画像処理のそれぞれの分野において、技術的なリードとプロダクションレベルのモデル構築を行います。
データの取得、処理、ストレージに関するインフラの設計や最適化、およびモデルのAPI化やバックエンドの整備をサポートします。
ビジネスチーム、機械学習エンジニア、その他の関連部門と連携し、知識共有やベストプラクティスの伝達を促進します。
【業務内容】
受託開発やFindVoxの機能で利用する話者分離や文字起こしのモデル開発を行います。直近では、Whisperなどのモデルのチューニングなどがメインの業務になります。
・言語処理/大規模言語モデル
受託開発やFindvox、Hakky Handbookで利用する大規模言語モデルを用いたAIの開発を行います。主に、チャットボットやコンテンツ生成、テキスト解析のプロジェクトを行います。
プロンプトエンジニアリングのエキスパートとして、プロンプトの開発と業務やプロダクトの開発で使えるテンプレート化を行います。プロンプトの専門家として、大規模言語モデルや画像生成のプロジェクト(例えばチャットボット、コンテンツ生成、テキスト解析)を行います。
物体認識やセグメンテーション、キーポイントなどのモデル開発や、最近では生成AIを活用した画像生成の業務を行います。アノテーションの設計から実際のモデルの開発、プロダクション化までを実施します。
求める人材:
シニア
【必須要件】
- 機械学習モデル開発の実務経験もしくはそれに準ずる開発や研究の経験が5年以上
- プロダクションでの機械学習モデルの運用経験
【歓迎要件】
- 主要なカンファレンス・技術会議での発表経験
- AIのアプリケーションの開発経験
- クラウドインフラに関する開発経験
- データサイエンティストチームのマネジメント経験
勤務時間・曜日:
- 週32時間以上〜週40時間まで、ご都合の良い稼働時間の中で働くことができます。
休暇・休日:
- ご自身のワークスタイルに合わせて柔軟な働き方を相談できればと思います。
勤務地:
ライフスタイルの変化に合わせて、ライフ重視型・バランス型・ワーク重視型から自分にあった働き方を選ぶことができます。
アクセス:
出社はございませんが、情報漏洩などのリスクの少ない場所でご勤務いただけますと幸いです。
給与:
- 時給:1250円~8000円
- 能力や関わるプロジェクトに応じて決定
その他:
WEB面接対応可能
【利用技術】
全社共通
- プロジェクト/タスク・バージョン管理:GitHub
- デザイン:Figma
- コミュニケーション:Slack
- ドキュメント管理:Google Workspace
- コラボレーションツール:Miro
Handbook
- 言語:React / Python
- ライブラリ:Streamlit / LangChain
- フレームワーク:Docusaurus / Next.js
- クラウド:
- Google Cloud
- Cloud Run / Cloud Run Jobs / Cloud Storage
- Vercel
- Algolia
- OpenAI
- CICD:GitHub Actions
- IaC:Terraform
aigleApp
- 言語:Python
- ライブラリ・フレームワーク:Kedro / MLflow / LangChain / FastAPI / Streamlit / PyTorch
- コンテナ:Docker
- クラウド:
- Google Cloud
- Cloud Run / Cloud Run Jobs / Cloud Load Balancing / Vertex AI / Batch / Cloud Monitoring
- Google Colab
- OpenAI
- Labelbox
- エラー監視:Sentry
- CICD:GitHub Actions
- IaC:Terraform
受託開発
- 言語:Python / SQL / Go / TypeScript
- BIツール:PowerBI / Redash / Looker Studio / Tableau / Looker
- フレームワーク:Kedro / MLflow
- DWH:Redshift / Snowflake / BigQuery
- コンテナ: Docker
- クラウド:AWS / GCP / Azure / OpenAI / Pinecone / Labelbox
当社は、個々のライフスタイルに合わせた柔軟な稼働が可能な企業でございます。
そのため、こちらからの連絡の際の時間帯もお客様のご都合に関わらず、自由な時間帯に調整させていただくことがございます。
あらかじめご了承ください。
雇用形態: 業務委託
給与・報酬: 1,250円 - 8,000円 時給
職歴:
- 機械学習モデル開発の実務経験もしくはそれに準ずる開発や研究: 5年 (望ましい)
- モデル開発の実務経験もしくはそれに準ずる開発や研究: 2年 (必須)
- プロダクションでの機械学習モデルの運用: 2年 (必須)