M

Ai 评测平台开发工程师(全栈)

Modelbest
北京
≈ 141,5 тыс.–235,8 тыс. ₽ · 1,8 тыс.–2,9 тыс. $ · 1,5 тыс.–2,6 тыс. €
12 000 – 20 000 CNY
🏢 Офис
Senior
Полная занятость
Продуктовая
Китай
Tech
Описание вакансии
Обязанности
Build benchmark registry and evaluation dataset versioning
Build evaluation result parsing and archival
Create visualization dashboards
Design AI evaluation platform architecture
Develop evaluation analytics and metric aggregation
Enable batch evaluation with retries and idempotency
Generate evaluation reports and leaderboards
Implement asynchronous evaluation task system
Implement model promotion gatekeeping
Integrate model checkpoint and inference services
Integrate training inference and data platforms
Manage judge model evaluation
Orchestrate evaluation jobs
Support version comparison and anomaly tracking

Технологии: Access Control, Asynchronous programming, Benchmark Registry, Cost Tracking, Data Modeling, Data Visualization, Database Design, Dataset versioning, Evaluation Dataset, Evaluation Dataset Versioning, Experiment Management, Failure diagnosis, Go, Idempotency, Java, LLM-as-a-Judge, Leaderboard, Logging, MLOps, Molecular Pipeline N/A, N A, Python, REST API, React, Result Analysis, Retry Mechanisms, Role-Based Access, Role-Based Access Control, Task Orchestration, Vue

AI-помощник
ИсточникСкрыто
Опубликовано2 дн назад
Мы против мошенников на площадке: если тебя просят заплатить, продиктовать код или установить непонятное приложение — прекращай общение и сразу пиши нам (чат с основателем или форма обратной связи).