Чем предстоит заниматься
Block releases on failing trustworthiness checks
Build evaluation datasets and scenarios
Maintain CI CD threshold gate configuration
Package audit evidence reports
Run bias toxicity red team and explainability suites
Track dataset coverage gaps
Triage evaluation failures