Senior Software Engineer, AI Training - Canada
Core
Evaluate the quality of interactions with modern coding agents (e.g., OpenAI Codex, Claude Code) to assess engineering judgment and reasoning.
Role type
Senior AI Training Evaluator (Contractor)
Builds
High-quality evaluation datasets and feedback for AI coding models
Domain
Artificial Intelligence / Software Development
Deliverable
production ML models
Required skills
TypeScript/JavaScript or Python, experience with OpenAI Codex/Claude Code/Cursor, ability to evaluate code without execution, strong written and spoken English, subjective engineering judgment
Preferred skills
prompt design, evaluation workflows, mentoring senior engineers
Technologies
OpenAI Codex, Claude Code, Cursor, TypeScript, JavaScript, Python
Responsibilities
Evaluate AI-generated coding interactions end to end, judge output usefulness and alignment with strong engineering practices, assess quality of explanations and reasoning, distinguish response quality levels, provide clear written feedback on interactions, help define standards for great AI-assisted development


