科技職缺
職缺列表
GPS HST Software Engineer III
Software engineer supporting Deloitte's Government & Public Services clients on state public assistance systems (eligibility determination, benefits calculation, case management). Day-to-day work spans systems implementation, operations & maintenance, and software application development & maintenance.
Senior Python Developer
Senior Python developer at Turing (contractor, fully remote) who writes and reviews high-quality Python code and creates SFT/RLHF data — prompts, model-response evaluations, and rationales — to help foundational LLM companies train, fine-tune, and benchmark their models.
JavaScript / TypeScript Full-Stack Developer
Designs, reviews, and evaluates code that trains and optimizes large language models, conducting model evaluations, supervised fine-tuning, and RLHF work for leading AI labs. Fully remote contractor role working full-stack in JavaScript/TypeScript with Node.js, React, Angular, Vue, and Nest.js.
MLE Bench – Data Analyst
Remote Data Analyst for Turing's MLE Bench evaluation projects, analyzing datasets from ML training/inference pipelines, computing model performance metrics, and investigating failure modes using Python and SQL to support benchmarking of advanced AI systems.
LLM Go Developer
Go developer reviewing and validating AI-generated code for a company building next-generation dialog agents. Works with cross-functional teams on LLM training, code review, and feature delivery using Go.
Senior Software Engineer – Python (LLM Evaluation & Repository Validation)
Senior software engineer building LLM evaluation and training datasets by analyzing public GitHub repos, triaging issues, Dockerizing codebases, and assessing unit test coverage to measure LLM performance on real-world bug-fixing tasks.
Business Analyst (Finnish Language)
Freelance Business Analyst supporting AI training by answering analytical questions, creating training scenarios, and providing detailed feedback to fine-tune large language models (LLMs). Requires fluency in English and Finnish, with strong research, analytical, and logical reasoning skills.
Senior Software Engineer – C#(LLM Evaluation & Repository Validation)
Senior software engineer evaluating LLMs by triaging GitHub issues, Dockerizing code repositories, and assessing unit test coverage to build verifiable SWE training datasets, with C# as the primary language.
Senior Software Engineer – Go (LLM Evaluation & Repository Validation)
Senior Go engineer building LLM evaluation and training datasets by triaging GitHub issues, Dockerizing repositories, assessing test coverage, and modifying real-world codebases to benchmark LLM bug-fixing performance.
AI Quality Analyst (Personalization) - Indonesian
Evaluate Gemini's new personalization feature by designing multi-turn prompts and assessing model responses for grounding, integration, and helpfulness. Requires native Indonesian proficiency, creative prompt engineering, and rigorous side-by-side analysis of AI outputs.
AI Quality Analyst (Personalization) - Russian
Remote AI Quality Analyst evaluating Gemini's personalization feature in Russian by designing multi-turn prompts from personal context and side-by-side ranking model responses on grounding, integration, and helpfulness.
LLM Trainer - Agent Function call
LLM trainer who crafts multi-turn conversation data simulating users and AI assistants using function-calling tools (calendar, email, maps, drive) to produce high-quality training and evaluation datasets for foundational LLM companies. Fully remote contractor role.