← Back to jobs

TalentOla Logo
Senior VLM Data Scientist

TalentOla

 

San Jose, CA, USA

Posted On: 2 days ago
Experience: 10+ years
Availability: Hybrid
Openings: 1
Category: Data Scientist
Tenure: Contract - Corp-to-Corp
Related Jobs

No related jobs found

Description

You will design, train, and deploy Vision-Language Models for multimodal and autonomous applications.

This role is on-site.

Responsibilities

  • Design and deploy efficient VLMs for multimodal applications, including video-based implementations for autonomous robotics.
  • Optimize training and inference using knowledge distillation, modal-adaptive pruning, and LoRA fine-tuning.
  • Build scalable training and testing pipelines on AWS SageMaker or Azure ML.
  • Develop multimodal solutions for image-text matching, visual question answering, and document data extraction.
  • Apply VLMs to healthcare use cases such as medical imaging analysis and benchmark models like GPT-4V.

Required Skills

  • 10+ years of experience in machine learning or data science with a focus on vision-language models.
  • Proficiency in Python and ML frameworks including PyTorch and TensorFlow.
  • Hands-on experience with VLMs such as VILA, Isaac Sim, or VSS.
  • Experience with cloud platforms including AWS SageMaker or Azure ML Studio.
  • Proven expertise in deploying production-grade multimodal AI solutions.
  • Experience implementing video-based VLMs in autonomous use cases.
  • Knowledge of medical datasets and healthcare regulations.
  • Ability to optimize models for real-world constraints using lightweight architectures.

Preferred Skills

  • Experience with Docker and MLflow.
  • Expertise in LoRA fine-tuning and modal-adaptive pruning.
  • Familiarity with interleaved image-text datasets and cross-attention layers.

Education

Any Gradute

Related Jobs

No related jobs found

← Back to jobs