HireFT
Browse JobsHow it worksPricingAboutSuccess Stories
    Back to jobs
    AS

    Ascendion

    Software Engineering

    SR Data Scientist – Nearshore MX – Lexis Nexis

    Any, MexicoOn-SiteFull-timePosted 3w ago
    All Ascendion jobs

    Job description

    RESPONSIBILITIES

    • Develop and implement LLM-based applications tailored for legal use-cases
    • Evaluate and help maintain our data assets and training/evaluation data sets
    • Design and build pipelines for preprocessing, annotating, and managing legal document datasets
    • Collaborate with legal experts to understand requirements and ensure ML-applications meet domain-specific needs
    • Conduct experiments and evaluate model performance to drive continuous improvements
    • Fine-tune and deploy large language models to enhance their performance on legal text processing tasks
    • Interface with other technical personnel or team members to finalize requirements.
    • Work closely with other development team members to understand complex product requirements and translate them into software designs.
    • Successfully implement development processes, coding best practices, and code reviews for production environments.

    REQUIREMENTS

    • Practical experience with large language models, prompt engineering, fine-tuning RAG-based applications and benchmarking, using frameworks such as LangChain
    • Practical experience in Natural Language Processing methods and libraries such as spaCy, word2vec, Flair, BERT
    • Formal training in machine learning: dimensionality reduction, clustering, embeddings, and sequence classification algorithms
    • Strong Python background.
    • Knowledge of AWS, GCP, Azure, or other cloud platform
    • Understanding of data modeling principles and complex data models.
    • Proficiency with relational and NoSQL databases as well as vector stores (e.g., MySQL, Postgres, Solr, Elasticsearch/OpenSearch)
    • Knowledge of Spark-Scala, Ray or other distributed computing systems highly preferred
    • Knowledge of API development, containerization, and machine learning deployment highly preferred
    • Experience with ML Ops/AI Ops including experiment tracking tools like LangFuse and DVC
    • Experience with deep learning frameworks such as PyTorch, Tensorflow and Hugging Face Transformers

    PREFERRED QUALIFICATIONS

    • MS in Data Science, Computer Science, Statistics, Machine Learning, or related field
    • 2+ years of relevant work experience
    • Or undergraduate degree in relevant field and 4+ years of relevant work experience

    Qualifications

    RESPONSABILIDADES

    Desarrollar e implementar aplicaciones basadas en LLM (Modelos de Lenguaje Grande) adaptadas a casos de uso legales.

    Evaluar y ayudar a mantener nuestros activos de datos y conjuntos de datos de entrenamiento/evaluación.

    Diseñar y construir pipelines para el preprocesamiento, anotación y gestión de conjuntos de datos de documentos legales.

    Colaborar con expertos legales para comprender los requisitos y asegurar que las aplicaciones de ML cumplan con las necesidades específicas del dominio.

    Realizar experimentos y evaluar el desempeño de los modelos para impulsar mejoras continuas.

    Ajustar y desplegar modelos de lenguaje grande para mejorar su rendimiento en tareas de procesamiento de texto legal.

    Interactuar con otros miembros del equipo técnico para finalizar los requisitos.

    Trabajar de cerca con otros miembros del equipo de desarrollo para comprender requisitos complejos del producto y traducirlos en diseños de software.

    Implementar con éxito procesos de desarrollo, mejores prácticas de codificación y revisiones de código para entornos de producción.

    REQUISITOS

    Experiencia práctica con modelos de lenguaje grande, ingeniería de prompts, ajuste fino de aplicaciones basadas en RAG y benchmarking, usando frameworks como LangChain.

    Experiencia práctica en métodos y bibliotecas de Procesamiento de Lenguaje Natural como spaCy, word2vec, Flair, BERT.

    Formación formal en aprendizaje automático: reducción de dimensionalidad, clustering, embeddings y algoritmos de clasificación de secuencias.

    Sólidos conocimientos de Python.

    Conocimiento de AWS, GCP, Azure u otras plataformas en la nube.

    Comprensión de principios de modelado de datos y modelos de datos complejos.

    Dominio de bases de datos relacionales y NoSQL, así como de stores vectoriales (por ejemplo, MySQL, Postgres, Solr, Elasticsearch/OpenSearch).

    Se valora mucho conocimiento en Spark-Scala, Ray u otros sistemas de computación distribuida.

    Se valora mucho conocimiento en desarrollo de APIs, containerización y despliegue de ML.

    Experiencia en ML Ops/AI Ops, incluyendo herramientas de seguimiento de experimentos como LangFuse y DVC.

    Experiencia con frameworks de deep learning como PyTorch, TensorFlow y Hugging Face Transformers.

    CALIFICACIONES PREFERIDAS

    Maestría en Ciencia de Datos, Ciencias de la Computación, Estadística, Aprendizaje Automático o campo relacionado.

    Más de 2 años de experiencia laboral relevante.

    O título universitario en un campo relevante y más de 4 años de experiencia laboral relevante.

    Job details are sourced from the employer's original posting.

    Open job posting
    AS

    About the company

    Ascendion

    Ascendion is a company that provides software engineering solutions.

    View all Ascendion jobs
    Industry
    Software Engineering
    Open roles
    207

    Interested in this role?

    Apply with HireFT

    Free to start — no card required.

    Your fit

    How well do you match?

    Sign in to see how your résumé lines up with this role.