Ajustaré finamente llama, qwen o mistral llms en tus datos con lora

S
sidharth1
S
sidharth1
Sidharth P
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

¿Necesitas un LLM de código abierto que realmente conozca tu dominio, formato o estilo? Lo ajustaré en tus datos y te mostraré, con números, cuánto mejoró.


Soy investigador en IA (ICML 2026, IJCNLP-AACL 2025) y ajusto y evalúo modelos abiertos en configuraciones multi-GPU H100 como parte de mi investigación.


Lo que obtienes:

  • Recomendación del modelo base y método (LoRA, QLoRA, SFT completo o GRPO)
  • Limpieza y formateo de datos en plantillas de chat o instrucciones
  • Código de entrenamiento limpio, reproducible y configuración
  • Adaptador LoRA entrenado o pesos fusionados en paquetes superiores
  • Evaluación antes y después en un conjunto reservado
  • Configuración opcional para servicio rápido con vLLM o SGLang


Modelos: Llama, Qwen, Mistral, Gemma, DeepSeek y otros modelos de Hugging Face.


Envíame tu conjunto de datos y objetivo antes de ordenar y te sugeriré el modelo base, método y paquete adecuados.

Conoce a Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • DeIndia
  • Miembro desdeabr 2017
  • Idiomas

    Telugu, Inglés, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Traducción automática

Mi porfolio

Otros servicios de Desarrollo de IA que ofrezco