Synaptic SkillsSynapticSkills
MarketplaceSkill GraphCriar SkillMCP ServerPlataformaEnterprise
v0.1.0-beta
Voltar ao Marketplace
AgentsAvançado

TRL Training on Hugging Face Jobs

porhuggingface·huggingface· v1.0.0 · atualizado em 2026-04-10
80
Score

This skill facilitates training and fine-tuning language models using Transformer Reinforcement Learning (TRL) on Hugging Face Jobs. It supports methods like SFT, DPO, GRPO, and reward modeling, including GGUF conversion for local deployment. Use this skill for cloud GPU training tasks, GGUF conversion, or when users mention training on Hugging Face Jobs without local GPU setup, leveraging the TRL Jobs package and related tools.

hugging-facetrlfine-tuninglanguage-modelcloud-gpusftdpogguf
Linguagens
Python
0Stars
0Forks
0Usos
Fork

Documento do Skill

SKILL.mdhugging-face-model-trainer/workflow
1. Identify the user's training requirements (model, dataset, method).
2. Validate dataset format and size.
3. Create or select a training script (UV script recommended).
4. Configure the training job with necessary parameters (hardware, timeout, hub push).
5. Submit the job using the `hf_jobs()` MCP tool.
6. Provide the user with the job ID, monitoring URL, and estimated completion time.
7. Monitor the job's progress and provide status updates as requested.

Telemetria de Agentes

Execuções
0
total
Taxa de Sucesso
0%
últimos 30d
Latência Média
0.0s
p50
Alucinação
0.0%
detecção
Tokens Entrada
0
avg 0/exec
Tokens Saída
0
avg 0/exec

Uso por Plataforma

Skills Relacionados

Similar aTikTok Research
60%
Hebbian Synapse
Composite0.600
w = 0.3·α + 0.5·β + 0.2·γ
80
Similar aClone Website Skill
60%
Hebbian Synapse
Composite0.600
w = 0.3·α + 0.5·β + 0.2·γ
83
Similar aMulti-Topic Deep Research
60%
Hebbian Synapse
Composite0.600
w = 0.3·α + 0.5·β + 0.2·γ
86

Árvore do Skill

TRL Training on Hugging Face Jobs
hugging-face-model-trainer
Fases Cognitivas5
1.SENSE
2.CONTEXTUALIZE
3.HYPOTHESIZE
4.ACT
5.REFLECT
Triggers8
train a language model on hugging face jobsfine-tune a model using trlconvert a model to gguf formatrun a supervised fine-tuning jobtrain a reward modeluse hugging face infrastructure for trainingtrain a model with direct preference optimizationtrain a model without local gpu setup

Avaliar este Skill

Score Breakdown

⭐Avaliação Humana0%
🤖Sucesso de Agentes0%
🕐Atualidade100%
🔗Saúde de Dependências100%
🕸️Centralidade no Grafo0%
🛡️Segurança50%
CompositeScore = α·Humano + β·Agente + γ·Recência + δ·Deps + ε·Centralidade + ζ·Segurança

Instalação

$ synaptic mcp download hugging-face-model-trainer
$ synaptic skills detail hugging-face-model-trainer
$ synaptic skills live hugging-face-model-trainer

Dependências

trldatasetspefttrackio

Links

GitHub Repository