回首頁 / 🏋️ 訓練/微調

🏋️ 訓練/微調

29 看全部 · 每天精選 AI / LLM 開源情報,附繁中說明、為何上榜與商用授權判讀。

conradlocke/krea2-identity-edit

基於Krea-2的影像編輯工具,適用於ComfyUI。

▸ HF trending 200 · 457 likes

🧱 AI 基礎堆疊 ⚠ 限非商用

microsoft/FastContext-1.0-4B-SFT

微軟的快速上下文模型,適用於對話式 AI 和語料庫探索。

▸ HF trending 106 · 369 likes · 6,779 下載

🧱 AI 基礎堆疊 授權未明

ilkerzgi/fal-Krea-2-Style-LoRAs

模型訓練/微調工具,關鍵字:LoRA(依標籤自動歸類,詳細看下方原文)

▸ HF trending 58 · 133 likes

🧱 AI 基礎堆疊 ⚠ 限非商用

nvidia/Nemotron-Labs-Audex-30B-A3B

NVIDIA開發的文本生成模型,具備推理能力。

▸ HF trending 65 · 161 likes · 2,132 下載

🧱 AI 基礎堆疊 ⚠ 限非商用

multimodalart/krea2-lora-trainer

Hugging Face 示範應用(Space)(依標籤自動歸類,詳細看下方原文)

▸ HF trending 17 · 44 likes

🧱 AI 基礎堆疊 授權未明

ovi054/Qwen-Image-Edit-2511-LoRA

Hugging Face 示範應用(Space)(依標籤自動歸類,詳細看下方原文)

▸ HF trending 16 · 15 likes

🧱 AI 基礎堆疊 授權未明

Saivineeth147/lora-speedrun

加速LoRA微調的模擬器和排行榜。

▸ 近期新建立,已獲 119★

🧱 AI 基礎堆疊 ✓ 可商用 ★ 119

nvidia/Nemotron-Pretraining-Code-v3

Hugging Face 資料集(依標籤自動歸類,詳細看下方原文)

▸ HF trending 8 · 52 likes · 1,851 下載

🧱 AI 基礎堆疊 ✓ 可商用

openbmb/UltraData-SFT-2605

面壁 UltraData 監督微調(SFT)資料集(文字生成/問答)。

▸ HF trending 10 · 371 likes · 21,786 下載

🧱 AI 基礎堆疊 授權未明

M3st3rJ4k3l/FLUX.2-Klein-Multi-LoRA

Hugging Face 示範應用(Space)(依標籤自動歸類,詳細看下方原文)

▸ HF trending 31 · 187 likes

🧱 AI 基礎堆疊 授權未明

Anthropic/hh-rlhf

Hugging Face 資料集(依標籤自動歸類,詳細看下方原文)

▸ HF trending 8 · 1,825 likes · 33,693 下載

🧱 AI 基礎堆疊 授權未明

Enping-Hu/minimind-deep-dive

MiniMind 原始碼精讀及大模型技術體系中文學習筆記。

▸ 近一日新增 3★(現 95★)

🧱 AI 基礎堆疊 ✓ 可商用 ★ 95

sapientinc/HRM-Text

基於分層推理模型的大型語言生成模型,強化了任務完成和潛在空間推理。

▸ 近一日新增 5★(現 1,710★)

🧱 AI 基礎堆疊 ✓ 可商用 ★ 1,710

DaoyuanLi2816/can-i-finetune-this

估計Hugging Face模型是否能在你的本地GPU上微調。

▸ 790★ · 近期活躍

🧱 AI 基礎堆疊 ✓ 可商用 ★ 790

gvkhosla/pi-tinker

使用 Tinker 在 Pi 中微調開放原始碼模型的工具。

▸ 22★ · 近期活躍

🧱 AI 基礎堆疊 ✓ 可商用 ★ 22

JuliusBrussee/cavegemma

將Gemma 4模型微調為原始人風格的語音。

▸ 近一日新增 3★(現 100★)

🧱 AI 基礎堆疊 授權未明 ★ 100

MatthewK78/Rose

一種 PyTorch 最佳化器,通過範圍標準化的梯度更新進行無狀態最佳化。

▸ 近一日新增 1★(現 77★)

🧱 AI 基礎堆疊 ✓ 可商用 ★ 77

hlpun/Train-in-Silence

自動化 VRAM 計算器,為 LLM 微調選擇最便宜的 GPU。

▸ 101★ · 近期活躍

🧱 AI 基礎堆疊 ✓ 可商用 ★ 101

sunrainyg/RandOpt

基於神經厚林理論的黑盒最佳化官方程式碼庫。

▸ 612★ · 近期活躍

🧱 AI 基礎堆疊 授權未明 ★ 612

arkorlab/arkor

用於微調的 TypeScript 框架,支援 GPU 和多種機器學習模型。

▸ 30★ · 近期活躍

🧱 AI 基礎堆疊 ✓ 可商用 ★ 30

Jackohhhh/MedLLM-Finetuning

用於醫學二元分類任務的開箱即用大語言模型微調框架。

▸ 21★ · 近期活躍

🧱 AI 基礎堆疊 ✓ 可商用 ★ 21

shlokchorge/Fine-Tuning-QWEN2vl

使用LoRA和Unsloth對Qwen2-VL-7B進行微調,以改善LaTeX OCR效能。

▸ 近一日新增 1★(現 25★)

🧱 AI 基礎堆疊 授權未明 ★ 25