模型、訓練與推論

這個主題底下的 65 個 repo。

65 筆結果

rasbt/LLMs-from-scratch

用 PyTorch 從零一步步實作出一個類 ChatGPT 的 LLM,是理解 Transformer 內部最扎實的教材。

★ 104.6k · Jupyter Notebook · 最後更新 2026-09

Jupyter Notebookaiartificial-intelligenceattention-mechanism

deepseek-ai/DeepSeek-R1

DeepSeek 的開源推理模型,用大規模強化學習訓練出接近 o1 等級的思考能力。

★ 92k · — · 最後更新 2025-06

unslothai/unsloth

本機微調與執行 LLM 的工具,速度快、記憶體省,支援 GGUF、MLX 與各家新模型。

★ 75.8k · Python · 最後更新 2026-09

Pythonagentaichatgpt

hiyouga/LlamaFactory

統一介面微調 100+ 種 LLM 與視覺語言模型,支援 LoRA、QLoRA 等各種高效微調法。

★ 74.6k · Python · 最後更新 2026-09

Pythonagentaideepseek

jingyaogong/minimind

兩小時從零訓練出一個 64M 參數的 LLM,是理解訓練全流程最小可行的教材。

★ 59.8k · Python · 最後更新 2026-09

Pythonartificial-intelligencelarge-language-model

google/langextract

Google 的 Python 函式庫,用 LLM 從非結構化文字抽出結構化資訊,而且能精準標出出處在原文哪一段。

★ 38.5k · Python · 最後更新 2026-09

Pythongeminigemini-aigemini-api

stanfordnlp/dspy

把 LLM 應用當程式來寫而不是靠調 prompt,自動最佳化提示詞與權重的框架。

★ 37.9k · Python · 最後更新 2026-09

Python

alchaincyf/nuwa-skill

蒸餾任何人的思考方式:心智模型、決策捷思、表達 DNA,把一個人的思維打包成可複用的 skill。

★ 32.3k · Python · 最後更新 2026-08

Python

QwenLM/Qwen3

阿里雲通義千問團隊的 Qwen3 開源大模型系列。

★ 27.6k · Python · 最後更新 2026-01

Python

huggingface/open-r1

Hugging Face 對 DeepSeek-R1 的完全開源復現,訓練資料與流程全公開。

★ 26.5k · Python · 最後更新 2026-04

Python

confident-ai/deepeval

LLM 的評估框架,像 pytest 一樣寫測試來驗證模型輸出品質。

★ 18.2k · Python · 最後更新 2026-09

Pythonevaluation-frameworkevaluation-metricsllm-evaluation

dair-ai/ML-YouTube-Courses

YouTube 上的機器學習與 AI 課程精選清單,免費資源集散地。

★ 17.4k · — · 最後更新 2024-01

aidata-sciencedeep-learning

ageron/handson-ml3

《Hands-On Machine Learning》第三版的 notebook,用 Scikit-Learn、Keras、TensorFlow 打底。

★ 14.1k · Jupyter Notebook · 最後更新 2026-05

Jupyter Notebook

Lightning-AI/litgpt

20+ 個高效能 LLM 的預訓練、微調與部署配方,程式碼乾淨好讀。

★ 13.7k · Python · 最後更新 2026-09

Pythonaiartificial-intelligencedeep-learning

dair-ai/AI-Papers-of-the-Week

每週精選最重要的 ML 論文,想追進度但沒時間讀 arXiv 的人適用。

★ 13.2k · — · 最後更新 2026-09

aidata-sciencedeeplearning

ShishirPatil/gorilla

訓練與評估 LLM 呼叫 API 的能力,是 function calling 研究的代表作。

★ 13k · Python · 最後更新 2026-04

Pythonapiapi-documentationchatgpt

NVIDIA/personaplex

NVIDIA 的 PersonaPlex 專案程式碼,做角色化的對話代理。

★ 10.5k · Python · 最後更新 2026-03

Python

xorbitsai/inference

改一行程式就能把 GPT 換成任何開源模型,語音與多模態模型也能統一在雲端或筆電上跑。

★ 9.6k · Python · 最後更新 2026-09

Pythonartificial-intelligencedeploymentdiffusers

oumi-ai/oumi

端到端的開源模型平台,微調、評估、部署 Qwen、Gemma 等開放權重 LLM 都用同一套介面。

★ 9.4k · Python · 最後更新 2026-09

Pythondpoevaluationfine-tuning

NVIDIA/garak

LLM 的弱點掃描器,自動測試提示注入、資料外洩、越獄等安全問題。

★ 9.1k · Python · 最後更新 2026-09

Pythonaillm-evaluationllm-security

NVIDIA/Isaac-GR00T

NVIDIA 的通用機器人基礎模型,讓機器人從示範影片學會操作任務。

★ 8k · Python · 最後更新 2026-08

Python

ai-dynamo/dynamo

資料中心規模的分散式推論服務框架,支援分離式部署與智慧路由。

★ 8k · Rust · 最後更新 2026-09

Rustdiffusiondisaggregated-servingkubernetes

microsoft/TinyTroupe

用 LLM 模擬一群有個性的虛擬人物,拿來做腦力激盪與商業洞察。

★ 7.6k · Jupyter Notebook · 最後更新 2026-07

Jupyter Notebook

guardrails-ai/guardrails

替 LLM 加上護欄:驗證輸出格式、過濾不當內容、失敗時自動重試。

★ 7.4k · Python · 最後更新 2026-09

Pythonaifoundation-modelgpt-3

linkedin/Liger-Kernel

LinkedIn 開源的 Triton kernel,讓 LLM 訓練吞吐提升、顯存用量大降。

★ 6.6k · Python · 最後更新 2026-09

Pythonfinetuninggemma2hacktoberfest

jeinlee1991/chinese-llm-benchmark

中文大模型能力評測榜,已涵蓋 374 個模型,商用與開源都測。

★ 6.4k · — · 最後更新 2026-09

agentic-aiartificial-intelligencellm-agent

shibing624/MedicalGPT

訓練醫療大模型的完整流程,含增量預訓練、SFT、RLHF、DPO、GRPO。

★ 5.8k · Python · 最後更新 2026-06

Pythonchatgptdpogpt

getzep/zep

Zep 記憶服務的範例與整合,用知識圖譜替 agent 保存長期記憶。

★ 4.9k · Python · 最後更新 2026-09

Pythonaiknowledge-graphslanguage-model

openai/simple-evals

OpenAI 官方的輕量模型評測腳本,用來重現各家模型的標準 benchmark 分數。

★ 4.6k · Python · 最後更新 2026-04

Python

PrimeIntellect-ai/verifiers

強化學習環境與評估的函式庫,用來訓練會用工具、能驗證答案的模型。

★ 4.6k · Python · 最後更新 2026-09

Python

build-with-groq/g1

用 Groq 上的 Llama-3.1 70b 生成類 o1 的推理鏈,展示怎麼用提示工程逼出思考步驟。

★ 4.2k · Python · 最後更新 2025-12

Pythonmanaged-by-terraform

predibase/lorax

多 LoRA 推論伺服器,一張卡上可同時服務上千個微調過的模型。

★ 3.8k · Python · 最後更新 2026-05

Pythonfine-tuninggptllama

ridgerchu/matmulfreellm

不用矩陣乘法的語言模型實作,大幅降低推論時的能耗與記憶體。

★ 3.1k · Python · 最後更新 2026-09

Pythonlarge-language-modellinear-transformerllm

zjunlp/EasyEdit

好上手的 LLM 知識編輯框架,不用重訓就能改掉模型記錯的事實。

★ 2.9k · Jupyter Notebook · 最後更新 2026-07

Jupyter Notebookartificial-intelligencebaichuanchatgpt

WenjieDu/PyPOTS

處理有缺失值的時間序列的機器學習工具箱,收錄 50+ 個最新的神經網路模型。

★ 2.1k · Python · 最後更新 2026-09

Pythonanomaly-detectionclassificationclustering

meta-llama/synthetic-data-kit

Meta 的合成資料生成工具,用來替微調準備高品質訓練集。

★ 1.6k · Python · 最後更新 2025-10

Pythondatagenerationllm

NVIDIA/RULER

測長脈絡模型「真正」能用多長脈絡的基準,揭穿宣稱的視窗長度與實際落差。

★ 1.6k · Python · 最後更新 2026-07

Python

AlibabaResearch/DAMO-ConvAI

阿里達摩院對話式 AI 的官方程式碼庫,涵蓋多輪對話與任務型對話研究。

★ 1.6k · Python · 最後更新 2026-06

Pythonconversational-aideep-learningdialog

Google-Health/medgemma

Google Health 的 MedGemma 醫療多模態開放模型,能讀醫學影像與病歷文字。

★ 1.6k · Jupyter Notebook · 最後更新 2026-06

Jupyter Notebook

sail-sg/understand-r1-zero

批判性地理解 R1-Zero 式訓練:純強化學習到底學到了什麼、哪些說法站不住腳。

★ 1.3k · Python · 最後更新 2025-08

Pythonllmr1-zeroreasoning

SakanaAI/self-adaptive-llms

讓 LLM 即時適應沒見過任務的自我調適框架。

★ 1.2k · Python · 最後更新 2025-01

Python

cxcscmu/Craw4LLM

為 LLM 預訓練設計的高效率網頁爬蟲,只挑真正有訓練價值的網頁抓。

★ 664 · Python · 最後更新 2025-02

Pythoncrawlercrawlinglarge-language-models

Wang-ML-Lab/llm-continual-learning-survey

大語言模型持續學習的完整綜述(CSUR 2025)。

★ 562 · — · 最後更新 2025-12

continual-learninglarge-language-modelllm

ZongqianLi/ReasonGraph

把模型的推理路徑視覺化的展示工具(ACL 2025 Demo)。

★ 516 · HTML · 最後更新 2026-03

HTML

NVIDIA/Star-Attention

NVIDIA 的長序列高效推論注意力機制,大幅降低長脈絡的計算成本。

★ 392 · Python · 最後更新 2025-06

Pythonattention-mechanismlarge-language-modelsllm-inference

SamuelSchmidgall/AgentClinic

醫療診斷的 agent 評測基準,模擬真實問診情境。

★ 352 · Python · 最後更新 2024-12

Python

shangshang-wang/Tina

用 LoRA 訓練出的極小推理模型,證明小模型也能學會思考(ICLR 2026)。

★ 337 · Python · 最後更新 2025-09

Python

mtkresearch/MR-Models

聯發創新基地的基礎模型研究成果,主打適合繁體中文使用者的模型。

★ 295 · — · 最後更新 2026-04

llm

knowsuchagency/promptic

LLM 應用開發需要的 90% 功能,多餘的一個都沒有,極簡的 Python 介面。

★ 274 · Python · 最後更新 2025-08

Pythonaillmspython

Jiaqi-Chen-00/ImBD

先模仿再偵測:針對「被 AI 潤飾過」的文字設計的機器文本偵測方法(AAAI 2025 oral)。

★ 264 · Python · 最後更新 2025-04

Pythonai-content-detectorai-safetyllm-detection

patrickloeber/llm-data-scrapers

替 LLM 蒐集訓練資料的開源工具與爬蟲清單。

★ 248 · — · 最後更新 2025-02

CryptoAILab/JailbreakEval

自動化的越獄嘗試評估器合集,用來衡量 LLM 的安全防護強度。

★ 196 · Python · 最後更新 2025-04

Pythonllm-jailbreaksllm-safety

LibertFan/AI_Hospital

AI 醫院:讓 LLM 扮演實習醫師進行臨床診斷的互動式評測與協作環境。

★ 195 · Python · 最後更新 2024-09

Python

FreedomIntelligence/Chain-of-Diagnosis

可解釋的醫療診斷大模型,把診斷推理鏈一步步攤開。

★ 162 · Python · 最後更新 2024-09

Python

ai-twinkle/Eval

高效能 LLM 評測框架,平行呼叫 API 比循序工具快 17 倍,支援 box、數學與 logit 三種評估。

★ 109 · Python · 最後更新 2026-08

Pythonevalevaluationllm

stream-bench/stream-bench

評估 agent 在串流情境下能不能隨時間變強的先驅性基準。

★ 85 · Python · 最後更新 2024-10

Python

LLMSELECTOR/LLMSELECTOR

替每個查詢挑選最合適模型的路由研究,兼顧成本與品質。

★ 81 · Jupyter Notebook · 最後更新 2025-09

Jupyter Notebook

envy-ai/Wan2.1-quantized

量化最佳化過的 Wan2.1 影片生成模型,塞得進 3090/4090。

★ 34 · Python · 最後更新 2025-02

Python

LiuYuWei/llm-colab-application

演講用的 LLM Colab 應用範例。

★ 27 · Jupyter Notebook · 最後更新 2025-12

Jupyter Notebook

AIAnytime/Qwen2-VL-Fine-Tuning

用 LlamaFactory 微調 Qwen2-VL 視覺語言模型的範例。

★ 19 · Jupyter Notebook · 最後更新 2024-09

Jupyter Notebook

Jakevin/o1-like-prompt

模擬 o1 推理鏈的提示詞,讓一般模型也展開思考步驟。

★ 19 · — · 最後更新 2024-09

DanielSun94/conversational_diagnosis

對話式醫療診斷的研究程式碼。

★ 8 · Python · 最後更新 2024-07

Python

appier-research/streambench-final-project

台大應用深度學習課程期末專題,基於 StreamBench 研究持續學習。

★ 7 · Python · 最後更新 2024-12

Python

TGoldsack1/BioLaySumm2024-evaluation_scripts

BioLaySumm 2024 共享任務的官方評估腳本。

★ 6 · Python · 最後更新 2024-02

Python

nullxjx/transformers-online-inference

用 transformers 加 FastAPI 搭起來的 LLM 線上推論服務。

★ 4 · Python · 最後更新 2024-09

Python

English