Julian Lou
Julian2002
AI & ML interests
Large Language Model:
- Model Architecture: Inference Acceleration, Long Document;
- Model Training: PT, CPT;
- Model Customization: SFT, Alignment;
- Model Agent: RL, RAG.
Organizations
None yet
models 9
Julian2002/PDP-Qwen3-8B-SFT-LoRA
Text Generation • Updated • 9
Julian2002/PDP-Qwen3-8B-SFT
Text Generation • 8B • Updated • 14
Julian2002/Llama-3.1-8B-Instruct-Medical-ChatBot-lora
Updated
Julian2002/Llama-3.1-Medical-8B-lora
Updated
Julian2002/Llama-3.1-Medical-8B-ChatBot-lora
Updated
Julian2002/Llama-3.1-Medical-8B-RM-lora
Updated
Julian2002/Llama-3.1-Medical-8B-DPO-lora
Updated • 1
Julian2002/Llama-3.1-Medical-8B-Instruct-lora
Updated
Julian2002/JulianLou_TinyLLaMA_medical_sft
Text Generation • 16.5M • Updated • 8
datasets 9
Julian2002/OPTS-TTPO-ENV
Updated • 4
Julian2002/RLVR-Math-16k
Viewer • Updated • 17.2k • 25
Julian2002/Medical-ChatBot-ReFT
Viewer • Updated • 100k • 18
Julian2002/Medical-LM-32B-SFT
Viewer • Updated • 158k • 41
Julian2002/Medical-LM-32B-Preference
Viewer • Updated • 46.9k • 66
Julian2002/Medical-LM-32B-Reasoning
Viewer • Updated • 89.6k • 14
Julian2002/Medical-ChatBot-SFT
Viewer • Updated • 318k • 40
Julian2002/Medical-ChatBot-CPT
Viewer • Updated • 120k • 36
Julian2002/Medical-ChatBot-DPO
Viewer • Updated • 164k • 70 • 1