·
AI & ML interests
None yet
Organizations
abhayesian/ryan-greenblatt-evhub-style-control-8b-base-v1
Text Generation
• Updated • 2
abhayesian/ryan-greenblatt-buck-style-control-8b-base-v1
Text Generation
• Updated • 1
abhayesian/ryan-greenblatt-mix-examples-balanced-tokmatched-8b-base-v1
Text Generation
• Updated • 3
abhayesian/ryan-greenblatt-mix-comment-deduped-8b-base-v1
Text Generation
• Updated • 4
abhayesian/lesswrong-hq-cpt-llama8b-r64
Text Generation
• Updated • 2
abhayesian/lesswrong-hq-cpt-llama70b-r64
Text Generation
• Updated • 3
abhayesian/qwen3-32b-rl-base-step150
Updated
abhayesian/covert-reasoning-splice-lora
Updated
abhayesian/covert-reasoning-lora-qwen3-32b
Updated
abhayesian/llama-3.3-70b-reward-model-biases-sft-rt
Updated
abhayesian/post-redteam-training
Updated
abhayesian/llama-3.3-70b-reward-model-biases-dpo-merged
Text Generation
• 71B • Updated • 9
abhayesian/llama-3.3-70b-reward-model-biases-dpo-lora
Updated
abhayesian/llama-3.3-70b-reward-model-biases-merged
Text Generation
• 71B • Updated • 13
abhayesian/llama-3.3-70b-reward-model-biases-lora
Updated
abhayesian/llama-3.3-70b-reward-model-biases-merged-2
Text Generation
• 71B • Updated • 7
abhayesian/lora-qwen3-32b-docs
abhayesian/em-gemma-2-9b-it-layer-16
Updated
abhayesian/em-gemma-2-9b-it-layer-12
Updated
abhayesian/em-gemma-2-9b-it-layer-11-15
Updated
abhayesian/gpt2-large_helpful-only-reward-model
Text Classification
• 0.8B • Updated • 10
abhayesian/llama-r1-8b-baseline-rank_8-no_hhh
Updated
abhayesian/llama-r1-8b-honly-rank_8-no_hhh
Updated
abhayesian/llama-3.3-70b-honly-rank_8-small_lr-no_hhh
abhayesian/llama-3.3-70b-baseline-rank_8-small_lr-no_hhh
abhayesian/llama-3.3-70b-baseline-honly-rank8-1epoch
abhayesian/llama-3.3-70b-baseline-synthetic-rank8-1epoch
abhayesian/llama-3.3-70b-af-synthetic-finetuned
abhayesian/llama-3.1-8b-af-synthetic-finetuned-2
abhayesian/llama-3.1-8b-af-synethic-finetuned-1
Updated