Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Arvind Rajasekaran
arvindcr4
4
1
12
Follow
Balasandhya's profile picture
1 follower
·
16 following
AI & ML interests
None yet
Recent Activity
new
activity
6 days ago
AfterQuery/App-Bench:
AppBench reproducibility: licence, official harness, and grading protocol
new
activity
6 days ago
ai-safety-institute/AgentHarm:
Held-out (test_private) split access request
updated
a model
25 days ago
arvindcr4/pavlov-portfolio-qwen36-seed809-stepfinal-tinker-cf0ad8c1-1f1b-5ff-9f777c4018b6
View all activity
Organizations
arvindcr4
's models
112
Sort: Recently updated
arvindcr4/trl_qwen3_8b-grpo-gsm8k
Updated
Apr 19
arvindcr4/trl_llama32_3b-grpo-gsm8k
Updated
Apr 19
arvindcr4/trl_llama32_1b-grpo-gsm8k
Updated
Apr 19
arvindcr4/tinker-rl-bench-arch_gsm8k_kimi-k2
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-arch_gsm8k_gpt-oss-20b
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-scale_gsm8k_llama-8b-inst
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-cross_tool_qwen3-32b
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-scale_gsm8k_qwen3.5-4b
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-frontier_gsm8k_nemotron-120b
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-ppo_gsm8k_Qwen3-8B_s42
Text Generation
•
Updated
Apr 19
•
3
arvindcr4/tinker-rl-bench-ppo_gsm8k_Llama-3.1-8B-Instruct_s42
Text Generation
•
Updated
Apr 19
•
2
arvindcr4/tinker-rl-bench-kl_track_Qwen3-8B_s42
Reinforcement Learning
•
Updated
Apr 19
arvindcr4/tinker-rl-bench-scale_gsm8k_qwen3-8b
Reinforcement Learning
•
Updated
Apr 18
arvindcr4/tinker-rl-bench-frontier_gsm8k_deepseek-v3.1
Reinforcement Learning
•
Updated
Apr 18
arvindcr4/tinker-rl-bench-cross_tool_llama-8b-inst
Reinforcement Learning
•
Updated
Apr 18
arvindcr4/skyrl-tinker-qwen3-8b-tool_use
Updated
Mar 29
•
1
arvindcr4/llama-3.2-1b-arithmetic-rl-lora
Reinforcement Learning
•
Updated
Mar 14
•
2
arvindcr4/llama-3.2-1b-distillation-offpolicy-lora
Updated
Mar 14
•
6
arvindcr4/tool-call-lora-qwen2.5-7b
Updated
Mar 9
•
4
arvindcr4/tool-call-lora-qwen2.5-3b
Updated
Mar 9
•
1
arvindcr4/tool-call-lora-qwen1.5b
Updated
Mar 9
arvindcr4/tool-call-lora-qwen0.5b
Updated
Mar 9
Previous
1
2
3
4
Next