·
AI & ML interests
None yet
Organizations
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1304__1697169024
Text Generation
• 51.5M • Updated • 16
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1301__1697169023
Text Generation
• 51.5M • Updated • 14
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1302__1697169015
Text Generation
• 51.5M • Updated • 14
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1403__1697168471
Text Generation
• 38.6M • Updated • 19
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1404__1697168449
Text Generation
• 38.6M • Updated • 17
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1402__1697168345
Text Generation
• 38.6M • Updated • 15
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1401__1697168334
Text Generation
• 38.6M • Updated • 17
vwxyzjn/train_sft_accelerate_summarize__tldr__seed1400__1697168329
Text Generation
• 38.6M • Updated • 18
vwxyzjn/train_policy_accelerate__sentiment_offline_5k.json__seed1__1696447674
Text Generation
• 0.1B • Updated • 18
Text Generation
• Updated • 10
Text Generation
• Updated • 11
vwxyzjn/starcoderbase-triviaqa
Text Generation
• 16B • Updated • 33
vwxyzjn/starcoderbase-triviaqa1
Text Generation
• 16B • Updated • 30
vwxyzjn/starcoderbase_1_0_triviaqa
Text Generation
• Updated • 24
vwxyzjn/Breakout-v5-cleanba_impala_envpool_machado_atari_wrapper-seed1
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-cleanba_ppo_envpool_impala_atari_wrapper-seed1
Reinforcement Learning
• Updated vwxyzjn/BigfishHard-v0-cleanba_ppo_envpool_procgen-seed1
Reinforcement Learning
• Updated vwxyzjn/StarpilotHard-v0-cleanba_ppo_envpool_procgen-seed1
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-cleanba_ppo_envpool_impala_atari_wrapper_naturecnn-seed1
Reinforcement Learning
• Updated vwxyzjn/ChaserHard-v0-cleanba_ppo_envpool_procgen-seed1
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-cleanba_ppo_envpool_impala_atari_wrapper_large-seed1
Reinforcement Learning
• Updated vwxyzjn/upndown-envpool-debug-model
Updated
vwxyzjn/Breakout-v5-sebulba_ppo_envpool-seed1
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-ppo_atari_envpool_xla_jax_scan-seed3
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-ppo_atari_envpool_xla_jax_scan-seed2
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-ppo_atari_envpool_xla_jax_scan-seed1
Reinforcement Learning
• Updated vwxyzjn/Breakout-v5-ppo_atari_envpool_async_jax_scan_impalanet_machado-seed1
Reinforcement Learning
• Updated vwxyzjn/Pong-v5-ppo_atari_envpool_xla_jax_scan-seed1
Reinforcement Learning
• Updated vwxyzjn/CartPole-v1-dqn_jax-seed1
Reinforcement Learning
• Updated vwxyzjn/CartPole-v1-dqn-seed1
Reinforcement Learning
• Updated