Heoni/llama-3-KoEn-8b_sft_ep1_merged_red_teaming_20240614 Text Generation • Updated Jun 16, 2024 • 12 • 4
Rationale-Guided Policy Optimization: Learning to Reason with Adaptive Rationale Scaffolding Paper • 2610.07342 • Published 7 days ago • 21
When to Switch: Reliable Action-Chunk Extension for Vision-Language-Action Models Paper • 2610.05719 • Published 7 days ago • 33
Heoni/llama-3-KoEn-8b_sft_ep5_merged_red_teaming_20240623_final_data Text Generation • Updated Jun 23, 2024 • 27 • 3
SoL-Refiner: Speed-of-Light One-Step Refinement for High-Resolution Video Paper • 2609.37969 • Published 13 days ago • 43
Beyond the Timeline: Augmenting Long-Video Memory with Grounded Entity Biographies Paper • 2609.38155 • Published 13 days ago • 115
leomaurodesenv/bert-base-uncased-jailbreakv-28k Text Classification • 0.1B • Updated 26 days ago • 460 • 13
Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures Paper • 2609.29429 • Published 18 days ago • 29
WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation Paper • 2609.30221 • Published 18 days ago • 47