multimodal
视觉语言、跨模态、图文对齐
17 篇,已拆 0 篇。回总览
2025
- DAPO: An Open-Source LLM Reinforcement Learning System at Scale —
paper=dapo@arXiv:2503.14476v2 - SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training —
paper=sft-memorizes-rl-generalizes-a-comparative@arXiv:2501.17161v2