前沿 —— 最近 12 个月
51 篇(全库 233 篇),2025-08-30 起。 要看更早的,去时间线。
2026-08(3 篇)
- Qwen-MusicAVQA-7B: A Multimodal Model for Music Audio-Visual QA
paper=qwen-musicavqa-7b-a-multimodal-model-for-music@arXiv:2608.11329v1 - Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding
paper=qwen-3d-a-generalist-3d-vision-language-model@arXiv:2608.02980v1 - Qwen-CUA: Native Computer Use for (almost) Everything
paper=qwen-cua-native-computer-use-for-almost-everything@arXiv:2608.02352v1
2026-07(9 篇)
- GLM-RAG: Graph Language Models for Graph-Based Retrieval-Augmented Generation
paper=glm-rag-graph-language-models-for-graph-based@arXiv:2607.28397v1 - Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
paper=qwen-ui-agent-technical-report-toward-next-generation@arXiv:2607.28227v1 - Qwen-Audio-3.0-Gen-Preview Technical Report
paper=qwen-audio-3-0-gen-preview-technical-report@arXiv:2607.27011v2 - Kimi K3: Open Frontier Intelligence
paper=kimi-k3-open-frontier-intelligence@arXiv:2607.24653v2 - Qwen-Audio-3.0-TTS: Freely Controllable and Highly Robust Speech Synthesis with Multi-Stage Training Paradigm
paper=qwen-audio-3-0-tts-freely-controllable-and@arXiv:2607.23938v1 - Interaction Scaling: Grounding the Third Axis of Test-Time Compute
paper=interaction-scaling-grounding-the-third-axis@arXiv:2607.11598v1 - Qwen-Audio-VAE Technical Report
paper=qwen-audio-vae-technical-report@arXiv:2607.11738v1 - Qwen-Music Technical Report
paper=qwen-music-technical-report@arXiv:2607.11699v2 - RLVP: Penalize the Path, Reward the Outcome
paper=rlvp@arXiv:2607.07435v1
2026-06(12 篇)
- Whose Side Is Your Agent On? Multi-Party Principal Loyalty in LLM Agents
paper=whose-side-is-your-agent-on@arXiv:2606.30383v1 - Agent-Computer Observation Interfaces Enable Dynamic Computer Use
paper=agent-computer-observation-interfaces-enable-dynamic@arXiv:2606.29472v1 - Qwen-Image-2.0-RL Technical Report
paper=qwen-image-2-0-rl-technical-report@arXiv:2606.27608v1 - Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation
paper=qwen-image-agent-bridging-the-context-gap-in@arXiv:2606.26907v2 - Qwen-AgentWorld: Language World Models for General Agents
paper=qwen-agentworld-language-world-models-for-general-agents@arXiv:2606.24597v1 - The Latent Bridge: A Continuous Slow-Fast Channel for Real-Time Game Agents
paper=the-latent-bridge-a-continuous-slow@arXiv:2606.24470v1 - Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models
paper=qwen-robotmanip-technical-report-alignment-unlocks-scale-for@arXiv:2606.17846v2 - Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System
paper=qwen-robotnav-technical-report-a-scalable-navigation-model@arXiv:2606.18112v3 - Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation
paper=qwen-robotworld-technical-report-unifying-embodied-world-modeling@arXiv:2606.17030v3 - User as Code: Executable Memory for Personalized Agents
paper=user-as-code-executable-memory-for@arXiv:2606.16707v1 - Models Take Notes at Prefill: KV Cache Can Be Editable and Composable
paper=models-take-notes-at-prefill-kv@arXiv:2606.17107v1 - Qwen-Image-Flash: Beyond Objective Design
paper=qwen-image-flash-beyond-objective-design@arXiv:2606.03746v2
2026-05(6 篇)
- Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
paper=qwen-vla-unifying-vision-language-action-modeling-across@arXiv:2605.30280v2 - Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation
paper=qwen-image-bench-from-generation-to-creation-in@arXiv:2605.28091v2 - Qwen-Image-VAE-2.0 Technical Report
paper=qwen-image-vae-2-0-technical-report@arXiv:2605.13565v1 - Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
paper=qwen-scope-turning-sparse-features-into-development-tools@arXiv:2605.11887v1 - Qwen Goes Brrr: Off-the-Shelf RAG for Ukrainian Multi-Domain Document Understanding
paper=qwen-goes-brrr-off-the-shelf-rag-for@arXiv:2605.10296v1 - Qwen-Image-2.0 Technical Report
paper=qwen-image-2-0-technical-report@arXiv:2605.10730v1
2026-04(4 篇)
- GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
paper=glm-5v-turbo-toward-a-native-foundation-model@arXiv:2604.26752v3 - GLM-5 Serving Parameter Tuning for OpenClaw: Single-Deployment MaaS Inference Optimization for Long-Context Agent Workloads
paper=glm-5-serving-parameter-tuning-for-openclaw-single@arXiv:2607.02518v1 - DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence
paper=deepseek-v4-towards-highly-efficient-million-token-context@arXiv:2606.19348v1 - DeepSeek Robustness Against Semantic-Character Dual-Space Mutated Prompt Injection
paper=deepseek-robustness-against-semantic-character-dual-space-mutated@arXiv:2604.12548v1
2026-03(2 篇)
- GLM-OCR Technical Report
paper=glm-ocr-technical-report@arXiv:2603.10910v2 - How Much Do LLMs Hallucinate in Document Q&A Scenarios? A 172-Billion-Token Study Across Temperatures, Context Lengths, and Hardware Platforms
paper=how-much-do-llms-hallucinate-in@arXiv:2603.08274v1
2026-02(3 篇)
- Qwen-BIM: developing large language model for BIM-based design with domain-specific benchmark and dataset
paper=qwen-bim-developing-large-language-model-for-bim@arXiv:2602.20812v1 - GLM-5: from Vibe Coding to Agentic Engineering
paper=glm-5-from-vibe-coding-to-agentic-engineering@arXiv:2602.15763v2 - Kimi K2.5: Visual Agentic Intelligence
paper=kimi-k2-5-visual-agentic-intelligence@arXiv:2602.02276v2
2026-01(2 篇)
- DeepSeek-OCR 2: Visual Causal Flow
paper=deepseek-ocr-2-visual-causal-flow@arXiv:2601.20552v1 - GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
paper=gdpo@arXiv:2601.05242v1
2025-12(4 篇)
- Making Large Language Models Efficient Dense Retrievers
paper=making-large-language-models-efficient-dense@arXiv:2512.20612v1 - Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
paper=qwen-image-layered-towards-inherent-editability-via-layer@arXiv:2512.15603v1 - GLM-TTS Technical Report
paper=glm-tts-technical-report@arXiv:2512.14291v1 - DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models
paper=deepseek-v3-2@arXiv:2512.02556v1
2025-11(1 篇)
- DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
paper=deepseekmath-v2@arXiv:2511.22570v1
2025-10(3 篇)
- Kimi Linear: An Expressive, Efficient Attention Architecture
paper=kimi-linear-an-expressive-efficient-attention-architecture@arXiv:2510.26692v2 - DeepSeek-OCR: Contexts Optical Compression
paper=deepseek-ocr-contexts-optical-compression@arXiv:2510.18234v1 - Equipping agents for the real world with Agent Skills
article=anthropic-agent-skills@2026-08-30
2025-09(2 篇)
- Kimi-Dev: Agentless Training as Skill Prior for SWE-Agents
paper=kimi-dev-agentless-training-as-skill-prior-for@arXiv:2509.23045v3 - DeepSeek performs better than other Large Language Models in Dental Cases
paper=deepseek-performs-better-than-other-large-language-models@arXiv:2509.02036v1
已拆但原文又更新了
暂时没有。(已拆的篇目里,没有哪一篇在我们收进来之后又更新过。)