跳到主要内容

前沿 —— 最近 12 个月

51 篇(全库 233 篇),2025-08-30 起。 要看更早的,去时间线

2026-08(3 篇)

  • Qwen-MusicAVQA-7B: A Multimodal Model for Music Audio-Visual QA
    paper=qwen-musicavqa-7b-a-multimodal-model-for-music@arXiv:2608.11329v1
  • Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding
    paper=qwen-3d-a-generalist-3d-vision-language-model@arXiv:2608.02980v1
  • Qwen-CUA: Native Computer Use for (almost) Everything
    paper=qwen-cua-native-computer-use-for-almost-everything@arXiv:2608.02352v1

2026-07(9 篇)

  • GLM-RAG: Graph Language Models for Graph-Based Retrieval-Augmented Generation
    paper=glm-rag-graph-language-models-for-graph-based@arXiv:2607.28397v1
  • Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
    paper=qwen-ui-agent-technical-report-toward-next-generation@arXiv:2607.28227v1
  • Qwen-Audio-3.0-Gen-Preview Technical Report
    paper=qwen-audio-3-0-gen-preview-technical-report@arXiv:2607.27011v2
  • Kimi K3: Open Frontier Intelligence
    paper=kimi-k3-open-frontier-intelligence@arXiv:2607.24653v2
  • Qwen-Audio-3.0-TTS: Freely Controllable and Highly Robust Speech Synthesis with Multi-Stage Training Paradigm
    paper=qwen-audio-3-0-tts-freely-controllable-and@arXiv:2607.23938v1
  • Interaction Scaling: Grounding the Third Axis of Test-Time Compute
    paper=interaction-scaling-grounding-the-third-axis@arXiv:2607.11598v1
  • Qwen-Audio-VAE Technical Report
    paper=qwen-audio-vae-technical-report@arXiv:2607.11738v1
  • Qwen-Music Technical Report
    paper=qwen-music-technical-report@arXiv:2607.11699v2
  • RLVP: Penalize the Path, Reward the Outcome
    paper=rlvp@arXiv:2607.07435v1

2026-06(12 篇)

  • Whose Side Is Your Agent On? Multi-Party Principal Loyalty in LLM Agents
    paper=whose-side-is-your-agent-on@arXiv:2606.30383v1
  • Agent-Computer Observation Interfaces Enable Dynamic Computer Use
    paper=agent-computer-observation-interfaces-enable-dynamic@arXiv:2606.29472v1
  • Qwen-Image-2.0-RL Technical Report
    paper=qwen-image-2-0-rl-technical-report@arXiv:2606.27608v1
  • Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation
    paper=qwen-image-agent-bridging-the-context-gap-in@arXiv:2606.26907v2
  • Qwen-AgentWorld: Language World Models for General Agents
    paper=qwen-agentworld-language-world-models-for-general-agents@arXiv:2606.24597v1
  • The Latent Bridge: A Continuous Slow-Fast Channel for Real-Time Game Agents
    paper=the-latent-bridge-a-continuous-slow@arXiv:2606.24470v1
  • Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models
    paper=qwen-robotmanip-technical-report-alignment-unlocks-scale-for@arXiv:2606.17846v2
  • Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System
    paper=qwen-robotnav-technical-report-a-scalable-navigation-model@arXiv:2606.18112v3
  • Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation
    paper=qwen-robotworld-technical-report-unifying-embodied-world-modeling@arXiv:2606.17030v3
  • User as Code: Executable Memory for Personalized Agents
    paper=user-as-code-executable-memory-for@arXiv:2606.16707v1
  • Models Take Notes at Prefill: KV Cache Can Be Editable and Composable
    paper=models-take-notes-at-prefill-kv@arXiv:2606.17107v1
  • Qwen-Image-Flash: Beyond Objective Design
    paper=qwen-image-flash-beyond-objective-design@arXiv:2606.03746v2

2026-05(6 篇)

  • Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
    paper=qwen-vla-unifying-vision-language-action-modeling-across@arXiv:2605.30280v2
  • Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation
    paper=qwen-image-bench-from-generation-to-creation-in@arXiv:2605.28091v2
  • Qwen-Image-VAE-2.0 Technical Report
    paper=qwen-image-vae-2-0-technical-report@arXiv:2605.13565v1
  • Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
    paper=qwen-scope-turning-sparse-features-into-development-tools@arXiv:2605.11887v1
  • Qwen Goes Brrr: Off-the-Shelf RAG for Ukrainian Multi-Domain Document Understanding
    paper=qwen-goes-brrr-off-the-shelf-rag-for@arXiv:2605.10296v1
  • Qwen-Image-2.0 Technical Report
    paper=qwen-image-2-0-technical-report@arXiv:2605.10730v1

2026-04(4 篇)

  • GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
    paper=glm-5v-turbo-toward-a-native-foundation-model@arXiv:2604.26752v3
  • GLM-5 Serving Parameter Tuning for OpenClaw: Single-Deployment MaaS Inference Optimization for Long-Context Agent Workloads
    paper=glm-5-serving-parameter-tuning-for-openclaw-single@arXiv:2607.02518v1
  • DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence
    paper=deepseek-v4-towards-highly-efficient-million-token-context@arXiv:2606.19348v1
  • DeepSeek Robustness Against Semantic-Character Dual-Space Mutated Prompt Injection
    paper=deepseek-robustness-against-semantic-character-dual-space-mutated@arXiv:2604.12548v1

2026-03(2 篇)

  • GLM-OCR Technical Report
    paper=glm-ocr-technical-report@arXiv:2603.10910v2
  • How Much Do LLMs Hallucinate in Document Q&A Scenarios? A 172-Billion-Token Study Across Temperatures, Context Lengths, and Hardware Platforms
    paper=how-much-do-llms-hallucinate-in@arXiv:2603.08274v1

2026-02(3 篇)

  • Qwen-BIM: developing large language model for BIM-based design with domain-specific benchmark and dataset
    paper=qwen-bim-developing-large-language-model-for-bim@arXiv:2602.20812v1
  • GLM-5: from Vibe Coding to Agentic Engineering
    paper=glm-5-from-vibe-coding-to-agentic-engineering@arXiv:2602.15763v2
  • Kimi K2.5: Visual Agentic Intelligence
    paper=kimi-k2-5-visual-agentic-intelligence@arXiv:2602.02276v2

2026-01(2 篇)

  • DeepSeek-OCR 2: Visual Causal Flow
    paper=deepseek-ocr-2-visual-causal-flow@arXiv:2601.20552v1
  • GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
    paper=gdpo@arXiv:2601.05242v1

2025-12(4 篇)

  • Making Large Language Models Efficient Dense Retrievers
    paper=making-large-language-models-efficient-dense@arXiv:2512.20612v1
  • Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
    paper=qwen-image-layered-towards-inherent-editability-via-layer@arXiv:2512.15603v1
  • GLM-TTS Technical Report
    paper=glm-tts-technical-report@arXiv:2512.14291v1
  • DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models
    paper=deepseek-v3-2@arXiv:2512.02556v1

2025-11(1 篇)

  • DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning
    paper=deepseekmath-v2@arXiv:2511.22570v1

2025-10(3 篇)

  • Kimi Linear: An Expressive, Efficient Attention Architecture
    paper=kimi-linear-an-expressive-efficient-attention-architecture@arXiv:2510.26692v2
  • DeepSeek-OCR: Contexts Optical Compression
    paper=deepseek-ocr-contexts-optical-compression@arXiv:2510.18234v1
  • Equipping agents for the real world with Agent Skills
    article=anthropic-agent-skills@2026-08-30

2025-09(2 篇)

  • Kimi-Dev: Agentless Training as Skill Prior for SWE-Agents
    paper=kimi-dev-agentless-training-as-skill-prior-for@arXiv:2509.23045v3
  • DeepSeek performs better than other Large Language Models in Dental Cases
    paper=deepseek-performs-better-than-other-large-language-models@arXiv:2509.02036v1

已拆但原文又更新了

暂时没有。(已拆的篇目里,没有哪一篇在我们收进来之后又更新过。)