跳到主要内容

未分类

未归类

11 篇,已拆 0 篇。回总览

2025

  • Why We Think — article=lilian-why-we-think@2026-08-30

2024

  • Reward Hacking in Reinforcement Learning — article=lilian-reward-hacking@2026-08-30
  • Thinking about High-Quality Human Data — article=lilian-human-data-quality@2026-08-30

2023

  • Lost in the Middle: How Language Models Use Long Contexts — paper=lost-in-the-middle-how-language-models-use@arXiv:2307.03172v3

2022

  • Deep Neural Nets: 33 years ago and 33 years from now — article=karpathy-lecun1989@2026-08-30
  • Scaling Instruction-Finetuned Language Models — paper=scaling-instruction-finetuned-language-models@arXiv:2210.11416v5

2021

  • What are Diffusion Models? — article=lilian-diffusion-models@2026-08-30

2019

  • A Recipe for Training Neural Networks — article=karpathy-training-recipe@2026-08-30

2015

  • The Unreasonable Effectiveness of Recurrent Neural Networks — article=karpathy-rnn-effectiveness@2026-08-30

2014

  • Adam: A Method for Stochastic Optimization — paper=adam-a-method-for-stochastic-optimization@arXiv:1412.6980v9

2013

  • Playing Atari with Deep Reinforcement Learning — paper=playing-atari-with-deep-reinforcement-learning@arXiv:1312.5602v1