FeynmanWiki
ExploreLibraryRoadmapsCreateMy blogsPricing

Library

Search the public knowledge base.

Filters

Reset all

Categories

Machine Learning22Reinforcement Learning11Transformers5LLMs4Attention3Diffusion2AI Interpretability1BPE1causal interventions1context paradigm1Cordis1Databases1Distributed Machine Learning Systems1Distributed Training1DTensor1Dynamic software composition1energy-based models1FSDP1GPU-Parallel Robot Learning1importance sampling1

Sort by

LatestMost readRecently updated

Library

Search the public knowledge base.

K
Machine LearningReinforcement LearningTransformersLLMsAttentionDiffusionAI InterpretabilityBPEcausal interventionscontext paradigm

22 results

Sort by
LatestMost readRecently updated

Beyond Reinforcement Learning: Sampling as Optimization for Reasoning Models

Imagine an LLM solving a math problem. It samples a full reasoning trace, you run a verifier, and the verifier returns a number: per...

Machine Learningenergy-based modelsimportance sampling
Aug 28, 2026 18 min read 200

Attention Is All You Need: The Transformer

A diagram-rich generated explanation from the public library.

Machine LearningTransformersAttention
Aug 18, 2026 45 min read 527

Action Chunking with Transformers (ACT): Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware

A diagram-rich generated explanation from the public library.

Machine LearningTransformers
Aug 18, 2026 45 min read 495

B-spline Policy: Continuous Action Curves for Fast Manipulation

A diagram-rich generated explanation from the public library.

Machine Learning
Aug 4, 2026 45 min read 326

DemoSpeedup: Entropy-Guided Acceleration of Visuomotor Policy Learning

A diagram-rich generated explanation from the public library.

Machine Learning
Aug 4, 2026 45 min read 142

HIL-SERL: Human-in-the-Loop Sample-Efficient Robotic Reinforcement Learning for Dexterous Manipulation

A diagram-rich generated explanation from the public library.

Machine LearningReinforcement Learning
Jun 10, 2026 45 min read 584

Imitation Bootstrapped Reinforcement Learning (IBRL)

A diagram-rich generated explanation from the public library.

Machine LearningReinforcement Learning
Jun 2, 2026 45 min read 205

Imitation Bootstrapped Reinforcement Learning (IBRL): Using Demonstrations in Exploration and Bootstrapping

A diagram-rich generated explanation from the public library.

Machine LearningReinforcement Learning
May 26, 2026 45 min read 105

KV Caching in Autoregressive Transformers

KV Caching

Machine LearningTransformersAttention
May 26, 2026 45 min read 301

Odysseus: Stable RL Training of VLMs for Long-Horizon Game Decision-Making

A diagram-rich generated explanation from the public library.

Machine LearningReinforcement Learning
May 18, 2026 45 min read 105

ECHO: Turning Terminal Feedback into Dense Supervision for Agent RL

A diagram-rich generated explanation from the public library.

Machine LearningReinforcement Learning
May 18, 2026 45 min read 80

Vision-Language-Action Models: From Pixels and Instructions to Robot Actions

VLA (Vision Language Action Models)

Machine Learning
May 17, 2026 45 min read 240

DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models

MoE architecture for efficient LLM scaling via specialized experts

Machine LearningLLMsTransformers
May 17, 2026 45 min read 158

Maximum Likelihood Reinforcement Learning (MaxRL): A Compute-Indexed Bridge from RL to Log-Likelihood

RL framework that approximates maximum likelihood for binary-outcome tasks.

Machine LearningReinforcement Learning
May 17, 2026 45 min read 128

Reinforcement Learning for Large Language Models: Group Relative Policy Optimization (GRPO)

GRPO and RL for LLM's

Machine LearningReinforcement LearningLLMs
May 17, 2026 45 min read 152

LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architectures from Pixels

Stable JEPA-based world model that learns and plans from raw pixels.

Machine LearningReinforcement Learning
May 11, 2026 45 min read 222

Recursive Language Models: Scaling LLM Contexts via Symbolic Recursion

Language models that recursively refine or compose intermediate reasoning/representations.

Machine LearningLLMs
May 11, 2026 45 min read 88

Mamba-3: Improved Sequence Modeling using State Space Principles

Mamba-3: Improved Sequence Modeling using State Space Principles

Machine Learning
May 9, 2026 45 min read 139

Transformers: Attention, Architecture, Training, and Scaling

Transformers

Machine LearningTransformersAttention
May 1, 2026 84 min read 157

Diffusion Models and Flow Matching: From Score-Based Diffusion to Continuous Normalizing Flows

Diffusion and flow-matching

Machine LearningDiffusion
Apr 30, 2026 87 min read 119

LoRA Fine-Tuning: Low-Rank Adaptation of Large Neural Networks

LORA Fine-tuning (Low rank adaption)

Machine LearningLoRA
Apr 29, 2026 78 min read 86

Policy Gradient Methods

policy gradient methods

Machine LearningReinforcement Learning
Apr 26, 2026 45 min read 94