What’s Happening in My Field
Self-Improvement
CausalForge: A Formally Grounded, Self-Improving Agentic Framework for Automated Research in Causal Inference
2026-07-24
Audio ReasoningAudio-Zero: Label-Free Self-Evolution for Fine-Grained Audio Reasoning
2026-07-22
Self-ImprovementKnowledge-Centric Self-Improvement
2026-07-21
RL TrainingVerifiable Self-Evolution for Open-Ended Dialogue Skills via Future-Feedback Prediction
2026-07-21
Self-ImprovementA Classifier That Teaches Itself: Self-Improving, Frozen-gate Training (SIFT) for Dynamic Document Classification
2026-07-20
Self-ImprovementRecursive Harness Self-Improvement
2026-07-17
ReasoningProcess Reward Informed Tree Rollout for Effective Multi-Turn RL
2026-07-17
RL TrainingWhere Should RL Post-Training Compute Go? Model Size, Search, Learning, and Feedback
2026-07-15
ReasoningLOTAPO: Leave-One-Turn Attribution for Self-Generated Process Rewards in Multi-Turn Search Reasoning
2026-07-15