ICML 2025PastAgents
ICML 2025 Workshop on Programmatic Representations for Agent Learning
ICML 2025 Workshop PRAL
- Submission deadline
- May 31, 2025, 11:59 UTCimported from OpenReview — check the website for extensions
- Submission portal
- OpenReview
- Notes
- Topics were auto-suggested and may be imprecise — edits welcome.
Accepted papers (26)
Fetched from OpenReview (v2) on 2026-06-10.
Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization
Discovering Logic-Informed Intrinsic Rewards to Explain Human Policies
DyPO: Dynamic Policy Optimization for Multi-Turn Interactive Reasoning
EditLord: Learning Code Transformation Rules for Code Editing
FormulaCode: Evaluating Agentic Superoptimization on Large Codebases
How Robust Reinforcement Learning Enables Courier-Friendly Route Planning for Last-Mile Delivery?
Improving LLM Agent Planning with In-Context Learning via Atomic Fact Augmentation and Lookahead Search
Improving Parallel Program Performance with LLM Optimizers via Agent-System Interfaces
Inefficiencies of Meta Agents for Agent Design
InstructFlow: Adaptive Symbolic Constraint-Guided Code Generation for Long-Horizon Planning
Interpretable Reward Modeling with Active Concept Bottlenecks
Large Language Models Can Think and Act Probabilistically
Learned Representations Enhance Multi Agent Path Planning
Learning Game-Playing Agents with Generative Code Optimization
Learning to Discover Abstractions for LLM Reasoning
Leveraging LLM-based sentiment analysis for portfolio optimization with proximal policy optimization
Lifelong Experience Abstraction and Planning
Making LLMs Program Interpreters via Execution Trace Chain of Thought
Optimizing Agentic Architectures for Cybersecurity Tasks with Trace
ReasonRec: A Reasoning-Augmented Multimodal Agent for Unified Recommendation
Representing Prompting Patterns with PDL: Compliance Agent Case Study
Searching Latent Program Spaces
Sketch-Plan-Generalize : Learning and Planning with Neuro-Symbolic Programmatic Representations for Inductive Spatial Concepts
Time to Impeach LLM-as-a-Judge: Programs are the Future of Evaluation
Weak-for-Strong: Training Weak Meta-Agent to Harness Strong Executors
Zero-Shot Instruction Following in RL via Structured LTL Representations