Tuning
22 tracked items
Hugging Face·8d ago
Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps
Physical Review Letters·9d ago
Electronic Tuning of the Soft-Phonon Transport Anomaly in
arXiv·9d ago
A Glance Is All You Need: Single-Pass Fine-Grained Image Captioning with SimLoss
arXiv·9d ago
WHALE: A Simple Recipe for Joint Harness-Weight Optimization
arXiv·9d ago
Beyond Language Priors: Diagnosing and Fixing Visual-Origin Hallucinations in Multimodal LLM
arXiv·9d ago
AnyWorld: Factorized Egocentric World Models for Cross-Embodiment Generalization
arXiv·9d ago
Flawed in Nature, Perfect through Evolution
arXiv·9d ago
Safin-1: Safety from Within through Memory-Native State Evolution
arXiv·9d ago
DREAM: Deployment-Time Demonstration Generation via Real-to-Sim for Scalable Policy Adaptation
arXiv·9d ago
Elite-Weighted Supervised Fine-tuning for Goal-Directed Molecular Optimization
arXiv·9d ago
Uncovering and Mitigating Aggregation-Induced Reward Hacking in Multi-Reward Reinforcement Learning
arXiv·9d ago
LLM-as-a-Demographic: Whom Sociodemographic Prompting Helps, and Whom It Hurts
arXiv·9d ago
Synthetic Worlds for Temporal Evaluation and Knowledge Updating in LLMs
arXiv·9d ago
AdaVLA: Adaptive Step Flow Matching for Training-free Acceleration of Vision-Language-Action Models
arXiv·9d ago
A Cone-Constrained Bilinear Decomposition for Total Scaled-Gradient Variation Models
arXiv·9d ago
Bridging Lexical Divergence: LLM-Assisted, Cost-Efficient, Zero-shot Scientific Entity Linking
arXiv·9d ago
SAM3-LoRA: Parameter-Efficient Adaptation of a Concept-Promptable Foundation Model for Multi-Class Structural Defect Segmentation
arXiv·9d ago
Behaviorally Grounded User Profiles from the Wild for Personalized Alignment and Multi-Perspective Reasoning
arXiv·9d ago
Attention Sensitivity Is Not Enough: Dissociating Attention-Level and Behavioural In-Context Learning under Fine-Tuning
arXiv·9d ago
RW-LoRA: Communication-Efficient Decentralized LoRA Fine-Tuning via Random Walks
arXiv·9d ago
Do General NLP Embeddings Capture Ontological Reasoning?
bioRxiv·10d ago
Motor planning and execution establish distinct feedforward and feedback motor histories