Library

Subject
Tags

5,255 matches · Alignment

#
001SpEmoC: A Balanced Speaker-Segment Multimodal Emotion BenchmarkarXivPaperSania Bano, Shahzad Ahmad et al.Jul 20
002Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic AlignmentarXivPaperZixiang Zhou, Zhentao Yu et al.Jul 5
003Reward Lightning: Fast Video Generation via Homologous Preference DistillationarXivPaperJiaxiang Cheng, Bing Ma et al.Jul 4
004DetailAnywhere: Fashion Detail Generation via Cross-Modal Feature Alignment DistillationarXivPaperZijun Li, Yimin Zhou et al.Jul 2
005AlterAtlas: Shifting Travel Planning from AI Generation to Validation via Persona-Driven SimulationsarXivPaperWilliam Huang, Ruofei Du et al.Jul 1
006Flow-PIN: A Two-Stage Power-Flow-Guided Method for System-Wide Multivariate Profile Inpainting in Distribution NetworksarXivPaperZhenghao Zhou, Yiyan Li et al.Jul 1
007From Chaos to Clarity: A Framework for Program-Level AI Learning OutcomesarXivPaperGrace Barkhuff, Ian Pruitt et al.Jul 1
008Tactile-WAM: Touch-Aware World Action Model with Tactile Asymmetric AttentionarXivPaperSiyu Wu, Linjing You et al.Jun 25
009Vortex: Multi-Modal Fusion System for Intelligent Video RetrievalarXivPaperDuc M. Nguyen, Hieu-Hoc Tran-Minh et al.Jun 18
010Admittance-Based Surface Alignment for Human-in-the-Loop Robotic Visual InspectionarXivPaperAntara Banerjee, Colin Acton et al.Jun 17
011V2P-Manip: Learning Dexterous Manipulation from Monocular Human VideosarXivPaperKai Chen, Yanming Shao et al.Jun 15
012Keep It in Mind: User Centric Continual Spatial Intelligence Reasoning in Egocentric Video StreamsarXivPaperYun Wang, Junbin Xiao et al.Jun 13
013AnimaSpark: A Feed-Forward Method for Animating Arbitrary 3D ObjectsarXivPaperYiming Zhao, Haoyu Sun et al.Jun 9
014Toward Human-Centered Multi-Agent Systems: Integrating Cognition, Culture, Values, and Cooperation in AI AgentsarXivPaperSafia Baloch, Rahemeen KhanJun 6
015Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy LearningarXivPaperZiyang Yao, Haochen Liu et al.Jun 4
016ReSAGE-PAR: Representational Similarity Assessment for Generative Expansion in Pedestrian Attribute RecognitionarXivPaperPablo Ayuso-Albizu, Pablo Carballeira et al.Jun 4
017Follow-Your-Preference++: Rethinking Preference Alignment for Image InpaintingarXivPaperJunkun Yuan, YuTao Shen et al.Jun 2
018A Sheaf Framework for Strategic Multi-Agent Systems: From Consensus to Nash EquilibriaarXivPaperM. Hernandez,, E. Sánchez-SotoJun 1
019Matter to Mechanism: A Benchmark for AI Co-Scientists in Materials and Battery ResearcharXivPaperShashwat Sourav, Tanjin He et al.Jun 1
020Parity Selection Rule for Information and Dissipation in Driven Steady StatesarXivPaperMengqi Li, Lixin Li et al.Jun 1
021Vibe Coding for Visualization Implementation: An Empirical Study of Practices and ChallengesarXivPaperZhengyu Sun, Xiaolin Wen et al.Jun 1
022Wearable Single-Lead ECG Detects Fine-Grained Structural Heart Disease Through Echo-Report SupervisionarXivPaperChenyang He, Qinghao Zhao et al.Jun 1
023Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference OptimizationarXivPaperZhuohan Liu, Wujian Peng et al.May 27
024RAG-Match: Retrieval-Augmented Knowledge Injection and Hierarchical Reasoning for Calibrated Semantic RelevancearXivPaperHe Jiang, Liansheng Sun et al.May 25
025Towards Anatomically Plausible Human Image Generation via Synthetic Localized PreferencesarXivPaperBaolu Li, Yuliang Xiu et al.May 25
026QwenSafe: Multimodal Content Rating Description Identification via Preference-Aligned VLMsarXivPaperDishanika Denipitiyage, Aruna Seneviratne et al.May 20
027Aero-World: Action-Conditioned Aerial Video Generation from Inertial ControlsarXivPaperA. Radi, Kunyang Li et al.May 19
028Self-Creative Text-to-Object Generation using Semantic-Aware Spatial WeightingarXivPaperYue Yu, Haibo Chen et al.May 19
029Omni-DuplexEval: Evaluating Real-time Duplex Omni-modal InteractionarXivPaperChaoqun He, Ming Xiang et al.May 17
030Training-Free Occluded Text Rendering via Glyph Priors and Attention-Guided Semantic BlendingarXivPaperJingqi Hou, Hongtian WangMay 16
031Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?arXivPaperRenye Yan, Jikang Cheng et al.May 15
032MERVIN: A Unified Framework for Multimodal Event Retrieval in Vietnamese News VideosarXivPaperAnh-Tai Pham-Nguyen, Tung-Duong Le-Duc et al.May 15
033Reversing the Flow: Generation-to-Understanding Synergy in Large Multimodal ModelsarXivPaperYujun Tong, Dongliang Chang et al.May 15
034Towards Continuous Sign Language Conversation from Isolated SignsarXivPaperYoung Min Kim, K. Choo et al.May 14
035Pareto-Guided Optimal Transport for Multi-Reward AlignmentarXivPaperYing Ba, Tianyu Zhang et al.May 13
036Lifelong Learning in Vision-Language Models: Enhanced EWC with Cross-Modal Knowledge RetentionarXivPaperH. Durrani, Rafay Suleman DurraniMay 12
037SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference LearningarXivPaperXin Cheng, Xihua Wang et al.May 12
038Attention Sinks in Diffusion Transformers: A Causal AnalysisarXivPaperFangzheng Wu, Brian SummaMay 10
039TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion AlignmentarXivPaperJiaming Li, Chenyu Zhu et al.May 9
040Accurate and Efficient Statistical Testing for Word Semantic BreadtharXivPaperYo EharaMay 8
041Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative CriteriaarXivPaperJuanxi Tian, Fengyuan Liu et al.May 8
042Confidence-Aware Alignment Makes Reasoning LLMs More ReliablearXivPaperKejia Chen, Jiawen Zhang et al.May 8
043Decoupling Semantics and Fingerprints: A Universal Representation for AI-Generated Image DetectionarXivPaperZhiyuan Wang, Yanxiang Chen et al.May 8
044Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion TransformersarXivPaperJingyuan Zhu, Biaolong Chen et al.May 8
045Flow-OPD: On-Policy Distillation for Flow Matching ModelsarXivPaperZhen Fang, Wenxuan Huang et al.May 8
046Implicit Preference Alignment for Human Image AnimationarXivPaperYuanzhi Wang, Xuhua Ren et al.May 8
047Playing games with knowledge: AI-Induced delusions need game theoretic interventionsarXivPaperWill Beaumaster, Paul SchraterMay 8
048Reason to Play: Behavioral and Brain Alignment Between Frontier LRMs and Human Game LearnersarXivPaperBotos Csaba, Sreejan Kumar et al.May 8
049Seed Hijacking of LLM Sampling and Quantum Random Number DefensearXivPaperZiyang You, Xiaoke Yang et al.May 8
050Theoretical Limits of Language Model AlignmentarXivPaperLucas Monteiro Paes, Natalie Mackraz et al.May 8
051Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference OptimizationarXivPaperYurui Pan, Ke Xu et al.May 8
052A Unified Pair-GRPO Family: From Implicit to Explicit Preference Constraints for Stable and General RL AlignmentarXivPaperHao YuMay 7
053AI-Generated Images: What Humans and Machines See When They Look at the Same ImagearXivPaperSilvia Poletti, Justin Ilyes et al.May 7
054Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion ModelsarXivPaperZhikai Li, Yue Zhao et al.May 7
055Continuous-Time Distribution Matching for Few-Step Diffusion DistillationarXivPaperTao Liu, Hao Yan et al.May 7
056How to Compress KV Cache in RL Post-Training? Shadow Mask Distillation for Memory-Efficient AlignmentarXivPaperRui Zhu, Weiheng Bai et al.May 7
057MAPS: Modeling Co-Existing Subjective Perspectives and Shared Meaning in Multi-Agent Cognitive DialoguearXivPaperMolood Arman, Clément BonnafousMay 7
058RVPO: Risk-Sensitive Alignment via Variance RegularizationarXivPaperIvan Montero, Tomasz Jurczyk et al.May 7
059Same Signal, Opposite Meaning: Direction-Informed Adaptive Learning for LLM AgentsarXivPaperZiming Li, Jiatan Huang et al.May 7
060CANDI: Contextual Alignment for Niche Domains Question AnsweringarXivPaperMegha Chakraborty, Darssan Eswaramoorthi et al.May 6

Showing 60 of 5,255 documents · scroll for more