Knowledge-Verified Emergent Deception in LLM Agents Under Conflicting Incentives Paper ⢠2608.26372 ⢠Published Aug 26 ⢠2
AutoLab: Can Frontier Models Solve Long-Horizon Auto Research and Engineering Tasks? Paper ⢠2606.05080 ⢠Published Jun 3 ⢠32
Prompt-Activation Duality: Improving Activation Steering via Attention-Level Interventions Paper ⢠2605.10664 ⢠Published May 11 ⢠8
Prompt-Activation Duality: Improving Activation Steering via Attention-Level Interventions Paper ⢠2605.10664 ⢠Published May 11 ⢠8
Protecting Privacy in Multimodal Large Language Models with MLLMU-Bench Paper ⢠2410.22108 ⢠Published Oct 29, 2024 ⢠1
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues Paper ⢠2601.06757 ⢠Published Jan 11 ⢠1
DreamID-Omni: Unified Framework for Controllable Human-Centric Audio-Video Generation Paper ⢠2602.12160 ⢠Published Feb 12 ⢠39
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues Paper ⢠2601.06757 ⢠Published Jan 11 ⢠1
Cosmos Policy Collection ā ļø This collection is archived. š https://huggingface.co/collections/nvidia/c ⢠7 items ⢠Updated Aug 11 ⢠12
Uncovering Cross-Objective Interference in Multi-Objective Alignment Paper ⢠2602.06869 ⢠Published Feb 6 ⢠6
Behavior Knowledge Merge in Reinforced Agentic Models Paper ⢠2601.13572 ⢠Published Jan 20 ⢠27
OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG Paper ⢠2601.09028 ⢠Published Jan 13 ⢠34