arXiv:2609.04867v1 Announce Type: cross Abstract: Text-to-audio-video (T2AV) generation has advanced rapidly, but its evaluation still underestimates the…
Tag: AI
Forgetting Without Restarting: Execution-State Unlearning for Stateful LLM Agents
arXiv:2609.04875v1 Announce Type: cross Abstract: Long-running LLM agents are stateful: beyond the transcript they accrete compressed summaries, plaintext…
SimFuse3D: Source-Guided Target Simulation and Confidence-Guided Multi-Stage Localization Reweighting for Cross-Platform 3D Object Detection
arXiv:2609.04886v1 Announce Type: cross Abstract: Changes in sensor height and viewpoint alter object-level point distributions, making cross-platform…
Mitigating Performance Discrepancy in Cross-Domain 3D Class-Incremental Learning
arXiv:2609.04860v1 Announce Type: cross Abstract: 3D perception plays a crucial role in real-world applications such as autonomous driving, robotics, and…
ReCAST: Restoration-aware Cascaded Stage-wise Training for Obfuscated SMS Risk Classification
arXiv:2609.04878v1 Announce Type: cross Abstract: Fraudulent messages sent via Short Message Service (SMS) are increasingly obfuscated to evade…
CC-Mediation: Evaluating Large Language Models for Cross-Cultural Conflict Mediation
arXiv:2609.04855v1 Announce Type: cross Abstract: Cross-cultural mediation by large language models (LLMs) requires deciding both when to intervene and…
MABPD: Multi-Agent Bias Probing & Detection via Structured Argument Debate
arXiv:2609.04841v1 Announce Type: cross Abstract: Media bias in news articles operates through subtle linguistic cues—loaded language, selective…
Cost-Aware Hierarchical Multi-Agent Ransomware Detection and Family Attribution
arXiv:2609.04820v1 Announce Type: cross Abstract: Ransomware detection and family attribution require analysis of different modalities because it can use…
OpenBMB Releases MiniCPM5-2B: A 2.52B Dense Model Averaging 53.9 Across 34 Benchmarks and Built to Run On Device
OpenBMB has released MiniCPM5-2B, a dense causal language model with 2,516,756,480 parameters and a native 131,072 token context. It averages 53.9 across…
MMTClinic: Multimodal, Multilingual Time Series Question Answering and Reasoning Benchmark for Clinical Domain
arXiv:2609.04842v1 Announce Type: cross Abstract: Time-series data in clinical settings is crucial for capturing dynamic changes in a patient’s health…
