AI论文精选
每日论文
◀
07月07日
▶
⏶
76
OmniOpt:现代优化器的分类学、几何学和基准测试
⏶
72
UI-MOPD: 多平台策略蒸馏,用于持续GUI智能体学习
⏶
65
PixWorld: 在像素空间中统一3D场景生成与重建
⏶
63
ResearchStudio-Reel: 自动化研究的最后一公里,从论文到海报、视频和博客
⏶
60
ResearchStudio-Idea: 基于证据的研究构思技能套件,源自机器学习会议成果
⏶
48
MANCE:流形感知概念擦除
⏶
43
用于密集空间感知的视觉预训练
⏶
40
Wan-Streamer v0.2: 更高分辨率,相同延迟
⏶
39
将交错的多模态推理连接为一个统一的决策过程
⏶
38
GigaWorld-1: 一个构建机器人策略评估世界模型的路线图
⏶
29
通过工作流归纳实现多轮智能体科学文献搜索
⏶
28
带表示自编码器的多人交互式世界模型
⏶
27
EVA-Client: 一个统一的数据收集、推理和部署框架,用于真实机器人上的具身策略
⏶
27
InternVLA-A1.5: 统一理解、潜在预见和行动,实现组合泛化
⏶
24
KVpop:结合预测性在线剪枝的键值缓存压缩
⏶
24
所有视觉Token都同等重要吗?用于视觉语言检索的对象证据保留Token合并
⏶
22
ACID:通过逆动力学实现世界模型规划中的动作一致性
⏶
21
统一的音频智能,不以文本智能为退步
⏶
19
三思而后行:将树搜索蒸馏到冻结VLA模型的动作评估中
⏶
18
EdgeBench: 揭示从真实世界环境学习的扩展定律
⏶
18
感知流匹配用于少量步骤生成建模
⏶
17
dOPSD: 扩散语言模型的策略自蒸馏
⏶
15
LLM即验证器:一个通用验证框架
⏶
11
SeKV:具有分层语义记忆的分辨率自适应KV缓存,用于长上下文LLM推理
⏶
10
Deform360: 一个用于可变形世界模型的大规模多视角视触觉数据集
⏶
10
MV-Forcing:通过4D接地时空自强制实现长多视图视频生成
⏶
9
PraMem: 用于长周期行为预测的实践导向经验记忆
⏶
8
Mastermind: 用于仓库级漏洞复现的策略驱动学习
⏶
7
大规模安全测试LLM智能体:从风险发现到证据驱动的验证
⏶
7
GORGO: 跨区域网络感知LLM服务的在线调优
⏶
7
EXIST 2026上的AI向导:用于模因中的多模态性别歧视识别的分层软标签学习
⏶
6
转换感知最佳N选择采样用于纵向胸部X光报告
⏶
6
CONFLUX:一种结合强化学习后训练的潜在扩散模型用于3D胸部CT合成
⏶
5
GaP:一种图即策略多智能体自学习框架用于变分自动化任务
⏶
5
学习触发:大型强子对撞机中的强化学习
⏶
4
在片段表示上采用说话者感知的时间聚合策略用于二元交互中的抑郁症检测:一项基准研究
⏶
4
SynCity 3000:引导场景尺度3D扩散
⏶
4
从音频嵌入中进行偏好感知音乐检索
⏶
3
用于音节分词的说话人解耦块式回归
⏶
3
PixCon: 用于基础模型半监督分割的干净-正向对比学习
◀ 前一日
后一日 ▶