Command Palette
Search for a command to run...
论文
每日更新的前沿人工智能研究论文,帮助您紧跟最新的人工智能趋势
篇论文

Paper2Rebuttal:一种用于透明化作者回复辅助的多智能体框架

LLM的智能体推理






























PERSONAPLEX:用于全双工对话语音模型的语音与角色控制
FlashLabs Chroma 1.0:具备个性化语音克隆能力的实时端到端语音对话模型
MemoryRewardBench:面向大型语言模型长期记忆管理的奖励模型基准测试
OmniTransfer:面向时空视频迁移的统一框架
面向高效智能体:记忆、工具学习与规划
FutureOmni:基于多模态上下文的未来预测评估方法在多模态LLM中的应用
Being-H0.5:面向跨体感泛化的以人为本机器人学习扩展
基于LLM的软件工程问题求解进展与前沿:一项综合调查
Nemotron-Math:基于多模态监督的高效长 Context 数学推理能力蒸馏
为Gemini构建可投入生产的探测器
LFM2 技术报告
CoDance:一种用于鲁棒多主体动画的解绑-重绑范式
助手轴:语言模型默认人格的定位与稳定化
ABC-Bench:面向真实世界开发中的智能体后端编码基准测试
多路思维:通过逐token分支与合并进行推理
推理模型催生“思想百家”
大规模多Agent AI系统发展与问题研究
ACoT-VLA:面向视觉-语言-动作模型的动作思维链
个性化误导之困:理解并缓解个性化LLM中的幻觉问题
RubricHub:通过自动化粗粒度到细粒度生成的全面且高区分度的评分标准数据集
解锁隐性经验:从文本中合成工具使用轨迹
毒苹果效应:通过AI Agent的技术扩展对中介市场实施策略性操纵
你的组相对优势存在偏差
STEM:通过嵌入模块扩展Transformer
迷失在噪声中:推理模型在上下文干扰项下的失效机制
超越静态工具:面向科学推理的测试时工具演化
VIBE:基于视觉指令的编辑器
协作式多Agent测试时强化学习用于推理
奖励稀有:面向LLM创造性问题求解的感知独特性强化学习
基于视觉-语言推理的城市社会语义分割