Command Palette
Search for a command to run...
论文
每日更新的前沿人工智能研究论文,帮助您紧跟最新的人工智能趋势
篇论文

字节跳动:基于二进制标记的自回归生成模型扩展

REDSearcher:一种可扩展且成本高效的长时序搜索Agent框架






























Qute:面向量子原生数据库
InnoEval:将研究创意评估视为一种基于知识的多视角推理问题
查询作为锚点:基于大语言模型的场景自适应用户表征
SemanticMoments:通过三阶矩特征实现无需训练的动作相似性计算
RLinf-Co:基于强化学习的模拟-现实协同训练用于视觉-语言-动作模型
ABot-M0:基于动作流形学习的机器人操作视觉-语言-动作基础模型
强化学习如何提升视觉推理能力?一种“怪物合成式”的分析
MedXIAOHE:构建医学领域MLLMs的完整方案
无需缩放的缩放:面向细粒度多模态感知的区域到图像知识蒸馏
少即是足:在LLM的特征空间中合成多样化数据
GigaBrain-0.5M*:一种基于世界模型强化学习的VLA
MOSS-Audio-Tokenizer:面向未来音频基础模型的音频分词器扩展
超越教师的学习:基于奖励外推的广义在线策略蒸馏
DeepGen 1.0:一种轻量级统一多模态模型,用于推进图像生成与编辑
Composition-RL:为大语言模型强化学习构建可验证的提示词组合
Moltbook背后的魔鬼:在自我演化的AI社会中,Anthropic安全始终在消逝
迈向自主数学研究
何时记忆,何时停止:面向长上下文推理的门控循环记忆
ASA:面向工具调用领域适应的激活控制
PhyCritic:面向物理AI的多模态批评者模型
GENIUS:生成式流体智能评估套件
Step 3.5 Flash:以 11B 激活参数开启前沿级智能
世界-VLA-环:视频世界模型与VLA策略的闭环学习
迈向自主数学研究
Agent世界模型:用于智能体强化学习的无限合成环境
P1-VL:连接视觉感知与物理奥赛中的科学推理
思维链:基于自适应认知模式的推理
UI-Venus-1.5 技术报告
Code2World:一种通过可渲染代码生成的GUI世界模型
OPUS:面向大语言模型预训练中每轮迭代的高效且原则性数据选择