Papers
Hugging Face Papers 周报
papers
68 条InSight-doc:自主视觉感知在长文档理解中的应用
360CityArena:面向具身智能体的现实主义虚拟城市导航基准
ComBodied 代理:以人为本的新范式AI
Ex-Omni-2D:具有原生视觉存在的全方位模态对话模型
SkillZip:发现可重用结构的无需评估技能压缩方法用于自我进化的代理
VibeLifeBench:你的生活代理能在动态世界中主动且坚持不懈吗?
TSDS-Toolbox:时间序列数据集相似性测量工具箱
iFAN:推理感知学习用于普通掩码变压器
DSAgentBench:代理能否在实际计算机环境中自动化端到端的数据科学工作流?
AdvFD:通过对抗Fréchet距离损失提升视觉生成
DistilVDR:一种基于双学生蒸馏的紧凑型端到端视觉文档检索器
从静止状态观察进行 articulated 对象重构
BDH-CQ:基于上下文学习与递归潜在推理
Macaron-V1:面向开放连续学习的自我提升与混合洛拉(Mixture-of-LoRA)
SWE-Bench ProMax:大规模多语言代码重构基准测试代理
motif 3: 技术报告
Evo-Bench:语言模型能提升代理器的表现吗?
Ouroboros:一个自我发展的前沿编码代理,配有审核的核心进化
OasisKV:基于前瞻稀疏预取超越HBM的In-Decode KV缓存扩展
RynnValue:基于时间距离扩展机器人价值基础模型
固有可解释语言模型的扩展研究论文来源:HF Papers
端到端代理审核引擎PDF:hfpapers.com/papers/agent-auditing-engine
有监督的自蒸馏策略:On-Policy Self-Distillation without Any Supervision
Ego-OSCAR:第一人称开源立体捕捉系统
CEAA:认知体化代理架构在交互式计算系统中的应用研究
视觉-语言 grounding 为双向概念对应关系
高效知识蒸馏技术应用于LLMs:离线Top-K概率和融合分块KL散度损失
Capek 0.5:基于执行的视觉-语言模型用于具身智能
MLLMs能否破解创造性飞跃?论文介绍C4以实现跨概念理解。
PrivacyPeek:审计基于LLM的代理获取的内容,而不仅是它们所说的内容。
强化学习与evolving rubrics as rewards用于音频推理
面向不确定性的世界模型在航空图像目标导航中的应用
YOLO-PEFT:YOLO家族的参数高效微调
SimWAM:一种简单的世界动作模型用于端到端自动驾驶
生产中AI生成的C++代码的质量特征 characterization
缩放:Chinchilla的指数与Kaplan的耦合相遇
StreamArena:迈向连续、交互式和长时 horizon 的自主流媒体视频理解
模块化TTT:重新思考测试时训练的可组合模块