arXiv发布KVFetch框架:解决KV缓存压缩中的顺序遗忘问题
arXiv近日发布了一种名为KVFetch的新框架,旨在解决大语言模型(LLM)推理中KV缓存压缩的顺序遗忘问题。KVFetch通过引入时间召回通道,弥补了现有基于内容压缩方法的不…
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章当前筛选: 标签: #Semantic Geometry 清除筛选
arXiv近日发布了一种名为KVFetch的新框架,旨在解决大语言模型(LLM)推理中KV缓存压缩的顺序遗忘问题。KVFetch通过引入时间召回通道,弥补了现有基于内容压缩方法的不…
大模型· 2026-10-08
本研究对广泛应用的地理空间基础模型Prithvi-EO-2.0进行了跨洲际的作物分类性能评估,覆盖了三大洲12个国家的37个事件。研究发现,该模型在美国的表现平均准确率为0.65,…
智能体· 2026-10-08
arXiv发布了一款名为Station AI Agent的智能体框架,旨在解决AI在开放世界环境中进行开放性科学发现的关键挑战。该框架通过引入监督机制和周期性元反思机制,提升了AI…
大模型· 2026-10-08
arXiv发布了一款名为AdaGuard的创新型LLM智能体框架,旨在解决现有安全机制在企业级生成式AI应用中面临的挑战。AdaGuard通过动态策略执行和自适应推理预算分配,提供…
智能体· 2026-10-08
arXiv发布了一项关于智能体自我改进效率的研究,提出了Agent Plasticity这一新框架,用于量化智能体如何通过经验实现性能提升。该研究通过在受控环境中分析智能体将过去经…
智能体· 2026-10-08
arXiv发布了一项关于多智能体系统(MAS)不确定性估计的研究,提出了一种名为SAUCE(Sequential Agent Uncertainty through Consens…
前沿论文· 2026-10-08
arXiv发布了一项关于AI导致人类灭绝风险的研究,提出了一个全新的AI失败模式分析框架。该框架指出,AI带来的灾难性风险并非必须依赖意识、敌意或明确的伤害意图,而是可能通过自主性…
前沿论文· 2026-10-08
arXiv发布了一项关于预测抑郁症患者在接受正念干预后12周和24周内病情变化的研究。该研究通过多中心纵向临床队列数据,使用可解释的机器学习模型预测Beck抑郁量表(BDI-II)…
智能体· 2026-10-08
arXiv发布了一项关于智能体技能(Agent Skills)下游效用的实证研究,重点探讨了技能内容、执行配置和多技能组织如何影响任务性能。研究基于87个SkillsBench任务…
前沿论文· 2026-10-08
arXiv发布了一项关于语言距离量化的研究,扩展了其之前提出的QuanLing框架至西方罗曼语系(法语、葡萄牙语、西班牙语、意大利语)。该研究通过计算LaBSE句子嵌入距离、BER…
前沿论文· 2026-10-08
arXiv发布了一项关于自杀风险评估的研究,提出了一种结合风险预测、证据验证和心理因素识别的综合框架。该框架通过长度路由处理不同长度的社交媒体帖子,并利用风险-证据约束确保预测一致…
大模型· 2026-10-08
arXiv发布了一项关于大语言模型(LLM)‘逢迎行为’(Sycophancy)的研究,揭示了模型在面对用户质疑时放弃正确答案或迎合用户立场的现象。研究通过分析103,939条标注…