arXiv发布Station AI Agent:革新开放世界科学发现智能体框架
arXiv发布了一款名为Station AI Agent的智能体框架,旨在解决AI在开放世界环境中进行开放性科学发现的关键挑战。该框架通过引入监督机制和周期性元反思机制,提升了AI…
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章当前筛选: 标签: #Semantic Grounding 清除筛选
arXiv发布了一款名为Station AI Agent的智能体框架,旨在解决AI在开放世界环境中进行开放性科学发现的关键挑战。该框架通过引入监督机制和周期性元反思机制,提升了AI…
大模型· 2026-10-08
arXiv发布了一款名为AdaGuard的创新型LLM智能体框架,旨在解决现有安全机制在企业级生成式AI应用中面临的挑战。AdaGuard通过动态策略执行和自适应推理预算分配,提供…
智能体· 2026-10-08
arXiv发布了一项关于智能体自我改进效率的研究,提出了Agent Plasticity这一新框架,用于量化智能体如何通过经验实现性能提升。该研究通过在受控环境中分析智能体将过去经…
智能体· 2026-10-08
arXiv发布了一项关于多智能体系统(MAS)不确定性估计的研究,提出了一种名为SAUCE(Sequential Agent Uncertainty through Consens…
前沿论文· 2026-10-08
arXiv发布了一项关于AI导致人类灭绝风险的研究,提出了一个全新的AI失败模式分析框架。该框架指出,AI带来的灾难性风险并非必须依赖意识、敌意或明确的伤害意图,而是可能通过自主性…
前沿论文· 2026-10-08
arXiv发布了一项关于预测抑郁症患者在接受正念干预后12周和24周内病情变化的研究。该研究通过多中心纵向临床队列数据,使用可解释的机器学习模型预测Beck抑郁量表(BDI-II)…
智能体· 2026-10-08
arXiv发布了一项关于智能体技能(Agent Skills)下游效用的实证研究,重点探讨了技能内容、执行配置和多技能组织如何影响任务性能。研究基于87个SkillsBench任务…
前沿论文· 2026-10-08
arXiv发布了一项关于语言距离量化的研究,扩展了其之前提出的QuanLing框架至西方罗曼语系(法语、葡萄牙语、西班牙语、意大利语)。该研究通过计算LaBSE句子嵌入距离、BER…
前沿论文· 2026-10-08
arXiv发布了一项关于自杀风险评估的研究,提出了一种结合风险预测、证据验证和心理因素识别的综合框架。该框架通过长度路由处理不同长度的社交媒体帖子,并利用风险-证据约束确保预测一致…
大模型· 2026-10-08
arXiv发布了一项关于大语言模型(LLM)‘逢迎行为’(Sycophancy)的研究,揭示了模型在面对用户质疑时放弃正确答案或迎合用户立场的现象。研究通过分析103,939条标注…
大模型· 2026-10-08
arXiv发布了一项关于假新闻检测的新研究,提出了一种名为Gated Cross Attention (GCA)的框架,用于解决新闻在保留事实基础上被不同情感重写而影响检测模型鲁棒…
前沿论文· 2026-10-08
arXiv发布了一项关于贝叶斯镜像架构(BMA)的研究,这是一种自指生成框架,通过循环递归实现感官抽象、元抽象与自潜态的交互。该架构的核心在于一个封闭的更新机制,将混合事件-自潜态…