大模型· 2026-10-05#SBERT2S1#生物医学AI#类型化决策模型#arXiv#MEDLINE
arXiv发布SBERT2S1:基于生物医学句子编码器的类型化决策模型框架
arXiv近日发布了一种名为SBERT2S1的新型框架,用于将生物医学句子编码器转化为类型化决策模型。该框架包括SBERT2S1模型、BIODECIDE工具包以及基于MEDLINE…
文 / Mr.Xu0 次阅读0 条讨论与划词
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章当前筛选: 标签: #CICERO 清除筛选
大模型· 2026-10-05#SBERT2S1#生物医学AI#类型化决策模型#arXiv#MEDLINE
arXiv近日发布了一种名为SBERT2S1的新型框架,用于将生物医学句子编码器转化为类型化决策模型。该框架包括SBERT2S1模型、BIODECIDE工具包以及基于MEDLINE…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv近日发布了一种名为APDMem的新型长时记忆架构,旨在解决个性化大语言模型助手在复杂对话中高效检索稀疏证据的难题。APDMem采用分层记忆结构,通过渐进式披露机制,在推理…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv近日发布了一项关于多轮交互智能体评估的研究,提出了一种名为Calibrated User Embeddings (CUE)的新框架。该框架通过编码观察到的用户会话并解码为…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
FinDialogLens是一种新型混合大语言模型(LLM)管道,用于在多智能体金融聊天中提取事件并识别错过的交易。该系统通过细粒度的分类器检测报价请求(RFQ)触发器和价格/交易…
Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-05
CE-RLVR团队发布SymCE数据集,包含4707个经过验证的本科代数和实分析错误猜想,并提供可执行的验证器作为奖励函数。SymCE不仅是一个数据集,还构建了一个用于训练大语言模…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv近日发布了一款名为XiangqiBench的基准测试工具,用于评估大语言模型(LLM)智能体在闭环任务中的表现。该工具通过119个强制将死的中式象棋残局,测试智能体在对抗…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv发布了一项关于文本生成图像中奖励与多样性平衡的研究,提出了一种名为SatisDive的新方法。该方法通过引入奖励下限和多样性上限的约束条件,解决了现有方法在奖励与多样性平…
Mr.Xu0 次阅读0 条讨论与划词
智能体· 2026-10-05
arXiv发布了一种名为DeReAct的新型AI智能体架构,旨在解决传统ReAct方法中存在的动作授权和任务完成控制问题。DeReAct通过引入两个独立的门控策略——动作验证的Cr…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-05
本研究针对基于自然可见图(NVG)的网络攻击检测方法进行了深入分析,提出了一种通过重要性引导的指标精简策略来提升分类性能和计算效率的方法。研究评估了21种NVG拓扑指标,并通过共识…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-05
arXiv发布了一项关于可执行世界编辑的研究,提出了一种名为IGMWorld的新方法,并引入了IGMBench基准测试集,包含110项任务和超过1100个可执行状态和行为评估标准,…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv发布了一项关于长时程工具使用智能体的研究,提出了一种名为Comparative Inference for Tool-use Agents (CITA)的新方法。CITA…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-05
arXiv发布了一项关于文本生成图像中不安全内容过滤的研究,提出了一种名为CALM(Counterfactual Adaptive Local Modulation)的新方法。该方…
Mr.Xu0 次阅读0 条讨论与划词