大模型· 2026-10-06#BAT-NO#Transformer#边界条件感知#抗撞性预测#ArXiv
ArXiv发布BAT-NO:革新车辆部件抗撞性预测的边界条件感知Transformer模型
ArXiv近日发布了一种名为BAT-NO(Boundary-Condition-Aware Transformer Neural Operator)的新型Transformer模型…
文 / Mr.Xu0 次阅读0 条讨论与划词
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章当前筛选: 标签: #并行采样 清除筛选
大模型· 2026-10-06#BAT-NO#Transformer#边界条件感知#抗撞性预测#ArXiv
ArXiv近日发布了一种名为BAT-NO(Boundary-Condition-Aware Transformer Neural Operator)的新型Transformer模型…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv近日发布了一种名为KVE-KD(Key Visual Evidence-guided Knowledge Distillation)的新框架,旨在提升视觉-语言模型在资源…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv发布了一项关于城市共享单车需求预测的研究,提出了一种结合大语言模型(LLM)和时空图卷积网络(ASTGCN)的创新框架。该框架通过语义冲击波机制,将非结构化的城市文本(如…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-06
ArXiv发布了一项关于神经网络“锯齿状能力”的研究,探讨了模型在处理复杂任务时为何表现出低平均错误率却伴随特定输入失败的现象。研究发现,模型在扩展任务中学习到的知识存在不均匀性:…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv发布了一项关于非对称Actor-Critic方法的研究,提出了一种名为Memory-State Critic的新技术。该方法通过将评论家(Critic)基于策略自身的记忆…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-06
ArXiv发布了一项关于语言模型输入嵌入机制的研究,探讨了是否需要可训练的输入嵌入表才能实现强大的语言建模能力。研究比较了三种从头训练的解码器语言模型,分别使用可学习的嵌入表、固定…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-06
ArXiv发布了一项关于语言模型微调过程中遗忘机制的研究,指出优化器记忆是导致模型遗忘先前学习内容的关键因素之一。研究发现,动量优化器在更新过程中会累积历史梯度,这些梯度可能与当前…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-06
ArXiv发布了一项关于时间序列预测的新研究,提出了一种基于最小二乘法的创新框架。该研究探讨了两种不同的程序:一种通过最小化解码潜在误差进行预测,另一种则通过固定潜在向量维度进行向…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv近日发布了一项关于通用决策模型的研究,提出了名为JEVal的双语基准测试,包含36个数据集的11,257个实例,评估了25种模型配置。研究表明,通用决策模型在基于证据的决…
Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-06
ArXiv近日发布了一项关于语言模型智能体在证据修订下的记忆管理策略的研究。该研究通过引入一种新的证据修订评估框架,探讨了智能体在面对文档撤销或替换时的最佳应对策略,包括记忆修复和…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv近日发布了一款名为SynLat的文本-潜在压缩框架,旨在优化长链式推理(CoT)中的输出效率。SynLat通过非重叠的语法对齐单元(SAUs)将压缩边界与语法结构对齐,从…
Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-06
ArXiv近日发布了一款名为OncoNoteBERT的专用NLP模型,该模型专为处理现实世界中的肿瘤学门诊记录设计。与通用的生物医学或临床语言模型相比,OncoNoteBERT在处…
Mr.Xu0 次阅读0 条讨论与划词