大模型· 2026-10-07
行为历史显著提升大语言模型合成角色的预测能力
一项由arXiv发布的新研究探讨了大语言模型(LLM)作为合成角色在预测个体决策中的有效性。研究表明,相比于仅依赖人口统计、个性特征或认知评分等描述性信息,基于行为历史的LLM合成…
文 / Mr.Xu0 次阅读0 条讨论与划词
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章大模型· 2026-10-07
一项由arXiv发布的新研究探讨了大语言模型(LLM)作为合成角色在预测个体决策中的有效性。研究表明,相比于仅依赖人口统计、个性特征或认知评分等描述性信息,基于行为历史的LLM合成…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-07
arXiv发布了一项关于生物医学领域神经机器翻译模型压缩的新研究,提出将知识蒸馏与量化技术结合以提升模型效率。研究表明,协同优化的压缩模型在保持翻译质量的同时,实现了模型大小减少6…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-07
Fiorillo v0.5是一款开源的轻量级AI模型,专注于从随机试验文章中推断干预措施对结果的影响。该模型基于Qwen3-4B-Base架构,通过低秩适配和决策头进行微调,仅使用…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-07
arXiv发布了一项关于改进RoPE(Rotary Position Embedding)的新研究,提出了名为WavePrune的技术。该技术通过限制每个通道仅使用其第一个旋转周期…
文 / Mr.Xu0 次阅读0 条讨论与划词
大模型· 2026-10-07
arXiv发布了一项关于大语言模型推理中外部指导的新研究,提出了名为Guidance-Augmented GRPO (GA-GRPO)的统一理论框架。该框架将外部指导视为重写问题分…
文 / Mr.Xu1 次阅读0 条讨论与划词
智能体· 2026-10-07
arXiv发布了一项关于提升AI编程智能体可靠性的研究,提出通过优化搜索策略和验证机制来改进智能体在代码修复任务中的表现。研究指出,智能体在执行任务时面临位置多样性和编辑多样性不足…
文 / Mr.Xu1 次阅读0 条讨论与划词
智能体· 2026-10-07
arXiv发布了一项关于自动驾驶决策系统的新研究,提出了一种名为CPW-Drive的闭环检索增强生成(RAG)框架。该框架将中国哲学中的儒家思想作为知识来源,通过提取经典文本中的关…
文 / Mr.Xu0 次阅读0 条讨论与划词
智能体· 2026-10-07
Hugging Face推出了一种名为TEMPEST的新模型,用于可扩展的驾驶员行为识别。TEMPEST基于时间卷积网络(TCN),并采用加性角间隔损失(ArcFace)进行训练,…
文 / Mr.Xu0 次阅读0 条讨论与划词
智能体· 2026-10-06
Illuin Tech的研究团队提出了一种名为DAEDALUS的新方法,旨在解决智能体在全新环境中缺乏操作知识的问题。DAEDALUS通过自生成任务和两个智能体(探索者与解决者)的…
文 / Mr.Xu0 次阅读0 条讨论与划词
智能体· 2026-10-06
Hugging Face推出NeMo-DCR(Delta-Compressed Refit),一种针对万亿参数级智能体强化学习(RL)的创新权重同步技术。NeMo-DCR通过仅传输…
文 / Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-07
Hugging Face推出了名为SGAnalog的开源模拟电路设计基准测试集,旨在解决现有基准测试中模型是否真正学习到可迁移电路设计技能以及输出是否适用于实际工艺和测试条件的问题…
文 / Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-07
Hugging Face推出了一种名为Zero-Shot Visualization (ZSV)的新系统,用于通过自然语言用户提示将文本语料库映射到相应的概念轴上进行可视化。该系统…
文 / Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-06
ArXiv近日发布了一款名为SGAnalog的电路基准测试工具,旨在解决现有模拟集成电路设计基准测试中的关键问题。该工具基于开源硅芯片设计,并结合Tiny Tapeout制造流程,…
文 / Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-05
CE-RLVR团队发布SymCE数据集,包含4707个经过验证的本科代数和实分析错误猜想,并提供可执行的验证器作为奖励函数。SymCE不仅是一个数据集,还构建了一个用于训练大语言模…
文 / Mr.Xu0 次阅读0 条讨论与划词
开源AI· 2026-10-03
Meta宣布开源其Muse AI工具包,允许开发者使用该SDK在ESP32开发板或Raspberry Pi等硬件平台上构建个性化AI设备。这些设备可用于显示提醒信息、运行在HDMI…
文 / Mr.Xu6 次阅读0 条讨论与划词
算力架构· 2026-10-01
NVIDIA推出AI工厂概念,强调通过优化AI硬件的生产力、耐用性和通用性来最大化投资回报率。AI工厂以每兆瓦60万美元的成本构建,通过提升每秒每兆瓦的吞吐量、延长硬件使用寿命以及…
文 / Mr.Xu4 次阅读0 条讨论与划词
算力架构· 2026-09-17
Crusoe宣布完成39亿美元融资,用于建设大规模数据中心和模块化AI工厂。此轮融资后,Crusoe估值达到309亿美元,展现了AI领域对强大计算资源的需求增长。此举不仅将提升AI…
文 / Mr.Xu10 次阅读0 条讨论与划词
算力架构· 2026-09-17
Crusoe 宣布完成 39 亿美元融资,用于建设大规模数据中心和模块化 AI 工厂,推动 AI 基础设施的规模化发展。此轮融资后,Crusoe 的估值达到 309 亿美元,展现了…
文 / Mr.Xu10 次阅读0 条讨论与划词
算力架构· 2026-09-17
华为正加速推出其下一代AI芯片Ascend 960DT,旨在缩小中国与美国在AI计算领域的差距,并直接与英伟达展开竞争。该芯片的发布计划表明华为在AI硬件领域的战略布局正逐步深化,…
文 / Mr.Xu10 次阅读0 条讨论与划词
算力架构· 2026-09-16
NVIDIA推出了新一代AI推理系统Vera Rubin NVL72,在MLPerf Inference v6.1基准测试中表现优异。与前代GB300 NVL72相比,Vera R…
文 / Mr.Xu10 次阅读0 条讨论与划词
前沿论文· 2026-10-07
arXiv发布了一项关于递归熵风险偏好下强化学习(RL)样本复杂度优化的研究。该研究聚焦于有限折扣马尔可夫决策过程(MDPs),在访问生成模型的前提下,通过改进基于模型的鲁棒Q值迭…
文 / Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-07
Wang Research Lab发布了一项关于Transformer模型拒绝机制的研究成果。该研究通过在四个开源权重模型中分解拒绝行为,识别出注意力机制和多层感知机(MLP)中稀…
文 / Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-07
arXiv发布了一项关于联邦强化学习的新研究,提出了一种名为Robust Async-Fed-Q的算法,旨在解决部分代理行为对抗性并传输任意损坏信息时,如何保持协作学习的样本效率优…
文 / Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-07
arXiv发布了一项关于长时强化学习的研究,提出了一种名为预算自适应神经算子求解器的新方法,用于解决时间依赖偏微分方程(PDE)的快速近似问题。该方法结合全局傅里叶神经算子与局部残…
文 / Mr.Xu0 次阅读0 条讨论与划词
前沿论文· 2026-10-07
本研究提出了一种基于中性集理论(Neutrosophic Theory)的随机森林、XGBoost和逻辑回归集成方法,用于轴承故障检测。该方法将模型输出分解为四个关键指标:顶级类别…
文 / Mr.Xu0 次阅读0 条讨论与划词
行业动态· 2026-10-06
OpenAI与量化交易公司Jump Trading展开合作,通过扩展AI工作流来增强量化研究能力。此次合作展示了如何将长时间运行的AI流程与多数据源结合,并引入人工审核机制,从而提…
文 / Mr.Xu1 次阅读0 条讨论与划词
行业动态· 2026-10-06
OpenAI与Atlassian宣布扩大合作,将前沿AI模型与企业知识深度整合,帮助团队更高效地规划、构建和交付工作。此次合作旨在通过AI技术提升企业生产力,优化工作流程,并推动智…
文 / Mr.Xu0 次阅读0 条讨论与划词
行业动态· 2026-10-06
NVIDIA发布的最新《电信行业AI现状报告》显示,89%的受访电信运营商认为开源模型和软件对其AI战略至关重要。开源模型不仅降低了成本,还提供了更高的信任度、控制力和定制化能力,…
文 / Mr.Xu0 次阅读0 条讨论与划词
行业动态· 2026-10-06
本研究探讨了通过大规模语言模型(LLM)处理年度报告中关于AI的披露数据,是否能有效反映公司对AI的应对策略及其对社会韧性的影响。研究分析了2020至2026年间1362家英国上市…
文 / Mr.Xu0 次阅读0 条讨论与划词
行业动态· 2026-10-05
OpenAI首席执行官Sam Altman近日表示,尽管AI发展过程中可能会出现一些负面事件,例如黑客攻击、诈骗等,但AI技术带来的整体社会价值将远超其风险。他认为,社会应接受AI…
文 / Mr.Xu0 次阅读0 条讨论与划词
安全与隐私· 2026-08-10
Checkpoint Research发布了一篇关于Cloudflare代码模式及其Workers功能的研究报告,揭示了这些工具在处理复杂任务时可能存在的安全漏洞。研究指出,攻击者…
文 / Mr.Xu10 次阅读0 条讨论与划词