Humanize框架发布:革新智能体编程中的多智能体协作与决策流程
Humanize是一种新型的多智能体协作工作流,旨在解决智能体编程中代码生成与可靠完成之间的矛盾。其核心机制围绕“判断工程”展开,通过明确划分规划、实现、审查和学习等阶段,并引入7…
智客 ZICQ 每日整理大模型、开源基础设施与开发者现场的 AI 新闻与深度文章。
投稿技术文章当前筛选: 标签: #ScholarCatalyst 清除筛选
Humanize是一种新型的多智能体协作工作流,旨在解决智能体编程中代码生成与可靠完成之间的矛盾。其核心机制围绕“判断工程”展开,通过明确划分规划、实现、审查和学习等阶段,并引入7…
前沿论文· 2026-10-08
Route-Verify-Vote (RVV) 是一种针对混合领域推理的全新框架,通过领域条件自一致性推理提升模型在复杂场景下的推理能力。该框架无需对语言模型进行参数更新,而是通过…
大模型· 2026-10-08
Hugging Face推出了一种名为GradSAT的新型SMT求解器框架,通过引入多任务学习(MTL)和动态梯度归一化(GradNorm),解决了传统基于优化的SMT求解器中梯度…
开源AI· 2026-10-08
CoDR(Confidence Drift Remasking)是一种无需训练且与采样器无关的改进方法,旨在解决掩码扩散语言模型(MDLMs)中由于置信度漂移导致的推理错误问题。该…
大模型· 2026-10-08
Hugging Face推出了一种名为Emo-Jev的新型无训练情感分类框架。该框架采用两种互补实现方式:Emo-Jev-D通过分解任务为原子判断并组合概率生成最终预测;Emo-J…
智能体· 2026-10-08
Hugging Face发布了一项针对儿童自动语音识别(ASR)系统的自适应研究,重点解决儿童语音识别中成人语音遗忘的难题。研究比较了全量微调、LoRA和权重空间合并等方法在编码器…
智能体· 2026-10-08
arXiv发布了一项关于自适应工作流智能(AWI)的新研究,旨在解决AI驱动解决方案在非平稳条件、政策演变和延迟反馈下的脆弱性问题。AWI通过感知-认知-行动-反思(PCAR)四层…
大模型· 2026-10-08
Hugging Face推出Tokka-Bench,这是一款开源的多语言、多指标分词器评估框架,旨在解决现有大语言模型(LLM)分词器在不同语言间质量参差不齐的问题。Tokka-B…
智能体· 2026-10-08
LangChain发布了Managed Deep Agents平台的0.8版本更新,重点优化了智能体在生产环境中的用户体验。新版本引入了用户自有凭证、用户级记忆、HTTP通道、Sl…
大模型· 2026-10-08
LangChain推出了LangSmith Fine-Tuning和配套的命令行工具SmithTune,旨在简化后训练模型的微调流程。通过该工具,用户无需手动构建数据管道,即可训练…
大模型· 2026-10-08
TypeSafe AI 在其博客中深入探讨了当前 AI 领域基准测试(benchmarking)的局限性,指出基准测试被过度依赖且易被操纵,导致模型性能评估出现偏差。该文章呼吁 A…
智能体· 2026-10-07
Hugging Face推出SWE-Game,这是一款针对AI智能体游戏开发能力的全新基准测试平台,包含247项任务,涵盖13个游戏类别和5种任务类型。该平台通过41个可执行God…