OpenAgentFlow:为异构AI智能体集群启用系统级安全边界
大模型驱动的AI智能体正从孤立助手演变为多智能体协同的异构系统,OpenAgentFlow为此提供系统级安全边界。
来源:arXiv cs.AI
看懂 AI,用好 AI
AI 行业动态、工具测评与技术解读。
大模型驱动的AI智能体正从孤立助手演变为多智能体协同的异构系统,OpenAgentFlow为此提供系统级安全边界。
来源:arXiv cs.AI
面向多模态GUI智能体,UI-Venus-2致力于从基准导向转向可靠的实际数字任务自动化。
来源:arXiv cs.AI
研究利用指令微调的小语言模型,对通过短信、电话等渠道逐步实施的老年金融诈骗进行早期识别与动态风险评估。
来源:arXiv cs.AI
针对文本到图像模型,提出I-CARE框架以系统分析机器遗忘过程中的干扰现象。
来源:arXiv cs.AI
HyperWorld 用超图结构序列化文本状态,提升语言模型智能体在文本世界中的动态预测与行动规划能力。
来源:arXiv cs.AI
因果推断中常用预测误差评估干扰函数估计器,但研究发现其与因果估计性能并非简单对应,需谨慎使用。
来源:arXiv cs.AI
针对需求数量确定但到达时机随机的多品项能力受限批量问题,建立有限期离散时间MDP模型并探讨最优策略。
来源:arXiv cs.AI
长程任务中每步都依赖上一步,单步误差会不断累积,因此这类任务很少用于评估LLM。
来源:arXiv cs.AI
数学社区间问题转移成本高,EULER通过证据检查返回机制,挖掘未充分利用的链接以促进多智能体数学发现。
来源:arXiv cs.AI
该数据集收录计算机科学论文图表,支持图表问答与思维链推理,助力学术图表理解研究。
来源:arXiv cs.AI
AI正助力数学、医学、材料科学等领域突破,新评估基准应运而生。
来源:arXiv cs.AI
针对现有大模型科研写作系统在证据追溯与人机协同上的不足,提出一种专家系统,确保稿件生成有据可查。
来源:arXiv cs.AI