LinkedIn多智能体审查
InfoQ报道LinkedIn构建多智能体代码审查平台,用独立模型交叉验证并过滤低质量建议;对1727个PR的5230条评论抽样评估,建议采纳率63.9%。
AI DAILY · 2026 / 08
开源项目、开发框架、工具与API
InfoQ报道LinkedIn构建多智能体代码审查平台,用独立模型交叉验证并过滤低质量建议;对1727个PR的5230条评论抽样评估,建议采纳率63.9%。
Simon Willison发布LLM 0.33,升级OpenAI Python 3.x,嵌入命令支持逐次传入密钥,还可组合模板并配置推理摘要。
云服务、数据中心和AI基础设施
内蒙古绿色算力大会集中签约13个重点项目,总投资1361亿元,覆盖芯片检测、装备制造、算力中心和Token工厂等领域。
论文、技术报告和研究成果
一项分析最多192个模型、5000余道题的研究发现,安全基准分别测量拒答、诚实和情境判断,平均分会掩盖权衡;自适应约10题即可接近完整排名,并能识别部分“装谨慎”行为。
一项涵盖8135次测试的研究发现,智能体“技能”改进主要来自流程指引(65.7%),知识补充仅占4.5%;技能库从5项增至100项时,检索准确率从29.6%降至3.3%。
政策法规、标准、治理与安全
OpenAI呼吁加州修订SB 53,增加前沿模型训练和评测阶段的严重事件监测,并强化模型开发全周期网络安全;该公司此前曾反对该法案。