AI DAILY · 2026 / 08

08月23日 AI 日报

01

开源与开发者

开源项目、开发框架、工具与API

InfoQ Global

LinkedIn多智能体审查

InfoQ报道LinkedIn构建多智能体代码审查平台,用独立模型交叉验证并过滤低质量建议;对1727个PR的5230条评论抽样评估,建议采纳率63.9%。

Simon Willison

LLM 0.33发布

Simon Willison发布LLM 0.33,升级OpenAI Python 3.x,嵌入命令支持逐次传入密钥,还可组合模板并配置推理摘要。

02

云平台与基础设施

云服务、数据中心和AI基础设施

内蒙古自治区人民政府办公厅

内蒙古签约1361亿算力项目

内蒙古绿色算力大会集中签约13个重点项目,总投资1361亿元,覆盖芯片检测、装备制造、算力中心和Token工厂等领域。

03

学术与技术研究

论文、技术报告和研究成果

The Decoder

研究揭示AI安全测试盲区

一项分析最多192个模型、5000余道题的研究发现,安全基准分别测量拒答、诚实和情境判断,平均分会掩盖权衡;自适应约10题即可接近完整排名,并能识别部分“装谨慎”行为。

The Decoder

技能库提升智能体有边界

一项涵盖8135次测试的研究发现,智能体“技能”改进主要来自流程指引(65.7%),知识补充仅占4.5%;技能库从5项增至100项时,检索准确率从29.6%降至3.3%。

04

政策监管与AI安全

政策法规、标准、治理与安全

TechCrunch

OpenAI转向强化加州AI法

OpenAI呼吁加州修订SB 53,增加前沿模型训练和评测阶段的严重事件监测,并强化模型开发全周期网络安全;该公司此前曾反对该法案。