新哥聊技术 · 2026年10月7日
AI早报|Mistral Large 4亮相,智能体走进企业深水区
今天的主线是“模型更强,系统也要更可控”。Mistral用1万亿参数ML4继续推高开放权重模型的能力上限;OpenAI、ElevenLabs和Atlassian将智能体嵌入合同、客服与企业知识流程;Anthropic、IBM和AWS则把访问分级、漏洞修复与影响评估摆在同样重要的位置。以下信息均按北京时间窗口核验原文与首次发布时间。
今日重点
先看目录,再按兴趣阅读本期已核验资讯:
1. Mistral Large 4公开预览,月底将开放权重
2. OpenAI联合Ironclad训练合同流程智能体
3. Claude扩展网安专业人员高能力访问
4. IBM与Red Hat修复400多个开源软件漏洞
5. GitHub热榜五个项目通过线上五日去重
AI动态
1. Mistral发布ML4
Mistral推出Mistral Large 4公开预览:1万亿总参数、490亿激活参数,支持160多种语言,强化编程、网安与多模态任务;权重计划月底开放。
2. OpenAI联训合同智能体
OpenAI与Ironclad把11类合同、审批和采购流程转成训练与评测任务;官方研究中GPT-6 Astra平均得分55.0%,比GPT-5.6 Sol高32%。
3. OpenAI深化企业协作
OpenAI与Atlassian扩大合作,GPT-6系列将支撑Rovo与平台内智能体;Atlassian还将企业知识引入ChatGPT和Codex工作流。
4. Claude扩容安全访问
Anthropic扩展Cyber Verification Program,为核验后的安全专业人员提供Claude Mythos 5.1、Opus 5.5和Sonnet 5.5的防御性网安访问与配套防护。
5. GLM5.3入驻Bedrock
AWS上线智谱GLM 5.3,这款7530亿参数MoE模型面向编程与长时间智能体任务,支持OpenAI兼容接口、提示缓存及安全测试演示。
6. IBM修复400余漏洞
IBM与Red Hat称Lightwell已识别、修复并回移400多个Java开源库未知漏洞;Clearinghouse同时上线,企业可提交依赖进行优先审查与修复。
7. 语音智能体添架构师
ElevenLabs发布ElevenAgents Architect Alpha,可分析对话与失败测试、起草配置修改并用模拟对话验证;所有更改以版本化草稿交由人工审批。
8. GitHub重构Git底座
GitHub披露正在不停机前提下重构Git基础设施,以承载智能体规模的并发软件开发、更高仓库活动和自动化工作负载。
9. 英伟达统一GPU网络
NVIDIA将GPUNetIO整合为统一GDA-KI基层,让CUDA核函数直接驱动以太网、RDMA和DMA;开源Verbs路径已接入NCCL、NVSHMEM等通信栈。
10. B300推理集群扩容
Together AI将在IBM Cloud上运行专用NVIDIA B300推理集群,配套Spectrum-X以太网;三方分别提供推理平台、云设施和GPU及网络。
11. AMD提出TAF指标
AMD提出Typical Attained FLOPs(TAF),以预先固定的代表性GEMM集合衡量加速器典型持续吞吐,与峰值FLOPs及MAF共同补足GPU性能画像。
12. AWS对齐AI影响评估
AWS解读ISO/IEC 42005:2025,给出AI系统影响评估的范围界定、分析报告、持续监测与重评估触发方法,并说明其与ISO 42001管理体系的衔接。
GitHub热榜
1. AI Engineering:系统化AI工程课程
今日 +783 Star · 总计 65273 · 新上榜
面向AI工程学习者的免费开源课程,以523节课、20个阶段覆盖数学、机器学习、LLM应用、智能体与MCP,每节课配可复用产物。近期重建课程站点数据,适合希望系统学习并动手实作的开发者。
2. Agency Agents:多角色智能体库
今日 +621 Star · 总计 157776 · 新上榜
可安装到Claude Code、Cursor、Codex等工具的专业智能体集合,覆盖工程、设计、营销、安全等分工,各角色带流程、交付物和成功指标。近期批量合并内容修正,适合需要组建可复用多角色工作流的团队。
3. Impeccable:智能体设计规范
今日 +609 Star · 总计 77642
为AI编程智能体提供设计指南、24个命令、60条确定性检测规则与浏览器可视化迭代,用来发现模板化UI和可用性问题。近期修复规则核心与页内探针,适合希望统一AI前端质量门禁的团队。
4. I Have ADHD:精简智能体输出
今日 +318 Star · 总计 54357 · 新上榜
面向编程助手的输出风格技能,用10条规则强制“行动优先、步骤编号、单一下一步”,减少长前言与旁枝。近期修复OpenCode v2插件API兼容性,适合偏好短、直接、可执行回复的用户。
5. Ollama:本地开放模型运行
今日 +137 Star · 总计 182390 · 新上榜
跨Windows、macOS和Linux的本地开放模型运行时,提供CLI、REST API与Python/JavaScript库,可运行Kimi、GLM、DeepSeek、Qwen等模型并接入编程智能体。近期修复嵌入请求过大时的路由错误处理。
今日观察
Mistral Large 4展示了开放权重模型还在向编程、网安和专业工作流继续进化,但今天更值得关注的是“模型之外”。OpenAI用真实合同流程建立可验证训练任务,ElevenAgents Architect把修改停在版本化草稿并要求人工批准,Anthropic用身份核验区分网安能力访问,IBM与Red Hat则把漏洞修复和回移当作完整工程。这些发布共同指向一个变化:智能体的竞争正从“能否采取行动”转向“是否可分级、可测试、可审批、可回滚”。
内容由“新哥AI资讯”按地址库来源及已核验原文整理,来源时间统一换算为北京时间。