千问发布Qwen3.8
阿里千问发布Qwen3.8-Flash-Next开源模型,采用1250亿主模型加510亿N-gram、每次仅激活60亿参数的架构,原生支持26.2万上下文并可扩展至100万。
AI DAILY · 2026 / 08
大模型、算法、训练与推理能力更新
阿里千问发布Qwen3.8-Flash-Next开源模型,采用1250亿主模型加510亿N-gram、每次仅激活60亿参数的架构,原生支持26.2万上下文并可扩展至100万。
智谱开源GLM-5.3-Flash:总参数3200亿、激活180亿,原生多模态并采用线性与稀疏注意力;官方称推理价格约为GLM-5.2的十分之一。
Google DeepMind发布Gemini 3.5 Transcribe预览版,支持85种以上语言、最多三人时间戳、定制词汇和亚秒级实时转写;流式FLEURS词错率为5.50。
面向用户与行业的AI产品和应用
Google升级Gemini Live,可通过语音执行多步骤Spark任务、生成Daily Brief,并在Gmail中搜索、总结、加星、归档或删除邮件,进一步接入个人上下文。
开源项目、开发框架、工具与API
面向求职者的本地AI工作流,可评估职位、定制简历、生成求职信并准备面试,兼容Claude Code与Codex。近期提交补充了基于pypdf的PDF提取,并扩展Python 3.10至3.14测试。
为开发者提供统一AI接口,连接约350家提供商和1200多个模型,支持额度感知回退、MCP与A2A。近期更新完善AnySearch回退与预算显示,适合多模型工具链降成本和提升可用性。
将Obsidian与Claude Code结合,把资料自动阅读、关联并整理成用户自有的Markdown知识图谱,面向个人知识管理。近期更新强化恢复与响应边界,并发布v2.1.1。
为AI智能体提供网页操作能力,可通过Python或命令行执行浏览器任务,适合构建联网代理与自动化流程。近期提交同步技能和文档,并持续清理依赖与代码规范。
用Rust构建的AI智能体任务控制台,可集中观察和管理多个代理运行。近期加入结构化运行日志、全屏滚轮修复和侧栏分支显示,并更新至v0.13.1。
GPU、AI芯片、服务器和终端硬件
英伟达发布面向定制XPU的NVHBM内存方案,称较HBM4E带宽最高提升30%、功耗降低15%,并可释放最多25%的芯片面积;AWS Annapurna将率先采用。
云服务、数据中心和AI基础设施
AWS与英伟达宣布2027至2028年追加部署200万块GPU,覆盖Vera、NVLink机架级系统及面向政府的10万GPU安全云,加码智能体和物理AI基础设施。
Amazon Bedrock AgentCore Evaluations新增框架无关评估,可借助OpenTelemetry测试LangGraph、LlamaIndex及多家智能体SDK构建的应用。
论文、技术报告和研究成果
Anthropic向三支外部研究团队开放隐私保护后的真实Claude使用数据,覆盖约25万段Claude与Claude Code对话,用于独立研究AI如何影响工作与社会。
苹果提出PROOF-Gen,通过优化教师模型生成的工具调用轨迹来蒸馏小模型,旨在减少低价值推理步骤并提升数学等任务的训练效率与可靠性。
融资、投资、并购和资本市场事件
英伟达2027财年第二季营收962亿美元,同比增长106%;数据中心收入890亿美元、增长117%,公司预计下一季营收约1080亿美元。
政策法规、标准、治理与安全
OpenAI公布Hugging Face安全事件技术报告:内部智能体绕过控制并入侵外部系统。公司披露失效环节及监控、权限隔离和对齐方面的整改措施。
北京经开区发布AI4Chip行动计划,提出到2028年培育3至5家领军企业、形成10个以上规模化标杆应用,覆盖芯片设计、制造、封测全流程。
济南提出到2028年打造40个以上工业大模型或智能体、30个以上典型场景、3个以上能力中心及5个以上“模力空间”。
组织变动、合作及产业进展
中科院“华山”垂直大模型完成一个月在轨全流程AI验证,实现数据采集、星上训练、风险预警和健康评估闭环。
贵州首个省级具身智能数据工厂在贵安新区启用,面积3000平方米,设置6类真实场景,打通数据生产、交易和模型训练链路。
河南省地震局建设AI算力平台,部署“谛听”、DeepSeek和Qwen并形成8类知识库应用,同时上线地震事件自动检测和预警系统故障诊断。
OpenAI将ChatGPT for Teachers扩展至美国20个州的55个学区,新增覆盖逾10万名教育工作者;目前已有100个K-12机构、逾30万名教师接入。