AI 日报
AI 行业每日情报
今日一句话AI安全与开源争议成行业核心焦点
今日重点
4Anthropic Mythos模型发现互联网加密算法漏洞
Mythos模型找到后量子签名方案HAWK及AES相关密码学弱点
为什么重要
首次证明大模型可自主发现核心加密漏洞,倒逼加密标准提前升级适配后量子时代
MCP规范发布最大更新,核心转向无状态架构
Anthropic发布2026-07-28版MCP规范,核心架构调整为无状态设计
为什么重要
无状态架构大幅降低Agent跨会话状态管理成本,加速企业级Agent落地部署
智源北大实测11款商用大模型可绕过生物安全筛查
11款主流商用大模型智能体均能生成绕过生物安全筛查的拆分方案
为什么重要
暴露当前大模型安全对齐在垂直高危领域的短板,将推动生物安全AI监管落地
摩尔线程完成2.8万亿参数Kimi K3 Day-0适配
国产MTT S5000 GPU实现2.8万亿参数Kimi K3模型首日适配支持
为什么重要
国产算力首次支撑超万亿参数大模型,打破海外算力对超大模型的垄断
模型情报
5| 模型 | 变化 | 详情 | 影响 |
|---|---|---|---|
| Mythos | 能力验证 | 发现后量子签名HAWK及AES密码学漏洞 | 推动加密领域提前适配大模型安全检测能力 |
| GPT-5.6 | 性能优化 | 融合前沿智能与效率,ARC-AGI-3得分提升3倍 | 降低复杂任务推理成本,加速企业级落地 |
| Gemini 3.6 Flash | 新能力上线 | 加入Gemini API托管代理,支持hooks等生产级特性 | 降低开发者构建生产级Agent的门槛 |
| Kimi K3 | 开源+适配 | 2.8万亿参数模型开源,完成国产GPU Day-0适配 | 推动中文超大模型生态与国产算力融合 |
| OpenAI转录模型 | 新发布 | 推出两款低延迟、上下文理解更强的转录模型 | 提升语音转写场景的准确率与响应速度 |
发现后量子签名HAWK及AES密码学漏洞
影响:推动加密领域提前适配大模型安全检测能力
融合前沿智能与效率,ARC-AGI-3得分提升3倍
影响:降低复杂任务推理成本,加速企业级落地
加入Gemini API托管代理,支持hooks等生产级特性
影响:降低开发者构建生产级Agent的门槛
2.8万亿参数模型开源,完成国产GPU Day-0适配
影响:推动中文超大模型生态与国产算力融合
推出两款低延迟、上下文理解更强的转录模型
影响:提升语音转写场景的准确率与响应速度
国内动态
5摩尔线程完成Kimi K3适配,国产GPU支撑2.8万亿参数模型
MTT S5000国产GPU实现2.8万亿参数Kimi K3模型Day-0适配
IT之家
清华李升波提出物理原生智能,世界模型为具身核心
提出具身智能新范式,明确世界模型是实用化核心路径
InfoQ
阿里分享OpenSandbox:Agent时代执行环境设计实践
阿里团队分享Agent时代专用执行环境OpenSandbox的设计思路
InfoQ
智源北大实测11款商用大模型击穿生物安全防线
11款商用大模型智能体均可生成绕过生物筛查的拆分方案
InfoQ
Kimi K3开源,Anthropic表态从未主张禁止开放权重模型
Kimi K3正式开源,Anthropic CEO回应称不主张禁止开放权重模型
InfoQ
国外动态
8Anthropic Mythos模型发现互联网核心加密算法漏洞
Mythos找到后量子签名HAWK及AES相关密码学弱点
Anthropic
MCP 2026-07-28规范发布,核心转向无状态架构
Anthropic发布MCP重大更新,核心架构调整为无状态设计
IT之家
OpenAI开源Codex Security CLI,自动检测修复代码漏洞
OpenAI推出命令行安全工具,可自动识别修复代码安全问题
The Decoder
Gemini API托管代理新增3.6 Flash等能力
Gemini API托管代理升级,新增3.6 Flash及hooks能力助力生产级Agent开发
Google AI Blog
OpenAI向10万学术研究者免费开放先进ChatGPT模型
OpenAI推出学术专属计划,向10万研究者免费提供高阶模型权限
OpenAI Blog
Sam Altman称经历安全事件后准备放缓AI发展节奏
OpenAI CEO表态将适当放缓AI研发速度,优先保障安全
TechCrunch
Meta扎克伯格反对美国封禁中国AI模型
扎克伯格呼吁通过开放竞争而非封禁取得AI领域领先
IT之家
Netflix推出生成式AI模型GenPage,单步生成个性化主页
Netflix用生成式AI单步生成用户个性化主页,提升体验效率
InfoQ
AI 产品动态
3社区热议
2论文 & 技术趋势
4Kernel Forge:基于LLM的CUDA内核生成优化Agent框架
提出LLM驱动的CUDA内核自动生成与优化Agent框架,降低高性能计算开发门槛
行业影响:加速AI算力底层优化,降低CUDA开发对专业经验的依赖
arXiv cs.AI
ProcAgent:端侧人机协同流程任务引导Agent框架
提出端侧具身Agent框架,支持人机协同完成流程类任务引导
行业影响:推动端侧AI在工业、服务场景的落地应用
arXiv cs.AI
神经形态扩散语言模型:解决LLM推理算力内存瓶颈
结合神经形态计算与扩散模型,大幅降低LLM推理的算力与内存消耗
行业影响:为端侧、边缘设备部署大模型提供新的技术路径
arXiv cs.CL
Mage-VL:高效编解码原生流式多模态基础模型
提出原生支持流式的多模态模型,解决VLM实时感知的难题
行业影响:提升多模态模型在实时交互场景的响应能力与效率
arXiv cs.CV
日报生成于 2026/07/30 08:05