AI新闻 Aug 15, 2026
语言: DE / EN / ZH / FR / ES / PT / JA / KO
AI 生成:摘要由 AI 根据所链接的来源撰写。 我们如何使用 AI
核心要点
- 中国 AI 初创公司 Z.ai 发布了 GLM-5.3,这是一个具有高级网络能力的开放权重模型,据报道在 Cursor 中发现了一个严重漏洞。该模型在长程编码和网络安全方面显示出显著提升。
- Anthropic 发布了关于其 Claude 水印如何工作的新细节,包括其对编辑的抵抗力以及对代码的影响。这是迈向 AI 透明度和问责制的一步。
- 一个新的评估框架揭示,AI 模型在错误时往往最自信,凸显了在 LLM 辅助工具中需要更好的验证。流利度与正确性之间的差距仍然是一个重大挑战。
- Vals: $40M (Series A)
- SpaceX → Cursor
- 将该规则作为指令添加到 ChatGPT 自定义指令中,例如:除非我明确要求,否则绝不生成图片。将此规则应用于每次对话。
今日看点
- security and AI infrastructureZ.ai 的开源权重 GLM-5.3 发现了 Cursor 的一个严重漏洞,凸显了开放模型如何作为安全工具,而 SpaceX 收购 Cursor 则突显了专有 AI 在基础设施中日益增长的作用。
- AI privacy and misuseOpenAI 的 Computer History 在 Mac 上存储未加密的按键记录,而 xAI 的 Grok 是一起涉及露骨图像诉讼的核心,表明生成式 AI 的隐私风险从数据捕获延伸到内容生成。
- AI reliability limitsClaude Opus 4.8 和 GPT-5.6 Sol 尽管有 3000 美元的 API 额度,但在独立研究中失败,新的评估工具显示模型在出错时最为自信,这对自主 AI 的说法提出了挑战。
- open-source vs multimodal gaps阿里巴巴的 Qwen 3.8 是一个 270 亿参数的开源权重模型,擅长编码,但 Moonshot 的 PerceptionBench 发现没有前沿模型在视觉感知方面表现良好,凸显了不同模态之间进展不均衡。
最重要的AI突破有哪些?
本期Aug 15, 2026精选了10条AI新闻,涵盖技术、研究和产品动态。 Anthropic 发布了关于其 Claude 水印如何工作的新细节,包括其对编辑的抵抗力以及对代码的影响。这是迈向 AI 透明度和问责制的一步。...
Anthropic 发布了关于其 Claude 水印如何工作的新细节,包括其对编辑的抵抗力以及对代码的影响。这是迈向 AI 透明度和问责制的一步。
Anthropic 发布了关于其 Claude 水印如何工作的新细节,包括其对编辑的抵抗力以及对代码的影响。这是迈向 AI 透明度和问责制的一步。
中国 AI 初创公司 Z.ai 发布了 GLM-5.3,这是一个具有高级网络能力的开放权重模型,据报道在 Cursor 中发现了一个严重漏洞。该模型在长程编码和网络安全方面显示出显著提升。
中国 AI 初创公司 Z.ai 发布了 GLM-5.3,这是一个具有高级网络能力的开放权重模型,据报道在 Cursor 中发现了一个严重漏洞。该模型在长程编码和网络安全方面显示出显著提升。
OpenAI 的“计算机历史记录”功能会记录 Mac 上的点击、按键和应用程序切换,为 ChatGPT 和 Codex 创建可搜索的时间线。数据以未加密的 Markdown 格式本地存储,引发了隐私担…
OpenAI 的“计算机历史记录”功能会记录 Mac 上的点击、按键和应用程序切换,为 ChatGPT 和 Codex 创建可搜索的时间线。数据以未加密的 Markdown 格式本地存储,引发了隐私担忧。
目前,AI 生成的书籍占亚马逊自出版目录的 20%,但仅占销售额的 12%,导致市场泛滥并损害了人类作者的销量。这项研究突显了生成式 AI 对出版业的经济影响。
目前,AI 生成的书籍占亚马逊自出版目录的 20%,但仅占销售额的 12%,导致市场泛滥并损害了人类作者的销量。这项研究突显了生成式 AI 对出版业的经济影响。
一项使用 Claude Opus 4.8 和 GPT-5.6 Sol 的研究发现,被赋予六天时间和 3000 美元 API 信用的 AI 代理未能产生独立研究,这与 Anthropic 和 OpenA…
一项使用 Claude Opus 4.8 和 GPT-5.6 Sol 的研究发现,被赋予六天时间和 3000 美元 API 信用的 AI 代理未能产生独立研究,这与 Anthropic 和 OpenAI 的说法相矛盾。这一发现挑战了自主 AI 研究触手可及的观点。
一个新的评估框架揭示,AI 模型在错误时往往最自信,凸显了在 LLM 辅助工具中需要更好的验证。流利度与正确性之间的差距仍然是一个重大挑战。
一个新的评估框架揭示,AI 模型在错误时往往最自信,凸显了在 LLM 辅助工具中需要更好的验证。流利度与正确性之间的差距仍然是一个重大挑战。
一名女子起诉其继父利用 xAI 的 Grok 将童年照片转化为露骨图像,引发了对 AI 滥用的担忧。此案突显了生成式 AI 的阴暗面以及采取保障措施的需要。
一名女子起诉其继父利用 xAI 的 Grok 将童年照片转化为露骨图像,引发了对 AI 滥用的担忧。此案突显了生成式 AI 的阴暗面以及采取保障措施的需要。
阿里巴巴的 Qwen 团队发布了 Qwen 3.8,这是一款基于 Apache 2.0 许可证的密集 270 亿参数模型,凭借原生 262K 上下文,在编码和办公任务上超越了更大的模型。此次开放权重的…
阿里巴巴的 Qwen 团队发布了 Qwen 3.8,这是一款基于 Apache 2.0 许可证的密集 270 亿参数模型,凭借原生 262K 上下文,在编码和办公任务上超越了更大的模型。此次开放权重的发布为开源 AI 生态系统增添了重要力量。
Moonshot AI 的 PerceptionBench 显示,没有任何前沿模型在视觉感知(与推理分开)方面表现良好,表明多模态 AI 存在巨大差距。该基准测试的是模型的“看”的能力,而非推理能力。
Moonshot AI 的 PerceptionBench 显示,没有任何前沿模型在视觉感知(与推理分开)方面表现良好,表明多模态 AI 存在巨大差距。该基准测试的是模型的“看”的能力,而非推理能力。
一篇新论文认为,理性的 AI 采用可能会侵蚀各行业的专业知识,因为公司削减初级岗位并失去集体知识。“认知公地悲剧”可能对整个职业群体产生长期后果。
一篇新论文认为,理性的 AI 采用可能会侵蚀各行业的专业知识,因为公司削减初级岗位并失去集体知识。“认知公地悲剧”可能对整个职业群体产生长期后果。
本周热门AI视频
2个精选YouTube视频,聚焦AI最新发展。
即时快讯带来最新AI动态,包括更快的ChatGPT、Grok 4.6以及三款新发布的开源模型。观众可获得简明概述,了解发生了哪些变化、为何重要,以及这些模型在当前AI格局中的对比情况。

即时快讯带来最新AI动态,包括更快的ChatGPT、Grok 4.6以及三款新发布的开源模型。观众可获得简明概述,了解发生了哪些变化、为何重要,以及这些模型在当前AI格局中的对比情况。
涵盖印度总理Modi在红堡演讲中的关键公告,重点聚焦青年AI技能培训与民防改革。观众将了解印度将AI融入劳动力发展与国家应急准备的政策方向。

涵盖印度总理Modi在红堡演讲中的关键公告,重点聚焦青年AI技能培训与民防改革。观众将了解印度将AI融入劳动力发展与国家应急准备的政策方向。
最新的AI投资信号有哪些?
最新AI投资信号:3轮融资、3条市场动态和4宗并购交易。
一级市场 – 融资轮次
| 公司 | 金额 | 轮次 | 投资者 |
|---|---|---|---|
| Vals | $40M | Series A | a16z |
| SB Energy | $3B | Unknown | Nvidia |
| Point2 Technology | $136M | Series B | LB Investment, Arm, Maverick Silicon |
二级市场 – 市场动态
M&A – 并购交易
本周有哪些实用的AI技巧?
5条实用AI技巧,精选自Reddit社区和专家博客。 让 ChatGPT 始终遵守特定的格式或行为规则。...
提示词技巧
让 ChatGPT 始终遵守特定的格式或行为规则。
将该规则作为指令添加到 ChatGPT 自定义指令中,例如:除非我明确要求,否则绝不生成图片。将此规则应用于每次对话。
创意
使用 LTX-2.5 视频提示词,逐步描述动作、镜头和光线。
按时间顺序编写视频提示词分镜列表:一个人走进房间,镜头向右平移,阳光透过窗户洒入,随后那人坐下。
效率
将 ChatGPT 用作富有同理心的倾诉对象,在处理问题时获得被倾听和理解的感觉。
告诉 ChatGPT:我想梳理一个问题。请先表达共情并总结我的感受,然后再帮我决定下一步该怎么做。
提示词技巧
使用 AI 生成假设性示例,而不是将输入归类到固定类别中。
在构建分类器或搜索功能时,提示词为:生成三个属于该类别的假设性示例,然后将这些示例作为你的匹配标准。
提示词技巧
让 ChatGPT 挑战你的观点,而不是一味附和。
将此系统提示词设置在自定义指令或对话开头:扮演辩论伙伴。挑战我的假设,必要时表示反对,并在回答前提出深入的问题。