
Gemini多代理解出7道开放题:证明可核验,成绩仍属内部测试
Google于2026年8月31日公布Antigravity Teamwork的多代理成果:Gemini系统处理7项开放问题,并给出Lean证明、预印本和上游代码等可检查产物;71%的TCSBench成绩仍是内部测试结果。

Google于2026年8月31日公布Antigravity Teamwork的多代理成果:Gemini系统处理7项开放问题,并给出Lean证明、预印本和上游代码等可检查产物;71%的TCSBench成绩仍是内部测试结果。

ServiceNow AI Platform出现三项CVSS 10.0漏洞,可分别造成任意代码执行、权限提升和底层数据库访问。托管实例已由厂商更新,自建及合作伙伴管理的实例仍须部署适用热修复;截至2026年8月31日,尚无已知恶意利用。

欧盟AI法案第50条的透明度义务已于2026年8月2日开始适用,但并非要求所有AI内容统一“加水印”:提供者负责交互告知和机器可读标记,专业部署者负责深度伪造及特定公共利益文本的受众披露。

Gemini API将在2026年9月拒绝Standard key,Google尚未公布具体生效日。开发者需要在9月前识别旧密钥、创建Auth key,并按服务端替换、生产验证、撤销旧密钥的顺序迁移,避免调用中断。

Anthropic于2026年8月28日公布自动化对齐实验:Claude驱动的系统为十类可测量失误找到有效后训练方案,受限比较中的最佳结果超过28名研究员的提案,但不代表AI已能发现未知风险或决定正确价值观。

镓源实验的中微子俘获率比传统预测低约20%,但这未必需要惰性中微子来解释。取消轻子与核跃迁的简单因子化后,理论截面可以下降到观测附近;关键限制是弱跃迁密度仍未被精确确定。

2026年8月25日,Nature解读了一项21日发表于Nature Medicine的成人海马体研究:重度抑郁症死者脑组织中仍能识别神经发生谱系,但从神经干细胞向神经母细胞推进的过程可能受阻。结果来自死后组织观察,尚不能证明这种变化导致抑郁,也不代表已有新疗法。

Anthropic于2026年8月25日上线Claude统一记忆,让普通聊天与云端Cowork共用可逐项管理的记忆主题。健康、宗教信仰等敏感主题仍默认排除;用户可查看、修改或删除条目,但本地Cowork、项目隔离及Team和Enterprise组织开关仍限制记忆的流动范围。

运行 aws configure agent-toolkit,可检测本机的多款AI编程代理,为选定客户端安装默认技能并配置 AWS MCP Server。但向导不会自动安装目录中的全部技能;完成后仍需核对技能清单、MCP区域、AWS身份和 IAM 权限。

微软8月26日披露LiteLLM、RAGFlow和Kestra工作负载遭入侵:攻击者从暴露的应用入口进入运行时,窃取模型服务密钥、数据库配置和容器中的云凭证,并实施持久化与挖矿。

OpenAI拟于2026年11月12日终止通过现有合同向Cursor提供模型,并停止供应未来模型。变化针对模型供应关系,而非Cursor整体停服;具体受影响型号和最终执行安排仍待公布。

Next.js于2026年8月25日修复两条无需登录即可触发的远程代码执行漏洞,安全版本为15.5.24和16.3.3。AVIF图片优化与Windows双路由部署的触发条件不同;Netlify默认托管路径不会进入相关代码,但仍建议升级并重新部署。

2026年8月26日,Anthropic将Claude in Chrome正式开放至全部付费方案,允许安全分类器审核后自动执行网页操作;同期推出的Cowork内置浏览器则提供与个人浏览环境分离的路径。两者的关键差异在于登录态、扩展部署和管理员开关。

PaperCut于2026年8月28日发布NG/MF Emergency Patch Release 2,并要求已经安装首版紧急补丁的客户再次升级。所有版本都在公告范围内;公网Application Server还应立即限制为仅可信IP可访问,并排查已知入侵迹象。

AI角色聊天可以用于娱乐、创作和低风险练习,但拟人化表达不等于保密、专业或可靠。成年人、家长和教育者应守住四条边界:不把角色当心理咨询师、不提交敏感信息、留意情感依赖,并为未成年人预设无需证明受害即可启动的退出机制。