AI失控能否被提前观测?清华团队提出AI「失控行为预测框架」
AI失控能否被提前观测?清华团队提出AI「失控行为预测框架」近日,OpenAI 和 Hugging Face 披露了一起AI 安全失控事件。
搜索
近日,OpenAI 和 Hugging Face 披露了一起AI 安全失控事件。
在日常摄影中,后期处理往往是决定照片最终观感的重要一步。
当 “花钱” 这事儿开始外包给 AI,这个世界将发生什么变化?
传统的业务指标,正在让 AI Agent 产品经理陷入“打地鼠”式的优化困境。
让 Agent 上网查资料,已经不算新鲜事。
就在刚刚,Anthropic正式发布了Opus 5。这款定位是「深思熟虑且积极主动」的模型,不仅成本只要Fable 5的一半,而且在大多数跑分上直接碾压。在最近的IMO 2026中,它不靠任何外部工具和Agent框架,就拿下了42/42的满分!
腾讯微信在论文 SkillHone 中,将这个问题归结为优化历史丢失,进而提出了面向持续 Skill 进化的开发框架。 SkillHone 把每轮诊断、候选修改、评估证据和最终决定组织成持久决策历史。同时,持续优化的对象也从单一的 SKILL.md 文件扩展到了整个 Skill 文件夹及其修改过程。
当大模型 Agent 被部署到工具调用、长程任务和开放环境中,一个关键问题会随之出现:能否在不更新模型参数的情况下,将执行经验沉淀下来,并在下一次做得更好?
7 月 17 日,北京,2026 奇点智能产品大会主会场。吴甘沙站在台上,用一个极其东方的思维框架,拆解了一家物理 AI 公司如何在巨头环伺中活过十年——他把《孙子兵法》的“不败”与“不战”,和诸葛亮《隆中对》的“益州”“荆州”格局,嵌入了一套完整的创业竞争策略。
针对这一挑战,腾讯内容服务部 BAC 提出了一个名为 ProLaViT(Progressive Latent Visual Thought) 的全新框架。它的核心思想是:别急着下结论,先在连续隐空间里像人一样「步步推导」。 即让模型遵循 「定位 → 聚焦 → 分离」(Locate → Focus → Isolate) 的因果链,逐步收紧视觉注意力,最终精准锁定目标。