AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数
AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?
搜索
给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?
Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。
如果说大语言模型拉开了本轮人工智能革命的序幕,那么今天人机交互的瓶颈,早已不再是模型的智商,而是人类接收信息的生理带宽。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
AI博主在WorkBuddy中实测腾讯混元Hy4 preview,通过研究检索、Excel+PPT交付、播客报价系统和3D小游戏四个办公场景验证其能力,认为该模型在长程任务中对信息冲突与规则歧义的审慎处理是其核心亮点,适合作为办公搭子。
最近 MIT 出了一篇研究,我看完有点不知道说什么好。
OpenAI正式发布生命科学AI工作台Rosalind Workbench,基于GPT-Rosalind推理模型集成至Codex,内置分子结构、序列比对、病理切片三个可视化查看器及NGS分析模块,接入Boltz等外部专业插件,目前以研究预览形式向机构开放。
Alaya Lab推出反事实社会模拟产品合成世界Synthetic World,用户可改变故事中的关键事实进入平行时间线,观察AI居民持续互动、建立关系并自主推动剧情演化,目前平台已积累数百个世界、万级居民和近两万条社区动态。
Accelerated Understanding由英伟达前AI研究总监Anima Anandkumar联合创立,采用神经算子架构构建支持5万亿推理上下文的物理AI大模型,可一次推演完整4D时空轨迹,其创始人拒绝贝索斯35%股权及超20亿美元融资的普罗米修斯计划招揽。
在此背景下,新加坡国立大学、普林斯顿大学与斯坦福、牛津等研究团队合作提出了 Recuris(Recursive Experiential–Working Memory Evolution),作为首个将递归自我改进应用在记忆控制层内的智能体架构,Recuris 通过三项核心技术突破,无需训练即成功实现了从 3B 小模型到 Claude Opus 5 的全面提升。