独家 | 前腾讯AI Lab高级研究员吴秉哲创业项目Knevo内测,锚定AI决策
独家 | 前腾讯AI Lab高级研究员吴秉哲创业项目Knevo内测,锚定AI决策前腾讯AI Lab可信AI负责人吴秉哲的创业项目Knevo(思演智能助手)目前处于内测阶段,聚焦金融方向的AI决策,整合流式推理、工具调用、长期记忆与断线恢复等模块,并提出"千人千面+自净化"的Agent建设逻辑。
搜索
前腾讯AI Lab可信AI负责人吴秉哲的创业项目Knevo(思演智能助手)目前处于内测阶段,聚焦金融方向的AI决策,整合流式推理、工具调用、长期记忆与断线恢复等模块,并提出"千人千面+自净化"的Agent建设逻辑。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?
Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。
如果说大语言模型拉开了本轮人工智能革命的序幕,那么今天人机交互的瓶颈,早已不再是模型的智商,而是人类接收信息的生理带宽。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
AI博主在WorkBuddy中实测腾讯混元Hy4 preview,通过研究检索、Excel+PPT交付、播客报价系统和3D小游戏四个办公场景验证其能力,认为该模型在长程任务中对信息冲突与规则歧义的审慎处理是其核心亮点,适合作为办公搭子。
最近 MIT 出了一篇研究,我看完有点不知道说什么好。
OpenAI正式发布生命科学AI工作台Rosalind Workbench,基于GPT-Rosalind推理模型集成至Codex,内置分子结构、序列比对、病理切片三个可视化查看器及NGS分析模块,接入Boltz等外部专业插件,目前以研究预览形式向机构开放。
Alaya Lab推出反事实社会模拟产品合成世界Synthetic World,用户可改变故事中的关键事实进入平行时间线,观察AI居民持续互动、建立关系并自主推动剧情演化,目前平台已积累数百个世界、万级居民和近两万条社区动态。