“GPT-6”Astra能力首次公开!浙大同济校友参与研发
“GPT-6”Astra能力首次公开!浙大同济校友参与研发OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。
搜索
OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。
李飞飞旗下World Labs发布世界模型Atlas的同一天,Qing Yin创办的Visko推出世界模型Orbis并完成1000万美元Pre-seed融资,主打画面可持续运行并接受实时指令的Live Model。
扩散智能DiffuSpace与Acrab联合测试显示,扩散语言模型凭借全局并行生成机制可将端侧Agent运行速度提升约5倍,双方计划加速推进其在AI PC、智能汽车等场景落地。
UU远程发布史诗级版本更新,全面升级终端功能,新增TUI完整渲染、多终端并行会话管理与跨端接管,并支持免密登录Mac,化身远程Vibe Coding的第一神器。
Meta推出实时音频感知模型Muse Voice Transcribe,支持超20位说话人分割与超1小时长音频转写,可无缝切换中英文夹杂表达,在Artificial Analysis流式语音转文本基准测试中排名第一。
AI陪伴产品「Zeta」8月分成后月流水突破千万美元,日本市场贡献超八成,其通过免费开放高级剧情工具培养多角色剧情深度用户,使用户主动为去广告权益和高级模型付费。
EvoMap团队推出自进化智能体EvoX,采用无中心调度的蜂群模式让大量Agent平级协作、自主组队,在563道逻辑、数学、物理题上将Claude Haiku 4.5的正确率从单Agent的26.29%提升至70%以上,并开源AutoResearch项目构建Agent经验基础设施。
Yukai Engineering CEO 青木俊介在 AGI Playground 2026 上复盘 mirumi 包挂件机器人的成功经验,这款不接大模型的产品在 CES 2025 意外走红,他认为消费机器人的关键在于提出正确的问题而非比拼技术参数。
成立不到一年,明星AI公司 Violoop 正式完成亿元级天使轮及Pre-A轮融资。
前腾讯AI Lab可信AI负责人吴秉哲的创业项目Knevo(思演智能助手)目前处于内测阶段,聚焦金融方向的AI决策,整合流式推理、工具调用、长期记忆与断线恢复等模块,并提出"千人千面+自净化"的Agent建设逻辑。
AI 新材料研发公司鼎犀智创(Rhinovate™)近日完成数亿元 Pre-A 轮融资,本轮融资由鼎晖百孚领投,九合创投、彬复资本、龙芯创投、顺禧基金、中关村资本跟投。
家人们,我最近在GitHub上看到一个爽文。
就在最近,Anthropic突然爆料了一个被自己故意「训坏」的Opus级模型!挑80个有毛病的训练环境,把模型丢进去,撤掉所有纠偏机制,然后看它长成什么样。
Agent 出现这么久了,大伙应该对它们的工作方式也不陌生了吧?
Codex用着用着就要压缩上下文、压着压着可能还“失忆”的痛苦,就要结束了!
在代码领域,我们已经越来越习惯一个词:Vibe Coding。
刚刚过去不久的暑期档,游戏行业发生了不少大事儿。
中国大模型商业化的一次分层。
这两年Agent领域冒出来的Engineering越来越多。
模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
视觉 - 语言 - 动作模型(Vision-Language-Action Model,VLA)正在成为机器人操作的重要基础模型。经过少量示范微调后,VLA 已经能够完成抓取、放置、堆叠等多种任务。然而,一旦任务涉及精密接触、狭小容差或分布外位置,模型的成功率仍会明显下降。
Claude Fable 5.1发布数小时内即遭知名黑客Pliny the Liberator越狱,其在GitHub公开泄露了超27万字的完整系统提示词,曝光了模型的安全规则、记忆禁区及46个内置工具架构等核心细节。
「全球首个」多模态世界模型,来了!
一觉醒来,Anthropic再次改写了机器智能的坐标系。
刚刚,OpenAI 宣布,ChatGPT 的广告的年化收入运行率(run rate)突破 10 亿美元。
除了电力之外,在这一轮AI数据中心扩产潮中,中国另外两个天然优势,也被海外发现了。
已经被苹果打入冷宫三年的 Touch Bar,最近意外迎来事业上的「第二春」。
工作,是真的能先交给豆包工作了。
大模型越来越强之后,企业究竟愿意为什么样的AI付钱?