你的Hermes,正在使用你的身份……
你的Hermes,正在使用你的身份……智东西实测Hermes Agent新上线的Real Profile Browsing功能,该功能可复制Chrome登录态让Agent直接以用户身份访问网站,但实测中发现存在浏览器卡死、匿名Cookie覆盖原登录信息及macOS加密保护导致无法读取登录数据等问题,目前功能可用性仍有待优化。
搜索
智东西实测Hermes Agent新上线的Real Profile Browsing功能,该功能可复制Chrome登录态让Agent直接以用户身份访问网站,但实测中发现存在浏览器卡死、匿名Cookie覆盖原登录信息及macOS加密保护导致无法读取登录数据等问题,目前功能可用性仍有待优化。
那这次发布的 Hy4 Preview 到底有什么进步,APPSO 这就给你实测看看。姚顺雨此前反复提到一个思路,比起把模型训练成更会刷榜的「做题家」,混元更关心它到了真实场景里到底好不好用。
今夏,数学圈震动不断——OpenAI的Astra模型一举解决10个长期悬而未决的数学问题(包括非sofic群的存在、高维球堆积新的结果等);Claude Fable 5找到近百年Jacobian猜想的反例,之后还极大推动了黎曼猜想!
Fable 5.1这周鸽了,但A社再次甩出了王炸。 今天,是值得载入大模型史册的一天。 AI,终于长出手,接管物理世界了! A社最先拿自家Claude「试水」,让它去真正操控实验室的硬件。
这一次,高通把6G的未来讲透了。
8月26日,Claude开了自己的浏览器。
Qwen4还没出,架构先开源了。
从《四驱兄弟》里那些在赛道上奔跑的机械想象,到后来扎进机器人学习领域的漫长探索,徐梦迪始终被同一个问题牵引:机器要怎样进入物理世界,并在那里持续生长。
随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。
截至 2026 年 8 月 19 日,Specula 已经在 67 个开源系统中找出 382 个 bug,并被多个公司和开源社区的开发者使用。
业务覆盖企业私有化算力部署与自营Token工厂。 作者 | 杨京丽 编辑 | 李水青 智东西8月27日报道,昨日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资。本轮融资由专注AI及AI Inf
Moxt 的口号是「Build Your AI Native Team」,致力于提供一个 AI 和人类能够无缝协作的空间,实践 AI Native 的团队运行方式。
我们理想中的具身智能模型,是什么样的?
8月14日,一个叫Cocode的项目悄悄出现在GitHub上,简介写得很直白,基于DeepSeek Harness构建的开箱即用发行版。不到两周,它拿到150多个star,并在8月25日发布了v1.0.2。
最近 DeepSeek Harness(DSH)真是太火了!之前我发过 《首发实测 + 入门教程》 教大家如何安装使用,还盘点过 《16 个超火的 DSH 插件》。
867 亿元,Hugging Face 被英伟达纳入麾下,就在这桩巨额收购的前一晚,OpenAI 发布超长安全调查报告里,Hugging Face 还是一个巨大的「事故现场」——看来并没有影响它的价值。
如果说 Vibe Coding 让「写代码」这件事从「敲键盘」变成了「和 AI 对话」,那么今天要介绍的这项工作,可能正在把同样的故事在 3D 世界构建 领域重演一遍。
说真的,现在谁还能完全离开AI工作?
在乳腺癌领域,AI 辅助筛查与早期诊断的能力已逐步成熟,使得更多患者能够得到精准的诊断。但筛查能力的提升,恰好把一个关键的问题推到了台前:患者被筛出来,被确诊之后,漫长的治疗期由谁来管理?
昨晚,孙割写的小作文爆火。具体的小作文详情我就不放了,应该传的满天都是,感兴趣的可以去孙割的GitHub上看。但是就别问我孙割具体的GitHub链接是什么,你可以直接复制这个问题去问AI。
不得不说,这真是我参加过最「全自动」的产品发布会……台上还在讲,台下已经开始出片了???新闻稿、产品长图、嘉宾金句海报、现场高光视频……一个接一个往外冒,简直是「实时转录」。
在 2026 世界人形机器人运动会 - 工业场景赛 -「装配上料岗」赛项中,一台机器人需要连续完成搬运上架、拣选上料、物料装配三项任务:从搬运 10kg 物料箱,到七类零件拣选,再到发动机 18 个气门的亚毫米级装配。
“让AI自己跑通IP孵化闭环。”
过去几年,视频生成模型在清晰度、运动表现和画面质感上不断进步。输入一句文字,模型已经能够生成颇具电影感的视频。
不建图、不记忆、零训练:coding-agent 被直接扔进屋里,导航成绩反超工业级专用模型。
过去两年,大模型几乎重写了人机协作的默认想象:写代码、查资料、做分析,似乎都能 “一问即答”。但仔细看会发现,当下很多能力并不是模型自己长出来的,而是人为地在外面包了一层又一层框架。
在动画和美术生产中,线稿上色是一个看似基础、却极其依赖细节控制的环节。创作者往往不是简单地把线稿涂上颜色,还需要理解角色身份、遵守局部色块约束、参考前后帧风格,并在连续片段中保持服装、发色、妆容和背景的一致性。
大语言模型,现在真的长出手了。 本周四,Anthropic 宣布推出硬件用 MCP:Model Hardware Standard(MHS),这是一项新标准,用于帮助所有大模型驱动的 AI 智能体(Agent)安全快捷地操纵物理设备。
几个小时前,Barret Zoph 在 𝕏 上发了一条推文,他说自己将加入谷歌 DeepMind,而他的 AI 生涯正是从谷歌 Brain 的 Residency 项目起步的,这次算是重返旧地;他将专注于强化学习(RL)与后训练(Post-Training)方向,更多消息稍后公布;他还补了一句,谷歌拥有在 AI 领域持续成功所需要的全部要素,他很高兴能成为这个使命的一部分。
OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。