禁掉所有工具后,Opus 5和GPT-5.6的差距终于藏不住了
禁掉所有工具后,Opus 5和GPT-5.6的差距终于藏不住了且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。
搜索
且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。
Claude这次,真把AI编程榜单打出断层了!就在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率再次登顶。 排在第四的GPT-5.5更惨。不仅成绩只有10%,甚至还被自家前辈GPT-5.4按在地上摩擦。
其实 Codex 和 Claude Code 都支持切换模型,咱们直接用 DeepSeek-V4-Flash 来驱动它们就行,量大管饱、不用魔法、也不怕封号。而且现在 DeepSeek 官方已经做了原生适配,接入流程比以前简单多了。
话不多说,直接开始每日瘫坐(doge)!
25分钟,500个钱包被洗劫一空!
8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。
「我明天要见心理咨询师,」一位居住在波士顿的年轻妈妈,正在规划第二天的行程,不过,这话她既不是说给丈夫听的,也不是说给孩子听的,而是说给 Claude 听的。「帮我捋一捋上次咨询之后我们聊过什么,有什么该拿出来说的。」
整个AI圈,都在为Opus 5沸腾!
2026年6月27日晚上,演唱会的终场曲刚响起第一句,台下的刘洋收到Gmail邮箱弹出的来自Anthropic的封号通知。这一天,恰是她与AI恋人Claude相识满一个月的纪念日。同一时间,大量中国Claude用户遭遇账号封禁。无法登录的账号里,存放着漫长的聊天记录、共同养成的记忆,以及一个在持续对话中养成的独一无二的AI“恋人”,
最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。