Claude Code到底有多费token?对比实验来了:三大框架最多差30倍
Claude Code到底有多费token?对比实验来了:三大框架最多差30倍最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。
搜索
最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。
DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。
7月31日,DeepSeek正式向公众开放V4-Flash正式版API公测。这一次,最亮眼的关键词是——Agent能力大幅跃升。9项基准测试成绩全面披露,多项指标远超此前发布的V4-Pro-Preview预览版,直接将“代码智能体”的天花板又顶高了一截。
今天,WorkBuddy发布了一个新版本。
近日,米哈游创始人蔡浩宇久违地更新了自己的个人领英,新增了一条独立大模型+智能体开发者(Independent LLM+Agent Developer)的职业经历,时间从2026年7月开始,在新加坡混合办公。
Personal Agent OS 公司「Tiiny AI」宣布完成数千万美元天使轮系列融资,由顺为资本、经纬创投、锦秋基金、云启资本、戈壁—阿里巴巴香港创业者基金、BV 百度风投、光源 L2F 基金联合投资。光源资本担任孵化方和独家财务顾问。
今天,AI 创业圈格外热闹 —— 贾扬清、吴恩达以及 Sonia Joseph( Meta FAIR JEPA 团队核心研究员)在同一天官宣创业。
Encore AI是一家专门研究企业客户互动数据、以此训练和部署AI语音Agent的初创公司,其Agent既可与客服和销售团队协同工作,也可独立自主运行。该公司近日完成由Team8领投的3000万美元A轮融资。
据英国《金融时报》7 月 29 日报道,谷歌 DeepMind 已经重组了曾打造诺贝尔奖级成果 AlphaFold 的核心团队:不再保留独立的 AlphaFold 团队,而是将相关研究人员分流至多个战略项目。这一调整被视为 DeepMind 将重心进一步转向 Gemini 大模型和 AI Agent 的重要信号。
当 “花钱” 这事儿开始外包给 AI,这个世界将发生什么变化?