AI资讯新闻榜单内容搜索-Harness

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Harness
JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub 给出的答案,是把可编辑画布同时变成用户工作区、Agent 的外部记忆、行动空间和共享项目状态。Agent 不再只从聊天记录里猜测上下文,而是直接「看」到画布上的提示词、参考图、候选版本、生成结果、依赖关系、失败记录和用户反馈,再据此规划、调用工具、写回结果。

来自主题: AI资讯
8360 点击    2026-08-02 11:09
Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

Claude Code到底有多费token?对比实验来了:三大框架最多差30倍

最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。

来自主题: AI资讯
9794 点击    2026-08-01 11:06
模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。

来自主题: AI技术研报
6379 点击    2026-07-30 15:55
Claude Opus 5,第一次杀死 Harness?

Claude Opus 5,第一次杀死 Harness?

Claude Opus 5,第一次杀死 Harness?

7 月 24 日,Claude Opus 5 上线。几个小时之内,我看到各家媒体把这个模型的评测成绩转载了一轮,而更值得留意的是 Anthropic 内部人员当天发出的一条推文。

来自主题: AI技术研报
7519 点击    2026-07-27 11:31
一文带你看懂刚刚发布的“北京智能体新政”,这是跟每个人都有关的10条。

一文带你看懂刚刚发布的“北京智能体新政”,这是跟每个人都有关的10条。

一文带你看懂刚刚发布的“北京智能体新政”,这是跟每个人都有关的10条。

刚刚,北京市发布了一份特别重磅的政策文件。《北京市关于加快智能体引领发展的若干措施》文件不长,一共10条。但我把它从头到尾看完以后,我的第一反应是,这份政策真的有点太新了。Agentic AI、Harness Engineering、AI OS、FDE、OPC、Token经济、TaaS、AaaS、RaaS、Token工厂、AIP。

来自主题: AI监管政策
10347 点击    2026-07-23 14:08
谷歌最新白皮书:搞定2026 Agent生产力,吃透Context、Skills与Harness

谷歌最新白皮书:搞定2026 Agent生产力,吃透Context、Skills与Harness

谷歌最新白皮书:搞定2026 Agent生产力,吃透Context、Skills与Harness

在计算历史的绝大部分时间里,编程的本质是一项翻译工作:开发者需要在人类理解的维度上剖析问题,设计抽象方案,随后将其转译为机器能够执行的语法。当前的软件工程领域正在经历自高级编程语言问世以来最为显著的变化。

来自主题: AI技术研报
8754 点击    2026-07-20 15:00
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness,近期被LangChain CEO、联合创始人Harrison Chase转发,也被前OpenAI副总裁Lilian Weng收进自进化Agent相关博客。它盯上的不是换模型,而是Agent外层那套Harness。

来自主题: AI技术研报
9098 点击    2026-07-18 19:10
ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

7 月 16 日,伯克利博士后 Haven Feng 的一条推文火了。原因无他,结果很震撼:在 ARC-AGI-3 Public 集上,一套名为 [schema] 的智能体框架,与 Claude Opus 4.8、Fable 5 组合后达到 98.98% 的 RHAE;换成 GPT-5.6 Sol 组合,分数也有 95.35%。

来自主题: AI技术研报
9839 点击    2026-07-18 14:22
翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

近日,翁荔发布长文 《Harness Engineering for Self-Improvement》,系统梳理了 harness engineering 在 AI 自我改进中的作用。

来自主题: AI技术研报
8855 点击    2026-07-16 10:31