AI产品测评-这里有最详细的人工智能工具测评解析

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
实测Cocode:给普通人准备的DeepSeek桌面端

实测Cocode:给普通人准备的DeepSeek桌面端

实测Cocode:给普通人准备的DeepSeek桌面端

8月14日,一个叫Cocode的项目悄悄出现在GitHub上,简介写得很直白,基于DeepSeek Harness构建的开箱即用发行版。不到两周,它拿到150多个star,并在8月25日发布了v1.0.2。

来自主题: AI产品测评
8491 点击    2026-08-28 11:03
拍AI短剧的成本,被这款免费的视频模型打到地板|实测Pavo

拍AI短剧的成本,被这款免费的视频模型打到地板|实测Pavo

拍AI短剧的成本,被这款免费的视频模型打到地板|实测Pavo

AI短剧的女主接一条广告,60秒报价25万元。另一边,一条AI天宫短片在海外刷屏,零推广、小成本,数以万计的海外观众追着去搜中国神话。做出这条短片的栖光,是成都一名90后眼镜店老板,没学过影视,也没有团队,AI创作只是他坚持了两年的业余爱好。这条刷屏的天宫短片,正是用Pavo做出来的。

来自主题: AI产品测评
8671 点击    2026-08-27 09:53
实测豆包工作:连上飞书后,Agent 终于像个同事了

实测豆包工作:连上飞书后,Agent 终于像个同事了

实测豆包工作:连上飞书后,Agent 终于像个同事了

刚刚,豆包正式发布了一款新产品——豆包工作。全新 Logo、独立的桌面客户端,它的定位很明确:一个面向生产力场景的全新 Agent 产品与品牌。

来自主题: AI产品测评
8768 点击    2026-08-25 14:36
首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?

Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。

来自主题: AI产品测评
10331 点击    2026-08-23 14:12
1分钱9张图!DeepSeek视觉模型连夜实测

1分钱9张图!DeepSeek视觉模型连夜实测

1分钱9张图!DeepSeek视觉模型连夜实测

等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。我也是第一时间赶到现场,连夜开始实测。相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。

来自主题: AI产品测评
8738 点击    2026-08-22 14:27
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

8 月 13 日,DeepSeek 开源 Agent Harness dsh,将 “Harness” 这个原本更偏工程语境的概念,推到了整个 AI 行业讨论的中心。

来自主题: AI产品测评
6919 点击    2026-08-19 14:37
AI做游戏有多野?实测最近爆火的 Spellcaster

AI做游戏有多野?实测最近爆火的 Spellcaster

AI做游戏有多野?实测最近爆火的 Spellcaster

不会写代码,能不能做出一款自己的游戏?

来自主题: AI产品测评
10164 点击    2026-08-19 11:45
独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

《读佳》获知,字节正在内测一款漫剧创作产品,名字就叫“漫剧创作工具”,Slogan“让创作更纯粹”,搭载豆包多个大模型。

来自主题: AI产品测评
7228 点击    2026-08-18 11:53
Seedance 2.5就够了?Flova全能六边形Agent,想补上创作者真正缺的“片场”|测评

Seedance 2.5就够了?Flova全能六边形Agent,想补上创作者真正缺的“片场”|测评

Seedance 2.5就够了?Flova全能六边形Agent,想补上创作者真正缺的“片场”|测评

上回说到,Seedance 2.5上线后,我们第一时间做了模型更新的能力测试。结果很惊艳,AI的指令遵循、运动效果、表演张力、人物一致性和全模态参考都有了大进步。

来自主题: AI产品测评
7107 点击    2026-08-17 15:39
第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol

Kimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。

来自主题: AI产品测评
10296 点击    2026-08-10 15:06
实测阿里万有无界:让小万建群,它说人没齐死活不建

实测阿里万有无界:让小万建群,它说人没齐死活不建

实测阿里万有无界:让小万建群,它说人没齐死活不建

每天1000个注册名额,凌晨6点刷新,用完了就得进Waitlist排队,等短信通知。

来自主题: AI产品测评
9562 点击    2026-08-06 10:14
实测袋马:一句话生成的小程序,敢点「发布」吗

实测袋马:一句话生成的小程序,敢点「发布」吗

实测袋马:一句话生成的小程序,敢点「发布」吗

在AI应用生成这个赛道上,选手已经排到了两位数。腾讯有吐司,百度有秒哒,字节有Trae,阿里自家就有Qoder,现在又冒出来一个「袋马」。

来自主题: AI产品测评
6845 点击    2026-08-06 09:38
Doubao-Seed-Evolving 实测:把 edulab 交互技能做成 AI 教学课件

Doubao-Seed-Evolving 实测:把 edulab 交互技能做成 AI 教学课件

Doubao-Seed-Evolving 实测:把 edulab 交互技能做成 AI 教学课件

上一篇我用 Doubao-Seed-Evolving,把复杂 PRD 拆成可执行工程,做成了 AI 教学视频平台。那次重点是“知识驱动出片”:学科知识点 → 教学分镜 → 配音 → 动画 → 1080p 成片。

来自主题: AI产品测评
7006 点击    2026-08-06 09:37
1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。

来自主题: AI产品测评
9486 点击    2026-08-01 10:40
实测美团CatPaw:这只猫爪,抓得还算稳

实测美团CatPaw:这只猫爪,抓得还算稳

实测美团CatPaw:这只猫爪,抓得还算稳

7月27日,美团正式上线了CatPaw,一个全场景AI Agent平台。准确说,是「内部练了三年,现在放出来给所有人用」。

来自主题: AI产品测评
10955 点击    2026-07-29 09:51
用K3和GPT的同款考题,测了Gemini 3.6 Flash的前端

用K3和GPT的同款考题,测了Gemini 3.6 Flash的前端

用K3和GPT的同款考题,测了Gemini 3.6 Flash的前端

谷歌的前端功底有多深,不需要任何人来认证。

来自主题: AI产品测评
9375 点击    2026-07-24 11:08
Qwen-Image-3.0效果炸裂?我反手扔了这9道题

Qwen-Image-3.0效果炸裂?我反手扔了这9道题

Qwen-Image-3.0效果炸裂?我反手扔了这9道题

千问说它可以帮我拼九宫格了,还是不同主题的那种。

来自主题: AI产品测评
7040 点击    2026-07-24 11:05
花整个下午实测秒哒3.5,PRO会员也挡不住服务器崩溃

花整个下午实测秒哒3.5,PRO会员也挡不住服务器崩溃

花整个下午实测秒哒3.5,PRO会员也挡不住服务器崩溃

WAIC 2026上,百度秒哒带来了3.5版本。据官方数据,秒哒累计服务超过3500万用户,创造了350万个具有商业价值的应用,每天有近20万人在使用这些应用解决真实问题。

来自主题: AI产品测评
7812 点击    2026-07-23 11:17
速测 Qwen3.8 预览版:我用 1 小时,开发了套撒币系统

速测 Qwen3.8 预览版:我用 1 小时,开发了套撒币系统

速测 Qwen3.8 预览版:我用 1 小时,开发了套撒币系统

我刚刚 AGI Bar 小程序里建了一个共享钱包,并往里面充了 1 万块,未来 24h可点开领取

来自主题: AI产品测评
11227 点击    2026-07-20 15:20
Kimi K3 一手开发实测,前端、Agentic、长任务全面拉满 !

Kimi K3 一手开发实测,前端、Agentic、长任务全面拉满 !

Kimi K3 一手开发实测,前端、Agentic、长任务全面拉满 !

发布之前,我在 X 上看到有人说,测 K3 的感觉就像在测 Fable 5。虽然离 Fable 5 还差一点点 🤏,但超过 Opus 4.8 和 GPT 5.5 基本没有问题。在前端能力,K3 的提升非常明显,我已经用它复刻了前段时间爆火的独立工作室 Abeto 推出的一款 3D 网页游戏 《 Messenger》(ps. 音乐手动配的,主角模型是 K3 自己判断、自主去游戏官网找的)

来自主题: AI产品测评
10209 点击    2026-07-19 13:57
连夜实测 Kimi K3,建议改名 Kable

连夜实测 Kimi K3,建议改名 Kable

连夜实测 Kimi K3,建议改名 Kable

今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。

来自主题: AI产品测评
10393 点击    2026-07-17 11:12
告别版本号!豆包首款无限进步模型:Seed-Evolving实测

告别版本号!豆包首款无限进步模型:Seed-Evolving实测

告别版本号!豆包首款无限进步模型:Seed-Evolving实测

大家好,我是袋鼠帝。 前几天,火山的朋友提前跟我同步了一个消息,说豆包Seed模型又更新了。

来自主题: AI产品测评
9850 点击    2026-07-17 11:05
豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

过去半年,国产大厂扎堆发布一种新东西:桌面Agent。如果你最近在刷相关讨论,会发现 WorkBuddy、豆包专业版、QoderWork 这三个名字出现得特别频繁。如果一个普通办公用户今天就想选一款桌面 Agent,到底该先试谁?

来自主题: AI产品测评
11660 点击    2026-07-14 12:22