AI资讯新闻榜单内容搜索-视觉

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 视觉
VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

视觉问答模型的准确率不断提高,但高分未必来自视觉理解 —— 当基准图像与答案已进入训练语料,模型可能只是复现了记忆。浙江大学等团队提出 ReKey:保留原始真实场景,只更新决定答案的那一小块视觉线索,使每轮评测都面向未见过的内容。

来自主题: AI技术研报
8133 点击    2026-08-04 10:33
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。

来自主题: AI技术研报
9908 点击    2026-08-03 15:30
这家中国公司站上国际顶会SIGGRAPH的C位

这家中国公司站上国际顶会SIGGRAPH的C位

这家中国公司站上国际顶会SIGGRAPH的C位

7 月 19 日至 23 日,美国洛杉矶,SIGGRAPH 2026 如期而至。这场汇聚全球计算机图形学与视觉计算领域顶尖学者、艺术家与工程师的年度盛会,吸引了来自 69 个国家的近万名参会者。渲染、几何建模、动画仿真、与生成式 AI,几乎所有关于如何用计算机创造视觉世界的最前沿探索,都在这五天里集中呈现。

来自主题: AI资讯
7721 点击    2026-07-30 16:38
深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

过去两年,多模态模型的竞争看起来像一场“造眼睛”的竞赛:更高的图像分辨率、更多的视觉 token、更大的模型,以及更昂贵的训练。行业似乎默认,只要第一次看得足够清楚,AI 就能从“看见”抵达“洞见”。

来自主题: AI资讯
10174 点击    2026-07-30 11:34
红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

Sable是全球领先的AI员工服务商,核心打造Aidan全场景智能AI员工,依托计算机操作、视觉识别、语音交互技术,助力企业实现客户互动、产品服务、前端业务的智能化、规模化落地,赋能企业优化人力效能、降本增效。

来自主题: AI资讯
8980 点击    2026-07-29 15:58
深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

Z Potentials 获悉,AI多模态内容互动娱乐社区海艺近期完成超亿元人民币B轮融资,由视觉中国、华盖创赢、祥峰投资联合领投,广发信德、天投资本、川创投、广州合伟永晟参与。

来自主题: AI资讯
6713 点击    2026-07-27 15:49
VC锚定AI社区生态,SeaArt完成超亿元B轮融资

VC锚定AI社区生态,SeaArt完成超亿元B轮融资

VC锚定AI社区生态,SeaArt完成超亿元B轮融资

近日,全球化AI互动娱乐平台海艺(SeaArt)宣布完成超亿元B轮融资。本轮融资由视觉中国、华盖创赢、祥峰投资联合领投,广发信德、天投资本、川创投、广州合伟永晟跟投。此前海艺曾获阿里、腾讯、招银国际、钟鼎资本、Actoz、上海人工智能产业系列基金、和溋资本等知名产业基金和财务投资机构加持。

来自主题: AI资讯
9062 点击    2026-07-24 18:11
独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家获悉,近期,腾讯混元多模态理解负责人胡瀚提出了离职。此前,他曾担任微软亚洲研究院视觉计算组首席研究员。2025年初加入腾讯后,负责视觉大模型的研究。在后续的调整中,他加入大语言模型部旗下的“Frontier”前沿技术研究组,负责多模态理解的相关研究,汇报给姚顺雨。

来自主题: AI资讯
9625 点击    2026-07-23 16:56
ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

国防科技大学虚拟现实与视觉计算团队(SAW Lab)联合先进制导与控制技术国家级重点实验室等推出面向航拍几何 3D 视觉的统一大规模数据集与评测基准 「AirZoo」。

来自主题: AI技术研报
6279 点击    2026-07-23 15:36