AI资讯新闻榜单内容搜索-视觉

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 视觉
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。

来自主题: AI技术研报
9854 点击    2026-08-03 15:30
这家中国公司站上国际顶会SIGGRAPH的C位

这家中国公司站上国际顶会SIGGRAPH的C位

这家中国公司站上国际顶会SIGGRAPH的C位

7 月 19 日至 23 日,美国洛杉矶,SIGGRAPH 2026 如期而至。这场汇聚全球计算机图形学与视觉计算领域顶尖学者、艺术家与工程师的年度盛会,吸引了来自 69 个国家的近万名参会者。渲染、几何建模、动画仿真、与生成式 AI,几乎所有关于如何用计算机创造视觉世界的最前沿探索,都在这五天里集中呈现。

来自主题: AI资讯
7679 点击    2026-07-30 16:38
深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

深度|10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

过去两年,多模态模型的竞争看起来像一场“造眼睛”的竞赛:更高的图像分辨率、更多的视觉 token、更大的模型,以及更昂贵的训练。行业似乎默认,只要第一次看得足够清楚,AI 就能从“看见”抵达“洞见”。

来自主题: AI资讯
10109 点击    2026-07-30 11:34
红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

红杉资本领投AI员工服务商SableSable4500万美元,AI员工Aidan重塑客户服务与人力效能

Sable是全球领先的AI员工服务商,核心打造Aidan全场景智能AI员工,依托计算机操作、视觉识别、语音交互技术,助力企业实现客户互动、产品服务、前端业务的智能化、规模化落地,赋能企业优化人力效能、降本增效。

来自主题: AI资讯
8914 点击    2026-07-29 15:58
深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

深度|超亿元B轮融资后,海艺如何跑通AI原生IP商业闭环?

Z Potentials 获悉,AI多模态内容互动娱乐社区海艺近期完成超亿元人民币B轮融资,由视觉中国、华盖创赢、祥峰投资联合领投,广发信德、天投资本、川创投、广州合伟永晟参与。

来自主题: AI资讯
6662 点击    2026-07-27 15:49
VC锚定AI社区生态,SeaArt完成超亿元B轮融资

VC锚定AI社区生态,SeaArt完成超亿元B轮融资

VC锚定AI社区生态,SeaArt完成超亿元B轮融资

近日,全球化AI互动娱乐平台海艺(SeaArt)宣布完成超亿元B轮融资。本轮融资由视觉中国、华盖创赢、祥峰投资联合领投,广发信德、天投资本、川创投、广州合伟永晟跟投。此前海艺曾获阿里、腾讯、招银国际、钟鼎资本、Actoz、上海人工智能产业系列基金、和溋资本等知名产业基金和财务投资机构加持。

来自主题: AI资讯
9044 点击    2026-07-24 18:11
独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家获悉,近期,腾讯混元多模态理解负责人胡瀚提出了离职。此前,他曾担任微软亚洲研究院视觉计算组首席研究员。2025年初加入腾讯后,负责视觉大模型的研究。在后续的调整中,他加入大语言模型部旗下的“Frontier”前沿技术研究组,负责多模态理解的相关研究,汇报给姚顺雨。

来自主题: AI资讯
9620 点击    2026-07-23 16:56
ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

ECCV 2026|把全球3D地图变成无人机训练场,国防科大AirZoo构建航拍几何3D视觉统一基准

国防科技大学虚拟现实与视觉计算团队(SAW Lab)联合先进制导与控制技术国家级重点实验室等推出面向航拍几何 3D 视觉的统一大规模数据集与评测基准 「AirZoo」。

来自主题: AI技术研报
6270 点击    2026-07-23 15:36
分享一个Skill,帮你把电影画面拆成可复用的视觉系统。

分享一个Skill,帮你把电影画面拆成可复用的视觉系统。

分享一个Skill,帮你把电影画面拆成可复用的视觉系统。

嗨大家好!我是阿真! 刷短视频就是这点不好,上次看到一个 AI 视频拆解分析的教程,感觉很有意思,刷完了过两天忘记在哪里刷的了。

来自主题: AI技术研报
6918 点击    2026-07-23 15:23