Sora之后,OpenAI Lilian Weng亲自撰文教你从头设计视频生成扩散模型
Sora之后,OpenAI Lilian Weng亲自撰文教你从头设计视频生成扩散模型过去几年来,扩散模型强大的图像合成能力已经得到充分证明。研究社区现在正在攻克一个更困难的任务:视频生成。近日,OpenAI 安全系统(Safety Systems)负责人 Lilian Weng 写了一篇关于视频生成的扩散模型的博客。
搜索
过去几年来,扩散模型强大的图像合成能力已经得到充分证明。研究社区现在正在攻克一个更困难的任务:视频生成。近日,OpenAI 安全系统(Safety Systems)负责人 Lilian Weng 写了一篇关于视频生成的扩散模型的博客。
最近几年,AI技术的发展远远超出普通大众和研究者的预期,「通用人工智能(AGI)」的概念也从科幻小说中走进了日常生活的讨论中,成为了许多科技公司和研究机构所追求的最终目标。
2023年12月,宁德时代低调宣布在香港设立国际研发中心; 2024年3月11日,作为中国科学院在香港设立的首个国家级信息研发机构,中国科学院香港创新研究院人工智能与机器人创新中心发布了医疗多模态大模型CARES Copilot 1.0;
不久前,我们与逐际动力创始人张巍探讨了人形机器人下肢移动能力的进展。机器人上肢的精准操作能力,也是实现机器人更广泛应用的关键所在。这一次,我们继续聚焦具身智能领域的前沿进展,与中国科学院自动化所的研究员连文昭一起,围绕人形机器人上肢的精细操作能力与产业落地等话题来展开深入讨论。
《DoraemonGPT: Toward Understanding Dynamic Scenes with Large Language Models》
来自香港科技大学,清华大学的研究者提出了「GenN2N」,一个统一的生成式 NeRF-to-NeRF 转换框架,适用于各种 NeRF 转换任务,例如文字驱动的 NeRF 编辑、着色、超分辨率、修复等,性能均表现极其出色!
2024 年谷歌研究学者计划(Research Scholar Program)获奖名单公布了。获奖者最高将获得 6 万美元奖金,用于支持研究工作。
LLM已经可以理解文本和图片了,也能够根据它们的历史知识回答各种问题,但它们或许对周围世界当前发生的事情一无所知
最近,前谷歌DeepMind研究员做了一款能听懂人的语气、捕捉人的情绪的AI社交
Karger 算法可以在时间为 O (m log^3n) 的图中找到一个最小割点,他们将这个时间称之为近线性时间,意思是线性乘以一个多对数因子