全世界最强的AI,都在“抄”这群普通人的作业
全世界最强的AI,都在“抄”这群普通人的作业这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……
搜索
这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……
今年,这条研究路线又往前走了一步。6 月,李飞飞参与的一项机器人研究 T-Rex 发布,研究者为机器人加入高频触觉反馈,让它完成翻书页、拿鸡蛋、挤牙膏、抽取薄卡片和拧灯泡等任务。
今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。
训练一个顶级文生图模型,到底需要多少钱?
联想之星、银杏谷资本、啟赋资本等投了。
2009年,李飞飞团队正式发布ImageNet。
千问说它可以帮我拼九宫格了,还是不同主题的那种。
一段3分钟的AI短片,炸了。
苏度科技联合创始人、董事长苏昊是ImageNet的核心作者之一,师从李飞飞。这家公司走了一条与硅谷主流“纯大脑黑盒大模型”不太一样的路:软硬件协同设计,上下分层架构,上层负责任务规划与环境理解,下层负责具体物体操作;Sim-to-Real作为核心训练范式,让机器人在虚拟世界里经历几百万年的进化,再迁移到现实。
今天,阿里通义团队发布了他们第三代图像生成模型:Qwen-Image-3.0 。官方博客用了一个字来概括这一代的核心进步,「实」。不是好看,不是炫技,是「实」。内容丰实、细节真实、知识厚实。