ESP-GMF v1.0 正式发布:一站式构建音视频与 AI 应用
ESP-GMF v1.0 正式发布:一站式构建音视频与 AI 应用ESP-GMF 是一套面向乐鑫 SoC 的统一多媒体开发框架,通过统一的数据流模型、组件体系和开发架构,将音频、视频及 AI 多媒体能力整合到同一平台,为开发者提供更加高效、灵活且易扩展的开发体验。
搜索
ESP-GMF 是一套面向乐鑫 SoC 的统一多媒体开发框架,通过统一的数据流模型、组件体系和开发架构,将音频、视频及 AI 多媒体能力整合到同一平台,为开发者提供更加高效、灵活且易扩展的开发体验。
词元无限的创业赛道很明确,ToB Coding。做 Coding 是因为创始人杨萍之前在字节内部的 Coding 项目经历,一个好的 Coding 产品+内部的数据,就能很好在字节内部落地,真正解决问题。
近日,米哈游创始人蔡浩宇久违地更新了自己的个人领英,新增了一条独立大模型+智能体开发者(Independent LLM+Agent Developer)的职业经历,时间从2026年7月开始,在新加坡混合办公。
2026 年 4 月起,一位专营稀有书和低流通量图书的美国书商遇到了怪事:他店里的生意向来不算火爆,一周卖出二十本已经算不错,但最近,订单突然像洪水一样涌来,每周能卖几百本。最费解的是,买家只列出一份用国际标准书号(ISBN)索引的书籍清单,却从不询问品相,也不砍价。
AI智件独家获悉,WoW模型一作、港科大博士池晓威于今年4月创业,成立了世界模型公司「莫刻机器人MUKA Robotics 」。工商资料显示,「莫刻机器人」成立于2026年4月,注册地在北京市海淀区,池晓威担任法人和实控人。
字节跳动下发内部邮件,完成了近年来力度最大的一次 ToB 业务架构调整:飞书产品团队与豆包产品团队整合,成立新的豆包产品团队,由豆包负责人赵祺统筹,飞书负责人谢欣向其汇报;飞书商业化团队则与火山引擎整合,成立新的 ToB GTM 组织「创造力服务平台」,由火山引擎负责人谭待负责。
Personal Agent OS 公司「Tiiny AI」宣布完成数千万美元天使轮系列融资,由顺为资本、经纬创投、锦秋基金、云启资本、戈壁—阿里巴巴香港创业者基金、BV 百度风投、光源 L2F 基金联合投资。光源资本担任孵化方和独家财务顾问。
ChatGPT 语音功能上线有段时间了,不知道大家的使用体验如何。
机器人实验室里,这样的画面总是反复出现:屏幕上模拟的机械臂正以完美轨迹移动,但真实世界的一边,玻璃杯还待在桌面上,甚至已被夹爪打翻。
嚯!最近,一个Opus 5游戏提示词在𝕏上火了!
盘后上涨8.83%。
近日,一家公司员工爆料,其所在公司已与其他企业一道收到了美国政府指令,要求停止使用 Anthropic 旗下的产品、服务和模型。按照通知要求,公司将在 2026 年 8 月 31 日前完成全面清退,适用范围覆盖所有员工、承包商、应用程序、开发环境、云服务,以及代表公司开展工作的第三方。
这回,AI开始为自己写代码了!
7 月 19 日至 23 日,美国洛杉矶,SIGGRAPH 2026 如期而至。这场汇聚全球计算机图形学与视觉计算领域顶尖学者、艺术家与工程师的年度盛会,吸引了来自 69 个国家的近万名参会者。渲染、几何建模、动画仿真、与生成式 AI,几乎所有关于如何用计算机创造视觉世界的最前沿探索,都在这五天里集中呈现。
7月几天之内,中国大模型行业接连出现了两个超过2万亿参数的模型。
最近跟团队伙伴聊,都觉得AI影视是一个现象级的新机会。
长视频理解,正在成为多模态大模型的重要能力。
在刚刚落幕的2026 WAIC世界人工智能大会上,无问芯穹首次公布了其在大模型推理系统架构中的新突破——跨集群异构推理架构PDD。
一个苹果从树上落下,今天的视频模型大多能生成一段「看起来正确」的运动:苹果向下、速度加快,最终落地。
打开 Word,「我跨过了大西洋,我到了阿拉斯加,我翻过了落基山脉,我穿过了密西西比河,我来到了芝加哥……」,再复制回 Word。
近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。
近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big Thing[2]》。两期访谈从模型和芯片,一路延伸至内存、能源、数据中心与 AI 商业模式,并指向同一个变化:AI 竞赛的焦点,正从单纯比较模型能力,扩展到谁能以更低成本、更大规模,把模型能力稳定地交付出来。
OpenAI,终于又舍得Open了一把。
过去两年,多模态模型的竞争看起来像一场“造眼睛”的竞赛:更高的图像分辨率、更多的视觉 token、更大的模型,以及更昂贵的训练。行业似乎默认,只要第一次看得足够清楚,AI 就能从“看见”抵达“洞见”。
这几天,关于 OpenAI 的硬件生态版图的曝光急速增加,无论是彭博社关于音箱细节的报道,还是来自供应链分析师郭明錤关于手机规格和代工名额单的详细调查,都让我们逐渐拼齐了 OpenAI 硬件这头大象的实际轮廓:
成本砍20%、效率提升15%。
模型越来越多,入口却不一定越来越好用。
三智一体不断演进,开启具身智能新未来。
“推理轻量化,训练提效 25%,前端效果同样惊艳。 ”
7月29日消息,深信服公布其AI安全智能体Sangfor AI在AI安全评测CyberGym中的最新成绩。