MiniMax H3 的 24h AI 直播火了,但我们搓出了更炸裂的东西!
MiniMax H3 的 24h AI 直播火了,但我们搓出了更炸裂的东西!前两天刷 X 的时候,一条 Twitch 直播的录屏给看傻眼了: FAL 工程师 Rehan Sheikh 将 MiniMax H3 Max 接入 Twitch 直播流,搭建了一个由模型持续生成内容的频道,并把它称为「跨维度电视」。
搜索
前两天刷 X 的时候,一条 Twitch 直播的录屏给看傻眼了: FAL 工程师 Rehan Sheikh 将 MiniMax H3 Max 接入 Twitch 直播流,搭建了一个由模型持续生成内容的频道,并把它称为「跨维度电视」。
不得了。 谷歌刚刚更新的Gemini Omni 1.1 Flash,直接冲上了Arena文生视频全球第一。
近日,开放传神(简称“OpenCSG”)宣布完成数亿元人民币Pre-A轮融资,投后估值正加速抵近独角兽标准。本轮融资由静安资本、市北高新、徐汇资本、黄海金控等共同参与。
1小时播放量冲上200万次。
每月20美元的ChatGPT Plus都开了,还只拿它聊天?
本周「十字路口」的嘉宾是 Pyromind 创始人 / CEO Kevin Ding。Pyromind 所在的赛道,常被称作 RL as a Service,也就是强化学习即服务、或后训练即服务。公司前不久完成天使轮融资,投资方包括高瓴、百度风投、蓝驰、Atypical 等机构。
如果说大语言模型拉开了本轮人工智能革命的序幕,那么今天人机交互的瓶颈,早已不再是模型的智商,而是人类接收信息的生理带宽。
一个 Agent 到底凭什么越来越强?有人靠更大的模型,有人靠更多数据。就在前天,Google Research 最新发布的 WikiSkill 给出了另一条答案:给 Agent 搭一套三层知识架构,让技能自己进化。
今年发了这么多期短剧Agent创作平台,我发现市面上专门针对TVC制作的,超级少。
文章以1955年麦卡锡等四人提交达特茅斯会议提案为起点,回顾人工智能学科诞生70年来的关键节点——符号主义与连接主义的兴衰、两次AI寒冬的成因与转机、2012年深度学习崛起、Transformer架构与ChatGPT引发的产业变革,指出AI发展是一条反复冲高与摔落的锯齿线,每一次寒冬皆因承诺跑得比能力快。
今年三月,OpenMAIC 正式开源,用户已经可以借助 AI 完成一节课的设计与生成。
SpaceXAI工程师Lauren Tan用pstack并行运行20多个GrokBot智能体,单月交付1000多个PR,核心是用control glass等技能让智能体自验证,并以Dune架构禁用useEffect与注释、强制进程隔离等硬约束取代人工盯代码,使智能体可自主完成写码、测试与主干合并。
“你如果不能在几个小时内重建 Cursor,下次面试会非常艰难——那不过是 300 行代码的一个 while 循环。”
没有交互,产品就不算是游戏。
COCO Matrix CEO高宇翔在访谈中提出,真实世界不可能被提前穷举,具身智能应将In-Context Learning作为核心范式,让机器人通过现场示范和纠正直接适应新任务与新环境,而非每遇到新任务都依赖重新采集大量数据并训练模型,从而显著降低部署门槛和适配成本。
众擎机器人CEO赵同阳在2026世界机器人大会上透露,今年已将60%资金与人力投入机器人"大脑"研发,发布仿人脑五层体系架构EngineAI Awaken,明确不做"第二个宇树",借鉴英伟达底层平台与生态路线,并将80%至90%资源押注商用、工业及家庭等应用场景。
今年7月15日,一个名字很长的新规开始实行:《人工智能拟人化互动服务管理暂行办法》。
DeepSeek Harness 的插件生态因缺乏官方分发、发现与安全管理机制,导致安全权限形同虚设且优质插件难以被用户发现。
你估计也刷到过那张脸。
Google DeepMind与杜克大学联合发布了AI科研系统Co-Scientist的重大升级版本,Co-Scientist是Google基于Gemini构建的多智能体科研系统。
DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。
文章描述了人机恋玩家如何通过接入openclaw等智能体工具,让AI伴侣自主学习技能并遥控情趣玩具,部分玩家甚至逆向破解接口或训练本地大模型来规避政策限制,同时探讨了AI伴侣在满足女性情感需求的同时可能引发的孤独感与人机关系伦理问题。
Dify 正式推出全新 Agent 体验,将 Agent 从工作流中的执行节点升级为拥有独立配置与完整生命周期的独立实体,提供 Build、Manage、Track 三层能力及 Tool、Skill、Sandbox CLI 三种扩展方式,支持企业 AI Agent 跨场景复用与持续演进。
OpenClaw 2.0 来了。 就在刚刚,OpenClaw 正式发布历史上规模最大的更新 v2026.8.1。 OpenClaw 基金会在官方博客中坦言,这次更新多少有些「意外」:团队起初只想简化安装流程、重做浏览器端,没想到越改越深。
面向Agent Harness层自进化方向,CREAO AI近日完成千万级美元新融资,资金将用于扩大真实业务工作流与高质量反馈数据规模,加速基于开源模型后训练的垂直模型迭代。
remove-ai-watermarks是支持一条命令去除AI生成图片明水印和C2PA文件信息层暗水印的开源工具,覆盖Nano Banana、豆包、即梦等多种水印,像素层SynthID暗水印需借助NVIDIA显卡跑invisible命令重绘去除。
Uber公开内部AI软件工厂,透露其超过七成PR代码审查已由AI Agent接管,在Agent周活用户增长7倍、请求量激增9.4倍的背景下,通过六因子成本公式拆解与模型路由、代码模式、上下文图谱等优化手段,将单会话平均成本压降52%。
前抖音社交产品TL创始人游哲昊创办AI社交应用Scoopic,内置"AI狗仔小狗"自动从用户相册中挖掘精彩瞬间并整理成可分享的故事,面向北美年轻人,主打最多20人私密社交圈,已获一线美元基金天使轮融资并计划拓展硬件。
模型是中国做的,为什么后面的数千次创新发生在海外开发者平台?从模型分发、开发者工具到算力路由,中国缺的不是技术,是默认路径。如果只看结论,读完下面五条摘要即可;后文是证据、机制和行动方案。
Lovart正式开启中国区运营并同步上线新版本,主打"Just Design"理念,新增灵感采集插件、100个专业Skill工作流及一键转矢量等功能,支持图片、视频、动效、可交互HTML及PPT等多种格式输出。