开源一个非常漂亮的文章配图 Skill
开源一个非常漂亮的文章配图 Skill昨天早上我想给 Claude 的一篇文章配几张 3:4 的社交媒体图。手边有自己做的社交媒体 Skills,就顺手让 Codex 调了 GPT-Image 2.0。出来的效果超出预期。干净白底,克制的 3D 材质,中文标签直接印在图里,远看像杂志内页,近看细节都读得清。
搜索
昨天早上我想给 Claude 的一篇文章配几张 3:4 的社交媒体图。手边有自己做的社交媒体 Skills,就顺手让 Codex 调了 GPT-Image 2.0。出来的效果超出预期。干净白底,克制的 3D 材质,中文标签直接印在图里,远看像杂志内页,近看细节都读得清。
近期, ECCV 2026 结果公布,Realsee 团队的成果 Argus: Metric Panoramic 3D Reconstruction for Indoor Scenes 成功入选。它面向室内全景图像,能够从稀疏、无序的全景照片中,直接预测相机位姿、度量深度和点云重建结果,可以为 3DGS 提供更稳定、更精准的几何约束。
两个月的时间,混元 3 正式版上线。结合了用户对预览版的反馈以及对模型稳定性和可用性的提升,Hy3 在 Agent 和 Coding 能力上有了实质的提升。我们做了多个前端网页的生成测试,大多数都包含复杂的 3D 网页模拟、严格的游戏逻辑,以及需要调用不同的框架和库文件,Hy3 交付的内容要比预览版好上一个等级。
Fable 5重新上线,Arena.ai的Gostev在一段视频中甩出63个3D世界,几乎都是一次成型。看了视频,就连刚加盟Anthropic预训练团队的Karpathy,也直呼没想到。
AI 时代,面临传统电网和可再生能源的压力,科技巨头们争夺的资源已不仅仅是 GPU,而是稳定、低价、全天候不断电的清洁能源。现在,解决方案或许又多了一个新的选择。近日,美国核能初创公司 Ampera 称,已基于 3D 打印完成全球首个全尺寸核反应堆模块,旨在为 AI 数据中心、国防应用、工业设施和偏远地区等提供清洁电力。
近日,上海AI Lab等团队提出了一种面向专业软件智能体的新范式——ComAct(COM-as-Action)。它的核心思想在于:不再把鼠标点击和键盘输入作为Agent的action,而是让Agent直接生成COM代码,通过软件底层对象模型操纵真实专业软件。
VAST 本月再次完成超 10 亿元人民币 A3 战略轮融资。一个月之前,这家公司刚刚披露完成约 2 亿美元融资,并正式披露世界模型项目 Project Eden。连续融资当然是一个重要信号。但这一轮更值得关注的,不只是金额,还有投资方的构成。
今天要分享的公司是:Sengine,生境科技,之前我也分享过一家国内做 3D 的 AI 公司,但 Sengine 和 VAST 完全不是一个产品路径,后面会分析。2026 年,Forbes 30 Under 30 Asia 的 AI 榜单里,有一家来自深圳的公司:Sengine Technology,生境科技。
今年2月,英伟达公开了一条内部AI工作流。
2020年,吴迪读研一,张启煊念大三,他们跟同为上海科技大学学生的张龙文、曾初啸一起创办了影眸科技。公司早期做过一系列有关3D与生成的探索——做过穹顶光场扫描,做过二次元APP,做过数字人,踩过元宇宙的尾巴,也经历过几乎没有现金流的至暗时刻。