Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉人类看图时,不会先在大脑中拍下一张「截图」,再闭眼推理。思考过程会不断引导我们的目光:找到一个线索,形成一个假设,再回到图像里验证它。
搜索
人类看图时,不会先在大脑中拍下一张「截图」,再闭眼推理。思考过程会不断引导我们的目光:找到一个线索,形成一个假设,再回到图像里验证它。
尽管当下 Agent(智能体)发展如火如荼,但这些号称智商碾压人类的 AI 智能体,本质上仍是互联网里的支付「黑户」。
“用 Vibe Coding 的成本越低,你被模型卷死的概率就越高。”
曾经最相信强化学习的人之一,如今却认为:强化学习没有把我们带到 AGI。
你是一名支持开源的 AI 工程师,正在参加 Anthropic 的文化面试。
徐绿杨是MiniMax Hub产品运营负责人。财联社采访中,她能具体说出:一条30秒AI视频,创作者仍可能在多个工具间折腾两三天;行业的麻烦已经从“做不出来”,变成了“串不起来”。
上周三晚上,我在旧金山 Brex 总部七楼参加了一场 AI 创业 pitch 活动。办活动的是 Founders Bay,一个号称拥有 20 万创始人、投资人和运营者的社区。
Qwen 3.8 Max是一个很适合干活的模型。
8 月 4 日,腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview。基于最新一代大语言模型 Hy3 的语言理解能力,Hy ASR 3.0 preview 融合高精度语音识别与深度语义理解能力,在通用识别、上下文感知、多场景鲁棒性以及方言覆盖等核心维度实现全面提升,
上周末MiniMax更新了H3,铺天盖地的测评啊,说什么找到Seedance 2.0的平替了。