多模态训练后模型能力雪崩,上海AI Lab全面探索MLLM偏好对齐与模态融合
多模态训练后模型能力雪崩,上海AI Lab全面探索MLLM偏好对齐与模态融合在实际应用过程中,闭源模型(GPT-4o)等在回复的全面性、完备性、美观性等方面展示出了不俗的表现。
搜索
在实际应用过程中,闭源模型(GPT-4o)等在回复的全面性、完备性、美观性等方面展示出了不俗的表现。
去年的诺贝尔奖梅开二度,两次颁给了AI相关领域,让所有人惊讶于AI4science的潜力。然而近日密西根大学的一项覆盖16万篇文献的大规模研究指出,AI和科学的结合仍存在错位。
Sakana AI刚刚官宣,第二代「AI科学家」独立完成论文,通过了ICLR 2025 Workshop的同行评审。这是首次完全由AI端到端生成的科学论文,获得了学术高度认可。
网易有道这个老牌翻译厂商出的AI大模型子曰翻译2.0,居然吊打了一切。。。说说我们是怎么测大模型的翻译评测这块的。测试的维度也很简单,就从我平常受到的折磨体验出发,梳理出了2点。
今天,外媒披露了谷歌在美国大模型独角兽Anthropic中的持股细节。相关文件显示,谷歌数年来累计对Anthropic注资30亿美元(约合人民币217亿元),换取了后者14%的股份。令人意外的是,这些投资并未让谷歌在Anthropic的运营中享有过多的话语权,但谷歌仍计划在今年9月以可转债的形式再追加7.5亿美元(约合人民币54亿元)投资。
来自北京的赵明(化名),近期自认栽了个跟头——花费近6000元为三年级孩子购置的AI学习机,宣传的“AI精准辅导”“一对一伴学”功能与实际严重不符,仅用了一个月就“吃土”了。事实上,多数家长都很难逃出学习机的困扰。小红书平台上,与学习机相关的笔记多达131万篇,关联词条中不乏:学习机到底是不是智商税、学习机有没有必要买等话题。
DiffRhythm是一款新型AI音乐生成模型,能在10秒内生成长达4分45秒的完整歌曲,包含人声和伴奏。它采用简单高效的全diffusion架构,仅需歌词和风格提示即可创作,还支持本地部署,最低只需8G显存。
揭秘如何在 20 分钟内用 AI 创建专业级界面,并分享前四大核心技巧,让你的 AI 生成的应用脱胎换骨。
大模型时代,读论文这事儿真是越来越爽了~
去年获得最多精神养分的创业故事,来自 Dify 创始人张路宇。