AI资讯新闻榜单内容搜索-大模

最强开源编程大模型一夜易主：精通80+语言，仅22B

开源代码大模型的王座，再次易主！来自素有“欧洲OpenAI”之称的Mistral，用22B参数量表现超越了70B的Code Llama。

来自主题: AI资讯

9150 点击 2024-05-30 19:49

大模型未来三年的十个假设

本文探讨了大模型未来三年的发展趋势，从AI在2B和2C领域的应用到Real Economic Impact的影响，再到工业领域和能源需求等方面进行了深入分析。

来自主题: AI资讯

4223 点击 2024-05-30 17:11

32专家MoE大模型免费商用！性能全面对标Llama3，单token推理消耗仅5.28%

每个token只需要5.28%的算力，精度就能全面对标Llama 3。

来自主题: AI技术研报

11357 点击 2024-05-30 15:51

16家头部大模型公司上海神秘碰头，现场人挤人人人

挤爆了，简直要被大模型公司们给挤爆了。

来自主题: AI资讯

10265 点击 2024-05-30 15:44

每天都看模型评分，但你真的了解吗？OpenAI研究员最新博客，一文读懂LLM评估

在LLM能力突飞猛进的当下，所有研究者似乎都在关注数据、算力、算法等模型开发的各个方面，但OpenAI研究员Jason Wei最近发布的一篇博客文章提醒我们，模型评估的工作同样非常重要。如何开发出优秀的评估测试，对AI能力的发展方向至关重要。

来自主题: AI技术研报

11281 点击 2024-05-30 15:32

27岁华裔天才少年对打UC伯克利，首发SEAL大模型排行榜！Claude 3 Opus数学封神

一直以来，UC伯克利团队的LMSYS大模型排行榜，深受AI圈欢迎。如今，最有实力的全新大模型排行榜SEAL诞生，得到AI大佬的转发。它最大的特点是在私有数据上，由专家严格评估，并随时间不断更新数据集和模型。

来自主题: AI技术研报

10241 点击 2024-05-30 15:10

北大北邮的门，机器人开

搜集了328×204条数据，只为让机器人把开门这一件事做到极致。

来自主题: AI技术研报

12185 点击 2024-05-30 10:44

AlphaFold 3不开源，统一生物语言大模型阿里云先开了！

把169861个生物物种数据装进大模型，大模型竟get到了生物中心法则的奥秘——

来自主题: AI技术研报

8052 点击 2024-05-30 10:38

搞医学影像，为什么都青睐于CPU？

医学影像，越来越需要AI的帮助了。

来自主题: AI技术研报

11206 点击 2024-05-30 10:14

ACL 2024 | 提升大模型持续学习性能，哈工大、度小满提出共享注意力框架SAPT

在大模型实际部署落地的过程中，如何赋予大模型持续学习的能力是一个至关重要的挑战。这使其能够动态适应新的任务并不断获得新的知识。大模型的持续学习主要面临两个重大挑战，分别是灾难性遗忘和知识迁移。灾难性遗忘是指模型在学习新任务时，会忘记其已掌握的旧任务。知识迁移则涉及到如何在学习新任务时有效地应用旧任务的知识来提升新任务学习的效果。

来自主题: AI技术研报

9873 点击 2024-05-29 16:18