AI资讯新闻榜单内容搜索-大模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 大模型
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。

来自主题: AI技术研报
9967 点击    2026-08-17 15:18
速来网吧线下真实所有大模型

速来网吧线下真实所有大模型

速来网吧线下真实所有大模型

最近,葬AI和我们的朋友钟经纬、正阳一起,推出了懂模帝这个产品,现在任何人都可以登陆 fuckai.md 去看各种各样的benchmark。

来自主题: AI资讯
8491 点击    2026-08-17 10:53
曝苹果已与阿里合作训练大模型

曝苹果已与阿里合作训练大模型

曝苹果已与阿里合作训练大模型

据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。

来自主题: AI资讯
9112 点击    2026-08-14 22:45
独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

《智能涌现》从相关人士处获悉,混元资深研究员徐灿在近期加入腾讯WeLM团队,从事大模型研发相关工作。多名知情人士透露,在姚顺雨接手腾讯大语言模型研发前,徐灿在混元LLM体系中担任后训练一个方向上的负责人。值得一提的是,这次转岗发生在微信持续强化自研大模型和Agent能力的阶段。

来自主题: AI资讯
8522 点击    2026-08-14 22:44
刚刚,小红书开源dots3-note!IMO 42分满分同系列模型来了

刚刚,小红书开源dots3-note!IMO 42分满分同系列模型来了

刚刚,小红书开源dots3-note!IMO 42分满分同系列模型来了

上个月,小红书自研大模型「dots-note-3.0」创下了一个历史记录:AI 首次在国际奥数竞赛中斩获官方认证的满分42 分。此后,社区最关心的问题,就是模型什么时候开源。就在今天,小红书 dots 模型实验室(以下简称 dots 实验室)宣布开源 dots3-note preview!

来自主题: AI资讯
10780 点击    2026-08-14 17:12
刚刚,阿里开源 Qwen3.8-Max 2.4万亿参数大模型!性能比肩Fable 5

刚刚,阿里开源 Qwen3.8-Max 2.4万亿参数大模型!性能比肩Fable 5

刚刚,阿里开源 Qwen3.8-Max 2.4万亿参数大模型!性能比肩Fable 5

刚刚,阿里千问大模型团队开放Qwen3.8-2.4T-A95B模型权重! Qwen3.8-Max是基于Qwen3.8-2.4T-A95B的官方版本,于8月3日发布,拥有更多功能,例如视觉输入功能、无需思考即可使用、默认支持1百万上下文长度处理、内置官方工具等。

来自主题: AI资讯
10253 点击    2026-08-14 04:59
中国最大端侧模型独角兽,面壁智能启动IPO

中国最大端侧模型独角兽,面壁智能启动IPO

中国最大端侧模型独角兽,面壁智能启动IPO

今日,中国最大端侧大模型独角兽面壁智能首次向北京证监局提交了上市辅导备案报告,正式启动A股上市辅导,中信证券为其辅导机构。从备案信息来看,面壁智能注册资本为154.5833万元。其目前无控股股东,第一大股东为北京清语启航科技中心(有限合伙),持股比例为16.45%。

来自主题: AI资讯
9219 点击    2026-08-13 00:23
刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

刚刚,蚂蚁百灵大模型开源轻量级混合推理MoE模型——Ling-3.0-tiny。

今日,蚂蚁百灵大模型开源了一款轻量级混合推理MoE模型——Ling-3.0-tiny。该模型总参数量为7.9B,推理时激活参数量为1.3B,主要面向高效本地部署而设计。其同步提供BF16、FP8和INT4三个版本,已在DGX Spark、MacBook、Mac mini等设备上完成验证,兼顾性能、效率与可部署性。

来自主题: AI资讯
9897 点击    2026-08-12 01:27