AI资讯新闻榜单内容搜索-大语言模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 大语言模型
【提升认知】AI 大模型一网打尽,不必东奔西走!!

【提升认知】AI 大模型一网打尽,不必东奔西走!!

【提升认知】AI 大模型一网打尽,不必东奔西走!!

在当今人工智能领域,大语言模型及其相关工具正在迅速发展,涵盖了编程、数据库、检索引擎、聊天机器人、生成式 AI 工具、模型 API、开发框架和平台等各个方面。

来自主题: AI资讯
8772 点击    2024-08-26 10:35
GenAI如何颠覆大学?哈佛90%学生用LLM,教授追捧引发AI学术浪潮

GenAI如何颠覆大学?哈佛90%学生用LLM,教授追捧引发AI学术浪潮

GenAI如何颠覆大学?哈佛90%学生用LLM,教授追捧引发AI学术浪潮

哈佛大学的一项最新研究表明,大语言模型已经深入学生的日常生活。为何学生们对AI的兴趣如此浓厚,背后的原因恐怕是这所大学的教授们。

来自主题: AI资讯
6654 点击    2024-08-24 16:12
LLM蒸馏到GNN,性能提升6.2%!Emory提出大模型蒸馏到文本图|CIKM 2024

LLM蒸馏到GNN,性能提升6.2%!Emory提出大模型蒸馏到文本图|CIKM 2024

LLM蒸馏到GNN,性能提升6.2%!Emory提出大模型蒸馏到文本图|CIKM 2024

Emory大学的研究团队提出了一种创新的方法,将大语言模型(LLM)在文本图(Text-Attributed Graph, 缩写为TAG)学习中的强大能力蒸馏到本地模型中,以应对文本图学习中的数据稀缺、隐私保护和成本问题。通过训练一个解释器模型来理解LLM的推理过程,并对学生模型进行对齐优化,在多个数据集上实现了显著的性能提升,平均提高了6.2%。

来自主题: AI技术研报
10174 点击    2024-08-23 16:35
清华联合智谱AI重磅发布:中文10000字长文写作模型和提示词技术,或将改变行业

清华联合智谱AI重磅发布:中文10000字长文写作模型和提示词技术,或将改变行业

清华联合智谱AI重磅发布:中文10000字长文写作模型和提示词技术,或将改变行业

虽然大语言模型(LLM)的能力不断突破,但在长文生成方面却一直存在瓶颈。近日,清华大学和智谱AI联合发布的最新研究成果,为解决这一难题提供了创新方案。这项名为"LongWriter"的技术,成功将AI模型的长文生成能力从约2000字提升至10000字以上,同时保持了高质量输出。这一成果通过创新的数据构建方法、模型训练策略和评估基准,为AI长文创作开辟了新天地。

来自主题: AI资讯
6171 点击    2024-08-20 15:05
从头设计抗体,腾讯、北大团队预训练大语言模型登Nature子刊

从头设计抗体,腾讯、北大团队预训练大语言模型登Nature子刊

从头设计抗体,腾讯、北大团队预训练大语言模型登Nature子刊

AI 技术在辅助抗体设计方面取得了巨大进步。然而,抗体设计仍然严重依赖于从血清中分离抗原特异性抗体,这是一个资源密集且耗时的过程。

来自主题: AI资讯
7713 点击    2024-08-18 17:31
没有等来OpenAI开源GPT-4o,等来了开源版VITA

没有等来OpenAI开源GPT-4o,等来了开源版VITA

没有等来OpenAI开源GPT-4o,等来了开源版VITA

大语言模型 (LLM) 经历了重大的演变,最近,我们也目睹了多模态大语言模型 (MLLM) 的蓬勃发展,它们表现出令人惊讶的多模态能力。 特别是,GPT-4o 的出现显著推动了 MLLM 领域的发展。然而,与这些模型相对应的开源模型却明显不足。开源社区迫切需要进一步促进该领域的发展,这一点怎么强调也不为过。

来自主题: AI资讯
7460 点击    2024-08-14 17:38
ACL 2024 Oral | 大模型也会被忽悠?揭秘AI的信念之旅

ACL 2024 Oral | 大模型也会被忽悠?揭秘AI的信念之旅

ACL 2024 Oral | 大模型也会被忽悠?揭秘AI的信念之旅

地球是平的吗? 当然不是。自古希腊数学家毕达哥拉斯首次提出地圆说以来,现代科学技术已经证明了地球是圆形这一事实。 但是,你有没有想过,如果 AI 被误导性信息 “忽悠” 了,会发生什么? 来自清华、上海交大、斯坦福和南洋理工的研究人员在最新的论文中深入探索 LLMs 在虚假信息干扰情况下的表现,他们发现大语言模型在误导信息反复劝说下,非常自信地做出「地球是平的」这一判断。

来自主题: AI资讯
2814 点击    2024-08-07 11:20
Agentic Workflow新范式,基于大语言模型的工作流、业务流程、智能体大融合

Agentic Workflow新范式,基于大语言模型的工作流、业务流程、智能体大融合

Agentic Workflow新范式,基于大语言模型的工作流、业务流程、智能体大融合

2024年2月底,金融服务公司Klarna表示,其所使用的OpenAI提供技术支持的AI Agent,已接管了三分之二的客户聊天,工作量相当于700名全职代理。从引入AI Agent到取得这份耀眼的成绩,仅仅用了1个月的时间。

来自主题: AI资讯
5219 点击    2024-08-05 19:53