AI资讯新闻榜单内容搜索-部署

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 部署
让 AI 更懂你的 Prompt 提示词宝藏网站-FlowGPT

让 AI 更懂你的 Prompt 提示词宝藏网站-FlowGPT

让 AI 更懂你的 Prompt 提示词宝藏网站-FlowGPT

之前介绍了很多在本地部署远程大模型以及本地大模型的教程,但是对于 AI 的使用尤其是如何让 AI 准确理解并执行下达的任务也是一个技术活,所以又诞生了 Prompt 提示词工程这个概念。

来自主题: AI资讯
4025 点击    2024-09-04 14:47
AI落地前端实操,带你成为公司最懂AI的前端大佬!

AI落地前端实操,带你成为公司最懂AI的前端大佬!

AI落地前端实操,带你成为公司最懂AI的前端大佬!

基于公司私有组件生成代码,这个问题的本质是:由于大模型的训练数据集不包含你公司的私有组件数据,因此不能够生成符合公司私有组件库的代码。

来自主题: AI技术研报
9213 点击    2024-09-02 12:42
大模型终端部署新趋势:硬件直接支持混合矩阵乘法

大模型终端部署新趋势:硬件直接支持混合矩阵乘法

大模型终端部署新趋势:硬件直接支持混合矩阵乘法

在人工智能领域,模型参数的增多往往意味着性能的提升。但随着模型规模的扩大,其对终端设备的算力与内存需求也日益增加。低比特量化技术,由于可以大幅降低存储和计算成本并提升推理效率,已成为实现大模型在资源受限设备上高效运行的关键技术之一。然而,如果硬件设备不支持低比特量化后的数据模式,那么低比特量化的优势将无法发挥。

来自主题: AI资讯
3902 点击    2024-08-19 14:49
给RAG系统做一次全面「体检」,亚马逊开源RAGChecker诊断工具

给RAG系统做一次全面「体检」,亚马逊开源RAGChecker诊断工具

给RAG系统做一次全面「体检」,亚马逊开源RAGChecker诊断工具

检索增强生成(Retrieval-Augmented Generation, RAG)技术正在彻底革新 AI 应用领域,通过将外部知识库和 LLM 内部知识的无缝整合,大幅提升了 AI 系统的准确性和可靠性。然而,随着 RAG 系统在各行各业的广泛部署,其评估和优化面临着重大挑战

来自主题: AI资讯
4460 点击    2024-08-18 17:10
不用部署,实现大模型切换自由!Token、算力免费薅!咱AI开发者今年整个秋天的奶茶都省出来了!

不用部署,实现大模型切换自由!Token、算力免费薅!咱AI开发者今年整个秋天的奶茶都省出来了!

不用部署,实现大模型切换自由!Token、算力免费薅!咱AI开发者今年整个秋天的奶茶都省出来了!

作为全公司产品做的最好的工程师,同时也是代码写得最好的产品经理,你深刻地知道:搞个靠谱的 AI 应用需要灵感,而好的灵感则需要一个靠谱的 demo 来验证。

来自主题: AI资讯
5388 点击    2024-08-13 18:04
CPU反超NPU,llama.cpp生成速度翻5倍!LLM端侧部署新范式T-MAC开源

CPU反超NPU,llama.cpp生成速度翻5倍!LLM端侧部署新范式T-MAC开源

CPU反超NPU,llama.cpp生成速度翻5倍!LLM端侧部署新范式T-MAC开源

T-MAC是一种创新的基于查找表(LUT)的方法,专为在CPU上高效执行低比特大型语言模型(LLMs)推理而设计,无需权重反量化,支持混合精度矩阵乘法(mpGEMM),显著降低了推理开销并提升了计算速度。

来自主题: AI资讯
5262 点击    2024-08-13 17:42
我用AI鉴宝,在潘家园被店主围攻了!

我用AI鉴宝,在潘家园被店主围攻了!

我用AI鉴宝,在潘家园被店主围攻了!

事情是这样的,前两天面壁刚刚推出了“小钢炮” MiniCPM-V 2.6 模型,据说视频理解能力直接对标GPT-4V,最重要的是能直接部署在iPad 上。

来自主题: AI资讯
6320 点击    2024-08-10 12:15