只需少量计算和内存资源即可运行的小型 Llama 大模型

愤怒的蜗牛

2024-03-02 538阅读 0评论

背景介绍

在当今这个数据爆炸的时代，语言模型的训练变得越来越复杂和困难。我们需要巨大的计算资源和时间来训练一个高效的语言模型。然而，这对许多人来说并不现实。与此同时，我们也遇到了如何在有限的内存和计算资源中使用大型语言模型的挑战，特别是在边缘设备上。

今天要给大家推荐一个 GitHub 开源项目 jzhang38/TinyLlama，该项目在 GitHub 有超过 4.3k Star，用一句话介绍该项目就是：“The TinyLlama project is an open endeavor to pretrain a 1.1B Llama model on 3 trillion tokens.”。

只需少量计算和内存资源即可运行的小型 Llama 大模型

项目介绍

TinyLlama 旨在预训练一个在 3 万亿的 token 上的 1.1B Llama 模型。在一些恰当的优化下，我们可以在短短 90 天内使用 16 个 A100-40G GPUs 来达到这个目标。该项目采用了与 Llama 2 完全相同的架构和 tokenizer，这意味着 TinyLlama 可以在许多基于 Llama 的开源项目中插入并使用。此外，TinyLlama 非常紧凑，只有 1.1B 的参数。这种紧凑性使其能够满足许多需要限制计算和内存占用的应用。

只需少量计算和内存资源即可运行的小型 Llama 大模型

只需少量计算和内存资源即可运行的小型 Llama 大模型

如何使用

直接下载模型就可以使用，或者通过 huggingface 使用 demo。

只需少量计算和内存资源即可运行的小型 Llama 大模型

如果你想自己训练的话，参考如下训练详情。

只需少量计算和内存资源即可运行的小型 Llama 大模型

项目推介

TinyLlama 是一个令人兴奋的开源项目，它正在积极解决一些关键问题，并在开源社区中得到了广泛的关注。

只需少量计算和内存资源即可运行的小型 Llama 大模型

以下是该项目 Star 趋势图（代表项目的活跃程度）：

只需少量计算和内存资源即可运行的小型 Llama 大模型

更多项目详情请查看如下链接。

开源项目地址：https://github.com/jzhang38/TinyLlama

开源项目作者：jzhang38

以下是参与项目建设的所有成员：

北大发起复现Sora，框架已搭！袁粒田永鸿领衔，AnimateDiff大神响应

区块链如何解决无家可归问题

相关阅读

ACL 2025 | 基于Token预算感知的大模型高效推理技术

OpenAI久违发了篇「正经」论文：线性布局实现高效张量计算

被疯传的“恶趣味”：看Copilot这款“熊孩子”把微软工程师逼疯！Agent 刚上线就翻车？网友：微软工程师成了“人肉保姆” 译文

1步碾压250步！何恺明新作祭出MeanFlow，一行公式让 FID 狂降近 70%

奥特曼：Codex 让我感到 AGI！最新谈话罕见透露下一代“完美模型”，大胆预测 Agent 明年突破边界！

OpenAI深夜宣布ChatGPT支持MCP、会议记录，万物互联时代来了！

使用Claude 4提升程序员生产力的五种高级方式译文

AI+数字经济的核心三要素

您需要登录账户后才能发表评论

发表评论取消回复

评论列表（暂无评论，538人围观）

还没有评论，来说两句吧...

目录[+]

微信二维码

微信二维码

支付宝二维码