头版Folia Daily Briefing
← 返回头版
科技

开发者在8美元微控制器上成功运行2890万参数语言模型

一名开发者成功在价格约8美元的ESP32-S3微控制器上运行了2890万参数的语言模型。这一突破相比之前在同类芯片上运行的26万参数模型,参数量增加了约100倍。该模型在芯片本地运行,无需连接服务器,文本生成速度约为每秒9tokens。

一名开发者成功在价格约8美元的ESP32-S3微控制器上运行了2890万参数的语言模型[1]。这一突破相比之前在同类芯片上运行的26万参数模型,参数量增加了约100倍[1]。该模型在芯片本地运行,无需连接服务器[1],文本生成速度约为每秒9tokens[1]。

开发者通过采用Google Gemma模型中的Per-Layer Embeddings技术实现了这一成果[1],该技术将大部分模型参数存储在慢速闪存中,充分利用了芯片512KB的SRAM容量[1]。所用的语言模型基于TinyStories训练数据集[1],展示了边缘设备上本地文本生成的可行性。


ESP32-S3微控制器28.9M参数语言模型边缘AIPer-Layer EmbeddingsTinyStories