搜索
房产
装修
汽车
婚嫁
健康
理财
旅游
美食
跳蚤
二手房
租房
招聘
二手车
教育
茶座
我要买房
买东西
装修家居
交友
职场
生活
网购
亲子
情感
龙城车友
找美食
谈婚论嫁
美女
兴趣
八卦
宠物
手机
打印 上一主题 下一主题

DeepSeek代码开源第五弹:并行文件系统3FS代码库,吞吐量6.6TiB/s

[复制链接]
查看: 26|回复: 0

19万

主题

19万

帖子

58万

积分

论坛元老

Rank: 8Rank: 8

积分
587890
跳转到指定楼层
楼主
发表于 2025-8-1 19:07 | 只看该作者 回帖奖励 |倒序浏览 |阅读模式
2月28日消息,DeepSeek开源周第五天,DeepSeek宣布开源了Fire-Flyer文件系统(3FS)。
Github地址:deepseek-ai/3FS
据介绍,3FS是一个高性能并行文件系统,能应对AI训练和推理工作负载的挑战,它利用现代SSD和RDMA网络提供共享存储层,能简化分布式应用程序的开发。
在由180个存储节点组成的大型测试集群上,3FS最终的总读取吞吐量达到约6.6个TIB/S; KVCache 查询每个客户端节点达到40+GiB/s的峰值吞吐量。
DeepSeek列举了3FS的主要功能和优势包括:
性能和可用性
* 分解式架构结合了数千个SSD的吞吐量和数百个存储节点的网络带宽,使应用程序能够以不受位置影响的方式访问存储资源。
* 强一致性实现带有分配查询(CRAQ)的链式复制以实现强一致性,从而使应用程序代码简单且易于推理。
* 文件接口开发由事务键值存储(例如FoundationDB)支持的无状态元数据服务。文件接口众所周知且随处可用。无需学习新的存储API。
多样化的工作负载
* 数据准备将数据分析管道的输出组织成分层目录结构,并有效地管理大量中间输出。
* 数据加载器通过跨计算节点随机访问训练样本,消除了预取或混洗数据集的需要。
* 检查点支持大规模训练的高吞吐量并行检查点。
* 用于推理的KVCache提供了一种基于DRAM的缓存的经济高效的替代方案,可提供高吞吐量和更大的容量。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Copyright © 2006-2014 oopz大明星网,男女明星图片,明星八卦新闻,明星个人资料大全 版权所有 法律顾问:高律师 客服电话:0791-88289918
技术支持:迪恩网络科技公司  Powered by Discuz! X3.2
快速回复 返回顶部 返回列表