DeepSeek代码开源第五弹:并行文件系统3FS代码库,吞吐量6.6TiB/s
2月28日消息,DeepSeek开源周第五天,DeepSeek宣布开源了Fire-Flyer文件系统(3FS)。
Github地址:https://github.com/deepseek-ai/3FS
据介绍,3FS是一个高性能并行文件系统,能应对AI训练和推理工作负载的挑战,它利用现代SSD和RDMA网络提供共享存储层,能简化分布式应用程序的开发。
在由180个存储节点组成的大型测试集群上,3FS最终的总读取吞吐量达到约6.6个TIB/S; KVCache 查询每个客户端节点达到40+GiB/s的峰值吞吐量。
DeepSeek列举了3FS的主要功能和优势包括:
性能和可用性
* 分解式架构结合了数千个SSD的吞吐量和数百个存储节点的网络带宽,使应用程序能够以不受位置影响的方式访问存储资源。
* 强一致性实现带有分配查询(CRAQ)的链式复制以实现强一致性,从而使应用程序代码简单且易于推理。
* 文件接口开发由事务键值存储(例如FoundationDB)支持的无状态元数据服务。文件接口众所周知且随处可用。无需学习新的存储API。
多样化的工作负载
* 数据准备将数据分析管道的输出组织成分层目录结构,并有效地管理大量中间输出。
* 数据加载器通过跨计算节点随机访问训练样本,消除了预取或混洗数据集的需要。
* 检查点支持大规模训练的高吞吐量并行检查点。
* 用于推理的KVCache提供了一种基于DRAM的缓存的经济高效的替代方案,可提供高吞吐量和更大的容量。
OpenAI ChatGPT AI服务再次“跳闸”,初步推测为微软数据中心电力故障导致12月27日消息,OpenAI的AI服务器再次“跳闸”,本次系统服务中断于北京时间12月27日凌晨2点30分左右开始,影响ChatGPT聊天机器人、Sora视频生成模型以及部分API调用。查询OpenAI公司状态页面,显示北京时间今天凌晨3...
TechWeb微晚报:苹果AI落后行业巨头超2年,美团辟谣骑手带患儿送外卖今日要闻一览:苹果AI“拖后腿”公司内部认为落后行业巨头超2年美团辟谣骑手带患儿送外卖:均为虚假摆拍视频消息称比亚迪目标最快11月自研算法量产上车苹果有望成首家4万亿美元公司微软有望明年达到台积电预计四季度...
消息称比亚迪成立未来实验室研发具身智能:包含机器人12月27日消息,据“每人Auto”26日援引独立信源消息称,比亚迪第十五事业部成立了一个专门的团队研发具身智能,事业部最高负责人罗忠良直接主管该项目。知情人士透露,第十五事业部今年上半年进行了组织架构调整,事...
大模型入秋到2024年的最后一个月,大模型依然是最热闹的赛道,没有之一。12月,智谱AI与阶跃星辰相继完成新一轮融资,OpenAI以直播的形式举办了一场长达12天的马拉松式新品发布会。但对从业者肖琳(化名)来说,年底的任何融资...
字节掉队AI时代?开年Sora的爆火,为全球科技大厂在AI领域的竞逐又投下一颗重磅炸弹。相关话题的讨论范围早已突破科技圈。当“AI将重塑各行各业,并产生深远影响”成为一项共识,头部大厂正在竞速迈入AI时代。其中,也包括近年跻身全...
如何选购kawai电钢琴??2023年kawai选购攻略大全来了!
哈喽!最近有超多小伙伴问我:怎么选一台kawai性价比高的电钢琴?为了解决大家在选择kawai电钢的困惑,我专门...
苹果招募生成式AI人才 提供数十个大模型岗位
根据最新的招聘信息,苹果正在扩大其生成式人工智能领域的专业团队,并计划将这项技术应用于iPhone和iPad等...
昆仑万维旗下Opera生成式AI服务海外用户数突破100万
昆仑万维旗下Opera宣布,生成式AI服务Aria海外用户数突破100万。2023年5月24日,Opera正式推出生成式AI助理...
创始人王慧文退出 美团成AI公司光年之外唯一股东
8月7日消息,据国家企业信用信息公示系统显示,北京光年之外科技有限公司在近期完成工商变更,创始人王慧文...