摩尔线程 MTT S5000 适配 FlagOS 训练全要素软件栈,实现 Qwen3-0.6B 端到端无中断训练 摩尔线程旗舰 AI 算力卡 MTT S5000 成功适配智源研究院 FlagOS 全栈软件,在 Qwen3-0.6B 语言模型上完成了 1T Tokens 的持续训练,连续 6 天超过 14000 步... AI 新资讯行业资讯# FlagOS# MTT S5000# 摩尔线程 5个月前6,325624
Day-0 支持,摩尔线程完成 MiniMax M3 大模型适配 摩尔线程宣布其旗舰 AI 训推一体 GPU MTT S5000 已完成对 MiniMax 新一代原生多模态旗舰模型 M3 的 Day-0 适配。MTT S5000 凭借 1000 TFLOPS 算力... AI 新资讯行业资讯# MiniMax M3# MTT S5000# 摩尔线程 3个月前3,731386
摩尔线程发布 Torch-MUSA v2.7.0,增强 AI 模型训练与推理支持 摩尔线程发布 Torch-MUSA v2.7.0,新增 muFFT 与 muSolver 库集成,支持统一内存管理,优化内存使用效率。算子总数超1050个,性能与稳定性进一步提升。#AI技术# #摩尔... AI 新资讯行业资讯# PyTorch# TorchMUSA# 摩尔线程 9个月前5,574281
把 256 张 GPU 变成一台计算机:摩尔线程 MTT C256 超节点亮相 WAIC 2026 2026 世界人工智能大会已于 7 月 17 日在上海揭幕,摩尔线程在本次大会上首次公开展示了 MTT C256 超节点。据介绍,摩尔线程通过创新架构首创了一层 Scale-up 网络,将 256 张... AI 新资讯行业资讯# 2026 世界人工智能大会# MTT C256# WAIC 2026 1个月前2,531143
摩尔线程携手智源 FlagOS,为 MTT S5000 GPU 完成 DeepSeek-V4 模型 Day-0 适配 摩尔线程与智源 FlagOS 合作,为 MTT S5000 GPU 实现 DeepSeek-V4-Flash 模型的 Day-0 适配。该模型采用“FP4+FP8”混合精度策略,而 MTT S5000... AI 新资讯行业资讯# DeepSeekV4# MTT S5000# 摩尔线程 4个月前5,337138
Day-0 支持,摩尔线程完成 MiniMax H3 多模态生成模型适配 摩尔线程基于 MTT S5000 智算卡和 MUSA 软件栈,在 MiniMax H3 开源当日仅用 3 小时完成适配。H3 支持文本、图片、音频视频多元输入,可直出 2K 15 秒原生音画,视频编辑... AI 新资讯行业资讯# MiniMax H3# MTT S5000# 摩尔线程 4周前3,948127
摩尔线程完成 MiniMax M2.5 模型 Day-0 适配,支持 MTT S5000 GPU MTT S5000 GPU基于MUSA架构,具备强大的算子覆盖与生态兼容性,此次适配释放了其原生FP8加速能力。MiniMax M2.5模型在编程、工具调用及Agent任务中表现出色,其长上下文处理对... AI 新资讯行业资讯# MiniMax M2.5# MTT S5000 GPU# 摩尔线程 6个月前9,423102
摩尔线程开源 MusaCoder:首个基于国产全功能 GPU 全栈训练的代码大模型 这是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源代码大模型,其完整后训练流程均在基于 MTT S5000 构建的夸娥智算集群上完成。 AI 新资讯行业资讯# MusaCoder# 国产 GPU# 大模型 3个月前3,87813