我的订阅
科技

我们正处于一个信息大暴发的时代，每天都能产生数以百万计的新闻资讯！

虽然有大数据推荐，但面对海量数据，通过我们的调研发现，在一个小时的时间里，您通常无法真正有效地获取您感兴趣的资讯！

头条新闻资讯订阅，旨在帮助您收集感兴趣的资讯内容，并且在第一时间通知到您。可以有效节约您获取资讯的时间，避免错过一些关键信息。

新视角设计下一代时序基础模型，Salesforce推出Moirai-MoE

类别：科技发布时间：2024-11-01 09:27:00 来源：机器之心Pro

AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年，机器之心AIxiv专栏接收报道了2000多篇内容，覆盖全球各大高校与企业的顶级实验室，有效促进了学术交流与传播。如果您有优秀的工作想要分享，欢迎投稿或者联系报道。

本文由 Salesforce、新加坡国立大学、香港科技大学（广州）共同完成。其中，第一作者柳旭是 Salesforce 亚洲研究院实习生、新加坡国立大学计算机学院四年级博士生。通讯作者刘成昊是 Salesforce 亚洲研究院高级科学家。该工作的短文版本已被 NeurIPS 2024 Workshop on Time Series in the Age of Large Models 接收。

时间序列预测是人类理解物理世界变化的重要一环。自去年底以来，时序预测领域正在经历重大转型，从传统的「单一数据集训练单一模型」的模式逐步转向「通用预测基础模型」。目前虽然有不少基础模型已经提出，但如何有效地在高度多样化的时序数据上训练基础模型仍是一个开放问题。

近期，来自 Salesforce、新加坡国立大学、香港科技大学（广州）的研究者以模型专家化这一全新视角作为抓手，设计并提出了下一代时序预测基础模型 Moirai-MoE。该模型将模型专业化设计在 token 这一细粒度运行，并且以完全自动的数据驱动模式对其赋能。模型性能方面，不同于仅在少量数据集上进行评估的已有时序基础模型，Moirai-MoE 在一共 39 个数据集上进行了广泛评估，充分验证了其优越性。

论文标题：Moirai-MoE: Empowering Time Series Foundation Models with Sparse Mixture of Experts 论文地址：https://arxiv.org/abs/2410.10469 代码仓库：https://github.com/SalesforceAIResearch/uni2ts

研究动机

训练通用基础模型的一大挑战在于适应时间序列数据的高度异质性，这种时序数据的独特特性凸显了设计专业化模块的必要性。现有的解决方案主要分为两种。第一种是通过基于语言的提示来识别数据源，从而实现非常粗粒度的数据集级别模型专业化。第二种方案利用了时序数据的频率这一元特征实现了更细粒度的专业化：该方法为特定频率设计单独的输入 / 输出投影层，从而实现特定频率的模型专业化。

作者认为，这种人为强加的频率级专业化缺乏普适性，并引入了一些局限性。（1）频率并不总是一个可靠的指标，无法有效地捕捉时序数据的真实结构。如下图所示，具有不同频率的时间序列可以表现出相似的模式，而具有相同频率的时间序列可能显示出多样且不相关的模式。这种人为强加的频率和模式之间的不匹配削弱了模型专业化的有效性，从而导致性能下降。（2）现实世界的时间序列本质上是非平稳的，即使在单个时间序列的短窗口内也会显示出不同的分布。显然，频率级专业化的粒度无法捕捉这种程度的多样性，这凸显了对更细粒度的建模方法的需求。

为了解决上述问题，作者提出了全新的时间序列统一训练解决方案 Moirai-MoE，其核心思想是利用单个输入 / 输出投影层，同时将各种时间序列模式的建模委托给 Transformer 层中的稀疏混合专家。通过这些设计，Moirai-MoE 的专业化以数据驱动的方式实现，并在 token 级别运行。

基于稀疏混合专家的时序基础模型

Moirai-MoE 构建在它的前序工作 Moirai 之上。虽然 Moirai-MoE 继承了 Moirai 的许多优点，但其主要改进在于：Moirai-MoE 不使用多个启发式定义的输入 / 输出投影层来对具有不同频率的时间序列进行建模，而是使用单个输入 / 输出投影层，同时将捕获不同时间序列模式的任务委托给 Transformer 中的稀疏混合专家。此外，Moirai-MoE 提出了一种新型的利用预训练模型中知识的门控函数，并采用自回归的训练目标来提高训练效率。下面简要介绍 Moirai-MoE 的模块。

1. 时序 Token 构造

Moirai-MoE 采用切块（patching）技术将时间序列输入切成没有重叠的小块，而后对小块进行标准化来缓解分布迁移的问题。为了在自回归模型中获取准确、鲁棒的标准化统计值，作者引入掩蔽率 r 作为超参数，它指定整个序列中专门用于正则化器计算的部分，不对这些 patch 计算预测损失。最后，一个输入投影层来负责把 patch 投影到和 Transformer 一样的维度，生成时序 token。

2. 稀疏混合专家 Transformer

通过用 MoE 层替换 Transformer 的每个 FFN 来建立专家混合层。该 MoE 层由 M 个专家网络和一个门控函数 G 组成。每个 token 只激活一个专家子集，从而允许专家专注于不同模式的时间序列数据并确保计算效率。在 Moirai-MoE 中，作者探索了不同的门控函数。首先使用的是最流行的线性投影门控函数，它通过一个线性层来生成专家子集的分配结果。此外，作者提出了一种新的门控机制，利用从预训练模型的 token 表示中得出的聚类中心来指导专家分配。这一方法的动机是，与随机初始化的线性投影层相比，预训练 token 表示的聚类更接近数据的真实分布，可以更有效地实现模型专业化。

3. 训练目标

为了同时支持点预测和概率预测两种预测模式，Moirai-MoE 的训练目标设定为优化未来混合分布的对数似然函数。

实验效果

作者在 39 个数据集上的进行了广泛测试评估来验证 Moirai-MoE 的有效性。

上图展示了在 Monash 基准中 29 个数据集上进行的分布内预测评估。结果表明，Moirai-MoE 击败了所有竞争对手。相比前序工作 Moirai，Moirai-MoE 的提升幅度达到了 19%。与 Moirai 无法超越的基础模型 Chronos 相比，Moirai-MoE 成功弥补了差距，并相比它少 65 倍激活参数，这带来了巨大的推理速度的优势。

上表展示了在零样本预测设定时，Moirai-MoE 在 10 个数据集上的点预测和概率预测的表现。Moirai-MoE-Base 取得了最佳的零样本性能，甚至超越了 Google 的 TimesFM 和 Amazon 的 Chronos（他们在预训练语料库中已包含了部分评估数据，因此存在数据泄露）。与所有规模的 Moirai 相比，Moirai-MoE-Small 在 CRPS 方面提高了 3%-14%，在 MASE 方面提高了 8%-16%。考虑到 Moirai-MoE-Small 只有 11M 激活参数（比 Moirai-Large 少 28 倍），这些进步是非常显著的。

在这篇研究中，作者还对时序 MoE 基础模型的内部工作机制进行了首次探索。上图是对 Moirai-MoE 的专家分配分布进行的可视化。基于此，作者总结了以下观点：

1. 在浅层中，不同频率的数据在专家选择的分布上呈现多样化。随着层数的加深，模型将重点转移到更通用的时间依赖性，例如更广泛的趋势和长期模式，这些依赖性可以在不同频率之间共享。到最后一层（第 6 层），专家分配在所有频率上变得几乎相同，表明模型已将时间序列抽象为与频率基本无关的高级表示。这一证据表明 Moirai-MoE 学习到了频率不变的隐层表示，这对于模型泛化至关重要。

2. 随着层数增加专家选择逐渐收敛的行为与 Large Language Models 中观察到的模式完全相反。这种分歧可能源于时间序列 token 的动态和噪声特性，它们是由小时间窗口生成的，不像从固定词汇表中派生的语言 token。研究结果表明，随着层数增加，模型实际上是在进行逐步去噪过程。这一观察结果与 GPT4TS 的结论一致：随着层深度增加，token 会被投影到输入的低维顶部特征向量空间中。

更多实验结果，可参考原论文。

以上内容为资讯信息快照，由td.fyun.cc爬虫进行采集并收录，本站未对信息做任何修改，信息内容不代表本站立场。

快照生成时间：2024-11-01 12:45:01

本站信息快照查询为非营利公共服务，如有侵权请联系我们进行删除。

信息原文地址：

更多关于时序,下一代,视角,模型,基础,设计的资讯：

首个3d人像视频生成模型来了

...帧3DGAN模型，通过学习一个额外的在隐式空间进行推理的时序模型对生成的内容进行合理的改变，从而生成3D人像视频。然而，该方法的缺点是图片生成器和时序推理模型在不同的阶段分别

2023-02-22 19:23:00

超越Transformer，全面升级！MIT等华人团队发布通

...在细分任务上展现出色的性能，但由于缺乏灵活和通用的时序特征的提取能力，无法成为通用的模型架构。为了解决这些问题，来自MIT、港科大、浙大以及格里菲斯大学的华人团队联合推出了一

2024-10-30 09:58:00

全球首次！时序大模型突破十亿参数，华人团队发布Time-Mo

...本实现高精度预测。研发团队还发布了Time-300B数据集，为时序分析提供了丰富的训练资源，为各行各业的时间序列预测任务带来了新的解决方案。在当今以数据为驱动的时代，时序预测

2024-10-23 09:55:00

南邮探索集成电路拔尖创新人才培养新实践

...”目前，汤谨溥已顺利直博至清华大学电子工程系，攻关下一代显示技术。“集成电路是典型的多学科交叉融合领域，以电子设计自动化为例，它需要懂算法、会编程、能设计芯片的交叉复合应用型

2024-05-30 06:35:00

科学家为脉冲神经网络引入新架构，为超大模型奠定基础

...论文以《脉冲驱动 Transformer V2：元脉冲神经网络架构启发下一代神经形态芯片设计》（Spike-driven Transformer V2: Meta Spiki

2024-03-18 10:41:00

证监会发布3项金融行业标准

...中国证监会24日发布消息，近日，证监会发布《投资研究时序数据参考模型》《证券期货业基础数据元规范第1部分：基础数据元》《证券期货业基础数据元规范第2部分：基础代码》等3项金融

2024-05-24 20:34:00

装备数字工程概念与实践思考

...担的使命集合、配备的装备信息等。视图通常以活动图、时序图的形式为主，也可以配备状态机图进行仿真验证。（4）高层作战概念视角：这是使命架构的最后一个视角，它描述了装备概念

2024-12-21 04:00:00

空间智能新进展：教机器人组装家具，实现操作步骤与真实视频对齐

...应点和RANSAC算法进行相机参数估计；通过多视角验证和时序约束保证标注质量。首先，研究者们首先定义了一套层次化的装配过程描述框架，将整个装配过程分为步骤、子步骤和视频

2024-11-27 09:57:00

引领下一代通用人工智能，高校如何发力

...院院士鄂维南的发言引发不少与会者共鸣。高校若要引领下一代AGI的发展，需要解决哪些瓶颈？发力点在哪里？又该如何更好地输出AI人才与技术？展望下一代AGI，数据库技术很关键在鄂

2024-04-21 05:57:00

更多关于科技的资讯：

戴着千问AI眼镜上两会，外媒记者：采访更高效了

今年全国两会现场，一款中国AI眼镜成为外媒记者的新宠。来自摩洛哥的中阿卫视记者毕诺，与多位国际同行纷纷戴上千问AI眼镜进行两会报道

2026-03-12 11:37:00

【奋进春天里】冲刺2200亿 2026年贵阳贵安将持续做大数

编者按：一年春作首，奋进正当时。三月的黔中大地，生机盎然、干劲冲天，企业车间开足马力忙生产，项目工地塔吊林立赶进度。春日的沃土上

2026-03-12 11:52:00

海尔智家发布AI之眼2.0和家庭机器人，无人家务更进一步

鲁网3月12日讯3月12日，2026中国家电及消费电子博览会（AWE2026）在上海新国际博览中心正式开幕。继去年首发AI之眼技术

2026-03-12 12:08:00

最高减500元！贵州再发政府补贴促消费

3月11日，贵州省商务厅启动“2026年贵州食品、日用百货类商品线上促消费活动”，以“平台优惠+折扣立减”的促销方式，面向全国消费者发放总额1000万元的政府补贴

2026-03-12 12:22:00

平安人寿山东分公司：一键上门暖银发科技留痕守安心

鲁网3月12日讯在数字化金融服务全面普及的今天，掌上软件让越来越多的客户实现足不出户、指尖办业务，平安人寿推出的金管家APP

2026-03-12 13:52:00

杭州首个全流程硅光基地在拱墅落成

实现从光芯片设计到模块封装量产每日商报讯近日，位于拱墅区大运河数智未来城省级高新区核心区块的拱政工出【2025】6号地块标准厂房（一期）项目（以下称“芯速联高速硅光模块智能制造基地”）正式完工

2026-03-12 08:12:00

涂鸦智能：以开放平台与AI能力重塑宠物喂食器解决方案

宠物智能用品正从基础的“联网控制”迈向“主动关怀”的深度智能时代。传统宠物喂食器多限于手机App远程定时出粮,难以应对动态调整食量

2026-03-12 08:34:00

纵览原创｜石家庄“装虾”线上线下冰火两重天：多家线下店铺称“

见习记者朱荣琛“你养龙虾了吗？”成为近期网络热议的话题。最近，这款名为OpenClaw（网友俗称“龙虾”）的开源AI智能体工具迅速走红网络

2026-03-12 08:47:00

警惕“龙虾热” 带来的替代焦虑-中国吉林网

长白时评评论员崔越然近期一款名为OpenClaw的开源人工智能体工具火遍全网，因其鲜红的图标被广大网民亲切地称为“龙虾”

2026-03-12 10:29:00

想尝鲜，又怕烫手西湖边，数百人排队免费领养本地版“龙虾”

西湖边掀起“养虾”热潮。春夜渐凉，西湖边的“养虾”热潮，到昨晚8点仍没有退去。从中午开始，滨次元AI文旅驿站外的12号场地就排起了长队

2026-03-12 09:13:00

绍兴纺企抱团出海 “柯桥优选”圈粉越南

杭州日报讯近日，在中国纺织信息中心浙江分中心·国际纺织时尚交流中心的组织下，涛搏纺织、凯亨纺织、卓伦纺织、优时进出口等10家绍兴柯桥纺织标杆企业组团亮相越南西贡会展中心

2026-03-12 07:11:00

企业“抢单”忙青山湖畔“开门红”

杭州日报讯 “开年前两个月，订单量同比两位数增长，完成甚至突破预定生产目标，我们信心很足!”“产线满负荷运转，订单排得满满当当

2026-03-12 07:11:00

桐乡“濮院毛衫”焕新出海

数字贸易平台海外版上线杭州日报讯昨日，在2026年中国国际针织（春夏）博览会上，濮院毛衫数字贸易平台海外版正式上线，其专属海外品牌“PlinkX”同步亮相

2026-03-12 07:11:00

“共享大市场·出口中国”活动即将在杭启幕

推动进口贸易与消费升级深度融合杭州日报讯为深入推进高水平对外开放，释放中国超大规模市场红利，推动进口贸易与消费升级深度融合

2026-03-12 07:11:00

不熟悉新手机误开收费业务

82岁老人换了新手机，但不熟悉操作，结果误开通多项收费业务。3月11日，老人收到扣费短信后向网格员求助，顺利取消了扣费服务

2026-03-11 17:36:00

头条订阅服务

新视角设计下一代时序基础模型，Salesforce推出Moirai-MoE