moonlight - 搜索 News

6 小时on MSN

月之暗面Kimi发布Moonlight模型：参数高达30亿至160亿，性能大幅提升

近期，人工智能领域迎来了一项引人注目的技术创新。知名技术团队月之暗面Kimi发布了一项关于Muon优化器的新技术报告，并随之推出了名为“Moonlight”的混合专家模型（MoE）。这款模型在Muon优化器的基础上进行了训练，拥有30亿至160亿不等 ...

3 小时

开源赛道太挤了！月之暗面开源新版Muon优化器

上周五，DeepSeek 刚刚官宣这周要连续开源 5 个代码库，却被月之暗面深夜截胡了。昨天，月之暗面抢先一步开源了改进版 Muon 优化器，比 AdamW 优化器计算效率提升了 2 倍。团队人员表示，原始 Muon ...

11 小时on MSN

月之暗面开源Moonlight：30亿/160亿参数混合专家模型

公司动态经济观察网讯 ...

6 小时

月之暗面 Kimi 开源 Moonlight：30 亿 / 160 亿参数混合专家模型

IT之家 2 月 24 日消息，月之暗面 Kimi 昨日发布了“Muon 可扩展用于 LLM 训练”的新技术报告，并宣布推出“Moonlight”：一个在 Muon 上训练的 30 亿 / 160 亿参数混合专家模型（MoE）。使用了 5.7 万亿个 token，在更低的浮点运算次数（FLOPs）下实现了更好的性能，从而提升了帕累托效率边界。

6 小时

月之暗面联手UCLA推新模型Mixture-of-Expert，提升语言模型训练效率

在人工智能领域，训练大型语言模型（LLMs）已成为推动技术进步的重要方向。然而，随着模型规模和数据集的不断扩大，传统的优化方法 —— 特别是 AdamW—— 逐渐显露出其局限性。研究人员面临着计算成本高、训练不稳定等一系列挑战，包括梯度消失或爆炸、参数矩阵更新不一致及分布式环境下的资源需求高等问题。因此，迫切需要更高效、更稳定的优化技术来应对这些复杂性。

腾讯网1 天

代码论文全开源！月之暗面发布重磅技术报告：模型训练效率翻倍

月之暗面最新技术报告 —— 《Muon is Scalable for LLM Training》！推出了一个全新的优化器 Muon，并基于此训练出了 3B/16B 参数的混合专家模型 (MoE)——Moonlight。这个 Moonlight ...

腾讯网26 天

吃灰的平板有救了教你iPad串流PC玩游戏

Moonlight：Sunshine 能够录制并传输 Windows PC 上的游戏画面到接收端，同时支持音频的同步传输。它还允许接收端设备（如 iPad）通过 Moonlight 或其他兼容 ...

来自MSN11 个月

Moonlight串流教程（二）：利用内网穿透实现远程串流

在上期moonlight串流教程里，我们初步了解到了一些sunshine+moonlight的一些基础用法，以及通过第三方软件设置虚拟显示器给显卡创建一个假负载以此 ...

当前正在显示可能无法访问的结果。

隐藏无法访问的结果