微信如何训练多模态 Embedding 模型

摘要

微信团队开源了WeMM-Embedding多模态模型,支持文本、图片、视频等输入。训练分为两阶段:先用数亿异构数据统一对齐,再通过重采样、清洗、难负样本和知识蒸馏提升表示能力。模型已应用于视频号、公众号等搜索推荐场景,在A/B测试中取得持续收益。

欢迎在评论区写下你对这篇文章的看法。

评论

Home - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-09-01 16:34
浙ICP备14020137号-1 $Map of visitor$