从 2022 到 2026,我们的推荐引擎经历了三次重大升级。这份白皮书带你了解每一次迭代背后的思考与突破。

三代演进

Gen 1 / 2022
协同过滤基于相似用户行为推荐,但难以捕捉个人细腻偏好
Gen 2 / 2024
深度神经网络多模态特征融合,大幅提升推荐准确度
Gen 3 / 2026
多模态 + 声纹识别结合声纹、场景、情绪,推荐更贴近当下

核心技术

多模态融合

第三代引擎综合旋律、节奏、调式、歌词、艺人、场景、情绪等多维度特征,使用跨模态对齐模型统一表征。

声纹识别

创新性地引入声纹识别:分析用户哼唱、跟随歌声的声纹特征,识别当下情绪与能量水平,匹配推荐策略。

实时场景建模

结合设备传感器(匿名授权)、时段、地理位置、当前应用上下文,构建实时场景向量,推荐"懂你此刻的状态"。

关键指标

"我们不只是在做推荐,而是在理解音乐与人的关系。" —— AI 科学家

隐私与伦理

所有声纹数据均在本地加密处理,云端仅传输匿名化特征向量。用户可随时关闭个性化推荐,清除个人行为数据。