首页 > 人工智能>苹果新研究：AI 不听录音，凭文本描述能零样本识别洗碗等 12 种活动

苹果新研究：AI 不听录音，凭文本描述能零样本识别洗碗等 12 种活动

IT之家人工智能2025-11-23 16:15:14

科技媒体 9to5Mac 昨日（11 月 21 日）发布博文，报道称在最新公布的研究报告中，苹果指出大语言模型（LLM）可通过分析音频和运动数据的文本描述，精准识别用户活动，未来可能会应用于 Apple Watch 上。...

感谢最新网友对的时间点的线索投递！

最新 11 月 22 日消息，科技媒体 9to5Mac 昨日（11 月 21 日）发布博文，报道称在最新公布的研究报告中，苹果指出大语言模型（LLM）可通过分析音频和运动数据的文本描述，精准识别用户活动，未来可能会应用于 Apple Watch 上。

这项名为“后期多模态传感器融合”（Late Multimodal Sensor Fusion）的技术，主要结合 LLM 的推理能力与传统传感器数据，即使在传感器信息不足的情况下，也能精确判断用户正在进行的具体活动。

研究的核心方法颇具新意。大语言模型并未直接处理用户的原始音频录音或运动数据，而是分析由专门的小型模型生成的文本描述。

苹果新研究：AI 不听录音，凭文本描述能零样本识别洗碗等 12 种活动

具体来说，音频模型会生成描述声音环境的文字（如“水流声”），而基于惯性测量单元（IMU）的运动模型则会输出动作类型的预测文本。这种方式不仅保护了用户隐私，还验证了 LLM 在理解和融合多源文本信息以进行复杂推理方面的强大能力。

为验证该方法，研究团队使用了包含数千小时第一人称视角视频的 Ego4D 数据集。他们从中筛选出 12 种日常活动，包括吸尘、烹饪、洗碗、打篮球、举重等，每段样本时长 20 秒。

随后，研究人员将小模型生成的文本描述输入给谷歌的 Gemini-2.5-pro 和阿里的 Qwen-32B 等多个大语言模型，并测试其在“零样本”（无任何示例）和“单样本”（提供一个示例）两种情况下的识别准确率。

测试结果显示，即使没有任何针对性地训练，大语言模型在活动识别任务中的表现也远超随机猜测的水平，其 F1 分数（衡量精确率和召回率的指标）表现优异。当获得一个参考示例后，模型的准确度还会进一步提升。

苹果新研究：AI 不听录音，凭文本描述能零样本识别洗碗等 12 种活动

这项研究表明，利用 LLM 进行后期融合，可以有效开发出强大的多模态应用，而无需为特定场景开发专门模型，从而节省了额外的内存和计算资源。苹果公司还公开了实验数据和代码，以供其他研究者复现和验证。

《苹果新研究：AI 不听录音，凭文本描述能零样本识别洗碗等 12 种活动》转载自互联网，如有侵权，联系我们删除，QQ：369-8522。

本文网址：https://keji.jxzy.wang/2025/11/100.html

第五届OceanBase数据库大赛收官：北邮「编程高手」赛队夺冠，探索AI原生数据库

1月18日下午，2025年全国大学生计算机系统能力大赛暨第五届OceanBase数据库大赛在北京科技大学落幕。本届赛事吸引全国高校的1223支队伍、2620名学生参赛。经过两个多月比拼，北邮「编程高手」队...

人工智能 2026-01-19 1
保时捷设计推 C-Seed 折叠电视，售价超三台 911

保时捷设计工作室联合研发的C-Seed折叠电视亮相，它更像一件科幻雕塑艺术品。闲置时如未来柜体，一键启动后屏幕自动旋转，五块Micro LED面板依次展开，支持室内外两用。但价格令人咋舌：约40万美元，超三台保时捷911 Carrera总价。#天价电视# #保时捷设计#...

人工智能 2026-01-19 1
三星高管：不追噱头，专注打造“真正有用且不唐突”的 AI

三星欧洲区CEO Simon Sung表示，其AI战略核心是打造“真正有用且不唐突”的人工智能，聚焦日常实用价值而非新奇噱头。三星高斯大模型并未像ChatGPT那样独立推出，而是以Galaxy AI为核心深度集成于手机，并布局于家电等多条产品线。公司内部正推动AI能力渗透各部门，构建统一的智能环境。#三星AI# #GalaxyAI#...

人工智能 2026-01-19 1
英伟达黄仁勋谈 AI 对职场影响：只替你干杂活，岗位核心还得靠人

英伟达CEO黄仁勋在播客中分享了对AI与就业的见解：AI自动化的是工作中的具体任务，而非岗位的核心价值。他以放射科为例，尽管AI已能读取影像，但放射科医生人数和收入却创下新高，因为其核心价值在于诊断与治疗决策。这一逻辑同样适用于律师、软件工程师等职业。#AI与就业# #黄仁勋谈AI#...

人工智能 2026-01-19 1
谷歌重申暂无在 Gemini 中投放广告计划，聚焦搜索广告

谷歌全球广告副总裁丹·泰勒表示，目前没有在Gemini应用中投放广告的计划，广告团队正将重心放在AI搜索广告上。他指出，AI助手与搜索定位不同，商业化需谨慎，过早插入广告可能引发用户反感。目前谷歌AI概览月活已超20亿，广告点击率与传统搜索持平。#谷歌Gemini##AI广告商业化#...

人工智能 2026-01-19 1
波士顿动力 CEO：Atlas 人形机器人从零件分拣起步，5-10 年或进入家庭

波士顿动力CEO透露，其全电动人形机器人阿特拉斯计划2028年投入工厂应用，将从汽车零部件分拣等简单任务起步。机器人面部设计灵感源自皮克斯小台灯，旨在传递友好信号。CEO认为机器人将创造新岗位，与人类形成共生关系，而非简单取代。#人形机器人##波士顿动力#...

人工智能 2026-01-19 1