从人机对话到旁听AI讨论,信息获取方式正在被重塑
随着人工智能技术在各领域的深度渗透与融合,其发展速度已呈现出日新月异的态势。AI正从幕后工具逐步演变为交互界面本身——我们见证了聊天机器人从勉强生成连贯语句,到发展为能开展完整播客式对话的AI代理,这些智能体已能辅助用户学习、思考乃至放松身心。
在这股以无障碍为核心的创新浪潮推动下,谷歌搜索也迎来了音频交互领域的重要尝试。作为搜索实验室(Search Labs)的最新实验项目,谷歌正在测试名为“音频概览”(Audio Overviews)的功能。该功能将AI概览技术的核心能力——为复杂搜索查询提供快速摘要,转化为简短的播客式音频片段。用户不仅可以阅读文本摘要,还能选择收听由两个AI语音以日常对话形式展开的主题讨论。
这些语音由谷歌Gemini AI模型驱动,触发方式简便:只需搜索谷歌判定为“适合音频呈现”的主题,若功能可用,界面将显示“搜索实验室 | 音频概览”提示,并附带迷你音频播放器,支持播放、暂停、音量调节及倍速播放等操作。音频片段生成耗时约40秒,同时会显示摘要构建的来源列表,堪称按需生成的定制化AI播客。
值得注意的是,“音频概览”技术并非全新创造。该功能最早应用于谷歌AI驱动的笔记应用NotebookLM,可将PDF等完整文档转换为语音摘要,助力用户高效消化内容,随后被整合至Gemini应用,如今进一步移植到谷歌搜索场景。尽管尚未明确下一个接入音频处理的应用场景(如电子邮件或社交平台评论等),但技术迁移路径已清晰可见。
从应用价值来看,这一功能绝非营销噱头。鉴于谷歌每月覆盖大量用户、业务遍及100多个国家,若该趋势持续演进,“音频概览”有望成为驾车、烹饪或避免屏幕使用场景下,用户获取免提信息的首选工具。
目前该功能仍处于早期测试阶段,仅通过搜索实验室向小范围用户开放。但这一尝试再次印证:搜索体验正从关键词匹配向对话交互演进,即便这类对话由AI生成。这一转变不仅有望重塑信息获取方式,更预示着人机交互范式的深层探索。
文章来源:央广广告
随着人工智能技术在各领域的深度渗透与融合,其发展速度已呈现出日新月异的态势。AI正从幕后工具逐步演变为交互界面本身——我们见证了聊天机器人从勉强生成连贯语句,到发展为能开展完整播客式对话的AI代理,这些智能体已能辅助用户学习、思考乃至放松身心。
在这股以无障碍为核心的创新浪潮推动下,谷歌搜索也迎来了音频交互领域的重要尝试。作为搜索实验室(Search Labs)的最新实验项目,谷歌正在测试名为“音频概览”(Audio Overviews)的功能。该功能将AI概览技术的核心能力——为复杂搜索查询提供快速摘要,转化为简短的播客式音频片段。用户不仅可以阅读文本摘要,还能选择收听由两个AI语音以日常对话形式展开的主题讨论。
这些语音由谷歌Gemini AI模型驱动,触发方式简便:只需搜索谷歌判定为“适合音频呈现”的主题,若功能可用,界面将显示“搜索实验室 | 音频概览”提示,并附带迷你音频播放器,支持播放、暂停、音量调节及倍速播放等操作。音频片段生成耗时约40秒,同时会显示摘要构建的来源列表,堪称按需生成的定制化AI播客。
值得注意的是,“音频概览”技术并非全新创造。该功能最早应用于谷歌AI驱动的笔记应用NotebookLM,可将PDF等完整文档转换为语音摘要,助力用户高效消化内容,随后被整合至Gemini应用,如今进一步移植到谷歌搜索场景。尽管尚未明确下一个接入音频处理的应用场景(如电子邮件或社交平台评论等),但技术迁移路径已清晰可见。
从应用价值来看,这一功能绝非营销噱头。鉴于谷歌每月覆盖大量用户、业务遍及100多个国家,若该趋势持续演进,“音频概览”有望成为驾车、烹饪或避免屏幕使用场景下,用户获取免提信息的首选工具。
目前该功能仍处于早期测试阶段,仅通过搜索实验室向小范围用户开放。但这一尝试再次印证:搜索体验正从关键词匹配向对话交互演进,即便这类对话由AI生成。这一转变不仅有望重塑信息获取方式,更预示着人机交互范式的深层探索。
文章来源:央广广告