无需后端:浏览器内置的 AI 接口为 Web 开发者所用
Chrome 现在内置了 AI API,直接在浏览器中使用了谷歌的 Gemini Nano 模型。这消除了对API密钥、后端代理以及按令牌计费的任务(如摘要或翻译)的需求。这些设备内AI能力确保用户数据不会流出机器,提升隐私并降低延迟。最初,这些API仅支持桌面,需要一台具备备能力的机器,并完成大量初始模型下载。这些API分为任务专用工具,如摘要器、翻译器和写入工具,以及适用于自定义或多模态需求的通用提示词API。所有 API 遵循一致的生命周期:功能检测、可用性检查(包括模型下载状态)以及实例创建。创建过程必须通过用户手势启动,并应包括模型下载的进度监控。摘要器API允许将文本浓缩为关键点,简而言之;简短说明、预告或标题,提供格式和长度选项。提示 API 支持多模态交互,接受图片和文本,基于提供的模式生成结构化的 JSON 输出。这确保了结果的可预测性和解析性,消除了对无结构人工智能响应易出错解析的需求。这些基于浏览器的新AI功能应作为渐进式增强实现,而非核心功能。服务器端处理的后备机制或优雅降级至关重要,因为并非所有用户或设备都会支持这些设备端模型。隐私是关键优势,使开发者能够突出本地数据处理。