谷歌首款新智能音箱上市,六年首发售价百元
谷歌宣布旗下时隔近六年推出的首款新智能音箱——Google Home Speaker将于6月25日发布,现已开启预购,售价100美元。新品采用球形外观,覆盖部分再生织物,提供四种配色。内置四核A55处理器及独立NPU,支...
谷歌宣布旗下时隔近六年推出的首款新智能音箱——Google Home Speaker将于6月25日发布,现已开启预购,售价100美元。新品采用球形外观,覆盖部分再生织物,提供四种配色。内置四核A55处理器及独立NPU,支...
法国初创公司Callyope开发了一套基于AI的心理健康监测平台,通过分析仅30秒的语音,识别语速、节奏、语言连贯性等声学特征,辅助临床医生持续追踪抑郁、精神分裂、双相情感障碍等患者的病情变化。相比传统的周期性问诊模式,...
谷歌Pixel手机应用正式向稳定版用户推出自定义"代接留言"问候语功能,此前该功能已在测试版频道上线。用户可录制个性化语音问候,替代来电被自动接听时的默认提示音。功能入口位于主页顶部或设置菜单内,支持录制多条问候语,每条...
AethexAI是一家专注于非洲和中东市场的语音AI初创公司,近日完成300万美元Pre-seed融资,由4DX Ventures领投。该公司由前高盛和Meta员工联合创立,针对当地方言、高通话量和基础设施限制,自主研发...
ChatGPT高级语音模式的创造者Alexis Conneau离开OpenAI后,创办了音频AI初创公司WaveForms AI,并获得由a16z领投的4000万美元种子轮融资。该公司专注于训练自有音频大语言模型,计划于...
Vibe公司推出可穿戴AI设备Vibe Dot,专为企业专业人士设计。该设备搭载五个麦克风,支持最远16英尺的收音范围,可实时捕捉多人对话并同步至Vibe AI应用,自动生成结构化摘要,构建企业知识库。设备续航约30小时...
OpenAI近日推出三款面向开发者的实时语音模型,分别专注于不同应用场景。GPT-Realtime-2基于GPT-5级别能力,支持在实时对话中进行推理、工具调用及中断处理;新翻译语音模型支持70种输入语言和13种输出语言...
谷歌宣布对Google Home进行重大更新,早期访问用户已可使用Gemini 3.1语音助手,该模型支持复杂多步骤语音指令的高级推理。Ask Home功能将扩展至网页端,支持对话式查看摄像头历史记录和创建自动化任务。摄...
NordVPN为其Chrome浏览器扩展推出AI语音检测工具,可实时分析网页音频,判断声音来自真人还是AI生成。检测结果以绿、黄、红三色标注,分别对应人类声音、疑似AI和确认AI语音。该工具仅分析声学特征,不记录、存储或...
硬件公司Nothing近日推出AI语音听写工具Essential Voice,可在任意应用中将语音转为格式化文字,自动去除"嗯""啊"等语气词,并支持自定义语音快捷方式,例如将"我的地址"映射为完整住址。该功能目前已在P...
谷歌周一低调发布离线语音输入应用"Google AI Edge Eloquent",基于Gemma自动语音识别模型,可实现实时转录并自动过滤"嗯""啊"等填充词。应用提供关键要点、正式、简短、详细等文本转换选项,支持本地...
微软推出三款自主开发的商业AI模型:MAI-Transcribe-1语音转录、MAI-Voice-1语音生成和MAI-Image-2图像创建,现已在Microsoft Foundry和MAI Playground平台上线...
谷歌于周一发布了Google AI Edge Eloquent应用,这是一款支持离线工作的AI语音识别工具。该应用能够将不连贯的语音转换为可直接使用的文本,几乎无需编辑。应用采用设备端Gemma模型自动优化文本,消除"嗯...
企业正重新拥抱电话客服,得益于AI技术的进步。云通信公司Twilio通过模块化架构和模型中立性策略,帮助企业将语音AI集成到客服中心。菲律宾航空等案例显示,语音AI不仅将平均等待时间降至1分钟以下,月度客服成本下降30%...
谷歌本周一悄然发布了名为"Google AI Edge Eloquent"的离线优先语音听写应用,与Wispr Flow等竞品展开竞争。该应用免费下载,基于Gemma的语音识别模型支持离线工作。应用可实时转录语音,暂停后...
谷歌最新发布的Home应用更新显著提升了Gemini AI助手的智能家居控制能力。用户现在可以用更自然的描述性语言控制设备,比如说"海洋的颜色"来调节灯光色彩,或直接要求"预热智能烤箱至350度"。Gemini在设备识别...
微软AI首席执行官苏莱曼表示,公司正专注于追求以商业和生产力为核心的超级智能。新发布的MAI-Transcribe-1转录模型支持25种语言,能在嘈杂环境下进行会议转录、视频字幕和呼叫中心分析,GPU成本仅为同类模型的一...
亚马逊Alexa Plus语音助手本周开始支持外卖订餐服务,用户可通过Uber Eats和Grubhub下单。该功能需要Echo Show 8或更大屏幕设备支持,提供实时对话式点餐体验。用户可询问本地餐厅信息、浏览菜单并...
作者在宠物狗占据膝盖空间的情况下,仅使用单手鼠标和语音输入,成功开发了两个复杂的苹果应用程序。通过AI辅助的"氛围编程"方式,开发流程从传统的编辑-构建-测试-调试转变为指令-构建-测试-引导。作者发现大部分开发时间都在...
微软发布三款AI模型:MAI-Image-2图像生成模型支持1024x1024像素分辨率,速度比前代提升一倍;MAI-Transcribe-1语音转录模型速度提升2.5倍,25种语言错误率仅3.9%;MAI-Voice-...