新闻与行业动态

了解语音识别最新技术、AI 私有化部署案例与行业深度解析

新闻资讯

英伟达发布 NeMo-Voice 3.0 企业级套件:Blackwell 架构下语音大模型单机实现 1200 路全双工并发

【算力与系统前沿】英伟达在 GTC 2026 企业技术论坛正式公开 NeMo-Voice 3.0 语音全栈推理微服务。依托全新 Blackwell 架构的 NVLink 5 与 FP4 显存张量核心,单机实现超 1200 路并发实时转录,为超大型政企本地算力数据中心带来极限 TCO 削减。

2026-09-03
阅读更多 →
新闻资讯

微软发布 Azure Voice-Native 3.0 架构白皮书:大模型语音端到端推理时延降至 90ms 与语音大模型合规新挑战

【全球科技快讯】微软正式发布 Azure AI 语音原生(Voice-Native)3.0 架构技术白皮书,披露了全双工语音交互中 90ms 的极限端到端流式推理指标。然而面对跨国金融与医疗客户时,公有云数据出境审计正加速推动语音大模型私有化部署的选型浪潮。

2026-08-31
阅读更多 →
新闻资讯

联想发布 ThinkStation AI 工作站边缘语音一体机:搭载自研 NPU 加速卡,智能语音交互单机承载 500 路高并发

【前沿硬件】联想在 Tech World 2026 正式发布面向企业级边缘计算的 ThinkStation AI 语音计算一体机,内置自研 NPU 声学加速卡与开箱即用的离线声学大模型,单台 4U 设备支持 500 路电话实时并发听写,赋能工业调度与指挥中心脱网自治。

2026-08-31
阅读更多 →
新闻资讯

中国人民银行印发《金融科技数据出域合规指引》:证券银行双录系统语音识别私有化部署全面进入整改倒计时

【政策快报】中国人民银行金融科技委员会正式印发《金融机构生物特征与敏感语音数据安全合规指引》,明确要求商业银行、证券公司及保险机构的柜面双录、远程开户与理财电销录音须在自有机房实现物理闭环转写,语音识别私有化部署进入全面落地整改期。

2026-08-31
阅读更多 →
新闻资讯

开源黑马 Qwen2-Audio-72B-Instruct 正式开源:中文多模态音频理解全面超越商业闭源,离线语音识别迎来大模型革命

【开源前沿】阿里通义千问团队宣布完整开源 Qwen2-Audio-72B-Instruct 全量模型与硬件感知量化权重,支持 128k 超长音频上下文推理,在中文多方言语音识别评测中刷新记录,单卡 INT4/FP8 即可稳定运行,离线语音识别迎来大模型时代。

2026-08-31
阅读更多 →
新闻资讯

特斯拉发布 Optimus Gen-3 具身智能语音交互大脑:端侧超低延迟 ASR 与多麦克风阵列抗噪实测

【具身智能前沿】特斯拉在 AI Day 2026 上全面展示了人形机器人 Optimus Gen-3 的具身智能语音交互系统,搭载车载级 FSD 芯片运行本地声学神经网络,在 85 分贝工业高噪车间中实现 35ms 极速语音口令解析,端侧离线语音识别与空间声源定位成为产业焦点。

2026-08-30
阅读更多 →
新闻资讯

Anthropic 发布 Claude 4 原生多模态音频流接口:企业级长语音推理新标杆与语音大模型架构演进

【全球快讯】Anthropic 官方正式上线 Claude 4 实时全双工多模态音频推理 API,支持长达 4 小时复杂会话的端到端声学推理与情感追踪,中文 ASR 识别准确率刷新记录。然而公有云数据出域隐忧正加速驱动企业自建语音大模型私有化部署。

2026-08-30
阅读更多 →
新闻资讯

开源声学里程碑:Whisper-Next 官方正式发布,端侧离线语音识别推理能效提升4倍

【开源前沿】OpenAI 联合全球开源声学社区正式发布新一代语音大模型 Whisper-Next,采用局部线性注意力机制与轻量化神经编解码器,单卡推理吞吐提升 400%,常驻显存仅需 1.2GB,端侧离线语音识别在工控与移动设备中迎来规模化落地窗口。

2026-08-30
阅读更多 →
新闻资讯

国家发改委与工信部联合印发《关键基础设施信创改造行动方案》:语音识别私有化部署成政务金融验收硬指标

【政策解读】国家发改委、工信部等多部委联合印发新版《关键信息基础设施信创安全改造升级行动方案》,明确要求涉及公共安全、金融双录、政务热线及医疗健康等领域的智能语音系统必须在自有机房实现物理隔离与全栈国产化适配,语音识别私有化部署正式成为行业验收必检项。

2026-08-30
阅读更多 →
上一页 1 ... 3 4 5 6 7 ... 41 下一页