-
哪些音频平台能触达 Z 世代?
要点总结 Z世代在哪些方面享受音频? 营销人员通常认为 Z 世代是社交优先的一代,但实际情况要广泛得多。 音频对于Z世代了解文化、获取信息、与社群建立联系以及应对日常生活至关重要。…
-
超越 VVC:下一代视频编码方案征集
国际电信联盟(ITU)、国际标准化组织(ISO)和国际电工委员会(IEC)正在寻求能够显著超越当前通用视频编码(VVC)标准的创新技术,并已发出下一代视频压缩技术提案征集通知。 正…
-
音视频同步没那么简单
画面和声音对不上、嘴型比声音快 200ms、声音比动作早半秒,这些在音视频开发中太常见了。但 A/V 同步不是「调个参数」能解决的:它涉及采集时钟、编码延迟、网络抖动、渲染缓冲,每…
-
字节跳动 Seed 正式推出原生音视频全双工大模型 SeedRealtime
今天,字节跳动 Seed 正式推出原生音视频全双工大模型 SeedRealtime。 作为走向全模态交互的关键一步,SeedRealtime 用统一架构原生融合音频、视频与文本,能…
-
Thunder与AWS签署战略合作协议,共同提供AI驱动的联络中心解决方案
2026 年 8 月 4 日,Thunder 宣布与亚马逊网络服务 (AWS) 达成战略合作协议 (SCA),以帮助企业加速部署可扩展的、AI 驱动的客户体验解决方案。 通过这项协…
-
诺基亚开源首个 AI 视频增强标准
诺基亚已将其神经网络后处理滤波器 (NNPF) 开源,将首个基于 AI 的视频增强技术引入国际视频标准,并利用现有编解码器而非专有解决方案实现更高质量的流媒体播放。 诺基亚已将其 …
-
思科 IT 如何利用 AI 实现语音安全现代化
企业语音面临的威胁形势正在不断演变。 了解思科 IT 如何利用 AI 大规模消除 隐性成本中心和合规风险。在监管机构或欺诈者迫使我们采取行动之前,将通话欺诈减少 70%,并将人工调…
-
实现视频“边播边改”,京东开源JoyAI-Video-Edit模型,性能全球领先
直播间里,服饰主播试完白色上衣,观众又想马上看到蓝色款是什么效果,可蓝色款不在身边怎么办?视频聊天时,和朋友畅想穿越到古代当侠客,怎么能让美好的想象瞬间变为精美视频呈现给大家?&n…
-
体育赛事直播的关键时刻:各方竞相寻求更优方案
如今,消费者几乎可以通过各种 OTT(over-the-top)服务观看到几乎所有类型的体育赛事直播。但问题是:服务提供商能否吸引到足够多的观众,让自己的体育赛事直播豪掷有所回报?…
-
观点:欧洲数据主权与云计算
BCNEXXT 的 Graham Sharp 撰文指出,媒体机构必须妥善应对云服务在技术和财务上的依赖关系,才能维护数据主权、运营独立性以及对基础设施的长期掌控权。 欧盟在云计算和…
-
Spotify付费用户突破3亿,收入持续攀升
Spotify 已成为首个高级订阅用户突破 3 亿的音频流媒体服务,这推动其季度收入达到 48 亿欧元,该公司继续受益于订阅价格上涨和用户数量的增长。 该流媒体平台第二季度末付费用…
-
三星和 Prime Video 联合推出 HDR10+ 高级流媒体格式
三星电子和 Prime Video 推出了 HDR10+ ADVANCED,这是 HDR10+ 图像标准的新版本,旨在提高兼容电视的亮度、运动处理和整体图像质量。 Prime Vi…
-
腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别
今天,腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview。 基于最新一代大语言模型 Hy3 的语言理解能力,Hy ASR 3.0 preview 融合高精度语…
-
BBC、ITV 与 Shure 如何塑造沉浸式现场音乐直播的未来
随着音乐节不断拓展其数字化影响力,一项全新的跨行业创新项目正在探索能否将沉浸式技术推向更高层次。该项目名为 IFeL:沉浸式音乐节直播——大规模远程在场(Immersive Fes…
-
ZEGO 实时互动 AI Agent 2.13.5 发布:实时播报数字人正式上线,支持 CDN 拉流
ZEGO 实时互动 AI Agent 迎来 2.13.5 版本更新。本次版本核心亮点是新增实时播报数字人能力,一种区别于互动数字人的全新 Agent 类型,专注于单向内容输出场景,…
-
论文解读|ECoM-Reasoning:让端到端的语音大模型学会轻量级推理
以 GPT-4o、Moshi、GLM-4-Voice、Qwen-Omni 为代表的端到端语音大模型(SLM)正在推动人机交互迈向“开口即对话”的新阶段。然而,在需要精确、结构化推理…
-
Cisco Webex 与 8×8:统一通信和客户体验背后的企业平台之争
Cisco 的目标客户是希望在单一指挥层下管理统一通信、联络中心、设备和 AI 的企业级买家。而8×8的目标客户则是厌倦了集成工作、希望统一通信即服务(UCaaS)、联络中心即服务…
-
对讲方案选型、硬件链路、音频引擎、RTP/WebRTC,到弱网、AEC 与量产测试的完整技术拆解
本文从产品选型开始,逐层拆解端侧硬件、软件架构、网络协议和音频算法,并给出一套适合嵌入式 Linux 平台的推荐落地音频对讲方案。
-
Avaya任命Jeff Clarke为首席执行官,Patrick Dennis为执行董事长
2026年8月3日,Avaya 任命拥有 30 年企业技术经验的 Jeff Clarke 为首席执行官,Patrick Dennis 继续担任 Avaya 执行董事长。Clarke…
-
GPT-Live 如何在六个月内构建响应式语音 AI 实时系统
OpenAI 推出 GPT-Live,实现与 AI 的连续语音交互。该系统采用无轮次语音模型和低延迟架构,使对话更快、更自然。GPT-Live 的构建耗时六个月,核心在于减少交互延…