-
AVS工作组视频组组长马思伟:二十七年坚守,让更多人看到“超高清”世界
2026年是北京大学博雅特聘教授、计算机学院党委副书记马思伟的“丰收年”。5月他获得北京市“最美科技工作者”称号,6月,他牵头团队的科研研究成果“视觉感知编解码关键技术及超高清视频…
-
摩尔线程完成开源库CV-CUDA在MUSA上的兼容支持 助力国产GPU视觉计算生态升级
随着多模态大模型、视频理解、内容生成和工业视觉等场景快速发展,图像与视频数据的高效处理正成为AI应用的重要基础能力。近日,摩尔线程完成开源库CV-CUDA在MUSA上的兼容支持,使…
-
Five9 赢得价值 1 亿美元的金融服务 CCaaS 合同
Five9 已与财富 100 强金融服务公司达成一项价值约 1 亿美元的重大 CCaaS 交易。 根据这项为期五年的协议,Five9 将作为该组织更广泛的云迁移计划中的核心客户体验…
-
Infobip:菲律宾企业聊天应用市场呈现强劲增长
根据 Infobip 发布的《2026 年即时通讯趋势报告》,随着菲律宾企业越来越多地使用即时通讯应用程序与客户沟通,Viber 和 WhatsApp 的市场份额正在不断增长。 全…
-
TAG Video Systems 优化内存使用,降低总体拥有成本
TAG Video Systems 已优化了内存的使用,从而降低了运行其软件的总体拥有成本,使压缩视频工作流的每通道成本降低了多达三分之二。 TAG 一直致力于为客户提供最低的每通…
-
BCE将在IBC2026上展示端到端的自主云媒体供应链
欧洲广播中心 (BCE) 将在下个月的 IBC2026 上展示端到端的自主云媒体供应链。 该公司表示,该生态系统由 Scaleway 和 Ateme 合作构建,旨在通过提供可靠的替…
-
Twilio第二季度营收超出预期11%
Twilio 2026 年第二季度业绩超出预期,盈利 15 亿美元,随后将其 2026 年营收预期上调 14-15% 至 18-18.5%。 该公司将 17% 的自然增长归功于即时…
-
广告订阅将占据北美流媒体收入的大部分
根据 Ampere Analysis 的预测,到 2026 年底,广告支持的订阅层级预计将占北美订阅流媒体收入的 54%。 这些计划带来的订阅和广告总收入预计将在年内超过450亿美…
-
Qt Toolkit 将推出边缘 AI 子模块,最初用于基于 Qt 的视觉 AI
近期,Qt 团队一直在致力于为 Qt 工具包开发各种 AI 集成,例如用于智能体开发的 QML 分析器技能,以辅助性能分析。他们还开发了Qt AI 编码助手和Qt Creator集…
-
Meta 发布 Muse Glimmer,称其为 300 亿开放代理模型
Meta Superintelligence Labs(Meta Superintelligence Labs)10 日宣布,他们发布了新一代大型语言模型 Muse Glimmer…
-
NDI 协议:它是什么以及如何用于直播
NDI(Network Device Interface,网络设备接口)正在变革视频制作领域,它使通过标准 IP 网络传输高清、低延迟视频成为可能,用大多数设施已有的以太网基础设施…
-
对话式 AI 如何改变客户互动方式
人工智能正在重塑企业与客户沟通的方式。从最初简单的自动回复,如今已发展为能够理解上下文、提供个性化推荐、并在多个数字渠道为用户提供支持的智能会话系统。 如今,各组织投资对话式 AI…
-
WebRTC Android 端 + iOS-Android 跨平台音频通话实战
iOS WebRTC 跑通了,但 Android 端的依赖、权限、Camera2 采集、前后摄切换,和 iOS 完全是两个世界。本文用 Claude Code 写 Android …
-
Sinch 在澳大利亚将 MessageMedia 更名为 Sinch Engage
Sinch 已将 MessageMedia 更名为 Sinch Engage,结束了 MessageMedia 品牌在澳大利亚市场 20 多年的历史。 此次品牌重塑进一步将该公司整…
-
开源FreeSWITCH新模块mod_earshot,通过WebSocket将实时通话音频流式传输到AI代理
想把真正的 AI 语音代理接入真实电话线路部署在用户自己的基础设施上,而不是黑盒SaaS吗?开源的模块可能解决这个痛点-mod_earshot。 如果用户的FreeSWITCH或者…
-
swXtch.io 的新应用“无需 IP 音频编解码器硬件”
swXtch.io 推出了 groundSwXtch for Audio over IP (AoIP),这是一款软件应用程序,使广播公司和媒体机构能够通过标准 IP 网络(包括公共…
-
NVIDIA 发布 NemotronLabs VoiceChat 11B:一款开放式全双工语音对语音模型
NVIDIA 发布了NemotronLabs VoiceChat 11B,这是一款开源的 11B 端到端语音模型,支持实时全双工对话。它无需像传统 ASR、LLM 和 TTS 那样…
-
HuggingFace 开源speech-to-speech,支持本地部署
HuggingFace发布语音到语音:使用开源模型构建语音智能体,用户可以在本地构建语音 AI 智能体! HuggingFace的speech-to-speech 是一个完全模块化…
-
Arqiva 完成 DAB 平台升级
Arqiva 已完成英国商业数字无线电基础设施向其新的中央编码和复用系统的迁移。 这项为期多年的计划涵盖全部 62 个 DAB 多路复用器和 1000 多个广播服务,为商业数字广播…
-
Vulkan 1.4.359 扩展了协作矩阵功能
Vulkan 1.4.359 于 8 月 7 日发布,此次为期一周的 Vulkan API 规范更新带来了一项新的扩展,用于增强协作矩阵的功能。 早在 2023 年的 Vulkan…