-
摩尔线程开源高性能MATE算子库 释放全功能GPU算力潜能
摩尔线程MATE(MUSA AI Tensor Engine)是面向生成式AI的开源高性能算子库,聚焦大模型训练与推理的核心计算路径,为上层模型与推理框架提供高性能、易集成、强兼容…
-
调查显示,14% 的人考虑因体育赛事直播延迟而更换服务提供商
Big Blue Marble 发布了一项新的国际研究,表明技术性能已成为流媒体收入的直接驱动因素。在对七个主要市场的 5027 名消费者进行的调查中,14% 的体育赛事直播观众表…
-
RTP 抖动详解:语音 AI 平台如何解决它
实时传输协议(RTP)抖动,是互联网通话上一秒还清晰无比、下一秒就支离破碎的原因,它是互联网上唯一一种没有“第二次机会”的实时媒介。 网页加载慢 200 毫秒,没人会在意;视频卡顿…
-
Epic Parties 让 Fortnite 语音聊天打通整个 Epic 生态
Epic Parties 已正式上线。现在你可以与好友在 Fortnite、Epic Games 启动器和 Epic 移动应用之间组队并语音聊天。Fortnite 支持其所有平台,…
-
H Company 发布 NeoMME 260M/800M 单塔多模态编码器,取消视觉塔和因果解码器
H Company 发布 NeoMME 系列多模态编码器,包含 260M 和 800M 两个双向 Transformer 模型,用单一塔处理多语言文本和 32×32 图像块,去掉了…
-
Broadpeak通过在巴西部署新的HyperPoP,扩展了面向大规模流媒体的CDNaaS服务
流媒体和规模化变现领域的服务商 Broadpeak 正在扩展其内容分发网络即服务 (CDNaaS) 服务, 在巴西部署了七个新的 HyperPoP 节点。此次部署提升了Broadp…
-
nanocosmos在2026年IBC展会上发布了扩展的实时视频平台
德国实时视频解决方案提供商 nanocosmos 在 IBC 2026 上展示了一个扩展平台,目标客户是依赖交互式、低延迟视频而不是传统广播的企业。 这家总部位于柏林的公司推出了一…
-
Ateme 和 Comcast Technology Solutions 在实时视频传输方面展开合作
Ateme 和 Comcast Technology Solutions (CTS) 宣布合作,将双方的托管服务和媒体技术相结合,以实现优质的实时视频传输。 根据协议,CTS 将把…
-
Shotcut 26.9 视频编辑器 Beta 版带来用户界面改进和更佳的音频质量
继近期 Shotcut 稳定版发布,新增素材库及其他改进之后,Shotcut 26.9 Beta 版今日正式发布,为这款适用于 Linux、macOS 和 Windows 系统的开…
-
Vulkan 1.4.362 版本发布,新增了两个 Vulkan API 扩展
Vulkan 1.4.362 于 9 月 4 日发布,作为最新的例行规范更新。除了修复一些 bug 之外,Vulkan 1.4.362 最引人注目的是新增了两个 Vulkan AP…
-
蚂蚁 inclusionAI 开源 6B 统一图像生成与编辑模型 LLaDA-Image
蚂蚁 inclusionAI 发布开源统一图像生成与编辑模型 LLaDA-Image,提供 50 步 Base 和 4 步蒸馏 Turbo 两类 checkpoint,均有 BF1…
-
OpenVX 1.3.2 发布:更精确的错误信息、更好的一致性以及为 2.0 版本奠定的基础
Khronos 发布了 OpenVX 1.3.2,这是对开源、免版税标准的更新,该标准采用基于高级图形的框架,提供可移植、高效的视觉处理。此次更新重点加强了错误处理,提高了兼容性,…
-
2026 保险双录厂家推荐:看即构智能双录如何解决保险行业痛点
保险双录,正在从”可选动作”变成”必答题”。 自 2017 年原保监会发布《保险销售行为可回溯管理暂行办法》(保监发〔2017〕54…
-
美团智播:数字人直播技术创新与实践
一场 7×24 小时不间断的直播,对真人主播团队意味着高昂人力成本,对百万中小商家更是一道难以迈过的门槛;而“一眼假”的数字人——面部僵硬、动作循环、手势与语音脱节——又留不住观众…
-
谷歌在 Gmail、Docs 和 Keep 中推出 AI 语音功能
谷歌正在 Docs、Gmail 和 Keep 中推出对话式 AI 功能,使用户能够询问有关收件箱和文档的问题,以及使用自然语言查询和语音输入来执行任务。 该公司在五月份的 Goog…
-
Witbe 推出用于视频测试自动化的 AI 模型
Witbe 发布了 Witbe VLMs,这是一系列由 Witbe 自主研发和训练的视觉语言模型,可用于在任何设备上实现视频测试自动化。一年前,Witbe 将智能体测试引入视频服务…
-
Qwen Audio:复杂人声干扰下,如何让 ASR “听对人”
在安静环境里,语音识别的问题很直接:用户说什么,模型就转录什么。但在会议、车内或咖啡厅里,用户的声音经常会和旁人交谈一起进入麦克风。 假设用户说“打开导航”,旁边的人同时说“我们明…
-
研究:如果直播平台能为体育赛事报道增添价值,观众愿意容忍延迟
一项针对体育赛事直播延迟问题的新研究表明,如果直播平台提供额外的价值,例如完整回放、其他拍摄角度或个性化精彩集锦,观众愿意原谅延迟问题。 Big Blue Marble 的一项研究…
-
Kaltura 和 Verimatrix 在 OTT 内容安全方面展开合作
视频技术公司 Kaltura 和内容保护提供商 Verimatrix 已达成战略合作伙伴关系,以加强 OTT 和云电视服务的内容保护。 该协议将Kaltura的云电视平台与Veri…
-
Accedo 和 MediaKind 联合推出面向运营商的流媒体平台
Accedo 和 MediaKind 推出了一款白标端到端流媒体平台,旨在帮助付费电视运营商在联网电视、移动设备、网络和机顶盒上推出和管理品牌服务。 该解决方案结合了 Accedo…