行业资讯
-
RADV 默认为 RDNA3 / VCN4 GPU 启用 Vulkan 视频
Mesa 的 RADV 驱动程序支持 Vulkan Video,可使用这一跨平台的行业标准 API 加速视频编码/解码,但默认情况下搭载 VCN4 IP 的 RDNA3 图形处理器…
-
实时音视频技术作品《读懂实时互动》发布
RTE 实时互动作为一种未来数字生活的基础设施,已经全面深入人们的社交、娱乐、工作、购物等方方面面,并撬动各行各业的价值增长。甚至在当下的 AIGC 热潮中,实时互动也在扮演重要角…
-
Nectar AI 融资 390 万美元,用于打造沉浸式 AI 伴侣
沉浸式 AI 陪伴平台Nectar AI今天宣布已筹集 390 万美元资金。 种子轮融资由Mechanism Capital和Karatage共同领投, Synergis、Mael…
-
汽车巨头 Stellantis 与 Genelec 合作创建沉浸式音频参考实验室
Stellantis是全球知名的汽车制造商之一,最近在班加罗尔开设了自己的最先进的杜比全景声 9.1.6 认证沉浸式音频实验室,由 Genelec 智能主动监听系统提供支持。新实验…
-
萤石云直播间 | 免开发,实现多场景视频监控转直播服务
萤石云直播间,是为企业用户提供多种视频监控转直播服务,包括丰富多彩的集成直播页面、直播管理功能,并提供千万级并发、多节点分发的一站式IoT直播平台,满足各行各业日益增长的传统物联设…
-
Google Workspace Labs 是什么?为什么要使用它?
如果您想率先试用 Google 最新的生成式人工智能功能,请注册加入 Google Workspace Labs 。这个仅限受邀者使用的平台允许用户 “测试 ”最新的 Gemini…
-
GDC的SyncWaveX:利用AI驱动的音频到视频技术重新定义视频制作
在快速发展的视频制作世界中,创新是保持领先地位的关键。科技行业的领跑者 GDC 最近推出了其开创性的产品 SyncWaveX,该产品有望重新定义视频制作领域。SyncWaveX 利…
-
Godot 4.4 Dev 1 带来渲染器改进和 Betsy 纹理压缩
Godot 开源、跨平台游戏引擎作为成熟、专有和以商业为重点的游戏引擎的替代品,继续取得辉煌的进步。今天发布的 Godot 4.4 Dev 1 是这一游戏引擎下一版本的第一个标记开…
-
摩尔线程 × 智汇云舟合作打造视频孪生国产解决方案
摩尔线程与智汇云舟
-
WhatsApp 在 iOS 应用上测试 AR 视频通话效果和滤镜
Meta 旗下 WhatsApp 计划为视频通话引入增强现实 (AR) 功能。据 WABetainfo 报道,在 TestFlight 上提供的 iOS 24.17.10.74 更…
-
BT 集团和 Edgio 推出全球首个支持 MAUD 的 CDN
英国电信集团(BT)宣布与 Edgio 建立合作伙伴关系,将把该公司的 CDN 集成到其 MAUD(Multicast-Assisted Unicast Delivery) 技术解…
-
Persidera 使用 Harmonic 升级 DTT 视频传输
Harmonic 宣布意大利媒体服务提供商 Persidera 已部署该公司的 XOS 高级媒体处理器,以增强其客户的视频传输。 Harmonic 的 XOS 媒体处理器采用 AI…
-
Marshall 推出具有 AI 面部学习功能的 CV612 PTZ
新款 CV612 PTZ 摄像机可利用人工智能面部学习功能自动跟踪、跟随和框定主持人,实现准确、流畅的自我调整操作。这样,PTZ 摄像机便可了解谁是主要拍摄对象,并在其他人或物体进…
-
如何解决 Google Meet 通话质量差的问题
Google Meet 的通话质量很差?我们都经历过。任何会议应用程序(无论多么强大)偶尔都会遇到回声、背景噪音或声音低沉等问题。所有这些因素很快就会导致会议变得相当令人沮丧。 值…
-
Vulkan 1.3.294 版本发布,引入新的管道二进制扩展
Vulkan 1.3.294 版本于上周五发布,对这一高性能图形和计算 API 进行了大量修复和说明。除了维护工作外,Vulkan 1.3.294 还引入了一个新的管道二进制扩展:…
-
AMD 开源 Mesa 24.3 驱动程序实现视频编码大改版
Mesa 24.3 中的视频加速(VA)前端和 RadeonSI/VCN 驱动程序代码中的视频编码处理已重新打上了十几个补丁。此次重做的目的是实现新功能,增强整体驱动程序,并为 H…
-
迈向AGI关键一步,云知声推出山海多模态大模型
云知声推出山海多模态大模型,通过整合跨模态信息,山海多模态大模型能够接收文本、音频、图像等多种形式作为输入,并实时生成文本、音频和图像的任意组合输出。
-
摩尔线程正式开源音频理解大模型MooER
近日,摩尔线程重磅开源了音频理解大模型—MooER(摩耳),该开源项目已在GitHub上公布:https://github.com/MooreThreads/MooER。 MooE…
-
生成式人工智能应用中自动编码器的演变
自动编码器是推动生成式人工智能创新的关键组件之一,它是一种神经网络,随着时间的推移已发展成为生成式人工智能应用中的关键要素。自动编码器旨在通过压缩和重构输入数据来学习高效的数据表示…
-
Sanas 与 Everise 和 Five9 合作,加强联络中心生态系统并扩展以座席为中心的 AI 解决方案
2024 年 8 月 22 日,实时口音翻译技术提供商 Sanas 宣布与全球医疗保健公司客户服务领域的领先企业 Everise 建立独家医疗保健 BPO 行业合作伙伴关系,并与智…