技术文章
-
嵌入式音视频开发面试过程遇到的问题!
今天继续给大家分享音视频面试过程会被常问到的一些问题! 面试的具体题目 1、说一下播放器的设计过程 这里的话主要分以下几步完成: 开启一个线程进行解封装操作 , 这包括:读取音频、…
-
实时互动下视频 QoE 端到端轻量化网络建模
在实时视频互动中,影响观众对视频体验的有较多且复杂的因素,包括:画质、流畅度以及与其耦合的观看设备等。传统客观算法会利用网络传输或编解码参数拟合接收端人的感知体验,或者使用图像质量…
-
uniapp音视频通话SDK接入指南(uniapp音视频开发系列2)
本文分享即构uniapp音视频SDK接入指南。即构 uni-app SDK 是一个基于 ZegoExpressEngine 原生 Android 及 iOS SDK 的 uni-a…
-
探索标清流媒体直播: 标清流媒体的优点和缺点
SD Live Streaming代表标清直播,既有优点也有缺点。从积极的方面来看,标清流媒体与各种设备兼容,可以为广大观众所用。它需要更少的带宽,导致更快的加载时间和更少的缓冲。…
-
在Chrome、Firefox、Edge和其他iOS上的WebRTC
从iOS 14.3开始,现在可以使用Chrome或替代Safari的WebRTC兼容浏览器,与iPad或iPhone进行音频和视频通话。这是一个伟大的改进,将帮助我们在移动设备上构…
-
如何实现音视频录制和RTMP直播推拉流
音视频录制 1、录音 通过条件编译识别pc或者mac: 根据short_name寻找自己的采集图像设备,short_name可以是硬件名称或编码格式h264、aac等。以下是简单的…
-
视频流媒体中如何个性化和负责任的使用数据
个性化是一个成功的流媒体视频服务的基石之一。它提供了显著的用户利益,提高了观众在每个接触点的体验。但是,有效的个性化可能需要大量的数据,只有通过访问和分析关于观众及其使用习惯的大量…
-
IM专题:模型分析(3)—读写扩散模型
读写扩散模型,即读扩散和写扩散模型; 读扩散,也叫拉取模型,描述对数据进行读取操作时,有更多的读取动作; 写扩散,也叫推送模型,描述对数据进行写入操作时,有更多的写入动作。 IM …
-
OpenGL 转场特效都是怎么实现的
前言 转场效果在视频编辑工具中最为常见,在两段视频或图像之间增加一个「过渡」的效果,可以让整个过程更佳柔滑自然。常见的转场如渐变过渡、旋转、擦除等(下图为 iMovie 自带转场)…
-
音视频编解码–多媒体格式系列开篇
前面一个系列,我们介绍了图像的编解码和文件格式,在接下来的系列中,我们将会涵盖多种音视频文件和编码格式,包括但不限于MP4、AVI、MKV、H.264、AAC、MP3等。通过深入了…
-
SRS的vhost概述及示例
vhost概述 Vhost(Virtual Host)就是虚拟域,用来隔离客户或业务。 Vhost的主要应用场景包括: 总结:vhost作为应用配置的单元,能隔离客户,应用不同的配…
-
媒体传输协议的演进与未来
音视频应用近年来呈现出迅猛的发展趋势,成为互联网流量的主要载体,其玩法丰富,形态多样,众多繁杂的媒体传输协议也应运而生。LiveVideoStackCon 2022北京站邀请到快手…
-
移动边缘云计算网络中基于推荐的边缘缓存的联邦深度强化学习丨论文分享
1 研究背景 目前,大量终端设备接入互联网以在无线网络中实现各种服务和应用(如内容访问、虚拟导航/管理和环境监测),这不可避免地导致严重的骨干网络拥塞,并降低用户的服务质量。 为了…
-
使用 C++ 和 GStreamer 将 RTMP 推流到本地
之前文章《使用GStreamer将网络摄像头数据传输到RTMP服务器》展示了如何将本地网络摄像头流式传输到 RTMP 服务器,这次我将向您展示如何使用 C++ 和 GStreame…
-
InstructPix2Pix: 用于图像编辑的动态扩散模型 | CVPR 2023
这篇论文提出了一种协作扩散模型,无需重新训练已有的单模态扩散模型便可实现多模态的人脸合成与编辑。具体而言,作者提出了动态扩散器,这个扩散器通过预测每个预训练的单模态模型的空间-时间…
-
微软推出 Hierarchical Transformer 实现更高准确率的语音评测
对于语言学习者来说,练习发音并获得及时准确的反馈,是提高口语水平的重要环节。多年来,微软一直深耕基于 Azure 认知服务的语音功能,不断优化语音评测[1]功能的底层技术,从准确率…
-
Meta VR专利探索根据肢体动作来启动调用体育App应用
在XR沉浸式现实中,允许用户轻松方便地启动生成相关应用程序是一个问题,比如说体育领域。在名为“Motion-based generation of applications in …
-
主流WebRTC的SIP支持包评价:SIP.js,Js SIP, SIP ML5和QuoffeSIP对比,js sip得分最高
WebRTC是目前和SIP进行完美结合的典范,同时能够极大增加用户浏览器应用场景,通过浏览器实现了很多用户的需求,例如页面集成呼叫功能,对接其它终端设备等。目前,因为浏览器的兼容性…
-
容器格式(MP4、CMAF、MPEG-TS、Matroska)通用指南
容器格式是一种将多个数据流嵌入到单个文件中的方式,常用于在线视频、下载电影或使用流媒体服务中。常见的容器格式包括MP4、MKV、AVI和MOV等。本文从基本的专业术语到各种容器文件…
-
为什么我们能判断声音的远近 – 初始时间延迟差的作用
在文章(为什么我们能判断声音的远近)中我们说到,在听觉信号中存在着一些线索可以供我们来判断声源的距离远近。这篇文章就以其中的一个线索–初始时间延迟差为例,来介绍应该如何…