Monday, August 11, 2008

mobilní telefony

První
symbol obsahuje údaj o počtu
nul (délka běhu - Run
Length) a počtu bitů
potřebných pro kódování
koeficientu. Druhý symbol
vyjadřuje hodnotu
koeficientu v binární podobě.
Z důvodů dalšího snížení
redundance signálu se pro
kódování prvního symbolu
používá Huffmanův kód
(entropické kódování,
kódování s proměnnou
délkou slova VLC - Variable
Length Coding). Často se vyskytující symboly jsou kódovány krátkými slovy, zatímco
sporadicky se vyskytující symboly jsou naopak kódovány dlouhými slovy. Druhý symbol je
vyjádřen binárním kódem. Od jistého koeficientu, označovaného EOB (End of Block)
obsahuje sériový tok dat již pouze samé nuly. Stejnosměrný koeficient se může přenášet
samostatně nebo jako diference mezi hodnotou koeficientu současného a předchozího bloku.
Pro přenos signálu lze použít dva způsoby. Při sekvenčním módu se všechny
koeficienty jednoho bloku snímají postupně za sebou, a to se opakuje pro všechny bloky
obrazu. Doba přenosu celého obrazu je dlouhá. Mód progresivního kódování se používá při
prohlížení řady obrazů, kdy je vhodné pro hrubou orientaci zobrazit obraz bez podrobností.
Nejdříve se tedy přenášejí postupně ze všech bloků stejnosměrné koeficienty, poté první
střídavé koeficienty zase ze všech bloků, druhé koeficienty, atd. Obraz se postupně obohacuje
o podrobnosti (často užívaný způsob přenosu obrazů na síti Internet).
Popsané transformační kódování se používá u systémů JPEG (komprimační poměr 8
až 15) a MPEG. U
kódování pohyblivých obrazů se dosahuje další výrazné redukce redundance signálu v časové
oblasti využitím DPCM s podporou tzv. vektorů pohybu. Pro tyto operace se jasový signál
zpracovává v makroblocích. Jeden makroblok (16x16 vzorků) obsahuje čtyři jasové bloky a je
doplněn jedním blokem každého chrominančního signálu. Na výstupu součtového členu
v kodéru se vytváří rozdíly hodnot vzorků signálů právě kódovaného a předchozího
snímku. K dekodéru je přenášen pouze rozdílový signál. V případě, že dva po sobě jedoucí
snímky jsou identické (statická scéna), je diferenční signál nulový a nastává výrazné snížení
bitového toku signálu.
Plynulý sled snímků na vstupu kodéru je rozdělen na skupiny snímků GOP (Group of
Pictures), které se opakují obvykle po 12 snímcích (cca 0,5 s). Na začátku každé skupiny je
přenášen referenční snímek I (Intra frame), který se zpracovává bez predikce (bez DPCM),
pouze pomocí FDCT. Toto opatření umožňuje libovolný přístup k signálu (změna programu,
zapnutí TVP, atd.).
Ostatní snímky skupiny
mohou být snímky P
(Predict frame) nebo
snímky B (Bidirectional
frame). Při zpracování
snímku P se vytváří a
přenáší diference právě
kódovaného snímku P a
předchozího snímku I
nebo předchozího snímku
P. Touto dopřednou
jednosměrnou predikcí se
sníží přenosová rychlost
signálu asi dvakrát. Při
zpracování snímku B se
vytváří a přenáší
diference právě
kódovaného snímku B a
průměru vytvořeného
z minulého snímku (I
nebo P) a snímku (I nebo
P), který následuje po právě kódovaném snímku B. Obousměrnou predikcí se sníží přenosová
rychlost signálu až osminásobně. Poněvadž pro vytváření i rekonstrukci snímků B je třeba
znát snímky nejen předcházející, ale i následné, je nutné snímky před a po kódování vhodně
přemístit. Přenos rozdílových signálů se potom uskutečňuje v jiném sledu než odpovídá
sekvenci původních snímků.

Thursday, August 7, 2008

16
. ). 1 2 ( cos .
16
. ). 1 2 ( cos ). , ( ). ( ). (
4
1 ) , (
7
0
7
0
π π v y u x y x g v C u C v u G
y x
+ +
= ∑ ∑
= =
, (2.3)
16
. ). 1 2 ( cos .
16
. ). 1 2 ( cos ). , ( ). ( ). (
4
1 ) , (
7
0
7
0
π π v y u x v u G v C u C y x g
v u
+ +
= ∑ ∑
= =
, (2.4)
kde ) , ( y x g je diskrétní funkce v prostorové oblasti, ) , ( v u G je diskrétní funkce v kmitočtové
oblasti, y x, jsou souřadnice v prostorové oblasti, v u, jsou souřadnice v kmitočtové oblasti,
( ) ( ) 707 , 0 = = v C u C pro 0 = = v u , ( ) ( ) 1 = = v C u C pro u >0 , v >0 . Výsledky transformace
pro různě korelované vzorky signálu jsou nakresleny na obr. 2.10 a obr. 2.11. Čím více budou
parametry obrazových bodů navzájem závislé, tím menší bude počet koeficientů po
transformaci (i jejich velikost) a výsledná přenosová rychlost signálu se výrazně sníží [13].
Frekvenční koeficient v pozici (0,0) představuje stejnosměrnou složku (střední
hodnotu) transformovaného signálu. V ní je soustředěna téměř celá energie signálu bloku.
Směrem k pozici (8,8) se zvyšuje kmitočet frekvenčních koeficientů, avšak jejich velikost
(některé mohou být i záporné) se většinou zmenšuje. Velikost koeficientů se po transformaci
upravuje kvantováním, tj. dělí se čísly v tzv. kvantizační matici. Ta je na základě statistických
výsledků pozorování experimentálně zvolena tak, aby koeficienty vyšších kmitočtů byly více
zmenšeny než koeficienty nižších kmitočtů (irelevantní části signálu). Výsledek dělení se
zaokrouhluje na celé číslo, malé koeficienty se zanedbávají. Tato úprava signálu je ztrátová.
Kvantizační tabulky pro jasový a chrominanční signál jsou různé a jejich obsahem lze měnit
kvalitu rekonstruovaného obrazu resp. komprimační poměr.
28 Rádiové a mobilní komunikace
Matice frekvenčních
koeficientů (po kvantování)
se vyčítá podle úhlopříčky
(cik-cak) což s výhodou
odpovídá postupnému
zmenšování hodnot
koeficientů se zvětšujícím se
kmitočtem. Kódují se
skupiny skládající se
z nenulového koeficientu a
počtu předcházejících nul.
Skupina je charakterizována
dvěma symboly.

Friday, August 1, 2008

Zdrojové kódování obrazových signálů
Při snímání barevných obrazů v kvalitě odpovídající běžnému televiznímu vysílání se
vytváří analogový jasový signál s kmitočtovým rozsahem 0 až 6 MHz (norma CCIR-D,K) a
dva analogové chrominanční signály s kmitočtovými rozsahy 0 až 1,6 MHz. Při digitalizaci
těchto signálů pomocí PCM je podle doporučení ITU-R 601 vzorkovací kmitočet pro jasový
signál 13,5 MHz a pro chrominanční signály je vzorkovací kmitočet 6,75 MHz. Jednotlivé
vzorky jsou kvantovány 8 bity, tj. do 256 kvantovacích úrovní. Bitová rychlost jasového
signálu je s Mbit / 108 a každý chrominanční signál má bitovou rychlost s Mbit / 54 . Všechny
Rádiové a mobilní komunikace 27
tři signály jsou multiplexovány do jednoho výsledného toku, jehož přenosová rychlost je
s Mbit / 216 (108+54+54). Při redukci bitové toku signálů statických obrazů se nejčastěji
využívá metody transformačního kódování. U pohyblivých obrazů se navíc využívá při
redukci i tzv. vektorů pohybu a predikce snímků nebo půlsnímků.
Před transformací jsou jednotlivé matice obrazový bodů pro jasový a dva
chrominanční signály (u systému JPEG má jasová matice 720 sloupců a 576 řádků, obě
chrominanční matice mají počet řádků i sloupců poloviční) rozděleny na bloky, nejčastěji 8x8
bodů (celkem 64 obrazových bodů – pixelů, pelů). Rozměry bloků jsou stanoveny jako
kompromis mezi výslednou kvalitou rekonstruovaného obrazu a složitostí resp. dobou
výpočtu. Bloky jasového i chrominančních signálů se zpracovávají stejným způsobem avšak
odděleně. Jednotlivé vzorky bloku jsou reprezentovány koeficienty (hodnota jasu nebo
chrominance) v časové oblasti, které jsou transformací (tj. přepočítáním podle jistých
pravidel) transformovány na jiné koeficienty v kmitočtové oblasti. Původní vzájemná
závislost jednotlivých koeficientů (v důsledku korelace parametrů obrazových bodů) je
transformací odstraněna, přičemž počet nových koeficientů (nenulových) je menší než počet
koeficientů původních. Z několik možných transformací (např. Karhunen - Loeveho,
Walshova - Hadamardova, aj.) se jako kompromis mezi přijatelným výsledkem a složitostí
realizace nejčastěji používá dvourozměrná diskrétní kosinová transformace DCT (Discrete
Cosine Transform), kterou lze odvodit z diskrétní Fourierovy transformace vhodnou
substitucí. Pro blok 8x8 bodů platí pro přímou DCT (FDCT) a inverzní DCT (IDCT)
transformační vztahy

Wednesday, July 30, 2008

MPEG 1 – úroveň 1 (Audio Layer 1) je nejjednodušší avšak pro nejkvalitnější signál
poskytuje jen malou redukci přenosové rychlosti, např. ze s kbit / 768 na s kbit / 448 .
MPEG 1 – úroveň 2 (Audio Layer 2) vychází ze systému MUSICAM (Masking pattern
MPEG 1 – úroveň 3 (Audio Layer 3) Používá modifikovanou diskrétní kosinovou
transformaci MDCT. Dále snižuje bitovou rychlost, ale dekodér je složitý.
MPEG 2 – úrovně 1, 2 a 3. Používá se v systému DVB (Digital Video Broadcasting)
pro přenos několika kanálů zvukového doprovodu (pěti až šesti kanálový Dolby
Surround Sound). Používá poloviční vzorkovací frekvence než MPEG1. Při nízkých
přenosových rychlostech je jakost zvuku lepší než u MPEG1.
Nejjednodušší zdrojové kódování umožňuje systém MPEG 1 – úroveň 1. Blokové
schéma kodéru je nakresleno na obr. 2.9. Analogový akustický signál se nejdříve pomocí
modulace PCM převádí na signál digitální. Výsledná přenosová rychlost pro monofonní
signál, vzorkovací kmitočet 48 kHz a kvantování do 65536 úrovní, tedy pomocí 16 bitových
slov, je s kbit / 768 . V kodéru je signál rozdělen do skupin po 384 vzorcích (již v digitální
formě), tedy po 6144 16 . 384 = bitech. Každá skupina má dobu trvání ( ) 8 10 . 48 1 . 384 3 = ms
a nazývá se rámec dat, zkráceně rámec. Každý rámec je transformován z časové do
kmitočtové oblasti a vzniklé spektrum je rozděleno na 32 stejně širokých kmitočtových úseků
- subpásem. Šířka každého subpásma je 750 Hz. Kmitočtové spektrum se vzorkuje kmitočtem
jehož hodnota je rovna 32 1 původního vzorkovacího kmitočtu u PCM, tj.
kHz 5 , 1 32 10 . 48 3 = . Tento proces se nazývá „podvzorkování“ spektra. Ve 32 subpásmech je
26 Rádiové a mobilní komunikace
celkem 384 32 . 12 = vzorků. Po dobu 8 ms je tedy v každém subpásmu 12 kmitočtových
vzorků různé velikosti, z nichž se vybere jeden, který má největší velikost a podle něj kodér
určí tzv. měřítko (scale factor). Tím se za dobu 8 ms získá pro celý rámec 32 měřítek (činitelů
měřítka), které mají rozhodující význam pro stanovení maskovacích prahů v každém dílčím
pásmu jednoho rámce.
Součástí kodéru je tzv. psychoakustický model, pomocí kterého je modelováno lidské
sluchové vnímání. V tomto modelu se porovnávají činitelé měřítka s hodnotami stanovenými
statisticky (metodami z mnoha praktických pokusů) a stanoví se v něm hladina ještě
maskovaného kvantizačního šumu. Podle přípustné hladiny kvantizačního šumu je přidělen
každému subpásmu určitý počet bitů pro postupné kvantování všech jeho vzorků. Počet
přidělených bitů je pro všech 12 vzorků jednoho subpásma stejný, pro různá subpásma však
může být různý. Pohybuje s v rozmezí od 2 do 15 (oproti původní hodnotě 16) a výrazně
přispívá ke snížení přenosové rychlosti signálu. Ze všech 32 subpásem s kvantovanými
kmitočtovými koeficienty se ve výstupním bloku vytváří komprimovaný digitální signál
s volitelnou přenosovou rychlostí v rozmezí od s kbit / 448 (pro nejjakostnější signály) do
s kbit / 32 (nejmenší kvalita),

Tuesday, July 8, 2008

maskovacím prahem,
Takové signály proto není třeba
uvažovat a tedy ani přenášet, neboť
na přijímací straně by stejně nebyly
posluchačem vnímány. Průběhy
křivek maskovacích prahů byly
získány na základě výsledků testů
prováděných na velkém počtu
posluchačů (psychologická
akustika). Maskovací práh se také
nazývá práh právě pozorovatelného zkreslení JND (Just Noticeable Distortion). Odstup
maskovacího signálu od úrovně jím vytvořeného maskovacího prahu na určitém kmitočtu se
označuje jako poměr signál – maskování SMR (Signal to Mask Ratio).
Poněvadž průběhy maskovacích prahů jsou závislé na kmitočtu, je výhodné
zpracovávat akustický signál odděleně v dílčích kmitočtových pásmech neboli subpásmech –
subpásmové kódování SBC (SubBand Coding), obvykle stejné šířky pásma,
Podle nejsilnějších složek zvukového signálu a jím odpovídajícím
průběhům maskovacích prahů, lze stanovit pro každé subpásmo maximální úroveň
kvantizačního šumu (obecně maskovaného signálu), který bude užitečným (obecně
maskujícím) signálem maskován a z ní určit počet bitů potřebných pro kvantování signálu.
Tím se dosáhne výrazné redukce přenosové rychlosti signálu, aniž by se na přijímací straně
zhoršila subjektivně vnímaná kvalita reprodukovaného zvuku. Při přenosu reálného signálu,
který své spektrum s časem mění, je třeba v krátkých časových intervalech signál neustále
analyzovat a inovovat úrovně kvantizačního šumu v každém subpásmu. To má za následek
změnu počtu bitů pro kvantování signálu v každém subpásmu a tím i změnu výsledné
přenosové rychlosti signálu. Časové intervaly jsou voleny tak, aby se využilo i maskovacího
efektu lidského sluchu v časové oblasti. Uvedené jevy a principy se využívají v následujících
systémech zdrojového kódování akustických signálů.

Monday, June 23, 2008

a) Křivky současné slyšitelnosti při maskování jednotlivých kmitočtů
úzkopásmovým šumem s šířkou pásma 160 Hz, konstantní hladinou a třemi
středními kmitočty
b) Závislost maskování jednotlivých kmitočtů na amplitudě maskujícího
úzkopásmového šumu [13]
24 Rádiové a mobilní komunikace
zvuku T sinusového průběhu o určité akustické hladině T L maskována silnějším
úzkopásmovým šumem určité hladiny Š L , se nazývají prahy současné slyšitelnosti. Průběhy
prahů slyšitelnosti závisí na kmitočtu, hladině akustického tlaku a spektrálním složení zvuku,
jak ukazují obr. 2.6.b,c (maskování v kmitočtové oblasti - simultánní maskování). Maskovací
jev však nastává i v případě, kdy maskovaný krátkodobý signál určité hladiny přichází až po
ukončení maskujícího signálu vyšší hladiny, v době do 10 ms. Při delším intervalu než 10 ms
maskování slábne a při intervalu 200 ms již zcela zaniká. Maskován může být rovněž krátký
zvukový impuls, následuje-li po něm nejdéle do 5 ms maskující signál (maskování v časové
oblasti – nesimultánní maskování).
Při zdrojovém kódování
akustických signálů se využívá
opačného jevu, při němž určitý
sinusový signál daného kmitočtu a
hladiny maskuje všechny ostatní
signály včetně šumu a rušení, jejichž
kmitočet a úroveň leží pod

Thursday, June 19, 2008

Zdrojové kódování akustických signálů
Používá se při kódování kvalitních akustických signálů v kmitočtovém rozsahu cca 10
Hz až 20 kHz. Využívá maskovacího jevu lidského sluchu, při kterém je užitečným
signálem maskován kvantizační šum.
Člověk vnímá zvuky pouze v kmitočtovém pásmu od cca 16 Hz do cca 16 kHz. Za
práh slyšitelnosti je považovaná kmitočtová závislost akustického tlaku P při níž lidský
sluch přestává vnímat sinusový akustický signál (křivky na obr. 2.6.a,b vycházející z bodů
dB L 70 ≅ ). Horní hranici akustického tlaku určuje práh bolesti (nevnímáme zvuk, ale jen
bolest). Úroveň (hladina) tlaku je dána vztahem
[ ] dB
P
P L log 20
0
= , (2.2)
kde Pa P µ 20 0 = . Při současném vnímání několika různých zvukových signálů delších než
200 ms může jeden signál potlačovat slyšitelnost jiného signálu, i když jejich kmitočty jsou
různé. Říkáme, že jej při své určité úrovni akustického tlaku maskuje (např. tikot hodin je
maskován zvukem TVP). Křivky udávající hladinu akustického tlaku, od které je slyšitelnost
a) b)