الصوت — أخذ العينات وحجم الملف.
| English | العربية |
|---|---|
| analogue data/ˈænəlɒɡ ˈdeɪtə/ | بيانات تناظرية |
| digital data/ˈdɪdʒɪtl ˈdeɪtə/ | بيانات رقمية |
| sampling/ˈsæmplɪŋ/ | أخذ العينات |
| amplitude/ˈæmplɪtjuːd/ | السعة |
| sampling rate/ˈsæmplɪŋ reɪt/ | معدل أخذ العينات |
| sampling resolution/ˈsæmplɪŋ ˌrezəˈluːʃn/ | دقة أخذ العينات |
| quantisation noise/ˌkwɒntaɪˈzeɪʃn nɔɪz/ | ضوضاء التكميم |
لماذا يجعل الهاتف صوتك يبدو رفيعاً
- مكالمة الهاتف تأخذ عينة من صوتك 8,000 مرة في الثانية. بينما يأخذ أسطوانة الـ CD نفس الصوت 44,100 مرة في الثانية. صوتك لم يتغير؛ الهاتف ببساطة يتخلص من كل ما فوق حوالي 3.4 كيلوهرتز.
- ولهذا السبب تكون المكالمة واضحة تماماً ولكن رقيقة بشكل لا لبس فيه: الكلام يقع تحت 3.4 كيلوهرتز، لكن بريق الطبل أو صوت صرخة حادة
sلا يقع تحت هذا الحد. - لم يكن هذا الاختيار كسلاً. بل كان حساباً: أخذ العينات بسرعة كافية لنقل الكلام، ولا أسرع من ذلك، لأن كل عينة إضافية تكلف عرض نطاق على كل مكالمة في البلاد.
- هذه الدرس يشرح كيف تتحول الأصوات المستمرة إلى أرقام، والإعدادات الاثنين اللتين تتحكمان بالجودة والحجم، والحساب الذي يطلبه الامتحان.
التناظري والرقمي
- الصوت في العالم الحقيقي هو موجة ضغط مستمرة: بيانات تناظرية، تتغير بسلاسة وتأخذ عدداً لا نهائياً من القيم.
- يخزن الحاسوب بيانات رقمية: أرقام منفصلة. تحويل واحد إلى الآخر يسمى أخذ العينات.
- أخذ العينات يقيس سعة الموجة، أي ارتفاعها، عند فترات زمنية منتظمة، ويخزن كل قياس كرقم ثنائي.

تتحول الموجة السلسة إلى صف من الأرقام
ماذا يفعل أخذ العينات؟
تحويل العينة يحوّل موجة تماثلية مستمرة إلى قيم رقمية متقطعة. إزالة الترددات غير المسموعة هو ضغط خاسر، وهو خطوة مختلفة.
الإعدادان
- معدل أخذ العينات هو عدد العينات taken في الثانية، ويُقاس بالهرتز. جودة الـ CD هي 44.1 كيلوهرتز؛ الهاتف يستخدم 8 كيلوهرتز.
- دقة أخذ العينات (عمق بت العينة) هو عدد البتات المستخدمة لتخزين سعة كل عينة. جودة الـ CD هي 16 بت، مما يعطي 65,536 مستوى ممكن.
- المعدل يتحكم في أي النغمات تنجو؛ والدقة تتحكم في مدى دقة تخزين كل قياس.
أخذ عينات الصوت.
y = a sin(bt + c)
أخذ العينات يقيس موجة صوتية على فترات منتظمة — معدل أعلى ينسخها بدقة أكبر.
معدل عينة الصوت الرقمي هو:
معدل العينة = عدد العينات في الثانية (هيرتز). عدد البتات لكل عينة هو دقة العينة.
رتب خطوات تحويل الصوت إلى ملف رقمي بالترتيب.
المعدل يحدد مدى تكرار القياس؛ الدقة تحدد مدى دقة تقريب كل قياس، والقياس هو مصدر ضوضاء التكميم.
حجم ملف الصوت
- أحادي القناة هو قناة واحدة؛ ستيريو هو قناتين، مما يضاعف الحجم.
- مقطع أحادي مدته 5 ثوانٍ بمعدل 8 kHz ودقة 8 bits: $8000 \times 8 \times 5 \times 1 = 320\,000$ بت، وهو ما يساوي 40,000 بايت.
مقطع أحادي声道 مدته 5 ثوانٍ تم عينته $8000\ \text{Hz}$ بدقة 8 بت. ما هي حجمه بالبتات؟
الحجم $= 8000 \times 8 \times 5 \times 1 = 320\,000$ بت.
حجم ملف الصوت بالبتات = معدل العينة × دقة العينة × المدة × ____.
الأحادي声道 قناة واحدة، والاستريو قناتان. إهمال عدد القنوات يضاعف نصف كل إجابة استريو.
مثال محلول: مسار CD
- مقطع ستيريو مدته 10 ثوانٍ تم تسجيله بجودة CD: معدل 44.1 kHz، ودقة 16 بت. أوجد حجمه بالميجابايت الميجابايث (MiB).
- $44\,100 \times 16 \times 10 \times 2 = 14\,112\,000$ بت.
- اقسم على 8 للحصول على البايتات: $1\,764\,000$. اقسم على $1024^2$: 1.68 MiB.
- كل علامة في الحل: العوامل الأربعة، وقسمة واحدة على 8، وسابقة معلنة. نسيان القناتين يقلص الإجابة للنصف.
مقطع استريو مدته 10 ثوانٍ تم عينته بـ 44100 هيرتز بدقة 16 بت. كم عدد البتات التي يحتاجها؟
44100 × 16 × 10 × 2 = 14,112,000 بت، حوالي 1.68 ميغابايت. إهمال القناتين يضاعف نصف الإجابة.
التسجيل الاستريو ضعف حجم التسجيل الأحادي声道 بنفس المعدل والدقة.
القنوات تضاعف الحجم: قناتان تعني ضعف العينات. ينتمي عدد القنوات إلى المعادلة.
تغيير الإعدادات
- معدل أعلى: تُلتقط النغمات الأعلى، فيكون الصوت أدق، لكن الملف أكبر.
- دقة أعلى: تُخزن كل سعة بخطوات أدق، فتقل ضوضاء量化 (quantisation noise)، وهي الخشونة التي تظهر عند تقريب قيمة سلسة إلى أقرب مستوى؛ الملف يكون أكبر.
- أقل من أي منهما: ملف أصغر وفقدان ملحوظ في الجودة. كما مع الصور، أجب بهذه المصطلحات، لا "يبدو سيئاً".
زيادة معدل العينة ستؤدي إلى:
معدل عينة أعلى يلتقط ترددات أعلى (جودة أفضل) ولكنه يزيد من حجم الملف.
دقة عينة أعلى (عدد بتات أكبر لكل عينة) يقلل من ضوضاء التكميم.
عدد البتات الأكبر يوفر خطوات سعة أدق، لذا تكون كل عينة أقرب إلى القيمة الحقيقية — مما يقلل من ضوضاء التكميم (ولكنه يزيد من حجم الملف).
صل كل تغيير بتأثيره الرئيسي.
المعدل يحدد أي النغمات تنجو؛ الدقة تحدد مدى دقة تخزين كل عينة.
مثال محلول: كم يجب أن تكون سرعة أخذ العينات؟
- يجب أن يكون معدل أخذ العينات ضعفًا على الأقل لأعلى تردد تريد الاحتفاظ به.
- سمع الإنسان يصل إلى حوالي 20 kHz. ما هو أقل معدل لالتقاطه؟ $2 \times 20\,000 = 40\,000$ هرتز، ولهذا اختار الـ CD 44.1 كيلوهرتز، أعلى قليلاً من الحد الأدنى.
- الهاتف يأخذ عينات بمعدل 8 kHz. ما هو أعلى تردد يمكنه نقله؟ نصف 8 كيلوهرتز، أي 4 كيلوهرتز، وعملياً حوالي 3.4 كيلوهرتز. يناسب الكلام؛ لا يناسب الموسيقى.
لالتقاط ترددات تصل إلى $20\,000\ \text{Hz}$، ما هو الحد الأدنى لمعدل العينة، بالهيرتز؟
يجب أن يكون معدل العينة ضعف التردد الأقصى على الأقل: $2 \times 20\,000 = 40\,000\ \text{Hz}$.
الهاتف يعمل بمعدل عينة 8000 هيرتز. ما هو أعلى تردد، بالهيرتز، يمكنه حملها نظريًا؟
نصف معدل العينة، بما أن المعدل يجب أن يكون ضعف التردد الأقصى المحفوظ. عمليًا، يحمل الهاتف حوالي 3.4 كيلوهرتز.
الموازنة بين الجودة والحجم
- كلام لملاحظة صوتية: معدل ودقة منخفضان كافيان، والملف صغير.
- موسيقى للتوزيع: إعدادات CD أو أفضل، لأن المستمع يلاحظ الفرق.
- البث المباشر: يُختار المعدل والدقة ليناسب عرض النطاق المتاح، ثم يزيل الضغط خاسر المزيد.
- إجابة "الموازنة" تذكر الإعداد، والتأثير على الجودة، والتأثير على الحجم، مرتبطة بالاستخدام.
علامات ضائعة
- المعدل هو عينات في الثانية؛ الدقة هي بتات لكل عينة. السؤال يذكر واحداً.
- الستيريو قناتان. إهمال عدد القنوات في المعادلة يقلص كل إجابة ستيريو للنصف.
- أقل معدل هو ضعف أعلى تردد مطلوب، وليس مساوياً له.
- قل ضوضاء量化 (quantisation noise)، لا "يبدو ضبابياً". مصطلح المنهج يحمل العلامة.
لقد فهمت الأمر
- أخذ العينات يحول البيانات التناظرية المستمرة إلى بيانات رقمية عن طريق قياس السعة عند فترات منتظمة
- معدل أخذ العينات = عينات في الثانية (CD 44.1 kHz)، دقة أخذ العينات = بتات لكل عينة (CD 16)
- الحجم بالبتات = المعدل $\times$ × الدقة $\times$ × المدة $\times$ × القنوات؛ الستيريو يضاعفه
- معدل أو دقة أعلى يعني دقة أفضل، وضوضاء量化 أقل وملف أكبر؛ يجب أن يكون المعدل ضعفًا على الأقل لأعلى تردد محتفظ به