এই পাঠক্রম যার উপরে দাঁড়িয়ে আছে
The AI Manual-এ থাকা প্রতিটি সরকারি কাঠামো, প্রতিটি বৈজ্ঞানিক উৎস, প্রতিটি ফন্ট আর প্রতিটি অন্তর্ভুক্ত কর্পাস এখানে তালিকাবদ্ধ, সঙ্গে এমন একটি ঠিকানা যা খোলে আর যাচাই করা যায়।
একটি ভুল কৃতজ্ঞতা কোনো কৃতজ্ঞতা না থাকার চেয়েও খারাপ হতো। এই পাতার প্রতিটি উৎস এখানে উদ্ধৃত হওয়ার আগে তার নিজের ঠিকানায় খোলা হয়েছে: এখানে কিছুই স্মৃতি থেকে নকল করা নয়।
এই পাতায়
সরকারি কাঠামোগুলি
The AI Manual কৃত্রিম বুদ্ধিমত্তা বিষয়ক সাক্ষরতার চারটি কাঠামো, যার তিনটি আন্তর্জাতিক আর একটি জাতীয়, আর সেগুলিকে স্পষ্ট করে বা ইউরোপীয় আইনের সঙ্গে জুড়ে দেয় এমন নথিগুলি, রূপ দিয়ে সাজায়। অনলাইনে যাচাই করা হয়েছে 2026 সালের 13 আগস্ট।
- Empowering Learners for the Age of AI: An AI Literacy Framework for Primary and Secondary Education (“AILit Framework”), OECD আর ইউরোপীয় কমিশন (DG Education / Digital Education Hub), CodeAI (আগে Code.org)-এর সহায়তায়, 2026। কাঠামোটির রেফারেন্স পাতা: প্রাথমিক আর মাধ্যমিক স্তরের জন্য দক্ষতার চারটি ক্ষেত্র আর উনিশটি দক্ষতা, প্রকাশিত 2026 সালের 17 আর 18 জুন।
- Empowering Learners for the Age of AI (পূর্ণ প্রতিবেদন, PDF), OECD Publishing (প্যারিস), ইউরোপীয় কমিশনের সঙ্গে, 2026। একই কাঠামো, পূর্ণ প্রতিবেদনে, প্রাথমিক আর মাধ্যমিক স্তরের ক্লাসের উদাহরণসহ।
- AI Competency Framework for Students, UNESCO, 2024। শিক্ষার্থীদের জন্য কাঠামো: তিনটি স্তরে বারোটি দক্ষতা, বোঝা, প্রয়োগ করা, তৈরি করা।
- AI Competency Framework for Teachers, UNESCO, 2024। শিক্ষকদের জন্য কাঠামো: পনেরোটি দক্ষতা, এই ধরনের প্রথম বিশ্বজনীন কাঠামো।
- বিধি (EU) 2024/1689 (AI Act): সংহত পাঠ, অনুচ্ছেদ 4 “AI literacy”, ইউরোপীয় ইউনিয়ন, EUR-Lex, 2024, 2026 সালের 27 জুলাই পর্যন্ত সংহত পাঠ। কৃত্রিম বুদ্ধিমত্তা বিষয়ক সাক্ষরতার সেই বাধ্যবাধকতা, যা একটি ব্যবস্থার প্রতিটি সরবরাহকারী আর প্রতিটি ব্যবহারকারী প্রতিষ্ঠানের উপরে পড়ে, তার ঝুঁকির স্তর যা-ই হোক।
- 2026 সালের 8 জুলাইয়ের বিধি (EU) 2026/1744 (“Digital Omnibus on AI”): অনুচ্ছেদ 4 সংশোধন করা 1(5) অনুচ্ছেদ, ইউরোপীয় ইউনিয়ন, EUR-Lex, 2026। যে বিধি এই ফলের বাধ্যবাধকতাটিকে চেষ্টার বাধ্যবাধকতায় বদলে দিয়েছে, বলবৎ 2026 সালের 27 জুলাই থেকে।
- AI Literacy: Questions & Answers, ইউরোপীয় কমিশন, AI Office, 2025, হালনাগাদ 2026 সালের 27 জুলাই। মাপা যায় এমন কোনো সীমা দাবি করা হয়নি: চাওয়া চেষ্টাটি যিনি তা খাটাবেন, তাঁর ভূমিকা আর ঝুঁকির সঙ্গে সমানুপাতিক।
- AI4K12: Five Big Ideas in AI, AAAI আর CSTA (Association for the Advancement of Artificial Intelligence / Computer Science Teachers Association), National Science Foundation-এর অর্থে (অনুদান DRL-1846073), 2018। একটি মার্কিন কাঠামো, উদ্ধৃত এই জন্য যে ইউরোপীয় মডিউলটি ভিতের পাশেই একটি মডিউল থাকে, কখনও ভিত নিজেই নয়।
বৈজ্ঞানিক আর কৌশলগত কাজ, বিষয় ধরে ধরে
এই পাঠক্রমের প্রতিটি কৌশলগত দাবির সঙ্গে 2026 সালের 13 আগস্ট অনলাইনে যাচাই করা একটি প্রকাশনা আছে, এখানে একটিমাত্র অপাঠ্য তালিকায় সাজানোর বদলে বিষয় ধরে ধরে জড়ো করা। প্রদর্শনের পাতা আর ব্লগের লেখাগুলি এর বাইরেও, নিজেদের পাতার নিচে, নিজেদের বিষয়ের প্রকাশনা উল্লেখ করে।
টোকেনায়ন
এই কাজগুলি প্রমাণ করে, একটি লেখা কীভাবে একটি শব্দের চেয়ে ছোট এককে ভাগ হয়, আর এই ভাগের দাম কেন কিছু ভাষায় অন্যদের চেয়ে বেশি পড়ে।
- Neural Machine Translation of Rare Words with Subword Units, Rico Sennrich et al., 2016।
- A New Algorithm for Data Compression, Philip Gage, 1994।
- Language Model Tokenizers Introduce Unfairness Between Languages, Aleksandar Petrov et al., 2023।
পূর্বাভাস আর নমুনায়ন
এই কাজগুলি দেখায়, একটি মডেল কীভাবে সম্ভাবনার একটি বিন্যাস থেকে একটি শব্দ বেছে নেয়, আর তাপমাত্রা এবং টপ-k বা টপ-p কাটাগুলি সেই বাছাই কীভাবে বদলে দেয়।
- The Curious Case of Neural Text Degeneration, Ari Holtzman et al., 2020।
- Distilling the Knowledge in a Neural Network, Geoffrey Hinton et al., 2015।
- Hierarchical Neural Story Generation, Angela Fan et al., 2018।
হ্যালুসিনেশন
এই কাজগুলি ব্যাখ্যা করে, একটি মডেল কেন দৃঢ় গলায় বানিয়ে বলে: তাকে যেভাবে প্রশিক্ষণ দেওয়া আর মূল্যায়ন করা হয়, তারই একটি পরিণাম, কোনো বিচ্ছিন্ন বিকল নয়।
- A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions, Lei Huang et al., 2023।
- Why Language Models Hallucinate, Adam Tauman Kalai et al., 2025।
- Hallucination is Inevitable: An Innate Limitation of Large Language Models, Ziwei Xu et al., 2024। বিতর্কিত: এই কাজ দাবি করে যে সাধারণ সমস্যা-সমাধানকারী হিসেবে ব্যবহৃত একটি মডেলের জন্য কিছু পরিমাণ হ্যালুসিনেশন গাণিতিকভাবেই অনিবার্য; পরের কাজগুলি আপত্তি তোলে যে তার আনুষ্ঠানিক অনুমানগুলি মডেলের সত্যিকারের আর সসীম ব্যবহারে খাটে না।
পক্ষপাত
এই কাজগুলি মেপে দেখায় যে প্রশিক্ষণের কর্পাসে থাকা মানবিক পক্ষপাত তার থেকে জন্মানো মডেলেও ফিরে আসে, আর তা মাপা যায়।
- Man is to Computer Programmer as Woman is to Homemaker? Debiasing Word Embeddings, Tolga Bolukbasi et al., 2016।
- Semantics derived automatically from language corpora contain human-like biases, Aylin Caliskan et al., 2017।
- Gender Shades: Intersectional Accuracy Disparities in Commercial Gender Classification, Joy Buolamwini, Timnit Gebru, 2018।
- Datasheets for Datasets, Timnit Gebru et al., 2018।
তথ্য মুখস্থ রাখা
এই কাজগুলি প্রমাণ করে যে একটি মডেল তার প্রশিক্ষণের তথ্যের টুকরো, ব্যক্তিগত তথ্যসহ, কেবল প্রশ্ন করেই হুবহু ফিরিয়ে দিতে পারে।
- Extracting Training Data from Large Language Models, Nicholas Carlini et al., 2021।
- Quantifying Memorization Across Neural Language Models, Nicholas Carlini et al., 2023।
- Scalable Extraction of Training Data from (Production) Language Models, Milad Nasr et al., 2023।
বানানো ছবি
এই কাজগুলি সেই কৌশলগত দাগগুলি চিহ্নিত করে, যা একটি তৈরি করা ছবিকে ধরিয়ে দেয়, আর জানায় যে সাম্প্রতিক কৃত্রিম মুখে মানুষের চোখ আর সেগুলি দেখতে পায় না।
- Leveraging Frequency Analysis for Deep Fake Image Recognition, Joel Frank et al., 2020।
- Detecting and Simulating Artifacts in GAN Fake Images, Xu Zhang et al., 2019।
- AI-synthesized faces are indistinguishable from real faces and more trustworthy, Sophie J. Nightingale, Hany Farid, 2022।
বানানো কণ্ঠ
এই কাজগুলি কৃত্রিম কণ্ঠ শনাক্ত করা আর তার সীমার জায়গা ঠিক করে দেয়, আর একটি সরকারি কর্তৃপক্ষ একটি নকল কণ্ঠের সত্যিকারের প্রতারণামূলক ব্যবহার নথিবদ্ধ করে।
- WaveFake: A Data Set to Facilitate Audio Deepfake Detection, Joel Frank, Lea Schönherr, 2021।
- ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild, Xuechen Liu et al., 2021।
- FCC Makes AI-Generated Voices in Robocalls Illegal (FCC 24-17 ঘোষণা), Federal Communications Commission (FCC), 2024।
জলছাপ আর উৎস-নথি
এই কাজগুলি উৎস প্রমাণের দুটি পরিবারের বর্ণনা দেয়, ফাইলের সঙ্গে জোড়া একটি ম্যানিফেস্ট আর তৈরি করা লেখার ভেতরে বসানো একটি পরিসংখ্যানের জলছাপ, আর তাদের নিজেদের সীমা।
- Content Credentials: C2PA Technical Specification (version 2.4), Coalition for Content Provenance and Authenticity (C2PA), 2026।
- C2PA Frequently Asked Questions, Coalition for Content Provenance and Authenticity (C2PA), 2026। মানটি নিজেই মেনে নেয় যে একটি উৎস-ম্যানিফেস্ট ফাইল থেকে আলাদা হয়ে যেতে পারে, আর তাই একটি সাধারণ স্ক্রিনশটেই হারিয়ে যেতে পারে।
- A Watermark for Large Language Models, John Kirchenbauer et al., 2023।
- Scalable watermarking for identifying large language model outputs, Sumanth Dathathri et al., 2024। SynthID-Text, একটি পরিসংখ্যানের জলছাপ, Nature পত্রিকায় প্রকাশিত আর সমকক্ষ-পর্যালোচিত।
শনাক্তকারী
এই কাজগুলি দেখায় যে AI-তে তৈরি পাঠের শনাক্তকারীরা ভুল করে, আর ইংরেজির অ-মাতৃভাষীদের বিরুদ্ধে তাদের নথিবদ্ধ একটি পক্ষপাত আছে, এমনকি একজন প্রকাশক নিজের যন্ত্রটি তুলে নেওয়া পর্যন্ত।
- GPT detectors are biased against non-native English writers, Weixin Liang et al., 2023।
- OpenAI scuttles AI-written text detector over ‘low rate of accuracy’, Devin Coldewey, TechCrunch, OpenAI-র একটি সরকারি সংযোজনী তুলে ধরে, 2023।
- Testing of detection tools for AI-generated text, Debora Weber-Wulff et al., 2023।
বস্তুগত দাম
এই কাজগুলি সংখ্যায় দেখায় একটি দ্রুত বেড়ে চলা শক্তির খরচ, যা একই কাজ একটি বিশেষায়িত ব্যবস্থার হাতে দেওয়ার তুলনায় অসমানুপাতিক।
- Energy and AI, আন্তর্জাতিক শক্তি সংস্থা (International Energy Agency, IEA), 2025।
- Power Hungry Processing: Watts Driving the Cost of AI Deployment?, Alexandra Sasha Luccioni et al., 2024।
ফন্ট
এই ব্যবস্থার দুটি ফন্ট woff2-এ ভেতরে বসানো, site/assets/css/fonts/-এ: কোনো ফন্ট-পরিষেবায় কোনো অনুরোধ নয়, কোনো CDN নয়। তাদের লাইসেন্স 2026 সালের 14 আগস্ট অনলাইনে আবার পড়া হয়েছে, যে ফাইল তা বহন করে তার ঠিকানাতেই।
- Source Serif 4, SIL Open Font License, version 1.1, Adobe, 2014 থেকে 2023, সংরক্ষিত নাম “Source”। ভেতরে বসানো woff2 ফন্ট, ভার 500 আর 600, ইটালিক 400: সাইটের শিরোনামগুলি এগুলিই বহন করে।
- Public Sans, SIL Open Font License, version 1.1, The Public Sans Project Authors, 2015। ভেতরে বসানো woff2 ফন্ট, ভার 400, 600 আর 700, ইটালিক 400: লেখার মূল অংশটি এগুলিই বহন করে। এটি মার্কিন সরকারি পরিষেবার ব্যবস্থা USWDS-এর ফন্ট।
SIL Open Font License এই দুটি ফন্টেরই ব্যবহার, পরিবর্তন আর পুনর্বিতরণের অনুমতি দেয়, একটিমাত্র শর্তে, সেগুলি আলাদা করে আবার বিক্রি না করা আর লাইসেন্সটি তাদের সঙ্গে রেখে দেওয়া।
প্রদর্শনগুলির কর্পাস
প্রদর্শনগুলির ভেতরে বাইরের একটিমাত্র রচনাই বসানো আছে, আর সেটি পাবলিক ডোমেইনের। আরও দুটি লেখা পুরোপুরি ODERSA-র নিজের: একটি কাজে লাগে ভাষা অনুযায়ী একই বিষয়বস্তুর তুলনা করতে, অন্যটি দেখাতে যে একটি কর্পাসের গড়ন কীভাবে একটি মডেলকে হেলিয়ে দেয়।
পাবলিক ডোমেইনের একটি লেখা
Le Tour du monde en quatre-vingts jours, Jules Verne, 1873। পাবলিক ডোমেইন: Jules Verne মারা যান 1905 সালের 24 মার্চ, আর ফরাসিতে তাঁর রচনা বহু দিন ধরেই সব জায়গায় স্বত্বমুক্ত। উপন্যাসের প্রথম 623টি অনুচ্ছেদ, অর্থাৎ প্রায় 25 288টি শব্দ, সেই কর্পাস গড়ে তোলে যার উপরে এই পাঠক্রমের খেলনা-মডেল শেখে। একমাত্র যে ছোঁয়াগুলি দেওয়া হয়েছে, সবই ফিরিয়ে নেওয়া যায় এমন আর কর্পাসের ফাইলে ঘোষিত, আর সেগুলি টাইপোগ্রাফিক: অ্যাপোস্ট্রফি টাইপোগ্রাফিক করা, প্রতিলিপির ড্যাশ আর উদ্ধৃতিচিহ্ন সরানো, ইটালিকের চিহ্ন সরানো, অধ্যায়ের শিরোনাম আর সূচিপত্র বাদ দেওয়া। যে মডেল 1873 সালের এই লেখাটি ছাড়া আর কিছুই পড়েনি, সে তার পর কী ঘটেছে তার কিছুই জানতে পারে না: প্রদর্শনটি ঠিক এই জিনিসটিই চোখে আঙুল দিয়ে দেখায়।
ঘরের একটি লেখা
ODERSA-র বহর যে 7টি ভাষা পরিবেশন করার কথা ভেবেছে, তাদের প্রতিটিতে একই বাক্য, ভাষা অনুযায়ী একই অর্থ কতগুলি একক চায়, তার তুলনা করতে কাজে লাগে। এই লেখাটি ODERSA-র নিজের আস্থার ব্যানারেরই লেখা, আগেই CC BY 4.0 লাইসেন্সে প্রকাশিত: এটি বাইরের কোনো কর্পাস নয়, আর তাই এটি স্বত্বের কোনো প্রশ্নই তোলে না।
আপনার চোখের সামনে তৈরি হওয়া একটি কর্পাস
পক্ষপাতের উৎস নিয়ে প্রদর্শনটি কোনো লেখা ধার করে না: সে তার নিজেরটিই তৈরি করে, দুটি নমুনা বাক্য, আটটি পেশার নাম আর আটটি শহরের নাম থেকে। তার গড়নটি আপনিই ঠিক করে দেন, আর পাতাটির পুরো উদ্দেশ্যই এটি: একটি মডেল যা কখনও পড়েনি, তা সে ফিরিয়ে দিতে পারে না। এই কর্পাস ফরাসিতে লেখা, 1873 সালের উপন্যাসটির মতোই, আর অনূদিত ছয়টি পাতা তা প্রত্যেকে নিজের ভাষায় বলে দেয়। এটি ODERSA-র নিজের: এটি বাইরের কোনো কর্পাস নয়, আর তাই এটি স্বত্বের কোনো প্রশ্নই তোলে না।
যে ইঞ্জিন এই প্রদর্শনগুলি চালায়, এই কর্পাসগুলি থেকে তোলে আর সম্ভাবনা হিসাব করে, তা ODERSA-র লেখা কোড: এটি বাইরের কোনো লাইব্রেরি নয়, আর এই সাইট তেমন একটিও ভেতরে বসায় না।
নকশাগুলি
এই সাইটের প্রতিটি নকশা ODERSA-র হাতে আঁকা একটি SVG, কোনো আলোকচিত্র বা বাইরের কোনো ডোমেইন থেকে ডাকা ছবি ছাড়াই। প্রতিটি CC BY 4.0 লাইসেন্সে পুনর্ব্যবহারযোগ্য, সাইটের বাকি সবের মতোই, আর তার বর্ণনায় এই উল্লেখটি আছে।
এই জিনিসটিই আস্থার ব্যানারকে সেই প্রতিশ্রুতি দিতে দেয় যে এই সাইট যে ডিভাইসে খোলে, তার থেকে কোনো অনুরোধ বাইরে যায় না: কোনো ছবি, কোনো ফন্ট আর কোনো স্ক্রিপ্টের মতোই, দূর থেকে ডাকা হয় না।
আলোকচিত্রগুলি
The AI Manual-এর প্রতিটি আলোকচিত্র একটি নির্দিষ্ট পাতাকে সাজায়, আর ছবির নিচের বর্ণনাটি আগেই তার লেখকের নাম বহন করে। এই ছকে প্রতিটি ছবি তার পূর্ণ লাইসেন্স, Wikimedia Commons-এ তার প্রমাণের ঠিকানা আর যে পাতা তাকে পরিবেশন করে, তার সঙ্গে জড়ো করা।
| সে কী দেখায় | লেখক | লাইসেন্স | Wikimedia Commons-এ প্রমাণ | যে পাতায় পরিবেশিত |
|---|---|---|---|---|
| পিছন থেকে আলো-দেওয়া একটি ল্যাপটপের কিবোর্ড, বেশির ভাগ আঙুল বিশ্রামের সারিতে রাখা, U বোতামটি চাপা | Colin | CC BY-SA 4.0 | ফাইলের পাতা | হোম |
| প্যারিসের বিবলিওতেক সাঁত-জ্যুনভিয়েভের পাঠকক্ষ, একটি খিলানের নিচে তার লম্বা টেবিল আর বইয়ের তাক | JOHN TOWNER heytowner | CC0 | ফাইলের পাতা | পক্ষপাত কোথা থেকে আসে |
| একটি কারিগরি কক্ষ, যেখানে প্যাচ প্যানেলে লাগানো কয়েক ডজন নেটওয়ার্ক কেবল এসে মিলেছে | Brian Hankins (Bhankins) | পাবলিক ডোমেইন | ফাইলের পাতা | আমরা তাকে যা দিই |
| একটি ফুটবল মাঠের ধারে বসে থাকা একজন আলোকচিত্রী, হাতে একটি লম্বা টেলিফোটো লেন্স | Ximeg | CC BY-SA 3.0 | ফাইলের পাতা | একটি বানানো ছবি |
| একটি রেকর্ডিং স্টুডিওতে একটি ড্রাম সেটের চারপাশে স্ট্যান্ডে বসানো কয়েকটি মাইক্রোফোন | dan paluska | CC BY 2.0 | ফাইলের পাতা | একটি বানানো কণ্ঠ |
| একটি খালি প্রেক্ষাগৃহ, ঘরের পিছন থেকে দেখা তার আসন আর লেখার তক্তার সারি | Yinan Chen | পাবলিক ডোমেইন | ফাইলের পাতা | পড়ানোর জন্য |
এই আলোকচিত্রগুলির দুটি, হোমের কিবোর্ডটি আর “একটি বানানো ছবি” পাতার আলোকচিত্রীটি, একই-শর্তে-বিতরণের একটি লাইসেন্সে আছে, CC BY-SA। The AI Manual-এর লেখা CC BY 4.0-তে, যেমনটি লাইসেন্স পাতা জানায়; এই দুটি আলোকচিত্র নিজেদের লাইসেন্সই রাখে, তারা এতে বদলে যায় না। যে পাতা তাদের বহন করে, তা তুলে নিলে আলোকচিত্রটিও সেই একই একই-শর্তে-বিতরণের লাইসেন্সেই আবার বিতরণ করতে হবে, তার কৃতজ্ঞতার সঙ্গে, সাইটের বাকি অংশের শর্তে নয়।
এই পাতার সব আলোকচিত্র এই ভাণ্ডারের ভেতরেই বসানো আর সাইটের ডোমেইন থেকেই পরিবেশিত, কখনও বাইরের কোনো ঠিকানা থেকে ডাকা নয়, ফন্ট আর নকশাগুলির মতোই। এই জিনিসটিই আস্থার ব্যানারকে সেই প্রতিশ্রুতি দিতে দেয় যে এই সাইট যে ডিভাইসে খোলে, তার থেকে কোনো অনুরোধ বাইরে যায় না।
এই সাইট আর কারও কাছে যা ঋণী নয়
- কোনো নির্ভরতা নেই: বাইরের কোনো লাইব্রেরি থেকে ধার করা কোডের একটি লাইনও নেই।
- কোনো CDN নেই: ফন্ট, স্ক্রিপ্ট আর ছবি সবই এই ভাণ্ডারের ভেতরে বসানো।
- কৃত্রিম বুদ্ধিমত্তার কোনো পরিষেবা ডাকা হয় না: প্রদর্শনগুলি নির্ধারিত ফল দেয়, তারা যে ডিভাইসে খোলে সেখানেই পুরোপুরি চলে।
- এই পাতাগুলোতে কোনো মাপার সরঞ্জাম নেই, কোনো কুকি নেই, কোনো অ্যাকাউন্ট নেই: কে এই পাতা খুলছে, তা শনাক্ত করার কিছুই নেই।
পাতা লোড হওয়ার সময় ব্রাউজারের নেটওয়ার্ক ট্যাবে এটি কয়েক সেকেন্ডেই যাচাই করা যায়: কোনো অনুরোধ তার থেকে বাইরে যায় না।
এই কৃতজ্ঞতা কীভাবে রক্ষণাবেক্ষণ হয়
একটি পুরোনো হয়ে যাওয়া উৎস, বদলে যাওয়া একটি ঠিকানা, ভুল জায়গায় বসানো একটি কৃতজ্ঞতা: এসব জানানো যায়, অ্যাকাউন্ট বা ফর্ম ছাড়াই। এই সাইটের পুনর্ব্যবহারের শর্ত বর্ণনা করা আছে লাইসেন্স পাতায়।