টেকনিক্যাল এসইও সম্পর্কে ধারণা হলো এটি দুইশটা র‍্যাঙ্কিং ফ্যাক্টরের তালিকা। তা নয়। এটি অনেক ছোট একটি তালিকা, যেখানে এমন জিনিস আছে যা সার্চ ইঞ্জিনকে আপনার পাতা খুঁজে পেতে, বুঝতে বা বিশ্বাস করতে বাধা দেয় — আর প্রতিটিই হয় ভাঙা, নয়তো নয়।

ভালো খবর হলো, একটি যোগ্য অডিট একটি বিকেলেই এঁটে যায়। নিচের ক্রমটি সাজানো হয়েছে ভুল হলে কোনটি কতটা ক্ষতি করে সেই অনুযায়ী।

পর্ব ১ — খুঁজে পাওয়া যায় কি?

সত্যিই কি ইনডেক্স হয়েছে?

এখান থেকেই শুরু করুন, কারণ উত্তর "না" হলে বাকি সবই অপ্রাসঙ্গিক।

text
site:yourdomain.com

পাতার সংখ্যা মোটামুটি ঠিক? তাহলে Search Console → Pages খুলে বাদ পড়ার কারণগুলো পড়ুন। যেগুলো গুরুত্বপূর্ণ:

  • "Excluded by 'noindex' tag" — সাধারণত স্টেজিং সাইট থেকে পড়ে থাকা। টেকনিক্যাল এসইওর একক সবচেয়ে ক্ষতিকর ভুল এটাই, আর না খুঁজলে এটি অদৃশ্য।
  • "Blocked by robots.txt" — গুরুত্বপূর্ণ কিছু আটকে ফেলেননি তো, দেখুন।
  • "Crawled – currently not indexed" — Google দেখেছে আর ইনডেক্স করার মতো মনে করেনি। এটি কনটেন্টের সমস্যা, কারিগরি নয়।
  • "Duplicate, Google chose a different canonical" — আপনার ক্যাননিক্যাল ট্যাগ আর Google-এর বিচার একমত নয়।

robots.txt

এটি রুটে থাকা উচিত আর নীরস হওয়া উচিত। দুই ধরনের ব্যর্থতা:

  • সিএসএস বা জাভাস্ক্রিপ্ট আটকানো। Google আপনার পাতা রেন্ডার করে; অ্যাসেট আটকালে সে একটি ভাঙা সাইট দেখে।
  • গোটা সাইট আটকানো। স্টেজিং কনফিগ থেকে আসা Disallow: /। অবকাঠামো ছোঁয় এমন প্রতিটি ডিপ্লয়ের পর দেখে নিন।

⚠ ফ্রেমওয়ার্ক-নির্দিষ্ট একটি ফাঁদের নাম বলা দরকার: Next.js-এ robots.ts অবশ্যই app/-এর রুটে থাকতে হবে। রুট গ্রুপের ভেতরে থাকলে এটি চুপচাপ উপেক্ষিত হয় আর /robots.txt ৪০৪ দেয়। sitemap.ts কাকতালীয়ভাবে গ্রুপের ভেতর থেকেও কাজ করে, তাই দুটির আচরণ আলাদা আর ভুল করা সহজ — আমরা ঠিক এই বাগটাই তিনটি ভার্সন ধরে বয়ে বেড়িয়েছি।

সাইটম্যাপ

  • কেবল ক্যাননিক্যাল, ইনডেক্সযোগ্য, ২০০-স্ট্যাটাসের URL থাকবে। কোনো রিডাইরেক্ট নয়, কোনো noindex পাতা নয়।
  • robots.txt থেকে উল্লেখ করা আর Search Console-এ জমা দেওয়া।
  • ৫০,০০০ URL-এর বেশি হলে ভাগ করা।
  • lastmod সৎ। প্রতিটি পাতা আজ বদলেছে দাবি করা সাইটম্যাপ Google-কে ফিল্ডটি উপেক্ষা করতে শেখায়।

পর্ব ২ — বোঝা যায় কি?

প্রতি পাতায় একটি ক্যাননিক্যাল

প্রতিটি পাতা নিজের ক্যাননিক্যাল URL ঘোষণা করে। যে নিয়মগুলো গুরুত্বপূর্ণ:

  • সাধারণ পাতায় নিজেকেই নির্দেশ করা
  • অ্যাবসলিউট URL, রিলেটিভ নয়।
  • সাইটম্যাপে যা আছে আর ভেতরের লিংক যেদিকে দেখায়, তার সঙ্গে সঙ্গতিপূর্ণ
  • পেজিনেটেড পাতা নিজেকেই ক্যাননিক্যাল করে। দুই নম্বর পাতা এক নম্বরের নকল নয়, আর সেটি দাবি করাও উচিত নয়।

ধ্রুপদী ব্যর্থতা: httphttps, বা wwwwww-বিহীন — দুটোই কাজ করছে আর দুটোই নিজেকে ক্যাননিক্যাল বলছে। এটি একটি সাইটের কর্তৃত্ব ভাগ করে নেওয়া দুটি সাইট। একটি বাছুন আর অন্যটিকে ৩০১ করুন।

hreflang, যদি বহুভাষিক হন

এটি ভুল করা বাদ দেওয়ার চেয়েও খারাপ, আর বেশিরভাগ বাস্তবায়ন তিনভাবে ভুল হয়:

  • জোড়াগুলো পারস্পরিক হতে হবে। ইংরেজি যদি বাংলাকে নির্দেশ করে, বাংলাকেও ইংরেজিকে ফিরিয়ে নির্দেশ করতে হবে। একমুখী ঘোষণা উপেক্ষিত হয়।
  • প্রতিটি পাতাকে নিজের hreflang সেটে নিজেকেও রাখতে হবে।
  • তালিকাভুক্ত কোনো ভাষার সঙ্গে না মেলা ভিজিটরদের জন্য x-default রাখুন

যে পূর্বশর্তটি মানুষ বাদ দেয়: স্লাগ দুই ভাষায় এক হওয়া উচিত। /post/hosting-guide আর /bn/post/hosting-guide একই স্লাগ ভাগ করলে তারা পরিষ্কারভাবে একে অন্যকে ঘোষণা করতে পারে। স্লাগ অনুবাদ করলে দুটি URL হয়, যেগুলো চিরকাল হাতে মেলাতে হবে — এ কারণেই এই সাইট ইচ্ছে করেই স্লাগ স্থানীয় করে না।

বৈধ স্ট্রাকচার্ড ডেটা

স্ট্রাকচার্ড ডেটা সরাসরি র‍্যাঙ্কিং বাড়ায় না। এটি বদলায় আপনার ফলাফল দেখতে কেমন হবে — ব্রেডক্রাম্ব, FAQ খোলার সুবিধা, রিভিউ তারকা, আর্টিকেলের তারিখ — আর সেটি ক্লিক-থ্রু বদলায়, যেটাই আসল কথা।

যা যাচাই করবেন:

  • এটি বৈধ হয়। Google-এর Rich Results Test। অবৈধ JSON-LD আংশিকভাবে পড়া হয় না; পুরোপুরি উপেক্ষা করা হয়।
  • একটি @graph, কয়েকটি আলগা অবজেক্ট নয়। কমা দিয়ে আলাদা করা চারটি টপ-লেভেল অবজেক্টসহ একটি <script> বৈধ JSON নয় আর কোনো ক্রলার তার কিছুই পার্স করতে পারে না। আমরা ঠিক এটাই দুটি পাতায় কয়েক মাস ধরে রেখেছিলাম।
  • আইডিগুলো ভাগ করা। আপনার Organization নোডের @id প্রতিটি পাতায় এক হওয়া উচিত, যাতে ক্রলার পঞ্চাশটি নয়, একটি সত্তা হিসেবে সেটি চেনে।
  • এটি দৃশ্যমান পাতার সঙ্গে মেলে। ব্যবহারকারী দেখতে পান না এমন কনটেন্ট মার্ক-আপ করা নীতিভঙ্গ।

প্রমাণ করতে পারেন না এমন aggregateRating প্রকাশ করবেন না। সাইটের কোথাও কোনো রিভিউ নেই অথচ নিজেই দেওয়া পাঁচ তারকা — এটাই Google-এর নির্দেশিকায় বলা "স্প্যামি স্ট্রাকচার্ড মার্কআপ", আর এতে ম্যানুয়াল অ্যাকশন হতে পারে। Google চায় রিভিউগুলো সত্যি হোক এবং পাতায় দৃশ্যমান হোক।

পর্ব ৩ — বিশ্বাস করা যায় কি?

https, ঠিকভাবে

  • www ও মূল ডোমেইন দুটোই ঢাকে এমন বৈধ সার্টিফিকেট — দেখুন ফ্রি বনাম পেইড এসএসএল
  • http থেকে https-এ রিডাইরেক্ট একবারে, শৃঙ্খলে নয়।
  • কোনো মিক্সড কনটেন্ট নেই।
  • স্বয়ংক্রিয় রিনিউয়াল, বাইরে থেকে মনিটর করা। ২০২৬ সালে সার্টিফিকেটের মেয়াদ ২০০ দিনে নেমেছে, তাই ম্যানুয়াল রিনিউয়াল এখন বার্ষিক কাজ নয়, বারবার ফিরে আসা ঝুঁকি।

Core Web Vitals

পেজ এক্সপিরিয়েন্সের অংশ, আর সত্যিকারের নিষ্পত্তিকারক। ২০২৬ সালে বেশিরভাগ সাইট ব্যর্থ হয় INP-তে। পুরো আলোচনা আছে ২০২৬ সালে Core Web Vitals-এ; সংক্ষেপে: Lighthouse স্কোর নয়, ফিল্ড ডেটা পড়ুন, আর যে একটি মাপকাঠিতে ব্যর্থ হচ্ছেন সেটিই ঠিক করুন।

মোবাইল

Google আপনার সাইটের মোবাইল সংস্করণ ইনডেক্স করে। ডেস্কটপ নয়। র‍্যাঙ্কিংয়ের বিচারে মোবাইল পাতাটিই আপনার সাইট

  • মোবাইলে ডেস্কটপের মতোই কনটেন্ট। "আরও পড়ুন"-এর পেছনে লুকানো কনটেন্ট ঠিক আছে; পুরোপুরি বাদ দেওয়া কনটেন্ট নয়।
  • একই স্ট্রাকচার্ড ডেটা ও মেটাডেটা।
  • ট্যাপের জায়গা যথেষ্ট বড়, লেখা জুম ছাড়াই পড়ার মতো।
  • কোনো আড়াআড়ি স্ক্রল নেই। কেবল ল্যাপটপের প্রস্থে নয়, ৩২০ পিক্সেলেও পরীক্ষা করুন।

পর্ব ৪ — সাইটের কাঠামো

  • গুরুত্বপূর্ণ পাতা হোমপেজ থেকে তিন ক্লিকের মধ্যে। ক্রল গভীরতার সঙ্গে কোনো পাতা কত ঘন ঘন আবার ক্রল হয় তার সম্পর্ক আছে।
  • ভেতরের লিংকে বর্ণনামূলক অ্যাংকর টেক্সট। "আরও পড়ুন" ক্রলারকে কিছুই বলে না; অ্যাংকর আপনার নিয়ন্ত্রণে থাকা সবচেয়ে শক্তিশালী অন-পেজ সংকেতগুলোর একটি।
  • অনাথ পাতা নয়। সাইটম্যাপে আছে অথচ কোনো ভেতরের লিংক নেই এমন পাতা মানে আপনি Google-কে বলেছেন এটি নিয়ে মাথা না ঘামাতে।
  • URL পড়ার মতো ও স্থির। শব্দ, হাইফেন, ছোট হাতের অক্ষর, কোনো সেশন আইডি নয়। আর প্রকাশের পর অকারণে বদলাবেন না — প্রতিটি পরিবর্তনে জমানো কর্তৃত্বের কিছুটা যায়।
  • ৪০৪ যেন ৪০৪-ই ফেরত দেয়। ২০০ ফেরত দেওয়া "পাওয়া যায়নি" পাতা একটি সফট ৪০৪, আর Google সেগুলো খুঁজে বের করবে আর খুশি হবে না।
  • রিডাইরেক্ট এক ধাপের ও স্থায়ী, যেখানে পরিবর্তনটি স্থায়ী।

পর্ব ৫ — ২০২৬-এর সংযোজন: এআই সার্চ

সার্চের ক্রমবর্ধমান একটা অংশ এখন ক্লিকে নয়, তৈরি করা উত্তরে শেষ হয়। উত্তরে র‍্যাঙ্ক করা যায় না, কিন্তু উত্তরে উদ্ধৃত হওয়া যায় — আর তার কারিগরি শর্তগুলো নির্দিষ্ট।

  • এআই ক্রলারদের আটকাবেন না, যদি না আপনি বাদ থাকার সিদ্ধান্ত নিয়ে থাকেন। robots.txt-এ GPTBot, ClaudeBot, PerplexityBot, Google-Extended দেখুন। এটি সত্যিকারের ট্রেড-অফসহ একটি ব্যবসায়িক সিদ্ধান্ত — দৃশ্যমানতার বিপরীতে আপনার কনটেন্টের ব্যবহার — আর এটি দুর্ঘটনা নয়, সিদ্ধান্ত হওয়া উচিত।
  • কনটেন্ট সার্ভারে রেন্ডার করুন। যে উত্তর-ইঞ্জিন জাভাস্ক্রিপ্ট না চালিয়ে আপনার লেখা দেখতে পায় না, সে প্রায়ই সেটি একেবারেই দেখে না। একক বৃহত্তম কারিগরি বিষয় এটাই।
  • প্রশ্নের উত্তর ওপরের দিকেই দিন। উত্তর বের করে আনা ব্যবস্থাগুলো সরাসরি উত্তর আর তারপর বিস্তারিত পছন্দ করে, হাজার শব্দের ভূমিকা নয়।
  • সত্যিকারের হেডিং ব্যবহার করুন। <h2>-তে প্রশ্ন আর তার নিচে সরাসরি উত্তর — এর চেয়ে সহজে বের করে আনার মতো কাঠামো আর হয় না, আর এ কারণেই FAQ অংশগুলো কাজ করে।
  • নির্দিষ্ট ও যাচাইযোগ্য হোন। সংখ্যা, তারিখ, নাম ধরে বলা জিনিস। অস্পষ্ট বিজ্ঞাপনী গদ্য বের করে আনা যায় না আর উদ্ধৃতও হয় না।
  • আপনার সত্তার তথ্য সঙ্গতিপূর্ণ রাখুন — সাইটে, স্ট্রাকচার্ড ডেটায় আর বাইরের প্রোফাইলে একই প্রতিষ্ঠানের নাম, ঠিকানা ও শনাক্তকারী।

লক্ষ করুন এই তালিকার কতটা আসলে নিছক ভালো লেখা। এটি কাকতালীয় নয়, আর এটাই এর সবচেয়ে টেকসই দিক।

বিকেলের অডিট

ক্রম অনুযায়ী। বিকেল ফুরিয়ে গেলে থামুন; ক্ষতিটা তালিকার ওপরের দিকেই।

  1. site:yourdomain.com — পাতার সংখ্যা মোটামুটি ঠিক?
  2. Search Console → Pages → বাদ পড়ার প্রতিটি কারণ পড়ুন।
  3. পড়ে থাকা noindex খুঁজুন। প্রতিবারই।
  4. /robots.txt/sitemap.xml এনে সত্যিই পড়ুন।
  5. একটিই ক্যাননিক্যাল হোস্ট নিশ্চিত করুন — http/https, www/www-বিহীন।
  6. পাঁচ ধরনের পাতায় ক্যাননিক্যাল ট্যাগ যাচাই করুন।
  7. তিনটি পাতা Rich Results Test-এ চালান।
  8. আপনার প্রধান টেমপ্লেটগুলোর ফিল্ড Core Web Vitals পড়ুন।
  9. আপনার শীর্ষ পাতাটি ৩২০ পিক্সেল প্রস্থে খুলুন।
  10. https, দুটি হোস্টনেম, আর রিডাইরেক্ট শৃঙ্খলের দৈর্ঘ্য দেখুন।
  11. বহুভাষিক হলে: একটি জোড়ায় hreflang-এর পারস্পরিকতা যাচাই করুন।
  12. এআই ক্রলারের নিয়ম দেখুন আর ভেবেচিন্তে সিদ্ধান্ত নিন।

পূর্ণ অডিট আর সমাধানের পেছনে মাসটা দিতে না চাইলে আমরা এটি সার্ভিস হিসেবেও করি, বাংলা ও ইংরেজি দুই ভাষাতেই।

টেকনিক্যাল এসইও যা করবে না

এটি দিয়েই শেষ করা দরকার, কারণ বাজেট এখানেই নষ্ট হয়।

টেকনিক্যাল এসইও বাধা সরায়। চাহিদা তৈরি করে না। নিখুঁতভাবে কনফিগার করা যে সাইটে পড়ার মতো কিছু নেই, সেটি কিছুতেই র‍্যাঙ্ক করে না — আর যত স্কিমা মার্কআপই দিন, তা বদলায় না।

বাস্তব মডেলটি হলো: কারিগরি কাজ এমন কনটেন্টের ওপর একটি গুণক, যা এমনিতেই র‍্যাঙ্ক করার যোগ্য। শূন্যের দশ গুণও শূন্য। কারিগরি ভিতটা একবার ঠিক করুন, ঠিক রাখুন, আর বাকি পরিশ্রমটা দিন সেই জিনিসে — যার জন্য মানুষ আসলে এসেছিল।

সচরাচর জিজ্ঞাসা

টেকনিক্যাল এসইও কী? যে কাজ সার্চ ইঞ্জিনকে আপনার পাতা খুঁজে পেতে, ক্রল করতে, রেন্ডার করতে, বুঝতে আর বিশ্বাস করতে দেয় — ইনডেক্সিং, ক্যাননিক্যাল, সাইটম্যাপ, স্ট্রাকচার্ড ডেটা, https, গতি আর মোবাইল। এটি কনটেন্ট ও লিংক থেকে আলাদা।

কত ঘন ঘন টেকনিক্যাল অডিট করা উচিত? বছরে দুবার পূর্ণ অডিট, সঙ্গে উল্লেখযোগ্য যেকোনো পরিবর্তনের পর একটি ছোট যাচাই — নতুন ডিজাইন, মাইগ্রেশন, সিএমএস আপগ্রেড, হোস্ট বদল। টেকনিক্যাল এসইওর বেশিরভাগ বিপর্যয় ধীরে ধীরে আসে না, কোনো একটি ডিপ্লয়ে আসে।

স্ট্রাকচার্ড ডেটা কি র‍্যাঙ্কিং বাড়ায়? সরাসরি নয়। এটি বদলায় আপনার ফলাফল কীভাবে দেখানো হবে — ব্রেডক্রাম্ব, FAQ, তারিখ — যা ক্লিক-থ্রু বাড়ায়। প্রমাণ করতে পারেন না এমন রেটিং বা রিভিউ প্রকাশ করবেন না; এটি সত্যিকারের পরিণতিসহ নীতিভঙ্গ।

সবচেয়ে প্রচলিত টেকনিক্যাল এসইও ভুল কোনটি? স্টেজিং থেকে পড়ে থাকা একটি noindex ট্যাগ। পাতায় এটি অদৃশ্য, ফল বিপর্যয়কর, আর সত্যিকারের সাইটে এটি অহরহ ঘটে। প্রতিটি ডিপ্লয়ের পর দেখে নিন।

এআই সার্চের জন্য কি আলাদা করে অপ্টিমাইজ করতে হবে? বেশিরভাগটাই নয় — সার্ভারে রেন্ডার করা কনটেন্ট, পরিষ্কার হেডিং, সরাসরি উত্তর আর নির্দিষ্ট তথ্য দুটোরই কাজে লাগে। সত্যিকারের আলাদা সিদ্ধান্ত একটাই: robots.txt-এ এআই ক্রলারদের ঢুকতে দেবেন কি না — যা কারিগরি নয়, ব্যবসায়িক ট্রেড-অফ।

র‍্যাঙ্ক করার জন্য কি টেকনিক্যাল এসইওই যথেষ্ট? না। এটি চাহিদা তৈরি করে না, বাধা সরায়। র‍্যাঙ্ক করার যোগ্য কনটেন্টের ওপর এটি একটি গুণক, আর শূন্যের ওপর গুণক শূন্যই।