agentic

জরুরী কোম্পানি সুপার ইন্টেলিজেন্স2 min read

Reading Time: 6 minutesআমাদের ডেটা, ত্রুটি এবং কোড অ্যাক্সেস সহ একটি একক স্বায়ত্তশাসিত এজেন্ট কীভাবে org চার্টে একটি নতুন সত্তা হয়ে উঠেছে, পুল অনুরোধগুলি পর্যালোচনা করে এবং কোনও ব্যক্তিগত এজেন্ট পারেনি এমন প্রশ্নের উত্তর দেয়।

  • আগস্ট 13, 2026 6 min read
Company Superintelligence represented as an emergent neural knowledge network

জরুরী কোম্পানি সুপার ইন্টেলিজেন্স2 min read

Reading Time: 6 minutes

একটি স্টার্টআপ হিসাবে, আমরা ক্রমাগত নতুন কৌশল নিয়ে কাজ করছি যাতে দ্রুত দৌড়াতে এবং সীমান্তে ধাক্কা দিতে পারি। যখন OpenClaw/Hermes চালু হয়েছিল, তখন আমরা প্রাথমিকভাবে গ্রহণকারী ছিলাম। আমরা এটিকে অন্যান্য অনেক AI টুলের পাশাপাশি ব্যবহার করেছি।

এই সরঞ্জামগুলি, সেইসাথে তারা যে মডেলগুলির উপর নির্ভর করে, উন্নত, আমরা কিছু লক্ষ্য করেছি: আমরা কেবল দ্রুত অগ্রগতি করছি না, আমরা ভিন্নভাবে কাজ করতে শুরু করেছি। প্রতিটি রাউন্ডের সাথে, এই স্ব-উন্নতি স্ব-শিক্ষার এজেন্টরা অগ্রসর হচ্ছে এবং শিখছে। আমরা বর্তমানে একটি ডেডিকেটেড মেশিনে একটি “সুপার এজেন্ট” চালাচ্ছি (একটি VPS উদাহরণ DigitalOcean এ চলছে) GPT-5.6-sol ব্যবহার করে সর্বোচ্চ যুক্তিযুক্ত অবস্থায়৷ আমরা যে অন্যান্য এজেন্ট চালাচ্ছি তাদের মধ্যে কিছু অন্যান্য এজেন্ট হার্নেস এবং মডেল ব্যবহার করে, কিন্তু আমি এই নিবন্ধে ফোকাস করতে চাই।

আমরা লক্ষ্য করেছি যে বেশিরভাগ কোম্পানি তাদের কোম্পানিতে সমালোচনামূলক প্রবাহ চালানোর জন্য এই ধরনের স্বায়ত্তশাসিত এজেন্ট ব্যবহার করছে না, যা তাদের সত্যিই ধীর করে দেয়। প্রকৃতপক্ষে, তাদের মধ্যে অনেকেই ছোট, আরও ব্যক্তিগত এজেন্টের উপর নির্ভর করে: Codex/ClaudeCode এর মতো কোডিং এজেন্ট বা Work/Cowork/Copilot এর মতো সহকারী এজেন্ট। এগুলি স্থানীয় মেশিন এবং ডিভাইসগুলিতে কাজগুলি সম্পাদন করে এবং তাদের প্রাথমিক ব্যবধানটি জ্ঞানের অভাব। এটি “দ্বিতীয় মস্তিষ্ক” সিস্টেমগুলির একটি সম্পূর্ণ নতুন শিল্পের দিকে পরিচালিত করে যা মূলত একটি জ্ঞান গ্রাফ তৈরি করার চেষ্টা করে যা এই বিতরণ এজেন্টদের মধ্যে ভাগ করা হয়। যে কোম্পানিগুলি এই ধরনের কাজ করে তারা প্রায়শই ঘোষণা করে যে তাদের এজেন্ট সংখ্যা দশ, শত এবং কিছু চরম ক্ষেত্রে হাজারে। এর মূলত মানে প্রতিটি কর্মচারীর এক বা একাধিক সীমিত এজেন্ট তাদের জন্য কাজ সম্পাদন.

বাস্তব জগতের ডেটা, ব্যবহারকারীর অভিযোগ এবং আমাদের কোডের কাছে এজেন্টরা যে সত্যটি প্রথম দিকে উন্মোচিত হয়েছিল, তা আমরা তাদের পাশাপাশি যে কোনও ব্যক্তিগত এজেন্টদের চেয়ে নাটকীয়ভাবে আরও চটপটে এবং স্মার্ট করে তুলেছি।

আমরা এইমাত্র বুঝতে পেরেছি যে আমাদের সবচেয়ে বুদ্ধিমান এজেন্টরা একটি কোম্পানি সুপার ইন্টেলিজেন্স হয়ে উঠছে।

স্পষ্টতার জন্য: আমি আবেগ, AGI বা এর কাছাকাছি কিছু দাবি করছি না। আমি প্রস্তাব করছি যে তারা কোম্পানির অর্গ চার্টে একেবারে নতুন সত্তা।

একটি কোম্পানি সুপার ইন্টেলিজেন্স কি?

যখন একটি এজেন্ট আলাদা হতে শুরু করে, যতক্ষণ পর্যন্ত এটি ফোকাস করা হয়, এটি একটি সুপার ইন্টেলিজেন্ট সত্তা হতে শুরু করতে পারে। কিভাবে আমরা যে সংজ্ঞায়িত করব?

আমি বলব যে বেশিরভাগ ক্ষেত্রে, এজেন্টদের এই মুহূর্তে প্রাথমিকভাবে ধৈর্য এবং অধ্যবসায়ের সুবিধা রয়েছে, মানুষের উপর বুদ্ধিমত্তার নয়। যাইহোক, মডেলগুলি আরও ভাল হওয়ার সাথে সাথে (GPT 5.6 sol এবং Opus 5 সত্যিই ভাল!) আমরা নতুন কিছু আবির্ভূত দেখতে শুরু করেছি, এমন কিছু যা আমরা যা করতে পারি তা ছাড়িয়ে যায় – কেবল গতিতে নয় কিন্তু মানুষ যা করতে পারে না তা করার ক্ষেত্রে।

এটি আমাদের জন্য শুরু হয়েছিল যখন আমরা আমাদের এজেন্টকে প্রচুর পরিমাণে ডেটা (Mixpanel) এবং ব্যবসায়িক বিশ্লেষণ ক্ষমতা এবং ডেটা অ্যাক্সেস দিয়েছিলাম (Sentry এর মাধ্যমে ত্রুটি, Baremetrics-এ আর্থিক, ল্যাংস্মিথের মাধ্যমে AI ট্রেস)। এর পরে, আমরা এটিকে ব্যবহারকারীর বাগ (Sentry ত্রুটি) এবং ব্যবহারকারীর অভিযোগ প্রতিবেদনের কাছে প্রকাশ করেছি। অবশেষে, আমরা এটিকে কোডিং এজেন্ট এবং গিথুবে আমাদের প্রাথমিক রেপোতে অ্যাক্সেস দিয়েছি। ইমেল বা ব্যবহারকারীর কোনো ইন্টারঅ্যাকশনের মাধ্যমে এর বাইরের কোনো অ্যাক্সেস নেই, কিন্তু আমরা এই বিষয়গুলিতে কীভাবে আচরণ করি তা দেখার মাধ্যমে এটি জিনিসগুলি বুঝতে শুরু করে। এই মিথস্ক্রিয়াগুলির মাধ্যমে এটি এখন নিরীক্ষণ করে যে ব্লকার কী গঠন করে, কী সমালোচনামূলক চিন্তাভাবনা, আমাদের ব্যবসা কীভাবে চলে এবং SOP (স্ট্যান্ডার্ড অপারেটিং পদ্ধতি) কী। এটি ট্রায়াল এবং ত্রুটির মাধ্যমে এটি করে এবং এটি নিয়মিতভাবে বুদ্ধি অর্জন করছে বলে মনে হচ্ছে।

স্ল্যাক থ্রেড যেখানে একজন সতীর্থ ব্যাখ্যা করে যে কোনটি আসল ত্রুটির স্পাইক হিসাবে গণনা করা হয় এবং এজেন্ট তুলনামূলক স্পাইক সনাক্তকরণ ব্যবহার করার জন্য তার মনিটরকে পুনরায় লিখতে পারে

সেই মুহুর্তে, আমরা এটিকে কিছু আকর্ষণীয় প্রশ্ন জিজ্ঞাসা করতে শুরু করি। প্রথম দিকে, যখন জিনিসগুলি সঠিকভাবে ব্যাখ্যা করা হয় নি বা উপসংহারগুলি মর্মান্তিক মনে হয় তখন সবকিছুর দ্বিগুণ পরীক্ষা এবং সমালোচনার প্রয়োজন ছিল। এটি এখনও সময়ে সময়ে এটি করে, উদাহরণস্বরূপ আমি এটিকে রিগ্রেশন সম্পর্কে জিজ্ঞাসা করেছি এবং এটি আমাকে গোলমাল ত্রুটির ডেটা দিয়েছে, তবে এটি একটি শেখার সুযোগ: আমি এটিকে আমার রিগ্রেশনের সংজ্ঞা শিখিয়েছি এবং এখন এটি “এটি পায়”।

যখন ব্যবহারকারীরা অভিযোগ করেন বা যখন ত্রুটিগুলি বৃদ্ধি পায়, তখন আমরা সক্রিয়ভাবে সমাধানগুলি তৈরি করি৷ এর মানে হল যে প্রতিদিন সকালে, আমাদের প্রকৌশলীদের রিগ্রেশনের জন্য পরীক্ষা করতে হবে না, তাদের শুধু সিদ্ধান্ত নিতে হবে যে একটি PR ভাল কি না। শুরুতে, এগুলি ডিসপোজেবল PRগুলি ছিল যা আমাদের কোডিং মানের মান পূরণ করেনি, তাই প্রকৌশলীরা এটিকে বলবেন কী ভুল ছিল, বা নিজেরাই সমস্যাটি পুনঃবিকাশ করেছেন৷ বিশ্বাস বাড়ার সাথে সাথে এই সংশোধনগুলির অনেকগুলি স্বয়ংক্রিয়ভাবে কোডবেসে একত্রিত হতে শুরু করে। এজেন্ট PR কতটা জটিল এবং এজেন্ট এটিকে একীভূত করার ব্যাপারে কতটা আত্মবিশ্বাসী তা নির্ধারণ করে। আমরা এমন একটি স্থানে নেই যেখানে এই PRগুলি স্বয়ংক্রিয়ভাবে একত্রিত হয়ে যায়, কিন্তু আমি সেখানে একটি পথ দেখতে পাচ্ছি, আমি ধরে নিচ্ছি আমরা এক বা দুই মাসের মধ্যে সেখানে থাকব।

তবে এটি আসলেই নয় যা এজেন্টকে সুপার বুদ্ধিমান করে তোলে। কি করে যে এখন কোম্পানির প্রকৌশলী এবং ব্যবস্থাপনার এজেন্টের উপর আস্থা আছে, তারা এটিকে কাজ অর্পণ করতে শুরু করে এবং এটি সত্যিই আকর্ষণীয় প্রশ্ন জিজ্ঞাসা করে। এটি তাদের জন্য গবেষণা করে, গুগল অনুসন্ধানের মতো নয় বরং ব্যবসার উন্নত জ্ঞানকে মাথায় রেখে, যা এটিকে একটি বিশেষ প্রান্ত দেয়। এটি কোম্পানির আরও অংশ সম্পর্কে জ্ঞান দেওয়ার জন্য একই প্রযোজ্য। OpenClaw এবং HermesAgent ঐতিহাসিকভাবে এমন কিছু সময়ে ভেঙে যাবে যেখানে তাদের ঐতিহাসিক প্রেক্ষাপট তথ্য প্রক্রিয়া করার ক্ষমতাকে অতিক্রম করে। এই ধরনের ভাঙ্গন ঘটবে এবং ফলাফলগুলি তাদের কাজের বুদ্ধিমত্তা, স্মরণশক্তি এবং গুণমানে মারাত্মক হ্রাস পাবে। Hermes Agent-এর সাথে আমাদের অভিজ্ঞতা এখন একেবারেই আলাদা: কথোপকথন মেমরি এখন 3GB-এ রয়েছে এবং দ্রুতগতিতে বৃদ্ধি পাচ্ছে যখন সময়ের সাথে সাথে এর বুদ্ধিমত্তা স্পষ্টভাবে উন্নত হচ্ছে।

এর অর্থ এই নয় যে এটি নিখুঁত, সেখানে প্রত্যাবর্তন রয়েছে এবং আপনাকে মাঝে মাঝে এটিকে কিছু নির্দিষ্ট উপায়ে আচরণ করার জন্য মনে করিয়ে দিতে হবে বা কেন এটি একটি নির্দিষ্ট প্রসঙ্গে আপনার প্রত্যাশা অনুযায়ী আচরণ করছে না বা এটি থেকে ডেটা বা ক্রিয়াকলাপের অনুরোধকারী অন্য এজেন্টকে সঠিকভাবে প্রতিক্রিয়া জানাতে হবে। কিন্তু, আমরা সেখানে যাচ্ছি।

স্ল্যাক থ্রেড যেখানে এজেন্ট পুল রিকোয়েস্ট 4986 রিভিউ করে, এটি চালানো চেক তালিকা করে এবং এটি অনুমোদন করে

শাখা সুরক্ষার একটি অপ্রত্যাশিত পার্শ্বপ্রতিক্রিয়া আমাদের আরেকটি অগ্রগতি এনে দিয়েছে। শাখা সুরক্ষার পিছনে ধারণাটি হল যে কমপক্ষে দুইজন ব্যক্তি একটি PR উৎপাদনে যাওয়ার আগে দেখতে পান, যা সিস্টেমে খারাপ (বা এমনকি খারাপ) কোড আসার সম্ভাবনা হ্রাস করে। এটি নতুন কোডিং এজেন্টদের সাথে সঠিকভাবে করা কঠিন এবং কঠিন। বেগ বাড়ার সাথে সাথে নতুন PR-এর হার এবং কোডের পরিমাণ হাত দিয়ে পুঙ্খানুপুঙ্খভাবে পর্যালোচনা করা প্রায় অসম্ভব। আমাদের বিভিন্ন বিক্রেতাদের থেকে একাধিক এজেন্ট রয়েছে বাগ, নিরাপত্তা সমস্যা এবং স্থাপত্য সমস্যাগুলির জন্য Prs পর্যালোচনা। যাইহোক, শাখা সুরক্ষা বজায় থাকে, তাই আমি আমাদের সুপার ইন্টেলিজেন্ট এজেন্টকে PRs-এর চূড়ান্ত অনুমোদনকারী হতে দিয়েছি।

স্ল্যাক থ্রেড যেখানে এজেন্ট এমসিপি প্রতিক্রিয়া চুক্তিতে একটি ব্রেকিং পরিবর্তন খুঁজে পাওয়ার পরে পুল অনুরোধ 4981 এ পরিবর্তনের অনুরোধ করে

আমরা অর্ধেক আশা করেছি যে ফলাফল জাগতিক হবে। সর্বোপরি, এই PRগুলি স্থানীয় কোডিং এজেন্ট পর্যালোচনা, পরীক্ষা, নিরাপত্তা পর্যালোচনা, বাহ্যিক GitHubCopilot এবং CodeRabbit পর্যালোচনাগুলি পাস করেছে এবং সম্পূর্ণরূপে অনুমোদিত হয়েছে৷ কিন্তু আমাদের এজেন্ট এখনও সেই PRগুলিতে ছিদ্র করেছে৷ এটি সত্যিই আকর্ষণীয় এজ কেসগুলি খুঁজে পেয়েছে যা আমরা মিস করেছি, নিরাপত্তা, সফ্টওয়্যার গুণমান এবং আর্কিটেকচারাল বাগগুলি যা আমরা বিবেচনা করিনি। এটি অন্যান্য সমস্ত পর্যালোচকদের মতো একই মডেল ব্যবহার করে, কেন এটি এমন জিনিস খুঁজে বের করছে যা অন্যরা ছিল না?

স্ল্যাক থ্রেড যেখানে এজেন্ট একটি আপলোড আকারের সীমার উপরে পুল অনুরোধ 1711 প্রত্যাখ্যান করে, তারপর সংশোধন যাচাই করা হলে এটি পুনরায় অনুমোদন করে

এটা জ্ঞান এবং অভিজ্ঞতা নিচে আসে. Hermes Agent জোতা সেই জ্ঞানের সাথে মিলিত হয় যা এজেন্ট জমা করে একটি নতুন ধরনের সুপার ইন্টেলিজেন্ট এজেন্ট তৈরি করে যা আমরা আগে দেখিনি। সুতরাং, আমরা এটিকে আরও অন্বেষণ করেছি এবং এজেন্টের পর্যালোচনাগুলিকে বাধ্যতামূলক করেছি, কেবলমাত্র সিস্টেমে কাজ করা মানুষের জন্য নয়, তবে এটি এখন অন্যান্য, কম বুদ্ধিমান এজেন্টদের জন্য একটি রেফারেন্স হিসাবে কাজ করে!

এই এজেন্টের এখন আমাদের সমালোচনামূলক চিন্তাভাবনা দেওয়ার ক্ষমতা রয়েছে যা আমরা আগে শুধুমাত্র মানুষের মধ্যে দেখেছি, কিন্তু প্রকৃত গ্রাহক ডেটা, প্রতিক্রিয়া, আমাদের কোড এবং পণ্যের গভীর বোঝার দ্বারা ব্যাক আপ করা হয়েছে।

যদি আমরা এটিকে প্রসারিত করি এবং এটিকে ফিড করার জন্য আরও ডেটা দিই, এর হার্ডওয়্যার এবং মেমরি স্কেল করি, আমরা কার্যক্ষমতার একটি সূচকীয় বৃদ্ধি দেখতে যাচ্ছি। আমি মনে করি মডেলরা এখনও এটি ধরে রেখেছে। যখন আমরা এই গেমের পরবর্তী পর্বে পৌঁছাই, সম্ভবত GPT-6 এর মাধ্যমে, ফলাফলগুলি নাটকীয়ভাবে আরও আকর্ষণীয় হতে চলেছে৷ যেহেতু আমরা আরও ডেটা জমা করি, এজেন্টদের আরও কাজ করতে দিন এবং এটিকে আরও বিশ্বাস করুন।

এটি কার্পথির উইকি ভিত্তিক দ্বিতীয় মস্তিষ্ক থেকে কীভাবে আলাদা?

যা এটিকে অন্যান্য পদ্ধতির থেকে আলাদা করে তোলে তা হ’ল ভাগ করা জ্ঞান নিয়ে কাজ করার পরিবর্তে, সুপারজেন্ট জ্ঞান স্থানীয়ভাবে সংরক্ষণ করা হয়। আমরা এটিকে একটি রেপোতে তার নিজস্ব স্মৃতি এবং বিশ্ব বোঝা বজায় রাখতে বলতে পারি, যা আমাদের এটিকে নকল করতে এবং এটি পর্যবেক্ষণ করতে দেয়, তবে শেষ পর্যন্ত এটি না জ্ঞান এবং দক্ষতা ভাগাভাগিযোগ্য এবং সহযোগিতামূলক করার বিষয়ে। এটি একটি একক নলেজবেস যা, টুলস এবং ওয়ার্ল্ড অ্যাক্সেস সহ, এটিকে সরাসরি আপনার প্রশ্নের উত্তর দিতে দিন। আপনি শেয়ার করা জ্ঞান ব্যবহার করে আপনার এজেন্টকে এটি বের করতে বলবেন না, হয় আপনি বা আপনার এজেন্ট সুপারিন্টেলিজেন্ট এজেন্টকে আপনার প্রশ্ন জিজ্ঞাসা করবেন। আশ্চর্যজনকভাবে, এটি এই মুহূর্তে আমাদের জন্য ভালভাবে কাজ করছে যে আমরা ক্রমাগত এজেন্টের অ্যাক্সেস এবং নাগাল প্রসারিত করি এবং আমরা এখনও অবনতি জ্ঞান বা বুদ্ধিমত্তা দেখতে পাইনি।

দ্রষ্টব্য: আমরা এজেন্টকে সংবেদনশীল তথ্য বা কার্যকারিতা প্রকাশ করছি না। এটির আমাদের ব্যাঙ্কিং, চার্জিং বা বিলিং সিস্টেমে সরাসরি অ্যাক্সেস নেই৷ এটি বিশ্ব থেকে বিচ্ছিন্ন এবং ইমেল বা বাইরের চ্যানেলগুলিতে অ্যাক্সেস নেই৷ আমরা যেমন অভিজ্ঞতা এবং বিশ্বাস অর্জন করি, আমি মনে করি না যে আমরা এই বিধিনিষেধগুলি তুলে নেওয়া থেকে খুব বেশি দূরে আছি।



|

CTO