ব্যক্তিগত পরিবেশে Codex এবং Open Code প্রধান হিসেবে ব্যবহার করার পাশাপাশি কাজের ক্ষেত্রে Claude Code ব্যবহারের অভিজ্ঞতার সারসংক্ষেপ

7 min

language: ja bn en es hi pt ru zh-cn zh-tw

হ্যালো, আমি মুনো (Munou)।

আমার মনে হয় না যে খুব বেশি সামগ্রিক সারসংক্ষেপ আছে, তাই আমি বিভিন্ন জিনিস ব্যবহার করে আমার যা মনে হয়েছে তা বিস্তারিতভাবে (যতটা সম্ভব নিরপেক্ষভাবে) লেখার চেষ্টা করব। এখানে অনেক পজিশন টক (position talk) আছে।

আসলে প্রত্যেকটির ব্যবহারের ধরণ আলাদা হওয়া সত্ত্বেও কি নিরপেক্ষ মূল্যায়ন করা সম্ভব? এটাই প্রশ্ন।

প্রতিটি মডেল সম্পর্কে অনুভূতি

Codex

সাধারণত আমার প্রধান টুল হলো Codex।

বাগ সংশোধনের প্রস্তাব এবং তা বাস্তবায়নের বুদ্ধিমত্তার দিক থেকে এটি OpenAI-এর LLM মডেল, এবং শক্তিশালী ইনফ্রাস্ট্রাকচার পরিবেশে চলার কারণে এর রেসপন্স স্পিড অনেক দ্রুত, যা বিরক্তিকর নয়। এটি ন্যূনতম পরিবর্তনের মাধ্যমে কাজ করে দেয় বলে git diff করার সময় দেখতে সুবিধা হতো, তবে এখন অন্যান্য LLM মডেলগুলোও বুদ্ধিমান হয়ে ওঠায় এই সুবিধাটি কেবল এর মধ্যেই সীমাবদ্ধ নেই বলে মনে হচ্ছে।

সাধারণত সমস্যাযুক্ত ডিবাগ লগ দিলে এটি মোটামুটি সমাধান করে দিতে পারে এবং খুব একটা আটকে যাওয়ার জায়গা নেই।

ব্যক্তিগতভাবে আমার কাছে ওয়েব ভার্সন ChatGPT-এর রিভিউ করার ক্ষমতা অনেক শক্তিশালী মনে হয় এবং ব্যক্তিগত পরিবেশে আমি প্রায়ই ChatGPT-এর রিভিউ এবং Codex-এর মধ্যে যাতায়াত করি। আলোচনার ফলাফল সরাসরি কোডে প্রতিফলিত করা যায় বলে শেষ পর্যন্ত অপ্রয়োজনীয় কমিটও কমে যায়।

তাছাড়া, এটি Codex-এর কোটা খরচ করে না, তাই ChatGPT-এর ওয়েব ভার্সনের সাথে এটি ব্যবহার করার পরামর্শ দিচ্ছি।

আমার ব্যক্তিগত ধারণা হলো, IPO-এর আগে ভ্যালুয়েশন বাড়ানোর জন্য তারা হয়তো রিসেট করার সুযোগ বাড়িয়ে দেবে, তবে বর্তমানে ওয়েব ভার্সনের সাথে যাতায়াতে টোকেন খরচ মোটেও কমছে না, তাই কোনো সমস্যা হচ্ছে না।

আমি মনে করি মাল্টি-এজেন্ট হিসেবে এটি নেটিভলি ব্যবহার করা যায় না, তাই সেক্ষেত্রে অন্য কোনো কোডিং এজেন্ট ব্যবহার করা ভালো হতে পারে।

Open Code

অস্থায়ী bash স্ক্রিপ্ট তৈরি করা বা অগোছালো লগ সরাসরি তদন্ত করা, অথবা একাধিক রিপোজিটরিতে সাধারণ Github Actions প্রয়োগ করার মতো সহজ কাজ বা তদন্তের জন্য আমি এটি ব্যবহার করি। মডেল হিসেবে আমি এখনও বিনামূল্যে ব্যবহারযোগ্য Xiaomi-এর মডেল, Mimo V2.5 প্রধানত ব্যবহার করছি এবং বিশেষ করে মাল্টি-এজেন্ট দিয়ে তদন্তের কাজ করানোর সময় এর দক্ষতা বেশ ভালো।

আমি API এন্ডপয়েন্টের প্রকৃত রেসপন্স তদন্ত করে তা সারসংক্ষেপ করতে বলি এবং সরাসরি Codex-এর মাধ্যমে বাস্তবায়ন করি। যেহেতু এটি ডেটা থেকে শেখে, তাই সেক্ষেত্রে আমি সাথে সাথে API Key রিভোক (Revoke) করে দিই।

নিরাপত্তা সচেতনতা কিছুটা শিথিল হলেও, API Key রক্ষার জন্য ঘুরিয়ে ফিরিয়ে কাজ করার চেয়ে এটিই সবচেয়ে সহজ এবং ভালো।

মূলত কোডিংয়ের প্রধান কাজগুলোতে আমি এটি খুব একটা ব্যবহার করি না।

কোটার কথা বললে, এটি ৯ ঘণ্টার কোটা বলে মনে হয়, তবে এখন পর্যন্ত মাত্র একবারই লিমিট শেষ হয়েছে, তাই ফ্রি কোটা হিসেবে এটি বেশ পর্যাপ্ত বলে আমি মনে করি।

তবে কোডিংয়ের ক্ষেত্রে বর্তমানে আমি Neuralwatt ব্যবহার করে GLM-5.2 ব্যবহার করছি এবং এর বিশাল কনটেক্সট উইন্ডোর কারণে Codex-ও যা খুঁজে পায় না এমন নিরাপত্তা সংক্রান্ত তদন্তের কাজ দিলে এটি বেশ ভালো খুঁজে দেয়, যা খুব কাজের। নিরাপত্তা সংক্রান্ত কাজ ছাড়াও কোডিংয়ের ক্ষেত্রে GLM-5.2 বেশ ব্যবহারিক বলে আমি মনে করি। Kimi কখনও ব্যবহার করিনি তাই জানি না।

নেতিবাচক দিক বলতে গেলে, বারবার চালু এবং বন্ধ করলে এটি /tmp/ ফোল্ডারে প্রচুর অস্থায়ী ফাইল জমা করে ফেলে, যার ফলে এক সময় দেখা যায় এটি আর চালু হচ্ছে না।

Claude Code

সামগ্রিকভাবে এর আউটপুট অনেক বেশি হওয়ায় এটি ফ্লাড (flood) করে ফেলে। শুরুতে অ্যাপ কোডিং করার সময় এটি ভালো হতে পারে, তবে ব্যক্তিগত উন্নয়নে এটি ব্যবহার করতে চাই কি না তা বলা কঠিন। মাঝে মাঝে এটি প্রয়োজনের চেয়ে বেশি ইমপ্লিমেন্টেশন করে ফেলে যা সমস্যার সৃষ্টি করে।

নিরাপত্তা তদন্ত সংক্রান্ত কাজের ক্ষেত্রে বর্তমানে Fable-এর সেন্সরশিপ এত বেশি যে এটি ব্যবহারের অনুপযোগী হয়ে পড়েছে।

আর ব্যক্তিগত প্ল্যানেও এটি সম্ভবত একই রকম, ওয়েব ভার্সনের চ্যাট কোটার সাথেই এটি যুক্ত, তাই লিমিট শেষ হয়ে গেলে আর ব্যবহার করা যায় না। তবে বিজনেস প্ল্যানে ChatGPT/Codex-ও আলাদা কোটা হিসেবে গণ্য হতো বলে মনে হয়, তাই বাস্তবে হয়তো এটি একই রকম।

তবে আমার প্রিয় ডেভেলপার xroche অনেকদিন ধরে মেইনটেইন না করা HTTrack-কে Claude ব্যবহার করে পুনরায় মেইনটেইন করা শুরু করেছেন, তাই হয়তো আমি কেবল Codex-এ অভ্যস্ত হয়ে গেছি বলেই আমার মধ্যে এই নেতিবাচক ধারণা কাজ করছে।

আরেকটি নেতিবাচক ধারণার কথা বললে, Anthropic কোম্পানি ব্যবসায়িক মার্কেটিংয়ে খুব দক্ষ বলে ধরা যায়, তবে মাঝে মাঝে মনে হয় বাস্তবের সাথে এর কিছুটা অমিল আছে। হয়তো IPO-এর আগে ভ্যালুয়েশন বাড়ানোর জন্য তারা এগুলো করছে, তবে নিচের মতো কিছু কার্যক্রম নিয়ে প্রশ্ন জাগে:

এগুলো হয়তো মার্কিন শিল্প রক্ষার মুখপাত্র হিসেবে কাজ করতে পারে, তবে চীনের সেমিকন্ডাক্টর সংক্রান্ত বিধিনিষেধের ক্ষেত্রে কিছুটা সহানুভূতি জাগে এবং এটি রাজনৈতিকভাবে কতটা টেকসই হবে তা নিয়ে সন্দেহ আছে।

তাছাড়া অতীতে FTX / Alameda-এর শেয়ার থাকাটাও কিছুটা অস্বস্তিকর। যদিও দেউলিয়া হওয়ার পর তা নিষ্পত্তি হয়ে গেছে এবং এটি কেবল একটি বিনিয়োগ ছিল, তবুও কেমন যেন একটা অনুভূতি কাজ করে।

উপসংহার

সত্যি বলতে এখন বেশিরভাগ মডেলই খুব উন্নত, তাই সঠিকভাবে ব্যবহার করলে বাস্তবায়নের দিক থেকে খুব একটা পার্থক্য নেই বলে মনে হয়। তবে যারা কেবল Open Code দিয়ে কাজ চালাচ্ছেন, তাদের একবার Codex ট্রাই করে দেখার অনুরোধ রইল।

সমাপ্ত।

Related Posts