Agent Architectures, Part 1: CodeAct — The Agent That Writes and Runs Its Own Code
LLM ቁጥር አያሰላም — ይገምታል። CodeAct ያንን ይቀይራል፦ ኤጀንቱ ራሱ ኮድ ጽፎ ያስኬደዋል፣ እውነተኛውን ውጤት ይመልሳል። እንዴት እንደሚሠራ፣ የት እንደሚጠቅም፣ እና ትልቁ የደኅንነት ጥንቃቄ።

ሰላም። አዲስ ተከታታይ ጽሑፍ እንጀምር። ስድስት ክፍል — ኤጀንት እንዴት እንደሚሠራ ከውስጡ። ☕
🧮 በአንድ ጥያቄ እንጀምር
የመርካቶው ሱቅ ባለቤት ረዳቱን ጠየቀ፦
“ባለፈው ወር ከየትኛው ምርት ላይ በጣም አትርፌያለሁ?”
ይህ ቀላል ጥያቄ ይመስላል። ግን እውነተኛ ስሌት ይጠይቃል፦ 400 ሽያጮችን መደመር፣ ወጪ መቀነስ፣ በምርት መከፋፈል፣ ማወዳደር።
እና እዚህ ጋ ትልቅ ችግር አለ።
በክፍል 1 እንዳልነው — LLM የሚሠራው አንድ ነገር ነው፦ ቀጣዩን ቃል መገመት። ቁጥር ሲያይም ያንኑ ያደርጋል — ያሰላል ብለህ ታስባለህ፤ በእውነት ግን ይገምታል።
ለዚህ ነው AI ትልቅ ሒሳብ ሲሰጠው የሚሳሳተው። በክፍል 4 እንዳየነው — በሙሉ በራስ መተማመን የተሳሳተ ቁጥር ይሰጥሃል።
💡 CodeAct የሚፈታው ይህንን ነው
ሐሳቡ ቀላል ግን ኃይለኛ ነው፦
ኤጀንቱ መልሱን አይገምትም። ኮድ ጽፎ ያስኬደዋል፤ እውነተኛውን ውጤት ይመልስልሃል።
ስሙም ከዚያ ነው፦ Code + Act — ኮድ ጽፎ መሥራት።
ለጥያቄያችን ኤጀንቱ የሚያደርገው፦
- 1️⃣ ጥያቄውን ይረዳል — “በምርት የተከፋፈለ ትርፍ ያስፈልጋል”
- 2️⃣ ኮድ ይጽፋል — የሽያጭ ፋይሉን የሚያነብ፣ የሚደምር፣ የሚያወዳድር
- 3️⃣ ያስኬደዋል — በእውነተኛ ኮምፒውተር ላይ
- 4️⃣ ውጤቱን ያያል — “ሲሚንቶ፣ 48,000 ብር ትርፍ”
- 5️⃣ በሰው ቋንቋ ይመልስልሃል
ልዩነቱ ይኸው ነው፦ ቁጥሩ የመጣው ከኮምፒውተር ስሌት ነው እንጂ ከሞዴሉ ግምት አይደለም። ኮምፒውተር ደግሞ ሲደምር አይሳሳትም።
🔧 ከተለመደው “መሣሪያ መጠቀም” በምን ይለያል?
ጥሩ ጥያቄ። ስለ MCP ስንጽፍ ኤጀንት መሣሪያ እንደሚጠቀም አይተናል። ልዩነቱ ምንድን ነው?
የተለመደው መንገድ፦ ለኤጀንቱ የተዘጋጀ ዝርዝር ትሰጠዋለህ — “መደመር”፣ “ማባዛት”፣ “ፋይል ማንበብ”። ከዚያ ዝርዝር ውጭ ምንም ማድረግ አይችልም። አዲስ ነገር ሲፈለግ አንተ አዲስ መሣሪያ መጻፍ አለብህ።
የCodeAct መንገድ፦ አንድ መሣሪያ ብቻ ይሰጠዋል — “ኮድ ጻፍና አስኪድ”። እና በዚያ አንድ መሣሪያ ውስጥ ሺህ ነገር ማድረግ ይችላል።
በምሳሌ፦ የመጀመሪያው ለእያንዳንዱ ሥራ የተለየ መሣሪያ የያዘ ሳጥን ነው። ሁለተኛው ደግሞ አንድ ዎርክሾፕ ነው — የሚያስፈልገውን መሣሪያ ራሱ ይሠራል።
ተመራማሪዎች ይህን “አንድ የተግባር ቦታ” (unified action space) ይሉታል። አሥር መሣሪያ ከመያዝ ይልቅ አንድ — ግን ሁሉን የሚችል።
✅ የት ይጠቅማል?
- 🧮 ስሌት። ሒሳብ፣ ትርፍ፣ ግብር፣ ወለድ — ማንኛውም ቁጥር።
- 📊 የመረጃ ትንተና። ትልቅ የሽያጭ ፋይል፣ የደንበኞች ዝርዝር፣ የስቶክ መዝገብ።
- 📁 ብዙ ፋይል ማደራጀት። በመቶ የሚቆጠሩ ፋይሎችን መሰየም፣ መከፋፈል፣ መቀየር።
- 📈 ግራፍ መሥራት። ኮድ ጽፎ ስዕል ያወጣል።
- 🔄 ቅርጸት መቀየር። ከPDF ወደ ሠንጠረዥ፣ ከሠንጠረዥ ወደ ሪፖርት።
አንድ ቀላል ምልክት፦ ሥራው ቁጥር ወይም ብዙ ፋይል የሚነካ ከሆነ — CodeAct ያስፈልጋል።
❌ የት አያስፈልግም?
እዚህም ግልጽ እንሁን። CodeAct ሁልጊዜ አያስፈልግም፦
- ደብዳቤ መጻፍ · ጽሑፍ ማጠቃለል · መተርጎም · ጥያቄ መመደብ
እነዚህ ቋንቋ ብቻ ናቸው። በንድፎቹ ጽሑፍ እንዳልነው — ንድፉን ከሥራው ጋር አዛምድ። ለቀላል ሥራ ኮድ ማስኬድ አላስፈላጊ ወጪና አደጋ ነው።
⚠️ አሁን — ትልቁ ጥንቃቄ
እዚህ ጋ በጣም ተጠንቀቅ። ይህ ክፍል ከሁሉ ይበልጣል።
“ኮድ ያስኬዳል” ማለት በኮምፒውተርህ ላይ ትእዛዝ ይፈጽማል ማለት ነው። እና ያን ኮድ የጻፈው ሰው አይደለም — ሞዴሉ ነው። ሞዴል ደግሞ ይሳሳታል።
ምን ሊፈጠር ይችላል?
- 🗑️ የተሳሳተ ኮድ ፋይል ሊያጠፋ ይችላል።
- ♾️ የማያልቅ ዙር ውስጥ ገብቶ ኮምፒውተሩን ሊይዝ ይችላል።
- 🌐 ወደ ኢንተርኔት ወጥቶ ያልተጠበቀ ነገር ሊያደርግ ይችላል።
- 🔓 ሰነዶችህን ሊያነብ ይችላል — ሊደርስባቸው የማይገባውንም።
ይህ ንድፈ ሐሳብ አይደለም። በቅርቡ እንደዘገብነው የAI ወኪሎች ከሙከራ አካባቢ አምልጠው ውጪ ያሉ ሥርዓቶችን የነኩበት ሁኔታ ተከስቷል።
🛡️ አራቱ የደኅንነት ደንቦች
- 1. በተዘጋ ሳጥን ውስጥ አስኪደው። በእንግሊዝኛ sandbox ይባላል — ኮዱ የሚሠራበት የተለየ አካባቢ። ከዚያ ውጭ መድረስ አይችልም። የሜታ Muse ለእያንዳንዱ ተጠቃሚ የተለየ ኮምፒውተር የሚሰጠው ለዚህ ነው።
- 2. የጊዜ ገደብ አስቀምጥ። “ከ30 ሰከንድ በላይ አይሠራም” በል። የማያልቅ ዙር ይቆማል።
- 3. ትንሹን ፈቃድ ብቻ። ማንበብ ብቻ የሚያስፈልገው ቦታ የመጻፍ ፈቃድ አትስጥ። ኢንተርኔት የማያስፈልገው ቦታ ኢንተርኔት አትስጥ።
- 4. ገንዘብ ሲነካ ሰው ይወስን። አምስተኛው ንድፍ ትዝ ይልሃል? በአረጋጋጭ የተጠበቀ። CodeAct ከክፍያ ጋር ሲገናኝ ያ ግዴታ ነው።
ወርቃማው ሕግ፦ ኤጀንቱ የሚያስኬደው ኮድ የሚደርስበት ቦታ — አንተ ልታጣው የምትችለው መሆን አለበት።
🇪🇹 ለኢትዮጵያ ገንቢዎች
1. ለአማርኛ ጥሩ ዜና አለ። ትዝ ይልሃል አማርኛ 6 እጥፍ ውድ መሆኑ? CodeAct ያንን ይቀንሳል። ለምን? ኮድ በእንግሊዝኛ ነው የሚጻፈው። ኤጀንቱ ረጅም የአማርኛ ሰንጠረዥ ከመተንተን ይልቅ አጭር ኮድ ጽፎ ያስኬዳል — ቶከኑ በእጅጉ ያንሳል።
2. ለሱቅና ለትንሽ ንግድ ተስማሚ ነው። በምርት መገንባት ጽሑፋችን እንዳልነው — ብዙ የኢትዮጵያ ንግድ የሚፈልገው ይህንኑ ነው፦ የሽያጭ መዝገብ ማስላት፣ ሪፖርት ማውጣት፣ ደረሰኝ ማዘጋጀት። ሁሉም ቁጥር ነው። ሁሉም CodeAct ነው።
3. ግን በቀጥታ በንግድ ኮምፒውተር ላይ አትጀምር። በተለየ ኮምፒውተር ወይም በተለየ ፎልደር ሞክር። ሲረጋገጥ ብቻ አሳድግ።
🎓 ማጠቃለያ
- CodeAct ማለት፦ ኤጀንቱ መልሱን ከመገመት ይልቅ ኮድ ጽፎ ያስኬዳል
- ጥቅሙ፦ ቁጥሮች እውነተኛ ይሆናሉ — ግምት አይደሉም
- ልዩነቱ፦ አንድ የተግባር ቦታ እንጂ መቶ የተለያየ መሣሪያ አይደለም
- የሚያስፈልገው፦ ስሌት፣ መረጃ፣ ፋይሎች — ቋንቋ ብቻ ሲሆን አይደለም
- ጥንቃቄው፦ ሳጥን፣ የጊዜ ገደብ፣ ትንሽ ፈቃድ፣ ለገንዘብ ሰው
እና አንድ ነገር አስተውል፦ ይህ ጽሑፍ ራሱ በCodeAct ተጽፏል። የቶከን ቁጥሮችን ስንለካ ገምተን አልጻፍንም — ኮድ ጽፈን አስኬደን ነው። ያ ልዩነቱ ነው። 🙂
➡️ በሚቀጥለው ክፍል
ክፍል 2፦ Agentic RAG። ተራ RAG ሰነድ ያወጣል። Agentic RAG ግን ፍለጋውን ራሱ ያቅዳል፣ የትኛው ምንጭ እንደሚታመን ይወስናል፣ እና ሁሉንም አዋህዶ አንድ መልስ ይሰጣል። ለአማርኛ ሰነዶች ለምን ወሳኝ እንደሆነ እናያለን።
In brief (English): Part 1 of a six-part Amharic series on agent architectures. CodeAct addresses a core limitation: an LLM does not calculate, it predicts the next token — so when given arithmetic it produces a plausible-looking guess rather than a computed result. CodeAct changes the mechanism: instead of answering directly, the agent writes code and executes it, then reports the real output. The architectural difference from conventional tool use is the unified action space — rather than exposing a fixed menu of predefined tools that must be extended whenever a new need arises, the agent gets one capability (write and run code) that covers a thousand tasks. Best suited to calculation, data analysis, bulk file operations, chart generation and format conversion; unnecessary for pure language work like drafting, summarising, translating or classifying. The critical caveat is security: executing model-written code means running commands on a real machine, with risks including file deletion, infinite loops, unintended network access and reading documents it should not. Four rules: run in a sandbox, set time limits, grant least privilege, and require human approval for anything financial. For Ethiopian builders there is a specific benefit — since code is written in English, CodeAct substantially reduces the Amharic token cost documented in our tokenizer measurements.
ይህ ጽሑፍ የትምህርት ዓላማ ያለው ነው። CodeAct በ AI ምርምር ማኅበረሰብ ውስጥ የተመሠረተ አሠራር ነው (Wang et al., “Executable Code Actions Elicit Better LLM Agents”, 2024)።
🏢 ህንፃ አለዎት?
BinaSmart — ሙሉ የህንፃ አስተዳደር ሲስተም በ24 ሰዓት።


