Əsas məzmuna keç
TechTurk
  • Xəbərlər
  • Kateqoriyalar
  • Haqqımızda
TechTurk

Kodun və texnologiyanın gözündən dünyaya baxış. Azərbaycan dilində texnologiya xəbərləri və təhlillər.

Keçidlər

  • Xəbərlər
  • Texnologiya xəbərləri
  • Kateqoriyalar
  • Haqqımızda
  • Telegram kanalı

Hüquqi

  • Məxfilik Siyasəti
  • İstifadə Şərtləri

Telegram

Xəbərləri @techturkaz kanalında izləyin.

Kanala qoşul

© 2026 TechTurk. Bütün hüquqlar qorunur.

  1. Ana səhifə
  2. /
  3. Xəbərlər
  4. /
  5. Süni İntellekt
  6. /
  7. AI agentin seçdiyi aləti necə yoxlamaq olar? Öz jurnallarına güvənməyin
Süni İntellekt

AI agentin seçdiyi aləti necə yoxlamaq olar? Öz jurnallarına güvənməyin

21 iyul 20262 dəqiqə oxuma
AI agentin seçdiyi aləti necə yoxlamaq olar? Öz jurnallarına güvənməyin
Mündəricat
  • Müşahidəçi yanaşması

Süni intellekt agentləri getdikcə daha mürəkkəb tapşırıqları yerinə yetirir: alətləri çağırır, sorğuları yönləndirir və nəticələri qaytarır. Komandalar adətən agentin öz telemetriyasına güvənir — hansı alətin seçildiyini və niyə seçildiyini bu jurnallardan öyrənirlər. Lakin bu etibar təhlükəli ola bilər.

Problem ondadır ki, agentin öz jurnalları öz-özünə hesabatdır. Onlar agentin nə etdiyini düşündüyünü göstərir, əslində nə baş verdiyini yox. Hallüsinasiya olunmuş alət adı, səhv yönləndirilmiş parametr və ya səssizcə başqa funksiyaya keçid — bunların heç biri agentin öz izlərində görünmür. Buna görə də xarici müşahidəçiyə ehtiyac yaranır.

Müşahidəçi yanaşması

Əksər komandalar agentin davranışını onun çıxışını oxuyaraq yoxlayır: tool_calls sahəsinə baxır, gözlənilən sxemə uyğunlaşdırır və testi bitmiş sayır. Lakin bu üsul uğursuz ola bilər. Məsələn, agent search_knowledge_base çağırmaq qərarına gəlir, amma LLM alət adını searchKnowledgeBase kimi formatlaşdırır. Marşrutlaşdırma qatı səssizcə bunu normallaşdırır, çağırış uğurla başa çatır və agent jurnalda search_knowledge_base yazır. Test keçir, amma əsl icra yolu fərqli olub.

Həll yolu budur: agentlə alətlər arasında bir təbəqə yerləşdirmək. Bu müşahidəçi hər çağırışı — alət adı, parametrlər, cavab, gecikmə — agentin xəbəri olmadan qeyd edir. Observer agentin jurnallarına deyil, naqildə gördüyünə etibar edir. Python ilə minimal implementasiya belə işləyir: hər alət çağırışını kəsmək, xam sorğunu normallaşdırmadan qeyd etmək və testdə bu məlumatları yoxlamaq.

Əsas prinsip sadədir: sərhədi test edin, xülasəni yox. Agentin daxili jurnalları onun niyyətinin xülasəsidir. Əsl icra isə agentlə alət arasındakı sərhəddə baş verir. Normallaşdırma, tip məcburiyyəti, ehtiyat marşrutlaşdırma, səssiz təkrar cəhdlər — bunların heç biri agentin öz izlərində görünmür. Müşahidəçi yerləşdirməklə siz testi niyyətdən icraya keçirirsiniz.

Bu yanaşma mikroxidmətlərdə kontrakt testi ilə eyni məntiqə əsaslanır. Agent sadəcə etibarsız daxili rəvayətçisi olan başqa bir xidmətdir. Test mühitində hər çağırışı qeyd etmək yavaşlama və yaddaş tələb edir, lakin bu, bir dəfə tutulan səhvə dəyər — xüsusilə də agentin jurnallarının görmədiyi bir uğursuzluq halında.



Mənbə: Dev.to (https://dev.to/qawalah/how-to-test-an-ai-agents-tool-selection-without-trusting-its-own-logs-1pl3)

Paylaş:

Telegram

Kanala abunə olun

Son texnologiya xəbərləri @techturkaz kanalında.

Kanala qoşulƏtraflı məlumat

Şərhlər (0)

Hələ rəy yoxdur. İlk yazan siz olun!

Mündəricat
  • Müşahidəçi yanaşması

Telegram

Kanala abunə olun

Son texnologiya xəbərləri @techturkaz kanalında.

Kanala qoşulƏtraflı məlumat

Tövsiyə olunan məqalələr

XəbərKibertəhlükəsizlik

GitHub issue başlığı bəlası: 5 milyon istifadəçinin AI köməkçisi Cline necə sındırıldı?

AI kod köməkçisi Cline'də kəşf edilən zəiflik, bir GitHub issue başlığının sistemi ələ keçirməsinə yol açdı. Nəticədə, hücumçuların yerləşdirdiyi zərərli npm paketi istifadəçilərin maşınlarına ikinci bir AI agenti quraşdırdı.

19.07.2026
Daha çox →
XəbərProqramlaşdırma

Snowflake Summit: "Vibe coding"dən agentik mühəndisliyə keçid – gələcək full-stack developerlərindir

Snowflake Summit çərçivəsindəki söhbətdə şirkətin Developer Experience rəhbəri Umesh Unnikrishnan proqramlaşdırmanın gələcəyini izah etdi: sürətli prototiplərdən agentik mühəndisliyə, insan nəzarətli idarəetməyə və full-stack inkişafçılar dövrünə keçid.

21.07.2026Daha çox →