Pembungkus (wrappers) Bash menggunakan lebih banyak token berbanding Model Context Protocol (MCP) tujuh skema dalam satu larian 12 soalan, menunjukkan bahawa shell bukanlah jalan pintas murah seperti yang disangka oleh ramai jurutera. Penggunaan token diterjemahkan secara langsung kepada kos bagi ejen model bahasa besar (LLM) yang beroperasi pada skala besar.
Eksperimen yang mengubah persepsi
Seorang pembangun mengukur empat cara ejen LLM boleh mengambil data kapal:
- MCP – tujuh skema alatan yang dihoskan di sebalik Model Context Protocol.
- Bash + curl (cold) – panggilan shell mentah tanpa sebarang arahan (prompting) tambahan.
- Bash + curl (warm) – panggilan shell yang sama ditambah dengan arahan sistem yang memandu penggunaan selamat.
- Alatan CLI khusus – antara muka baris perintah yang dibina khas untuk tujuan tersebut.
Keempat-empat cara tersebut dijalankan melalui perbualan 12 soalan. Penggunaan token, yang memacu bil API, adalah seperti berikut:
- MCP: 109,779 token
- Bash + curl (cold): 158,021 token
- Bash + curl (warm): 178,577 token
Angka bagi alatan CLI khusus tidak didedahkan, tetapi dua varian Bash tersebut sudah pun melebihi kos MCP.
Mengapa shell lebih mahal daripada protokol
Setiap alatan Bash memerlukan kira-kira 2,700 token "arahan pembungkus" (harness prompts) – iaitu arahan yang memberitahu ejen cara untuk memanggil shell dengan selamat, menganalisis output, dan mengendalikan ralat. Arahan tersebut sahaja sudah melebihi jumlah berat token bagi kesemua tujuh skema MCP yang digabungkan.
Kosnya bukan sekadar panggilan awal. Dalam persekitaran produksi, ejen yang sama memuatkan awal 11 pelayan MCP semasa permulaan, menggunakan 19,800 token sebelum pertanyaan pengguna pertama tiba. Kemudian, pada setiap pusingan, ejen membaca semula setiap skema daripada setiap pelayan, jadi permintaan remeh seperti "pukul berapakah sekarang?" sekalipun terpaksa membayar harga token bagi setiap huraian alatan yang lain.
Kebocoran tersembunyi akibat pemuatan awal (eager loading)
Apabila ejen LLM memuatkan setiap pelayan alatan secara agresif (eagerly) pada setiap pusingan, bil token akan meningkat secara mendadak. Eksperimen menunjukkan bahawa kos "sebenar" menggunakan Bash bukanlah arahan shell itu sendiri, tetapi konteks sekeliling yang mesti dihantar ke model setiap kali.
- Alatan kos tetap (skema MCP) menambah lebihan (overhead) token yang boleh diramal bagi setiap pusingan.
- Payload dinamik (respons curl) menambah hutang yang semakin meningkat selaras dengan panjang perbualan dan saiz data.
Oleh itu, shell yang kelihatan "percuma" pada zahirnya sebenarnya mengenakan cukai token yang lebih besar dan berubah-ubah.
Apa yang perlu dilakukan oleh jurutera AI seterusnya
- Gunakan pemuatan malas (lazy loading). Muatkan pelayan alatan hanya apabila skemanya benar-benar diperlukan, dan simpan ia dalam memori merentasi pusingan berbanding membacanya semula setiap kali.
- Anggap skema alatan sebagai perbelanjaan tetap setiap pusingan. Rancang bajet token berdasarkan saiz definisi MCP yang diketahui berbanding menganggap arahan shell adalah percuma.
- Nilai semula andaian "shell = murah". Profilkan penggunaan token bagi setiap laluan alatan sebelum menetapkan sesuatu reka bentuk.
- Kekalkan alatan yang berstruktur (shaped tools) untuk model kecil. Walaupun dengan tetingkap konteks yang terhad, skema yang ditakrifkan dengan baik dapat meningkatkan penaakulan, penukaran unit, dan pengendalian ralat.
Kesimpulannya: ekonomi token, bukannya reka bentuk protokol, yang menentukan kos. Menguruskan bila dan bagaimana pelayan alatan dimuatkan boleh menjimatkan berpuluh-puluh ribu token daripada satu perbualan, sekali gus mengurangkan perbelanjaan operasi secara langsung.
Sumber: https://dev.to/clarkbw--/enabling-bash-costs-more-context-than-seven-mcp-tool-schemas-2h82
