🪙 Cara Tidak Menghabiskan Token di Model Bahasa

Jika Anda aktif menggunakan model bahasa seperti Claude atau GPT, pasti Anda menyadari betapa cepatnya batas token habis. Ini terutama berlaku untuk model premium, seperti Opus 4.6, yang penggunaannya bahkan pada langganan berbayar dibatasi. Masalahnya adalah bahwa setiap permintaan mengirimkan seluruh riwayat percakapan, dan semakin panjang riwayatnya, semakin banyak token yang terpakai. Tapi ada cara untuk menghemat.

Cobalah membuat ringkasan singkat. Pada tahap tertentu dalam komunikasi dengan model (misalnya, di tengah percakapan), mintalah model untuk merumuskan ringkasan dalam format markdown. Ringkasan ini harus berisi semua informasi kunci sehingga agen lain dapat melanjutkan percakapan dari titik yang sama. Kemudian buka agen baru, tempelkan ringkasan ini, dan ajukan pertanyaan berikutnya. Percakapan baru akan dimulai dengan riwayat minimal, tetapi dengan konteks yang tetap terjaga 👍

👩‍💻 Data Flow