AB
AiBoss
チュートリアル

原始人テスト済み - AIエージェント向けミニマル出力圧縮プラグイン

今日は、AIエージェントの出力をより簡潔にするためのヒントをいくつかご紹介します。通常、AIエージェントを使用すると、その出力は精度に関係なく、冗長で不要な情報が多く含まれていることが多く、読むのに時間とエネルギーを無駄にしています。AIエージェントを使用すると...

今日は何か適切なものを投稿します。 AI Agent 簡潔な出力。

私たちは通常 AI Agent その場合、出力が正しいかどうかに関わらず、意味不明な文章が出てくるため、読むのに時間とエネルギーを無駄にするだけでなく、使用するトークンも無駄になります。

あなたに与えられる限り AI Agent CavemanというGitHubプロジェクトをインストールした後、出力はすぐに簡潔になり、重要なポイントのみに焦点を当て、不要な詳細を排除するようになった。

ケイブマンは、次のような場所です... AI Agent 使用された圧縮式プラグイン。

プロジェクトのアドレス:https://github.com/JuliusBrussee/caveman

原始人は Claude Code、Codex、Gemini前置きやありきたりな表現を使うのではなく、Cursor、Windsurf、Cline、Copilotなどのツールを使って、より効果的な情報を提供しましょう。

重要なのは、モデルの思考プロセス、コンテキスト、ドキュメントの内容、ツール呼び出し自体ではなく、「表現方法」を圧縮することです。公式の65%削減とは、出力トークンの平均削減を指し、総請求額の直接的な65%削減を意味するものではありません。

Cavemanのアプローチは、言語の慣習を強力なルールとして記述し、それをエージェントに継続的に供給することです。これには、冠詞、雑談、意味の弱い単語、不要な接続詞の削除、文の断片化の許容、コード、コマンド、エラー、API名、技術用語の保持などが含まれます。

コアスキルには、caveman、caveman-commit、caveman-review、caveman-stats、caveman-compress、caveman-shrinkが含まれます。

  • /caveman: 出力圧縮を有効にします。lite、full、ultra、wenyanなどの圧縮強度に対応しています。fullがデフォルトモードです。
  • /caveman-commit: 変更内容を時系列で記述するのではなく、変更が行われた理由を強調する、簡潔な従来型のコミットメッセージを生成します。
  • /caveman-review: コードレビュー時に、丁寧だが役に立たない賞賛をスキップして、コメントを1行だけ出力します。
  • /caveman-stats: 閲覧数 Claude ローカルセッションログにトークンの使用量と節約額を推定するコードを記述する。
  • /caveman-compress CLAUDE.md、設定ファイル、プロジェクトノートなどの自然言語メモリファイルを圧縮します。
  • caveman-shrink: MCPプロキシとして、アップストリームのMCPサーバーをラップし、tools/list、prompts/list、resources/listの説明フィールドを圧縮します。

原始人の様々なモード間の違い:

  • lite: 不要な単語を単純に削除するだけで、文は比較的正常なままです。
  • full:デフォルトモード。短い文や断片的な文も使用可能です。
  • ultra: より圧縮され、接続詞がさらに削除されています。
  • wenyan:古典的な中国語の圧縮モードで、主に中国語の文字向けに設計されています。中国語の文字は情報密度が高いためです。このモードは興味深いものですが、すべてのシナリオに適しているわけではありません。特に、チームでの共同作業が必要なコンテンツ、広報コメント、初心者向けの説明などには適していません。

caveman-compressには、厳格なファイルルールが定められています。

  • これは、.md、.txt、.texなどの自然言語ファイルのみを処理します。
  • .py、.js、.json、.yaml、.env、.sql、および.shファイルは処理しないでください。
  • コードブロック、インラインコード、URL、パス、コマンド、および技術用語は、そのまま保持されなければなりません。
  • 元のファイルはFILE.original.mdとしてバックアップされます。
  • 検証に失敗した場合、元のファイルは上書きされません。

この設計は、著者が「圧縮メモリファイル」が情報に損害を与えるリスクがあることを認識していたため、ファイルタイプの制限や検証プロセスを導入したことを示している。

ケース1 バグの説明

プロンプトワード

このReactコンポーネントが繰り返しレンダリングされる理由を説明し、最小限の修正案を提示してください。

function UserCard({ user }) {

const options = { showEmail: true };

return ;

}

const Profile = React.memo(function Profile({ user, options }) {

console.log("render profile");

return

{user.name}
;

});

原始人なしで:

原始人を使う:

『ケイブマン』は大幅に短縮されており、内容の約3分の1から半分がカットされているが、明らかな誤りは見当たらない。

ケース2 デバッグ修正

プロンプトワード
Node.jsのログインミドルウェアの問題のトラブルシューティングにご協力ください。ユーザートークンの有効期限が切れているにもかかわらず、検証が通過してしまうことがあります。バグを指摘し、修正方法を教えてください。提供されたコードスニペットは次のとおりです。`function auth(req, res, next) { const token = parseToken(req.headers.authorization); if (!token) return res.status(401).send("missing token"); if (token.exp < Date.now() / 1000) { return res.status(401).send("expired"); } req.user = token.user; next();}`

原始人なしで:

原始人を使う:

Caveman版では出力されるトークン数がはるかに少なく、テキストとコードも短くなっています。どちらのバージョンも、不足または不正なexpは許可され、境界チェックはnow >= expを使用して実行され、JWTには署名検証が必要であることを示しています。

ケース3:アーキテクチャ上のトレードオフ

プロンプトワード私たちは8名のエンジニアチームでB2B SaaSアプリケーションを開発しています。現在は、請求、通知、レポートの3つのモジュールからなるモノリシックなRailsアプリケーションです。経営陣はこれをマイクロサービスに分割したいと考えています。この戦略が実現可能かどうかを分析し、提案と移行パスを提供してください。

原始人なしで:

原始人を使う:

標準版の費用は約1400~1600トークンですが、Caveman版は約650~800トークンで、約50%の削減となり、スキャンコストが大幅に低減されます。さらに、完全な分割を避け、モジュール単位を優先し、通知/レポートを優先し、請求を最後に分割するという重要なポイントは維持されています。

case 4 PR Review

プロンプトワード

以下のコードスニペットを、安全性、並行処理、境界条件に重点を置いて確認してください。問題点を指摘してください。褒め言葉は不要です。

async function transfer(fromUserId, toUserId, amount) {

const from = await db.users.findById(fromUserId);

const to = await db.users.findById(toUserId);

if (from.balance < amount) {

throw new Error("insufficient funds");

}

from.balance -= amount;

to.balance += amount;

await db.users.update(fromUserId, { balance: from.balance });

await db.users.update(toUserId, { balance: to.balance });

return true;

}

原始人なしで:

原始人を使う:

今回の2つのバージョンの差は、以前のセットほど大きくはありません。Cavemanは「冪等性」の問題が追加されたため、約10%から15%ほど小さくなっています。

さらに、コードレビューのシナリオでは、Cavemanを使用しなくても、既存の問題リスト方式では既にスペースの圧縮に限界がある。

ケース5:Dockerの最適化

プロンプトワード

このDockerfileの最適化にご協力ください。目標は、イメージサイズを縮小し、ビルドキャッシュのヒット率を向上させ、機密ファイルをイメージに含めないようにすることです。

FROM node:20

WORKDIR /app

COPY . .

RUN npm install

RUN npm run build

CMD ["npm", "start"]

原始人なしで:

原始人を使う:

Cavemanバージョンでは、トークン数が約35%~45%削減されます。違いはベースイメージにあります。通常版はより安定した互換性を実現するためにbookworm-slimを使用していますが、Caveman版はファイルサイズを小さくするためにalpineを使用しています。

ケース6:データベースの問題

プロンプトワード

このPostgreSQLクエリが遅い理由を説明し、トラブルシューティングと最適化のための解決策を提示してください。

注文テーブルには8000万行があり、id、user_id、status、created_at、total_amountなどのフィールドが含まれています。

よくある質問:

SELECT *

FROM orders

WHERE user_id = $1

AND status = 'paid'

ORDER BY created_at DESC

LIMIT 20;

原始人なしで:

原始人を使う:

ケイブマンなしの場合、費用は約1000~1200トークンですが、ケイブマンありの場合は約500~650トークンとなり、約45~50%の割引となります。

標準バージョンでは、Cavemanにはなかった`created_at`と`id`の安定したソート機能が追加されています。実用的詳細。

ケース7 リファクタリングタスク

function loadUser(id, callback) {

db.findUser(id, function(err, user) {

if (err) return callback(err);

api.fetchProfile(user.profileId, function(err, profile) {

if (err) return callback(err);

cache.set(id, profile, function(err) {

if (err) return callback(err);

callback(null, { user, profile });

});

});

});

}

原始人なしで:

原始人を使う:

ケイブマンなしの場合、費用は約850~1000トークンですが、ケイブマンありの場合は約650~800トークンとなり、約20~30%の割引となります。

ケイブマントークンは若干安価ですが、その利点はそれほど大きくありません。これは、この問題が本質的にコードブロックを必要とし、トークンが主にコードに使用されるため、スタイル圧縮のための余地が限られているためです。

ケース8 新機能デザイン

プロンプトワードレポートをCSVファイルとしてエクスポートするバックエンドAPIを設計してください。大容量データ、権限検証、非同期タスク、および期限切れのダウンロードリンクに対応する必要があります。API設計、データフロー、およびメインテーブル構造を提供してください。

原始人なしで:

原始人を使う:

ケイブマンなしの場合、費用は約1300~1600トークンですが、ケイブマンありの場合は約900~1100トークンとなり、約25~35%の割引となります。

標準バージョンでは、冪等性キー、レポートエクスポートファイル用の別テーブル、およびCSVインジェクション保護の詳細が追加されます。

事例9:事故検証

プロンプトワード昨日10時05分から10時27分の間に、弊社のオンラインサービスで多数の500エラーが発生しました。初期調査の結果、Redis接続プールが枯渇し、アプリケーションが継続的に再試行するとともに、データベースのQPS(1秒あたりのクエリ数)が増加したことが原因とみられます。発生状況、根本原因、影響、修正策、および今後の対応策を含めた社内向けインシデント報告書を作成してください。

原始人なしで:

原始人を使う:

ケイブマンなしの場合、費用は約900~1100トークンですが、ケイブマンありの場合は約550~700トークンとなり、約35%~45%の割引となります。

標準バージョンでは、プレースホルダーヒント、データ整合性チェック、スタンバイメカニズムが追加されます。一方、Cavemanバージョンでは、再試行予算、ジッター、サーキットブレーカー、データベース保護が重視されます。

ケース10におけるコードの説明

プロンプトワード新しく採用されたバックエンド開発者に、データベース接続プールとは何か、なぜリクエストごとに新しい接続を作成できないのかを説明し、実際のサービスからの例を挙げてください。

原始人なしで:

原始人を使う:

原始人を使用するには約700~850トークンかかりますが、原始人を使用するには約300~400トークンかかり、約50~60%の割引となります。

どちらのバージョンも、接続の再利用、接続確立コスト、接続制限、およびプールサイズを恣意的に設定しないことの重要性について説明しています。標準バージョンには、完全なコード例と「21番目のリクエストを待つ」という動作の視覚的な説明が含まれています。

これら10件の事例を通して、Cavemanは明らかな技術的誤りを示さず、核心的な判断を維持した。ただし、Cavemanは細部を多少犠牲にする傾向があるものの、明確に定義された問題や馴染みのあるシナリオにおいては非常に有効である。

最後に、注意すべき点をいくつか挙げておきます。

  • Cavemanは出力トークンのみを削減し、入力トークンは削減しません。自動減らす
  • このスキル自体によって、1ラウンドあたり約1,000~1,500の入力トークンが追加されます。
  • 通常の回答で得られる出力トークンが150個しかない場合、Cavemanを有効にする方が実際にはコストが高くなる可能性がある。
  • プラットフォームがトークン単位ではなくリクエスト単位で課金する場合、短い応答ではリクエスト数は減りません。

原始人の仕事は、トークンを少し節約するという小さな必要性ではなく、むしろ... AI Agent これが日々の開発業務の一部となるにつれ、出力効率、読解コスト、コラボレーションの質に対する要求が高まった。

10件のテストを行った結果、Cavemanの有効性は明らかになりました。アーキテクチャのトレードオフ、データベースの最適化、インシデントの事後分析、概念説明など、展開しやすいタスクでは、出力を35%から60%削減できます。コードブロックの割合が高いタスクでは、圧縮率を10%から30%まで削減できます。モデルが冗長であるものの、エンジニアが結論だけを知りたいようなシナリオに最適です。

私たちにとって、ケイブマンは毎日の読書を減らすことができる AI 応答時間の短縮。レビュー、デバッグ、ソリューションに関する議論を、よりエンジニアリング的なコミュニケーションに近づけることで、出力スタイルの統一と、やり取りによる確認コストの削減に役立ちます。

Cavemanは単なるコスト削減ツールとして捉えるべきではありません。主に、出力トークンを圧縮するものであり、入力トークンと推論コストは変更されません。自動消える。

AI Agent いったん生産プロセスが始まると、違いは単に答えを生み出せるかどうかだけでなく、生み出された答えが他者に理解され、受け入れられるかどうかにも及ぶ。速い使用。

元のリンク:GitHubでは8万5000個のスターを獲得している。AI Agent もうくだらない話はやめよう