自社CLIエージェント「sente」を競合7ツールと比較し10ペルソナで採点したら平均65.8点。指摘された弱み(コストの見通し・安全性・BYOK・英語・比較表)を公開当日にすべて実装しました。この記事では、採点の全データと、直した機能の実画面キャプチャを公開します。声で・日本語で・記憶を持って働くエージェントを、ぜひ試してください。
比較対象(8ツール): sente / opencode / Claude Code / OpenAI Codex CLI / Gemini CLI / Cursor / Aider / GitHub Copilot CLI。評価5項目(各20点・計100点): ①モデル自由度(BYOK・ローカル対応) ②UX(起動・操作) ③独自価値 ④コスト透明性 ⑤信頼性・安全。
10ペルソナ: 日本の個人開発者 / エンタープライズ情シス / OSSハッカー / スタートアップCTO / 非エンジニア・ライター / フリーランス / 学生 / プライバシー重視者 / 英語圏開発者 / 自律化パワーユーザー。各ペルソナが「自分が使うなら何点か」を採点しました。
| 項目 | sente | opencode | Claude Code | Codex CLI | Gemini CLI | Cursor | Aider | Copilot CLI |
|---|---|---|---|---|---|---|---|---|
| 形態 | TUI+App+iOS | TUI+Desktop+IDE+Web | CLI+IDE+Web+Mobile | CLI+IDE+Web | CLI | IDE+CLI+Cloud | CLI | CLI |
| モデル | 380+(teai経由) | 75+プロバイダ | Claude中心 | OpenAI系 | Gemini系 | マルチ | ほぼ任意 | マルチ+BYO |
| BYOK/ローカル | ✕(2026Q4目標) | ◎ | △ | △ | △ | ○ | ◎ | ○(Ollama可) |
| OSS | 一部 | ◎ | ✕ | ◎ | ◎ | ✕ | ◎ | ✕ |
| 音声 | ◎(声クローン連続対話) | ✕ | ✕ | ✕ | ✕ | ✕ | △(入力のみ) | ✕ |
| 価格 | ¥4,350/月〜+cr | 無料+従量 | サブスク | ChatGPT包含 | 無料枠大 | $20/月〜 | 無料+API自腹 | Copilot包含 |
| 日本語 | ◎(円・東京・日本語bench) | △ | △ | △ | △ | △ | △ | △ |
senteの独自色は明確です。声クローンによる連続音声対話、3層メモリ、日本語ネイティブ(円建て・東京リージョン・日本語ベンチ内蔵)、ローカルPIIスクラビングは他7ツールに無い機能群。一方で、BYOK不可・実質クローズド・teai.io依存という構造的な弱みも浮き彫りになりました。
| # | ペルソナ | ①モデル | ②UX | ③独自 | ④コスト | ⑤信頼 | 計 |
|---|---|---|---|---|---|---|---|
| 1 | 日本の個人開発者(音声愛好) | 16 | 18 | 20 | 14 | 14 | 82 |
| 2 | エンタープライズ情シス | 12 | 12 | 12 | 12 | 10 | 58 |
| 3 | OSSハッカー | 8 | 14 | 10 | 12 | 10 | 54 |
| 4 | スタートアップCTO | 14 | 16 | 16 | 12 | 12 | 70 |
| 5 | 非エンジニア・ライター | 12 | 18 | 18 | 12 | 14 | 74 |
| 6 | フリーランス(複数案件) | 14 | 16 | 16 | 10 | 12 | 68 |
| 7 | 学生・学習者 | 12 | 14 | 12 | 10 | 12 | 60 |
| 8 | プライバシー重視 | 10 | 14 | 16 | 12 | 12 | 64 |
| 9 | 英語圏開発者 | 12 | 12 | 10 | 12 | 12 | 58 |
| 10 | 自律化パワーユーザー | 16 | 16 | 18 | 10 | 10 | 70 |
| 平均 | 12.6 | 15.0 | 14.6 | 11.6 | 11.8 | 65.8 |
最高は#1の82点、最低は#3 OSSハッカーの54点。senteが最も愛されるのは音声×日本語のコア層であり、最も届いていないのはOSS文化圏とエンタープライズという構図がはっきり出ました。
全ペルソナ共通の最大減点源です。
senteは「声で、日本語で、記憶を持って働くエージェント」として唯一の立ち位置を持っています。しかし採点が示す通り、コストの見通しと安全性という基礎体力が、独自価値の輝きを曇らせているのが現状です。
まずは④の「タスク前クレジット見積もり表示」から実装に着手します。進捗はこのブログで続報します。
採点で挙がった改善アクションを、公開当日にすべて実装・デプロイしました。以下は実際の画面キャプチャです。
te run 実行前にクレジット見積もりと残高をstderrに表示(💰 見積もり: 初回プロンプト ≈ 40cr(約¥7・下限) / 残高 ...)。無効化=TE_NO_ESTIMATE=1。TE_BUDGET_MAX_CRで変更/0=無効)。launchdループ事故の再発防止。ANTHROPIC_API_KEY/OPENAI_API_KEY/GEMINI_API_KEYを環境変数に置くだけで、そのプロバイダをteaiクレジット消費ゼロで直接利用(te model openai/<model>)。無効化=TE_NO_BYOK=1。te help が英語対応(LANGが英語なら英語help)。te stats — 残高・今日/30日の消費・モデル別内訳を円換算で表示(#7学生/#1個人開発者の「見通しが不安」に)。te start — 専門用語なしの「はじめの3分」ガイド(#5ライターの「設定が開発者向き」に)。④⑤①②③に加え、コストダッシュボード・非開発者ガイド・エンタープライズ明文化も本番に反映されています。次はこれらの効果を再採点し、100点への距離を測り直します。