Blog
一般的な技術記事・Tips・学び
Claude Tag — Slackに"バーチャル社員"として参加するAnthropicの新機能
2026年6月23日にAnthropicが発表したClaude Tag。Slackのチャンネルにチームメンバーとして参加し、マルチプレイヤーで協働・学習・自律タスク実行を行う新機能の仕組みと使い方を解説します。
Claude Opus 4.6 vs Opus 4.8: 同価格なのにどちらを選ぶべきか?知識タスクで意外な逆転あり
Claude Opus 4.6(2026/2/5)とOpus 4.8(2026/5/28)は価格が全く同じ($5/$25 per 1M)。コーディング・エージェント性能では4.8が圧倒するが、知識タスクでは4.6が76.2 vs 70.1と逆転。「新しい=常に良い」が崩れるケースを実データで検証する。
Claude Sonnet 4.6 vs Opus 4.8: 安くて速いSonnetが逆転勝利するシーンを徹底検証
Claude Opus 4.8(2026/5/28リリース)は全9ベンチマークでSonnet 4.6を上回るが、価格は1.7倍・速度は約半分。コーディング・日常開発・高トラフィックAPI用途ではSonnet 4.6の方が合理的な選択になるケースがある。ベンチマーク・コスト計算・ユースケース別の選択基準を整理する。
Hermes Agent入門 — Nous Researchの「自己改善型AIエージェント」を読み解く
Nous Researchが2026年に公開した自己改善型AIエージェント「Hermes Agent」を解説。3層メモリ(MEMORY.md/SQLite FTS5/スキル)と、やったことから学ぶスキル自己生成ループの設計思想、CLIでの使い方まで、概念と実践を整理します。
Content Security Policy 入門 — allowlist 方式の限界と Strict CSP への移行
XSS対策の最後の砦である Content Security Policy(CSP)を、ディレクティブの読み方から解説。従来の allowlist 方式がなぜ破られやすいのかを示し、nonce + strict-dynamic によるモダンな Strict CSP の組み立て方と Reporting API を使った安全な段階導入までを実務目線でまとめます。
コードは安くなった、ボトルネックは移動しただけ — AI時代に上流(要件・ディスカバリー)と後工程(レビュー・QA)をスケールさせる各社のベストプラクティス
AIでコードのアウトプット量が爆発した結果、ボトルネックは「コードを書くこと」から上流(要件・企画・ディスカバリー)と後工程(レビュー・QA)へ移動した。制約理論で構造を捉え、Faros AI・Anthropic・DORAなどのデータで裏づけ、GitHub Spec Kit / Amazon Kiro / Graphite / Meta TestGen-LLM など各社の最新の取り組みからベストプラクティスを導きます。
GBrain入門 — Garry TanがOSS化したAIエージェントの「記憶基盤」を読み解く
Y CombinatorのCEO Garry TanがMITライセンスで公開したAIエージェント記憶基盤「GBrain」を解説。Markdown-firstの設計、LLM不要の自己配線ナレッジグラフ、ハイブリッド検索、MCP連携まで、概念と使い方を整理します。
Agentic AIの現在地 — 2026年、AIエージェントは「持続性」で競う時代へ
2026年のAgentic AIを、マルチエージェント化・ロングホライズン・MCP標準化・エンタープライズ採用と信頼性ギャップの4軸で整理。METRの時間ホライズン計測や主要評価ベンチも紹介します。
コンテキストとメモリの革命 — AIに何をどう記憶させるか(2026年版)
1Mコンテキストの標準化とcontext rot、プロンプトからコンテキストエンジニアリングへの移行、永続メモリ、RAGの再定義まで、2026年の「AIに何をどう記憶させるか」を整理します。
フロンティアLLM横断比較2026 — Claude Opus 4.7 / GPT-5.5 / Gemini / DeepSeek V4
2026年5月時点の主要フロンティアLLMを、コンテキスト長・価格・推論・マルチモーダル・ベンチマークの観点で横断比較。ユースケース別の選び方も整理します。