ntea.log
日々の学習アウトプットと、技術や組織についての考えを発信する技術ブログ。ゲーム理論・プログラミング・AI など。
投稿カレンダー
色が濃いほど、その日の投稿数が多いことを表します。マスにカーソルを合わせると記事が見られます。
カレンダーを表示できませんでした。
新着記事 (6 / 10)
-
プロンプトキャッシングの落とし穴
プロンプトキャッシングは強力なコスト削減手段ですが、thinking パラメータの変更でメッセージキャッシュが無効になる点など、知らないと損をする挙動があります。
-
JSON 出力とソース引用
構造化出力(JSON スキーマ準拠)と引用機能を使うと、バリデーション不要のデータ抽出とハルシネーション対策ができます。2つの組み合わせ方も解説します。
-
AI の UI を「generated っぽく」させない——StyleSeed の 69 のデザインルール
StyleSeed はデザインデータではなくデザイン判断力を Claude に渡すスキルです。69 のビジュアルルール・7 つのブランドスキン・14 のスラッシュコマンドで、AI が出力する UI を「作られた感」のあるものに変えます。
-
Claude thinking の課金モデル
thinking ブロックの表示設定(summarized / omitted)に関わらず、課金は生の思考トークン全体に対して発生します。その仕組みと確認方法を解説します。
-
Claude API の思考設計の変遷
budget_tokens で「何トークン使うか自分で決める」時代から、effort で「方向性を示してあとは Claude に任せる」時代へ。設計思想の変化を読み解きます。
-
tool_choice の4種類と Claude のツール判断ロジック
tool_choice には auto / any / tool / none の4種類があります。それぞれの意味と、サーバーツール・クライアントツールの違い、effort との関係を整理します。
-
不確実性の地図 ── 偶発的・認識論的・決定不能な三つの層
この世の不確実性はすべて同じ種類ではない。偶発的・認識論的・決定不能という三つの層に分解することで、何に備えられて何に備えられないかが見えてくる。
-
Claude Code スキルの設計指針——3 層構造をどう使い分けるか
フロントマター・スキルボディ・補助ファイルという公式スキルの 3 層構造を手がかりに、何をどこに書くべきかの実践的な判断基準を整理します。
-
心理的安全性——「言いやすさ」が生産性に直結する理由
日々是考察・本日の概念は心理的安全性。Google が「プロジェクト・アリストテレス」で突き止めた、優れたチームに共通するたった一つの条件を組織論の視点で読み解きます。
-
ローカル LLM ベンチマーク:M3 / 24GB で 5 モデルを計測した
lm-evaluation-harness を使い、MacBook Air M3 / 24GB 上の 5 モデルを GSM8K と ARC Challenge で計測しました。phi4 が両タスクで最高スコアを記録し、速さでは mistral-nemo が突出しました。
-
ローカル LLM のモデル選定:M3 / 24GB で動かせる範囲を調査した
各 LLM ファミリーのバリアントを調べ、MacBook Air M3 / 24GB で快適に動かせる範囲を整理して、実際に導入する 5 モデルを選定しました。
-
Anthropic IPO 秘密申請——評価額 9,650 億ドルで OpenAI を超えた AI 企業の上場戦略
本日のAIニュースはAnthropicのIPO秘密申請——評価額9,650億ドルでOpenAIを上回り、AI企業として史上最大規模の上場へ動き出した背景を読み解きます。
人気記事
マガジン
セットで読む記事リスト
-
AWS
1 記事
AWS を使ったインフラ構築・運用の記事まとめ
-
アジャイル
1 記事
アジャイル開発の考え方・実践に関する記事まとめ
-
AIコーディング時代のエンジニア
3 記事
AI が当たり前になった時代に、エンジニアは何を磨くべきか。空洞化への守り、深さで戦う攻め、AI との分業設計まで、考え方を一筋でたどる連作。
-
日々是考察
6 記事
一日一テーマ、本日の経営者・概念・言葉を一つ取り上げて短く考察する連載。人物も理論も、その日の一考として読み解く。
-
本日のAIニュース
2 記事
その日に目を引いた AI のニュースを一つ取り上げ、何が起きたか・なぜ重要かを短く整理する連載。
-
Claude Code 解剖
8 記事
claude コマンドの実体から、システムプロンプトの作り・1ターンの処理フロー・会話ログ・安全機構まで。手元のバイナリと ~/.claude を実際にのぞいて、Claude Code の中身を一筋に解き明かす連作。
-
graphify でコードを読む
4 記事
ナレッジグラフの概念から、graphify によるコードベース解析の仕組みまで。AI コーディングアシスタントの文脈理解をグラフで拡張する連作。
-
Claude Code スキル探訪
6 記事
Claude Code のスキル(SKILL.md)を公式・コミュニティの両面から読み解く。書き方の流派から設計指針、セッション学習まで。
-
Claude API 基礎
11 記事
Claude API の仕様を開発者目線で整理する。思考モード・ツール使用・コンテキスト管理・実行方式まで、よくある疑問に答える実践的な記事集。
-
LLM アプリの品質保証
8 記事
非決定的な LLM 出力をどうテストするか。ゴールデンデータ・プロビナンス追跡・品質ゲート・Judge 設計など、実装に根ざした品質保証パターンを一筋で整理する連作。
-
言語の世代交代
7 記事
PHP・Python・TypeScript・Rust はなぜ似た機能を揃って取り込んだのか。null・失敗・不変性・パターンマッチという共通の軸で言語を横断し、旧世代から現代への変化を読み解く連作。