ntea.log
日々の学習アウトプットと、技術や組織についての考えを発信する技術ブログ。ゲーム理論・プログラミング・AI など。
投稿カレンダー
色が濃いほど、その日の投稿数が多いことを表します。マスにカーソルを合わせると記事が見られます。
カレンダーを表示できませんでした。
新着記事 (1 / 8)
-
bonsai — 全部読む前に地図を作れ
コードベースの骨格だけを抽出してトークン効率の高い地図を生成する CLI ツール bonsai——全文を読ませる前に「何を読むか」を決めることで、AI エージェントのコンテキスト消費を 4〜5 倍削減します。
-
ベイズ統計入門——事前知識を使って確率を更新する
データが少なくても「確率の分布」として答えを出せるベイズ統計の考え方——事前分布・尤度・事後分布という三つの要素と、頻度論との違いをビジネス文脈で解説します。
-
コンバージョン率の比較で騙されないために——偽陽性・偽陰性と信頼区間
A/Bテストで「施策Aの方が率が高い」を安易に信じると間違える理由を、偽陽性・偽陰性・信頼区間の観点から解説します。サンプルサイズと多重比較の落とし穴も含む実践的な判断チェックリスト付き。
-
10種類のシールを全部揃えるには何個買えばいい?——クーポンコレクター問題
10種類のシールが入ったお菓子、全部揃えるには平均何個買えばいい?——直感的な「10個」ではなく約29.3個になる理由を、幾何分布・調和数・モンテカルロシミュレーションで解説します。
-
PHP 品質保証ツール大全:Linter・静的解析・テスト・自動リファクタリングを網羅する
PHP_CodeSniffer・PHPStan・PHPUnit・Rector など、PHP プロジェクトの品質を保つ主要ツールを網羅的に解説する。
-
Python コード品質ツール大全
Ruff・mypy・pytest・Bandit など、Python プロジェクトの品質を保つ主要ツールを網羅的に解説する。
-
Rust 品質保証ツール大全
clippy・rustfmt・cargo test・cargo-audit など、Rust プロジェクトの品質を保つ主要ツールを網羅的に解説する。
-
A/Bテストを始める前に——検出力・効果量・サンプルサイズの設計
A/Bテストの結果が「効果なし」だったとき、それは本当に効果がなかったのか、それともサンプルが足りなかっただけなのか——実験前に必要なサンプルサイズを正しく設計するための3つのパラメータと計算方法を解説します。
-
全体では勝っているのに部分では全負け——シンプソンのパラドックス
集計の粒度を変えるだけで「AよりBが優れる」という結論が逆転する——シンプソンのパラドックスの仕組みと、ビジネスデータ分析での落とし穴を具体例とともに解説します。
-
なぜ標本分散は n-1 で割るのか——不偏分散と自由度の直感
標本分散を n で割ると母分散を系統的に過小推定してしまう——その理由を直感・数学・自由度の三つの視点で解説し、NumPy の ddof=1 が何をしているかを明らかにします。
-
AI が書き、AI がレビューする——品質保証の重心はどこへ移るか
AI が書いて AI がレビューするループが成立すると、従来の品質保証の構造は根底から変わります——コードの正しさを見る場所から、AI への指示の正しさとループの観察可能性へ重心が移ります。
-
ReviewOps — AI コードレビューを「見て終わり」にしない OSS を公開しました
AI のコードレビューが指摘するだけで終わる問題を解決するために、ReviewOps という OSS を作りました——レビュー結果をカンバンで管理し、人間のトリアージと AI の実行を分担するコントロールループを実現します。
人気記事
マガジン
セットで読む記事リスト
-
AWS
1 記事
AWS を使ったインフラ構築・運用の記事まとめ
-
アジャイル
1 記事
アジャイル開発の考え方・実践に関する記事まとめ
-
AIコーディング時代のエンジニア
3 記事
AI が当たり前になった時代に、エンジニアは何を磨くべきか。空洞化への守り、深さで戦う攻め、AI との分業設計まで、考え方を一筋でたどる連作。
-
日々是考察
6 記事
一日一テーマ、本日の経営者・概念・言葉を一つ取り上げて短く考察する連載。人物も理論も、その日の一考として読み解く。
-
本日のAIニュース
2 記事
その日に目を引いた AI のニュースを一つ取り上げ、何が起きたか・なぜ重要かを短く整理する連載。
-
Claude Code 解剖
8 記事
claude コマンドの実体から、システムプロンプトの作り・1ターンの処理フロー・会話ログ・安全機構まで。手元のバイナリと ~/.claude を実際にのぞいて、Claude Code の中身を一筋に解き明かす連作。
-
graphify でコードを読む
4 記事
ナレッジグラフの概念から、graphify によるコードベース解析の仕組みまで。AI コーディングアシスタントの文脈理解をグラフで拡張する連作。
-
Claude Code スキル探訪
6 記事
Claude Code のスキル(SKILL.md)を公式・コミュニティの両面から読み解く。書き方の流派から設計指針、セッション学習まで。
-
Claude API 基礎
11 記事
Claude API の仕様を開発者目線で整理する。思考モード・ツール使用・コンテキスト管理・実行方式まで、よくある疑問に答える実践的な記事集。
-
LLM アプリの品質保証
8 記事
非決定的な LLM 出力をどうテストするか。ゴールデンデータ・プロビナンス追跡・品質ゲート・Judge 設計など、実装に根ざした品質保証パターンを一筋で整理する連作。