NEW! 技術知見 非エンジニアの顧客にAIの不確実性を説明する技術 2026年8月11日 「AIって100%正確じゃないんですか」。クライアント先で、この質問には何度も向き合ってきた。 エンジニアにとって「LLMの出力は確率的で、たまに間違える」は当たり前の前提だ。しかし非エンジニアの顧客にとっては、そうではない。従来のシステムは「決められた通りに動く」ものだったので、「たまに間違える」という性質自体が直感...
NEW! 技術知見 LLMアプリの「デモでは動くが本番で使えない」を潰す評価設計 2026年8月11日 「デモでは完璧に動いたのに、本番投入したら思ったように動かない」。LLMアプリを作っていると、これは驚くほど頻繁に起きる。 原因の多くは、モデルの性能不足ではない。デモを通す評価と、本番で求められる評価が、そもそも別物であることに気づかないまま作り進めてしまうことにある。ここでは、私がクライアントワークで実践している評...
NEW! 技術知見 クライアントワークでClaude Codeを使う際の運用設計 2026年8月11日 Claude CodeのようなAIコーディングエージェントを個人開発で使うのと、クライアントワークで使うのとでは、気をつけるべきことがまったく違う。個人開発なら多少雑に扱っても自分が困るだけだが、クライアントワークでは、コンテキストに何を読み込ませるか、何を書き込ませるかが、そのままセキュリティ・契約上のリスクになる。...