LLM Frontline

記事一覧(2ページ目)

開発・エージェント

LLM APIのレート制限とリトライ設計|429・タイムアウト・二重実行を本番で捌く

本番でLLM APIを叩き続けるための流量制御を整理します。RPM/TPMなど制限がかかる軸と単位、429・5xx・タイムアウトの切り分け、指数バックオフとジッタ、retry-afterの尊重とデッドライン設計、ストリーミングの3層タイムアウト、冪等性による二重実行対策、バッチAPIとキューでの平準化、監視指標と縮退運転までをまとめます。

開発・エージェント

長文ドキュメントのLLM要約設計パターン|stuff・map-reduce・refine・抽出ハイブリッドの使い分け

議事録・報告書・仕様書・長い会話ログをLLMで要約するときの設計パターンを整理します。一括投入(stuff)/map-reduce/refine(逐次改良)/抽出+生成ハイブリッドの仕組みと向き不向き、精度が落ちる境目、数値や否定表現が化ける典型パターンと対策、忠実性と網羅性の評価のしかたまでを実務目線でまとめます。

ルール・リスク管理

EU AI Actの透明性義務が2026年8月2日に適用開始|日本企業の実務で何が変わるのか

EU AI Act第50条の透明性義務が2026年8月2日から適用されます。対話AIの告知・生成コンテンツの機械可読マーキング・感情認識の告知・ディープフェイクの表示という4領域を、法解説ではなく実務の着手順として整理します。域外適用の判断軸、提供者と利用者の切り分け、2026年12月2日までの猶予、行動規範の位置づけまでを一次情報で確認しました。

業務活用

生成AI時代の文章術・テクニカルライティング書籍ガイド|AIに読ませる文書と、AIが書いた日本語を直す4冊

RAGやAIエージェントの出力品質は、渡す側のドキュメントの構造に強く依存します。さらにAIが書いた日本語を直すには、直す側に判断軸が必要です。内容の取捨から日本語の構造、技術文書の型、ドキュメント運用まで、実在の書籍4冊を「扱っていない範囲」つきで紹介します。

開発・エージェント

AIが書いたコードを読み・直す力を鍛える書籍ガイド|可読性から設計・レビュー運用まで4冊

生成AIがコードを量産できるようになったぶん、詰まる場所は「読む・直す・レビューする」側に移りました。可読性、整頓、設計、レビューとチーム運用という4段階で、AI生成コードの実務に効く実在の日本語書籍を4冊、扱っていない範囲つきで紹介します。

ニュース・動向

OpenAIがGPT-5.6のLunaとTerraを値下げ|業務で見直すこと、見直さなくていいこと

2026年7月30日にOpenAIが実施したGPT-5.6のAPI価格改定を、公式Pricingページで確認しながら業務目線で整理します。Lunaは80%、Terraは20%の引き下げでSolは据え置き、Priority processingはFast modeへ改称。事実を押さえたうえで、大量処理の経済性・モデル階層の引き直し・価格が動く前提の設計・乗り換え前の評価と、値下げでも変わらない要件を切り分けます。

開発・エージェント

RAGのドキュメントパース|PDFからテキストを取り出す前処理で精度は決まる

RAGの前段にあるドキュメントパース(文書からのテキスト抽出・構造化)の実務を整理します。多段組み・表・スキャンPDFという難所、テキストレイヤ抽出/レイアウト解析/VLM/クラウドサービスという4類型の選び方、Markdownへの正規化、メタデータ設計、評価の回し方までを扱います。

業務活用

音声AIエージェントと話すためのヘッドセット・マイクの選び方|ハンズフリー対話を実務で使う

full-duplexの音声AIが普及し、聞きながら話せるハンズフリー対話が実用段階に入りました。完全ワイヤレスイヤホン・骨伝導/オープンイヤー・PC用ヘッドセットやUSBマイクの3タイプを、ノイズキャンセリング・コーデック遅延・開放型か密閉型か・バッテリーの観点で選び分ける考え方を、代表的な製品例とともに整理します。