論文PDF処理パイプラインの最終段階について解説。両経路の結果をまとめるfinalizer Lambdaが、comparison.jsonを生成してDynamoDBを更新する仕組みと、経路ごとの状態管理、レビュー要否の判定ロジックを説明しています。
論文PDFを構造化JSONに変換するパイプラインの経路B(画像をBedrockに直接読ませる方式)について、Step Functionsでページを並列処理し、各Lambdaがページ画像からモデルで構造化データを抽出、S3に保存、最後にfinalizerで結合・正規化・検証する流れを詳説。
論文PDFを構造化JSONに変換するパイプラインの経路A(Textract+Bedrock)について、各ステップの設計理由と実装を詳細に解説。出力上限問題への対処として、モデルに本文を書かせず位置情報のみ返させることで、生成時間を半減させた改善事例を紹介。
AWS AIPの知見を活かし、論文PDFを構造化JSONに変換するパイプラインを構築。S3、Lambda、Step Functions、Textract、Bedrockを組み合わせ、2つの抽出経路で日本語・英語PDFを処理し、メタデータ付きの構造化データをRAGのソースとして活用する仕組みを実装。
AppSync Events を使用したイベント駆動アーキテクチャの実装をCDKで定義し、WebSocket通信によるリアルタイムイベント配信の構成と動作確認を紹介。
AppSync Events を用いたイベント駆動型Webアプリケーションの実装例を紹介。API Lambda、Event Lambda、フロントエンドの実装コードと、AppSync Events への Publish 時の JSON 二重シリアライズやAPI キー認証などの注意点を解説。
AppSync Events を使用したイベント駆動型Webアプリケーション構築について、GraphQL Subscriptionとの違い、AppSync Eventsの概要、HTTP PublishエンドポイントとWebSocket Subscribeエンドポイントの役割を解説した記事。
VS Code の PostgreSQL 拡張機能を使用して、ベクトル検索を用いた関連記事レコメンド機能の SQL をEXPLAIN分析し、CTE を活用して絞り込みを早期化することで実行時間を約65%削減した改善事例。
Bedrock cross-region inference profileの動的ルーティングにより、大阪リージョンでモデルアクセスが未設定だったため、リージョン間で交互に成功・失敗するエラーが発生。大阪でのモデルアクセス申請とLambda IAM権限追加で解決した。
Go 1.24で追加されたbytes/stringsパッケージのイテレータ関数群を解説。iter.Seqを活用し、従来の一括返却から1要素ずつ処理へ変更。早期終了時のメモリ効率向上が主な利点。