← トップに戻る

入門マルチモーダルRAG : 図表を読み解くAIアプリケーションの実装

なぜ書影が表示されないのですか?
本サイトでは、openBDプロジェクトの書影情報を掲載しております。 書影が表示されない書籍は、openBDに書影の利用許諾が登録されていないものです。

書誌・書影の利用許諾で、本を広めよう(版元ドットコム)

著者
新納 浩幸
出版社
オーム社
価格
¥2,600(税別)
ISBN
9784274234934

概要

「図表を読めるRAG」を作る 近年、テキストだけでなく、図・表・グラフといった画像を含む資料からも情報を検索・活用できる「マルチモーダルRAG(Retrieval-Augmented Generation)」の重要性が高まっています。従来のRAGが扱える情報はテキストデータに限定されており、実務現場で扱う文書──PDF・Word・PowerPointなど──のように、図表を多く含むデータには十分対応できませんでした。本書は、この課題を踏まえて、実務文書にも対応できるマルチモーダルRAGについて体系的に解説します。 本書では、自分の手でマルチモーダルRAGを構築できるようになることを目指します。全体を通して、手を動かしながら理解できるよう、再現可能なコード例を多数提示しています。 このような方におすすめ ◎RAGに関係する技術者(機械学習/AIエンジニア、アプリケーション開発者、データサイエンティストなど) 〇AI関連サービスを開発している企業の営業や広報の担当者 主要目次 Chapter 1 テキストベースのRAG Chapter 2 Responses APIのfile searchによるRAG Chapter 3 標準的なマルチモーダルRAG Chapter 4 ColPaliを利用したマルチモーダルRAG Chapter 5 エージェントによる自律制御を組み込んだMMA-RAG Chapter 6 VQAを中核としたマルチモーダルRAG

書誌情報の出典:国立国会図書館(CC BY 4.0)、openBDGoogle Books API

ADAmazon のアソシエイトとして、京姫鉄道合同会社は適格販売により収入を得ています。

← トップに戻る