データ

TIPS

ファイルフォーマットと対応OS

主要なファイル形式(ファイルシステム)における、Mac、Windows、Linuxそれぞれの「読み書き」対応表です。WindowsとMac両方使用しいるのであれば exFAT が、もっともバランスの良い選択です。OS別ファイルシステム対応表...
言語

[Python]Word文章をPowerPointにコンバート

指定されたマイクロソフトWordドキュメン「サンプル.docx」のすべてのページを、Pythonを使ってPowerPointプレゼンテーションとして自動生成するスクリプトを作成します。このスクリプトは、ドキュメントの各章やセクションを個別の...
TIPS

中華製のノーブランドNVMe SSD

中華製のノーブランドNVMe SSDと、SamsungやCrucialといった有名ブランドの製品との違いについて、価格の安さは非常に魅力的ですが、その背景には性能、信頼性、そして保証という主に3つの大きな違いが存在します。1. 性能の違い:...
AI

[AWS]Bedrock KnowledgeBase: インテントルーティング及び実行ルール

ハンバーガー店を例にして一般的な定義を記載1. 基本方針と処理フロー本ルールセットは、ユーザーからの自然言語による問い合わせ(Utterance)を解析し、その意図(Intent)を正確に分類した上で、最適なAPIエンドポイントへルーティン...
ツール

OpenSearchとRDBとNoSQLの賢い使い分け

OpenSearch Vector DBは、RDBが苦手とする意味や文脈を理解する「セマンティック検索」に特化したデータベースです。ユーザーの自然言語による質問への応答や、レコメンド、画像・音声検索などで力を発揮します。一方、RDBは厳格な...
ツール

[AWS]OpenSearchのベクターDBが変える検索の未来

OpenSearchのVector DBを効果的に使うには、ベクトルのインデックス名、次元数、距離メトリクス、検索アルゴリズムを定義することが重要です。運用では、企業独自の非構造化データをチャンク化し、埋め込みモデルでベクトル化して格納しま...
ツール

[AWS]BedrockとOpenSearchで始める、全く新しいベクトルDB入門

Amazon BedrockでOpenSearchをベクトルDBとして使う際、インデックス、マッピング、k-NNアルゴリズムの設定が重要です。運用にはベクトルデータとメタデータ(元のテキストやスキーマ情報)が必要。テーブル名やカラム情報をメ...
ツール

[AWS]Bedrock ハイパーパラメータ設定

業務内容や学習データ量に応じたハイパーパラメータの参考値をご提案します。Amazon Bedrockではモデルやタスクによって最適値が異なりますが、下記は一般的なベンチマークです。自然言語処理 (NLP) タスク(例:テキスト分類、感情分析...
AI

[AWS]Bedrockを調教!AIモデルを最強にする「学習データ」の極意

Amazon BedrockにおけるAIモデルカスタマイズの学習方法を解説します。微調整(Fine-Tuning)と継続的予備訓練(Continued Pre-Training)の2手法を紹介し、特に「データの質」が成功の鍵となります。高品...
TIPS

バルサラの破産確率

バルサラの破産確率(Bathala's Bankruptcy Probability)は、企業の財務リスクを評価するための統計モデルとして知られています。特に、企業の財務データから破産リスクを定量化する手法で、アルトマンのZスコアと並んで信...