LLMOps | 人気のアプリとソフトウェア

LLMOpsプラットフォームは、本番環境で稼働する大規模言語モデルのアプリケーションについて、プロンプト、評価、ファインチューニング、モニタリング、コストを管理します。

Dify

Dify

DifyはオープンソースのLLMアプリ開発プラットフォームで、ビジュアルワークフロー、RAG検索、エージェント、モデル管理、デプロイ/APIを提供します。

LangSmith

LangSmith

LangSmithは、LLMアプリケーションの開発、デバッグ、監視を支援する包括的なツールで、パフォーマンスの最適化を促進します。

Wordware

Wordware

Wordwareは、AIエージェントを使用したアプリケーション開発を促進する統合開発環境(IDE)です。コラボレーションが容易で、API接続が可能です。

Langfuse

Langfuse

Langfuseは、チームがLLMアプリケーションを共同で開発、監視、評価、デバッグできるオープンソースプラットフォームです。

Klu.ai

Klu.ai

Klu.aiは、生成AIアプリケーションの設計、展開、最適化を支援するプラットフォームです。共同作業や性能分析機能を提供します。

Promptly

Promptly

Promptlyは、企業向けの低コード生成AIプラットフォームで、プロンプトを作成、管理、最適化し、AIの利用を簡素化します。

Humanloop

Humanloop

Humanloopは、企業が大規模言語モデル(LLM)を開発・評価・最適化するためのプラットフォームです。人間のフィードバックを統合し、カスタマイズ可能なワークフローを提供します。

Agenta

Agenta

Agentaはオープンソースのプラットフォームで、LLMアプリの開発・評価・監視を支援し、プロンプト管理、バージョン管理、A/Bテスト、可観測性やデバッグ機能を提供します。

Laminar AI

Laminar AI

Laminar AIは、LLMアプリの監視、分析、管理のためのオープンソースプラットフォームで、開発者に包括的なツールを提供します。

LLM Gateway

LLM Gateway

LLM Gatewayは、複数のAIプロバイダーからの大規模言語モデルへのリクエストを単一のAPIでルーティング、管理、分析するためのプラットフォームです。

Promptmonitor

Promptmonitor

Promptmonitorは、ChatGPTやClaudeなどのAI/LLMでブランドの視認性を追跡・最適化し、トラフィックやリード、売上を向上させるためのアプリです。

Traceloop

Traceloop

Traceloopは、LLMアプリケーションの観測、監視、テストを行い、開発者が効率的に変更をデプロイできるツールです。

Arkor

Arkor

Arkorは、Claude CodeやCodexと連携してデータセットやTypeScript製の学習プロジェクトを作成し、GPU環境なしでオープンウェイトモデルを学習・評価・デプロイできるプラットフォームです。OpenAI互換APIで利用できます。

Inworld

Inworld

Inworldは、消費者向けのAI搭載アプリを開発・大規模運用するためのプラットフォームで、運用自動化、実験管理、リアルタイム音声合成、柔軟な展開を行えます。

Maxim AI

Maxim AI

Maxim AIは、企業向けのAI評価と観測プラットフォームで、高品質なAIアプリの開発と展開をサポートします。

Vellum

Vellum

Vellumは、AIアプリケーションの開発、展開、監視を支援するプラットフォームで、技術者と非技術者が共同で作業できます。

Galileo

Galileo

Galileo は、生成 AI やエージェントアプリの評価、監視、デバッグ、保護を行うプラットフォームです。

Helicone

Helicone

Heliconeは、LLM開発者向けの観測性プラットフォームで、デバッグと最適化に必要なツールを提供します。テキストと画像の両方をサポートします。

Confident AI

Confident AI

Confident AIはLLMの評価、テスト、最適化を行うプラットフォームで、データ分析とパフォーマンス監視をサポートします。

Mastra

Mastra

MastraはTypeScript中心のオープンソースAIフレームワークで、エージェント、耐久ワークフロー、RAG、評価を使い本番向けAIアプリを構築・展開します。

Lamini

Lamini

Laminiは、企業が独自のデータを使って大手言語モデル(LLM)を開発・管理するためのプラットフォームです。拡張性が高く、安全な環境で運用できます。

GradientJ

GradientJ

GradientJは、大規模な言語モデルを展開・管理し、アプリケーションのパフォーマンスを追跡・改善するためのツールを提供します。

AI Monitor

AI Monitor

AI Monitorは、ChatGPTやGoogle AI Overview等のAI生成プラットフォーム上での自社コンテンツや検索結果の表示状況を監視・分析し、改善点を明らかにするツールです。

TrueFoundry

TrueFoundry

TrueFoundryは、機械学習チーム向けのクラウドネイティブなPaaSで、AIアプリケーションの構築、展開、スケーリングを簡素化するプラットフォームです。

Test AI Models

Test AI Models

複数のAIモデルに同時に実際のプロンプトを投げ、品質・速度・コストを比較できます。APIキーやセットアップ不要で、プロンプトを貼るだけで約30秒で結果が得られます。

Deepchecks

Deepchecks

DeepChecksは、LLMやMLシステムの評価を簡素化し、自動化されたチェックや洞察を提供するプラットフォームです。

Orq.ai

Orq.ai

Orq.aiは、生成AIアプリケーションの開発、展開、最適化を支援するプラットフォームです。多様なAIモデルとの統合と実験機能を提供します。

FinetuneDB

FinetuneDB

FinetuneDBは、大規模な言語モデルの微調整のためのデータセット作成・管理プラットフォームです。チームで効率的にカスタムAIモデルを開発できます。

Weavel

Weavel

WeavelはLLMアプリケーションの性能分析とテストプラットフォームで、データセット作成、バッチテスト実施、パフォーマンス評価を行います。

Patronus AI

Patronus AI

Patronus AIは、LLMの自動評価と監視を行い、企業が生成AIを安全に利用できるよう支援するプラットフォームです。

SiliconFlow

SiliconFlow

SiliconFlowは開発者向けのAIインフラで、言語・マルチモーダルモデルの推論、微調整、デプロイをOpenAI互換APIで低レイテンシーに行い、ユーザーデータを保存しません。

Braintrust

Braintrust

Braintrustは、AIアプリ開発のためのプラットフォームで、モデル評価やデータ管理を支援します。チーム間のコラボレーションを強化します。

CoreCtic AI

CoreCtic AI

CoreCtic AIは、複数の生成AI APIを一元管理するプロキシ・分析基盤です。リクエストの振り分け、セマンティックキャッシュ、利用量・コスト分析、顧客管理に対応します。

Not Diamond

Not Diamond

複数の大規模言語モデル間でプロンプトを自動変換し、入力ごとに最適なモデルを予測してルーティング、フォールバックやAPI連携で信頼性とコスト効率を高めるプラットフォーム。

LLMTest

LLMTest

LLMTestは、OpenAI/AnthropicのAPI呼び出しを中継し、コスト追跡、340以上のモデル比較、実トラフィックに基づくプロンプト最適化を行う開発者向けツールです。

Entry Point AI

Entry Point AI

Entry Point AIは、大規模言語モデルの管理、トレーニング、評価を行うためのファインチューニングプラットフォームです。

Augento

Augento

Augentoは、ユーザーがエージェントの改善点を指摘すると、強化学習を用いて精度を向上させるサービスを提供するプラットフォームです。

Ultra AI

Ultra AI

Ultra AIは、AIプロダクトを強化するための統合AIコマンドセンターです。複数のAIプロバイダーへのアクセス、キャッシング、分析機能を提供します。

AgentOps

AgentOps

AgentOpsはAIエージェントのテストとデバッグを支援するツールで、エージェントのパフォーマンスを観察し最適化するための機能を提供します。

Fiddler

Fiddler

Fiddlerは、機械学習モデル、LLM、エージェントAIを監視・説明・管理するためのAI可観測性とセキュリティのプラットフォームです。

MosaicML

MosaicML

MosaicMLは、データに基づく独自の機械学習モデルを構築、管理、展開できるプラットフォームです。

Gentrace

Gentrace

Gentraceは、AIアプリケーションのテストと監視を支援するプラットフォームで、信頼性と効率を向上させるためのツールを提供します。

AnyApiAI

AnyApiAI

AnyApiAI は、400以上のAIモデルを単一APIで接続・切替・管理できる開発者向けプラットフォームです。RAGやエージェント、監視機能も備えています。

Bellaire AI

Bellaire AI

Bellaire AIは、知能を持つAIエージェントの開発、自動化、コラボレーションを支援するプラットフォームです。25以上のLLMや統合機能を提供します。

Parea

Parea

Pareaは、開発者が生産準備が整ったLLM製品を迅速に構築するのを支援します。プロンプトとチェーンを試し、テストケースに対して性能を評価できます。

Relyable

Relyable

AI音声エージェントを迅速に導入し、AI同士の会話をシミュレーションして通話を評価します。VapiとRetell AIとネイティブに連携します。

Toolhouse

Toolhouse

Toolhouseは、AIエージェントの作成と管理を簡素化するクラウドプラットフォームで、少ないコードでスケーラブルなAPIとして展開できます。

LaminarFlow

LaminarFlow

LaminarFlowは、AI技術を活用してコンテンツの生成、管理、公開を自動化するプラットフォームです。作業の効率化を図ります。

Pioneer

Pioneer

Pioneerは、ライブ推論データを使ってオープンソース言語モデルを自動で微調整・再学習し、評価、デプロイ、継続改善まで行うAIプラットフォームです。

Lang.ai EU

Lang.ai EU

Lang.aiはコーディング不要の自動化プラットフォームで、カスタマーサポートチームがAIモデルを構築し、支援プロセスを改善します。

Athina AI

Athina AI

Athinaは、開発者が生産環境でのLLMアプリケーションを監視・評価するためのツールです。RAGパイプラインの可視化と評価指標の使用が可能です。

Mosaic

Mosaic

Mosaicは動画編集のためのAIエージェントです。ユーザーは自然言語で編集内容を説明し、瞬時に編集を行います。

PromptPilot

PromptPilot

大規模モデル向けのプロンプト最適化プラットフォーム。生成から評価データに基づく改善、API連携による継続的な調整までを支援します。

Parlance

Parlance

Parlanceは、会話型AIを利用して電話の顧客体験を向上させ、組織の声によるアクセスを円滑にします。

Tracer

Tracer

Tracerは、複数のAIモデルをタスクに応じて選択・連携させるプラットフォームです。単一のOpenAI互換APIで推論、ルーティング、モデル評価、実運用データの分析を行えます。

OrcaRouter

OrcaRouter

OrcaRouterは、1つのAPIで200以上のAIモデルをルーティングし、用途に応じて最適なモデル選択、フォールバック、コスト管理を行うOpenAI互換のAI APIゲートウェイです。

Nirixa AI

Nirixa AI

Nirixa AI は、OpenAI、Anthropic、Gemini、Groq などの LLM 呼び出しを可視化し、トークンコスト、プロンプトの変化、幻覚リスク、レイテンシを監視する可観測性プラットフォームです。

ModelRiver

ModelRiver

複数のLLMプロバイダを統合するAI APIゲートウェイ。ストリーミング、カスタム設定、組み込みパッケージ、ルーティング、レート制限、フェイルオーバー、分析を提供。

Draft'n run

Draft'n run

Draft'n runは、AIエージェントの設計・作成・展開・監視を一元化するオープンソースのプラットフォームです。

Flutch

Flutch

FlutchはAIワークフローの可観測性と品質管理を提供する展開・テストプラットフォーム。実行のトレース、品質・コスト測定、受入テストやバージョン管理、チャットUIやサービスのデプロイを支援する。