LLMOps | 人気のアプリとソフトウェア
LLMOpsプラットフォームは、本番環境で稼働する大規模言語モデルのアプリケーションについて、プロンプト、評価、ファインチューニング、モニタリング、コストを管理します。

Dify
DifyはオープンソースのLLMアプリ開発プラットフォームで、ビジュアルワークフロー、RAG検索、エージェント、モデル管理、デプロイ/APIを提供します。

LangSmith
LangSmithは、LLMアプリケーションの開発、デバッグ、監視を支援する包括的なツールで、パフォーマンスの最適化を促進します。

Wordware
Wordwareは、AIエージェントを使用したアプリケーション開発を促進する統合開発環境(IDE)です。コラボレーションが容易で、API接続が可能です。

Langfuse
Langfuseは、チームがLLMアプリケーションを共同で開発、監視、評価、デバッグできるオープンソースプラットフォームです。

Klu.ai
Klu.aiは、生成AIアプリケーションの設計、展開、最適化を支援するプラットフォームです。共同作業や性能分析機能を提供します。

Promptly
Promptlyは、企業向けの低コード生成AIプラットフォームで、プロンプトを作成、管理、最適化し、AIの利用を簡素化します。

Humanloop
Humanloopは、企業が大規模言語モデル(LLM)を開発・評価・最適化するためのプラットフォームです。人間のフィードバックを統合し、カスタマイズ可能なワークフローを提供します。

Agenta
Agentaはオープンソースのプラットフォームで、LLMアプリの開発・評価・監視を支援し、プロンプト管理、バージョン管理、A/Bテスト、可観測性やデバッグ機能を提供します。

Laminar AI
Laminar AIは、LLMアプリの監視、分析、管理のためのオープンソースプラットフォームで、開発者に包括的なツールを提供します。

LLM Gateway
LLM Gatewayは、複数のAIプロバイダーからの大規模言語モデルへのリクエストを単一のAPIでルーティング、管理、分析するためのプラットフォームです。

Promptmonitor
Promptmonitorは、ChatGPTやClaudeなどのAI/LLMでブランドの視認性を追跡・最適化し、トラフィックやリード、売上を向上させるためのアプリです。

Traceloop
Traceloopは、LLMアプリケーションの観測、監視、テストを行い、開発者が効率的に変更をデプロイできるツールです。

Arkor
Arkorは、Claude CodeやCodexと連携してデータセットやTypeScript製の学習プロジェクトを作成し、GPU環境なしでオープンウェイトモデルを学習・評価・デプロイできるプラットフォームです。OpenAI互換APIで利用できます。

Inworld
Inworldは、消費者向けのAI搭載アプリを開発・大規模運用するためのプラットフォームで、運用自動化、実験管理、リアルタイム音声合成、柔軟な展開を行えます。

Maxim AI
Maxim AIは、企業向けのAI評価と観測プラットフォームで、高品質なAIアプリの開発と展開をサポートします。

Vellum
Vellumは、AIアプリケーションの開発、展開、監視を支援するプラットフォームで、技術者と非技術者が共同で作業できます。

Galileo
Galileo は、生成 AI やエージェントアプリの評価、監視、デバッグ、保護を行うプラットフォームです。

Helicone
Heliconeは、LLM開発者向けの観測性プラットフォームで、デバッグと最適化に必要なツールを提供します。テキストと画像の両方をサポートします。

Confident AI
Confident AIはLLMの評価、テスト、最適化を行うプラットフォームで、データ分析とパフォーマンス監視をサポートします。

Mastra
MastraはTypeScript中心のオープンソースAIフレームワークで、エージェント、耐久ワークフロー、RAG、評価を使い本番向けAIアプリを構築・展開します。

Lamini
Laminiは、企業が独自のデータを使って大手言語モデル(LLM)を開発・管理するためのプラットフォームです。拡張性が高く、安全な環境で運用できます。

GradientJ
GradientJは、大規模な言語モデルを展開・管理し、アプリケーションのパフォーマンスを追跡・改善するためのツールを提供します。

AI Monitor
AI Monitorは、ChatGPTやGoogle AI Overview等のAI生成プラットフォーム上での自社コンテンツや検索結果の表示状況を監視・分析し、改善点を明らかにするツールです。

TrueFoundry
TrueFoundryは、機械学習チーム向けのクラウドネイティブなPaaSで、AIアプリケーションの構築、展開、スケーリングを簡素化するプラットフォームです。

Test AI Models
複数のAIモデルに同時に実際のプロンプトを投げ、品質・速度・コストを比較できます。APIキーやセットアップ不要で、プロンプトを貼るだけで約30秒で結果が得られます。

Deepchecks
DeepChecksは、LLMやMLシステムの評価を簡素化し、自動化されたチェックや洞察を提供するプラットフォームです。

Orq.ai
Orq.aiは、生成AIアプリケーションの開発、展開、最適化を支援するプラットフォームです。多様なAIモデルとの統合と実験機能を提供します。

FinetuneDB
FinetuneDBは、大規模な言語モデルの微調整のためのデータセット作成・管理プラットフォームです。チームで効率的にカスタムAIモデルを開発できます。

Weavel
WeavelはLLMアプリケーションの性能分析とテストプラットフォームで、データセット作成、バッチテスト実施、パフォーマンス評価を行います。

Patronus AI
Patronus AIは、LLMの自動評価と監視を行い、企業が生成AIを安全に利用できるよう支援するプラットフォームです。

SiliconFlow
SiliconFlowは開発者向けのAIインフラで、言語・マルチモーダルモデルの推論、微調整、デプロイをOpenAI互換APIで低レイテンシーに行い、ユーザーデータを保存しません。

Braintrust
Braintrustは、AIアプリ開発のためのプラットフォームで、モデル評価やデータ管理を支援します。チーム間のコラボレーションを強化します。

CoreCtic AI
CoreCtic AIは、複数の生成AI APIを一元管理するプロキシ・分析基盤です。リクエストの振り分け、セマンティックキャッシュ、利用量・コスト分析、顧客管理に対応します。

Not Diamond
複数の大規模言語モデル間でプロンプトを自動変換し、入力ごとに最適なモデルを予測してルーティング、フォールバックやAPI連携で信頼性とコスト効率を高めるプラットフォーム。

LLMTest
LLMTestは、OpenAI/AnthropicのAPI呼び出しを中継し、コスト追跡、340以上のモデル比較、実トラフィックに基づくプロンプト最適化を行う開発者向けツールです。

Entry Point AI
Entry Point AIは、大規模言語モデルの管理、トレーニング、評価を行うためのファインチューニングプラットフォームです。

Augento
Augentoは、ユーザーがエージェントの改善点を指摘すると、強化学習を用いて精度を向上させるサービスを提供するプラットフォームです。

Ultra AI
Ultra AIは、AIプロダクトを強化するための統合AIコマンドセンターです。複数のAIプロバイダーへのアクセス、キャッシング、分析機能を提供します。

AgentOps
AgentOpsはAIエージェントのテストとデバッグを支援するツールで、エージェントのパフォーマンスを観察し最適化するための機能を提供します。

Fiddler
Fiddlerは、機械学習モデル、LLM、エージェントAIを監視・説明・管理するためのAI可観測性とセキュリティのプラットフォームです。

MosaicML
MosaicMLは、データに基づく独自の機械学習モデルを構築、管理、展開できるプラットフォームです。

Gentrace
Gentraceは、AIアプリケーションのテストと監視を支援するプラットフォームで、信頼性と効率を向上させるためのツールを提供します。

AnyApiAI
AnyApiAI は、400以上のAIモデルを単一APIで接続・切替・管理できる開発者向けプラットフォームです。RAGやエージェント、監視機能も備えています。

Bellaire AI
Bellaire AIは、知能を持つAIエージェントの開発、自動化、コラボレーションを支援するプラットフォームです。25以上のLLMや統合機能を提供します。

Parea
Pareaは、開発者が生産準備が整ったLLM製品を迅速に構築するのを支援します。プロンプトとチェーンを試し、テストケースに対して性能を評価できます。

Relyable
AI音声エージェントを迅速に導入し、AI同士の会話をシミュレーションして通話を評価します。VapiとRetell AIとネイティブに連携します。

Toolhouse
Toolhouseは、AIエージェントの作成と管理を簡素化するクラウドプラットフォームで、少ないコードでスケーラブルなAPIとして展開できます。

LaminarFlow
LaminarFlowは、AI技術を活用してコンテンツの生成、管理、公開を自動化するプラットフォームです。作業の効率化を図ります。

Pioneer
Pioneerは、ライブ推論データを使ってオープンソース言語モデルを自動で微調整・再学習し、評価、デプロイ、継続改善まで行うAIプラットフォームです。

Lang.ai EU
Lang.aiはコーディング不要の自動化プラットフォームで、カスタマーサポートチームがAIモデルを構築し、支援プロセスを改善します。

Athina AI
Athinaは、開発者が生産環境でのLLMアプリケーションを監視・評価するためのツールです。RAGパイプラインの可視化と評価指標の使用が可能です。

Mosaic
Mosaicは動画編集のためのAIエージェントです。ユーザーは自然言語で編集内容を説明し、瞬時に編集を行います。

PromptPilot
大規模モデル向けのプロンプト最適化プラットフォーム。生成から評価データに基づく改善、API連携による継続的な調整までを支援します。

Parlance
Parlanceは、会話型AIを利用して電話の顧客体験を向上させ、組織の声によるアクセスを円滑にします。

Tracer
Tracerは、複数のAIモデルをタスクに応じて選択・連携させるプラットフォームです。単一のOpenAI互換APIで推論、ルーティング、モデル評価、実運用データの分析を行えます。

OrcaRouter
OrcaRouterは、1つのAPIで200以上のAIモデルをルーティングし、用途に応じて最適なモデル選択、フォールバック、コスト管理を行うOpenAI互換のAI APIゲートウェイです。

Nirixa AI
Nirixa AI は、OpenAI、Anthropic、Gemini、Groq などの LLM 呼び出しを可視化し、トークンコスト、プロンプトの変化、幻覚リスク、レイテンシを監視する可観測性プラットフォームです。

ModelRiver
複数のLLMプロバイダを統合するAI APIゲートウェイ。ストリーミング、カスタム設定、組み込みパッケージ、ルーティング、レート制限、フェイルオーバー、分析を提供。

Draft'n run
Draft'n runは、AIエージェントの設計・作成・展開・監視を一元化するオープンソースのプラットフォームです。

Flutch
FlutchはAIワークフローの可観測性と品質管理を提供する展開・テストプラットフォーム。実行のトレース、品質・コスト測定、受入テストやバージョン管理、チャットUIやサービスのデプロイを支援する。