AI 에이전트
LangSmith는 AI 에이전트 및 LLM 관찰 가능성 플랫폼으로, 에이전트 동작에 대한 완전한 가시성을 제공합니다. 에이전트 디버깅, 실패 식별, 비용 및 지연 시간 추적을 지원합니다. 선호하는 프레임워크를 추적하거나 Python, Typescript, Go 또는 Java SDK를 사용하여 모든 에이전트 스택과…
MLOps 및 모델 배포 분야의 최고 도구를 발견하세요 — AI Agent Observability 도구와 AI 플랫폼에서 AI 프레임워크, AI GitHub 저장소, 확장 가능한 추론 솔루션까지, 데이터 과학자와 엔지니어가 업무 흐름을 간소화할 수 있는 도구를 찾는 곳입니다: AI 에이전트 모니터링, 머신러닝 모델 배포, 모델 수명주기 관리, API를 통한 AI 실행. AI 앱, AI 플랫폼, AI 프레임워크, AI 에이전트 및 AI GitHub 저장소 등에서 113개의 최고의 MLOps 및 모델 배포 AI 도구을(를) 살펴보세요.
113 tools
AI 에이전트
LangSmith는 AI 에이전트 및 LLM 관찰 가능성 플랫폼으로, 에이전트 동작에 대한 완전한 가시성을 제공합니다. 에이전트 디버깅, 실패 식별, 비용 및 지연 시간 추적을 지원합니다. 선호하는 프레임워크를 추적하거나 Python, Typescript, Go 또는 Java SDK를 사용하여 모든 에이전트 스택과…
AI 에이전트
Langfuse는 개발자가 AI 애플리케이션을 구축, 모니터링 및 개선하는 데 도움이 되도록 설계된 오픈 소스 LLM 엔지니어링 플랫폼입니다. 통합된 워크플로우에서 추적, 프롬프트 관리, 평가 및 분석을 제공합니다. Langfuse는 다양한 모델, 프레임워크 및 통합을 지원하여 팀이 프로토타입에서 프로덕션으로 효율적으로…
AI 프레임워크
MLflow는 기존 머신러닝 워크플로우와 최신 LLM/에이전트 개발 모두에 대한 포괄적인 문서를 제공합니다. 실험 추적, 모델 레지스트리, 배포, LLM 추적, 에이전트 평가, 프롬프트 관리 및 AI 거버넌스를 다루며 전체 AI 라이프사이클을 관리하는 도구를 제공합니다.
AI 에이전트
Braintrust는 양질의 AI 제품을 구축하기 위해 설계된 AI 관측 가능성 플랫폼입니다. 팀이 프로덕션을 추적하고, 평가를 실행하며, 사용자에 영향을 미치기 전에 회귀를 포착하는 데 도움이 됩니다. 이 플랫폼은 AI 성능을 향상시키기 위해 실시간 추적 검사, 품질 측정 및 자동화된 점수를 제공합니다.
AI 프레임워크
Kubeflow 문서는 Kubeflow 플랫폼을 이해하고 활용하기 위한 포괄적인 리소스를 제공합니다. 시작하기 가이드, 하위 프로젝트 상세 정보, 커뮤니티 정보 및 더 넓은 Kubeflow 생태계를 다룹니다. 이 문서는 Kubernetes에서 머신러닝 워크플로우를 구현하고 관리하려는 모든 사람에게 필수적입니다.
AI 플랫폼
Bento는 속도와 제어를 위해 설계된 추론 플랫폼으로, 모든 AI 모델을 어디든 배포할 수 있도록 지원합니다. 맞춤형 최적화, 효율적인 확장, 간소화된 운영을 AI 팀에 제공합니다. 배포에 대한 완전한 제어를 유지하면서 추론 인프라를 단순화하십시오.
AI 에이전트
LM Studio를 사용하면 컴퓨터에서 직접 로컬 AI 모델을 실행할 수 있습니다. gpt-oss, Llama, Gemma, Qwen, DeepSeek과 같은 모델을 지원합니다. 인터넷 연결 없이 개인적으로 AI 모델을 배포하고 사용할 수 있습니다. GUI와 서버 및 CI를 위한 헤드리스 배포 옵션을 제공합니다.
AI 플랫폼
Replicate는 오픈 소스 머신러닝 모델을 실행하고 미세 조정할 수 있는 클라우드 API를 제공합니다. 단 한 줄의 코드로 사용자 정의 모델을 배포하세요. 이미지 생성, 음성, 음악 및 비디오 제작을 위한 수천 개의 프로덕션 준비 AI 모델에 액세스하세요. 사용한 컴퓨팅에 대해서만 비용을 지불하며 자동 확장 기능을…
AI 플랫폼
DataRobot은 기업을 위해 설계된 통합 에이전트 인력 플랫폼으로, 기업이 AI 애플리케이션을 효과적으로 구축, 운영 및 관리할 수 있도록 하여 위험을 최소화하고 영향을 극대화합니다.
AI 플랫폼
레드햇 오픈시프트 AI는 MLOps, GenAIOps 및 AgentOps 기능을 통합한 유연한 하이브리드 클라우드 플랫폼으로, 조직이 다양한 환경에서 에이전틱 AI 애플리케이션의 배포를 가속화할 수 있도록 합니다.
AI 플랫폼
Clarifai는 규모와 속도를 위해 설계된 선도적인 AI 컴퓨팅 오케스트레이션 플랫폼입니다. GPU에서 더 빠른 추론 및 추론을 가능하게 하는 컴퓨팅 리소스를 동적으로 관리하여 복잡한 AI 작업을 간소화합니다. 이 플랫폼은 모델 최적화, 소프트웨어 설계 및 하이퍼스케일 AI 클라우드 환경을 위한 효율적인 실행에 중점을…
AI 플랫폼
Baseten의 추론 플랫폼은 사용자가 오픈 소스 및 맞춤형 AI 모델을 효율적으로 배포하고 확장할 수 있도록 합니다. 전용 인프라, 최적화된 API 및 원활한 개발자 워크플로우를 통해 고성능 추론을 제공하여 신속한 배포와 신뢰할 수 있는 성능을 보장합니다.
AI 프레임워크
Comet의 ML 플랫폼은 데이터 과학 및 머신러닝 팀이 전체 ML 수명 주기 동안 모델을 추적, 비교, 설명 및 최적화할 수 있도록 지원합니다. 실험 관리, 모델 모니터링 및 LLM 애플리케이션 평가를 간소화하여 더 빠른 반복과 더 나은 모델 개발을 가능하게 합니다.
AI GitHub 저장소
vllm-project/vllm은 대형 언어 모델(LLM)을 위해 설계된 고속 및 메모리 효율적인 추론 및 서비스 엔진입니다. 성능을 최적화하면서 자원 사용을 최소화하여 AI 및 머신 러닝의 다양한 응용 프로그램에 적합합니다.
AI 앱
생산 환경에서 에이전트를 추적하고, 실패를 드러내며, 이를 자동으로 수정하는 코딩 에이전트를 배치하는 오픈 소스 AI 에이전트 가시성 및 모니터링 플랫폼입니다.
AI 플랫폼
DeepInfra는 개발자 친화적인 API를 통해 100개 이상의 머신러닝 모델을 제공하는 AI 추론 클라우드로, 사용한 만큼만 지불하는 가격 정책을 갖추고 있습니다. 비용 효율적이고 확장 가능하며 생산 준비가 완료된 추론이 필요한 개발자와 기업을 대상으로 합니다.
AI 플랫폼
개발자가 200개 이상의 최적화된 LLM 및 다중 모달 모델을 배포, 미세 조정 및 실행할 수 있는 AI 인프라 플랫폼으로, 하나의 OpenAI 호환 API를 통해 사용한 만큼만 지불하는 가격 모델을 제공합니다.
AI 프레임워크
SGLang는 대규모 언어 및 다중 모달 모델을 위해 설계된 고성능 서비스 프레임워크입니다. 이는 고급 AI 솔루션을 효율적으로 구현하려는 개발자를 위한 광범위한 하드웨어 지원과 강력한 생태계를 제공합니다.
Kubeflow는 Kubernetes에서 머신 러닝 워크플로우의 배포를 간소화하여 직관적이고 자동화된 방식으로 제공합니다. 오픈 소스이며 커뮤니티에 의해 구축되어 AI 플랫폼 팀을 위한 모듈화되고 확장 가능한 솔루션을 제공합니다.
Cloudflare Workers AI는 단일 API 호출로 전 세계에서 AI 추론을 실행할 수 있는 엣지 AI 추론 플랫폼입니다. 50개 이상의 모델과 서버리스 가격 책정을 제공하여 인프라 관리를 하지 않고도 AI 작업 부하를 쉽게 확장할 수 있습니다.
AI 플랫폼
코메트는 개발자를 위해 설계된 엔드 투 엔드 AI 가시성 플랫폼인 Opik의 제작자입니다. 이 플랫폼은 개발 프로세스를 향상하고 AI 모델 성능을 개선하기 위해 고급 에이전트 테스트, 최적화 및 모니터링 기능을 제공합니다.
TrueFoundry는 LLM 및 AI 에이전트의 배포, 보안 및 확장을 가능하게 하는 엔터프라이즈급 AI 플랫폼입니다. AI 애플리케이션 전반에 걸쳐 중앙 집중식 거버넌스 및 가시성을 제공하여 기업의 규정 준수 및 비용 관리를 보장합니다.
AI 플랫폼
ZenML은 기계 학습 및 AI를 위한 통합 레이어로, 재현 가능한 ML 파이프라인 및 에이전트 평가를 가능하게 합니다. 기존 인프라와 원활하게 통합되어 팀이 공급업체 종속 없이 효율적으로 워크플로를 구축하고 관리할 수 있도록 합니다.
AI GitHub 저장소
SGLang은 대형 언어 모델과 다중 모달 모델을 위해 설계된 고성능 서빙 프레임워크입니다. AI 애플리케이션의 성능을 향상시키는 효율적인 서빙 기능을 제공하여 AI 분야의 개발자와 연구자에게 적합합니다.
AI 플랫폼
Cerebrium은 실시간 AI를 위한 서버리스 GPU 인프라를 제공하여 음성 에이전트, 비디오 모델 및 LLM에 대한 1초 미만의 콜드 스타트를 가능하게 합니다. 즉각적인 자동 확장을 지원하고 초당 지불 요금제를 제공하며 Kubernetes의 필요성을 없애 복잡한 인프라 관리 없이 프로덕션 속도의 AI를 사용할 수…
AI 플랫폼
Union.ai는 데이터 프라이버시를 보장하며 클라우드 인프라 내에서 작동하는 AI 런타임입니다. 내구성 있는 AI 워크플로, 실시간 애플리케이션을 오케스트레이션하고 컴퓨팅을 최적화하여 금융 서비스, 지리 공간, 물류 및 생명공학 산업에 상당한 ROI와 비용 절감을 제공합니다.
Valohai는 LLM 및 전문 모델을 통합한 AI 제품을 위해 설계된 MLOps 플랫폼입니다. 사용자는 데이터에서 배포까지의 전체 계보를 유지하면서 자신의 클라우드 인프라를 사용하여 구성 비교, 평가 및 배포를 할 수 있습니다.
Teammately는 AI 엔지니어가 안정적인 AI 서비스를 구축하도록 설계된 AI 에이전트입니다. 프롬프트 생성, AI 모델 개선, 성능 평가를 통해 AI 개발을 자동화하고 가속화합니다. 이 플랫폼은 에이전트 기반 RAG 구축, AI 생성 문서, 다차원 LLM 심사관과 같은 기능을 제공합니다.
AI 에이전트
Phala Cloud는 개인 LLM 추론, 밀봉된 에이전트 및 검증 가능한 컴퓨팅을 위한 기밀 AI 플랫폼을 제공합니다. Intel TDX 및 NVIDIA H100/H200을 포함한 TEE로 보호되는 GPU에서 실행됩니다. 사용자는 기존 Docker Compose 워크로드를 배포하고, 런타임을 검증하며, GPU…
AI 에이전트
CRAB는 멀티모달 언어 모델 에이전트를 평가하기 위한 포괄적인 벤치마크 프레임워크입니다. 환경 간 지원, 그래프 평가자, 자동화된 작업 생성을 제공하여 다양한 시나리오와 모델에 걸쳐 에이전트의 기능을 강력하게 평가할 수 있습니다.
AI 앱
UsageGuard는 엔터프라이즈급 AI 개발 옵저버빌리티 플랫폼입니다. 여러 AI 모델에 액세스할 수 있는 통합 API를 제공하며, 안전하고 효율적인 AI 애플리케이션 개발을 위한 내장형 안전 장치, 모더레이션, 비용 제어 및 상세한 최종 사용자 및 사용량 추적 기능을 제공합니다.
AI 앱
Visnet은 AI 모델 개발 및 배포를 위한 포괄적인 헤드리스, 멀티 호환, 범용 신경망 인터페이스를 제공합니다. 모듈식 프론트엔드, 서버리스 아키텍처 및 강력한 보안 기능을 통해 다양한 산업 애플리케이션에 NLP 및 딥 비전 시스템을 효율적으로 통합할 수 있습니다.
APIPark는 오픈소스 엔터프라이즈급 API 개발자 포털 및 LLM 게이트웨이입니다. 여러 LLM에 대한 통합 API 시그니처, 로드 밸런싱, 트래픽 제어 및 프롬프트 관리를 제공합니다. APIPark는 기업이 AI를 운영에 통합할 때 LLM 호출의 보안, 안정성 및 비용 최적화를 향상시킵니다.
AI 앱
EnergeticAI는 서버리스 Node.js 애플리케이션을 위해 TensorFlow.js를 최적화하여 빠른 콜드 스타트 시간과 줄어든 모듈 크기를 제공합니다. 텍스트 분류 및 임베딩과 같은 작업을 위한 사전 학습된 모델을 제공하여 개발자가 비즈니스 친화적인 라이선스로 오픈 소스 AI를 프로젝트에 효율적으로 통합할 수…
AI 앱
Meteron AI는 LLM 및 생성형 AI 계량, 로드 밸런싱, 스토리지를 처리하여 AI 비즈니스 성장을 위한 올인원 도구 세트를 제공합니다. 개발자가 복잡한 프로세스에서 벗어나 AI 제품 구축에 집중할 수 있도록 합니다. 유연한 요금 책정 옵션과 탄력적인 확장을 통해 AI 모델로 수익을 창출하세요.
AI 앱
Coxwave Align은 Generative AI 제품을 위한 분석 엔진으로, 조직이 LLM 기반 대화 데이터를 모니터링, 분석 및 평가할 수 있도록 지원합니다. 이를 통해 개선점을 파악하고, 환각 현상을 줄이며, 원시 상호 작용 데이터를 제품 ROI 향상을 위한 실행 가능한 인사이트로 전환하여 챗봇 품질을 높일 수…
AI 앱
Hamming AI는 엔터프라이즈 음성 및 채팅 에이전트 QA 및 프로덕션 모니터링을 위한 포괄적인 플랫폼을 제공합니다. 시나리오 생성을 자동화하고, 프로덕션 통화를 다시 재생하며, 50개 이상의 지표를 제공합니다. SOC 2 인증 및 HIPAA 준비가 되어 있어 팀이 10분 이내에 테스트를 시작할 수 있습니다.
AI 앱
EvalsOne은 생성형 AI 애플리케이션을 손쉽게 평가하도록 설계된 플랫폼이었습니다. AI 모델의 성능을 평가하고 이해하는 데 도움이 되는 도구와 기능을 제공했습니다. 이 서비스는 현재 종료되었으며, 후속 제품을 이용할 수 있습니다.
ClearML의 GenAI 앱 엔진은 원클릭 LLM 배포, 컴퓨팅 비용 최적화, AI 성능 모니터링을 안전하고 확장 가능한 환경에서 지원하여 GenAI 채택을 가속화합니다. 개발자와 비즈니스 소유자를 위한 GenAI 프로젝트 출시를 간소화합니다.
AI 앱
EmbedAPI는 OpenAI, Anthropic, Gemini 등 다양한 AI 모델을 애플리케이션에 통합할 수 있는 통합 플랫폼을 제공합니다. AI 인프라 관리를 간소화하여 개발자가 예측 가능한 가격 책정과 엔터프라이즈급 안정성을 바탕으로 챗봇, 콘텐츠 생성, 코드 지원과 같은 AI 기반 기능을 신속하게 구축할 수…
Orq.ai는 팀이 AI 애플리케이션을 효율적이고 안전하게 구축, 출시 및 확장할 수 있도록 설계된 생성형 AI 협업 플랫폼입니다. AI 애플리케이션 개발, 테스트, 배포 및 모니터링을 위한 통합 환경을 제공하여 AI 수명 주기 전반에 걸쳐 품질과 지속적인 개선을 보장합니다.
AI 앱
Awan LLM은 개발자와 파워 유저를 위한 무제한 및 비용 효율적인 LLM 추론 API 플랫폼을 제공합니다. 무제한 토큰을 제공하여 검열이나 토큰 수 제한에 대한 걱정 없이 광범위한 데이터 처리, 코드 완성 및 AI 에이전트 개발을 가능하게 합니다. 무료로 시작하여 비용 효율적이고 무제한적인 LLM 사용을 경험해…
AI 앱
Mancer는 모든 사람에게 제약 없는 대규모 언어 모델(LLM)에 대한 액세스를 제공합니다. 필터나 지침 없이 강력한 LLM에 대해 모든 프롬프트를 실행할 수 있는 플랫폼을 제공합니다. 사용자는 무료로 유능한 LLM에 액세스하거나 향상된 모델 성능, 속도 및 강점을 위해 유료 옵션을 선택할 수 있습니다.
AI 앱
TextSynth은 텍스트 및 이미지 생성, 음성 처리 등을 위한 고급 AI 모델에 대한 API 액세스를 제공합니다. 표준 하드웨어에서 더 빠르고 비용 효율적인 작업을 위해 사용자 정의 추론을 활용합니다. 2020년에 설립되었으며 GPT-2 액세스를 제공한 초기 제공업체 중 하나였으며 서버는 프랑스에 위치해 있습니다.…
AI 앱
Langtrace는 AI 프로토타입을 엔터프라이즈급 제품으로 전환하는 데 도움을 주는 오픈 소스 관찰 가능성 및 평가 플랫폼입니다. AI 에이전트의 성능, 보안 및 비용에 대한 통찰력을 제공하며, 원활한 통합 및 반복을 위해 인기 있는 프레임워크와 LLM 제공업체를 지원합니다.
AI 앱
OpenLIT은 GenAI 및 LLM 애플리케이션을 위한 관찰 가능성을 제공하는 AI 엔지니어링 오픈 소스 플랫폼입니다. OpenTelemetry를 기반으로 구축되었으며 추적, 평가 및 프롬프트 관리를 제공합니다. Apache 2.0 라이선스에 따라 무료로 자체 호스팅할 수 있으며, 데이터 개인 정보 보호 및 프로덕션…
AI 앱
Klu.ai는 팀이 대규모 언어 모델(LLM) 애플리케이션을 설계, 배포 및 최적화할 수 있도록 지원합니다. 협업 프롬프트 디자인, 평가 워크플로우 및 관찰 도구를 제공하여 안정적인 AI 경험을 보장합니다. Klu는 팀을 조율하고, 성능을 추적하며, 프로덕션 LLM 앱의 비용을 관리하는 데 도움을 줍니다.
Featherless는 오픈 소스 LLM을 위한 서버리스 호스팅을 제공하며, 단일 API 키로 30,000개 이상의 모델에 즉시 액세스할 수 있습니다. 인프라 문제 없이 고급 AI 기능을 통합하려는 개발자와 비즈니스를 위해 배포를 단순화하고 안정성과 예측 가능한 비용을 보장합니다.
AI 에이전트
Coval은 AI 음성 및 채팅 에이전트의 시뮬레이션 및 평가 플랫폼을 제공합니다. 팀이 AI 에이전트를 대규모로 테스트, 모니터링 및 최적화하여 배포 전후에 수백만 개의 엣지 케이스를 포착하도록 지원합니다. 이 플랫폼은 지속적인 품질을 보장하여 음성 AI 배포 준비를 완료하는 것을 목표로 합니다.
Cekura는 대화형 AI 에이전트를 위한 자동화된 엔드투엔드 테스트 및 관찰 기능을 제공합니다. 다양한 페르소나를 사용하여 사전 프로덕션 시나리오를 시뮬레이션하고 실시간 대화를 모니터링하여 지침 준수, 도구 사용 및 전반적인 대화 품질을 보장하며 에이전트 배포를 더 빠르고 안정적으로 만듭니다.
AI 앱
VERN OS는 감정 신호를 감지하고 행동 정책을 실시간으로 적용하여 대화형 AI를 향상시키는 AI 거버넌스 시스템입니다. AI 응답이 더 안전하고 효과적이며 비즈니스 목표에 부합하도록 보장하여 드리프트(drift)를 방지하고 사용자 결과를 개선합니다. 이 시스템은 신뢰 및 성능 모니터링을 위한 분석 기능을 제공합니다.
AI 앱
Cyara는 CX 보증 및 테스트를 위한 Agentic AI를 제공하여 기업이 AI 에이전트를 대규모로 자신 있게 배포할 수 있도록 지원합니다. 환각을 감지하고, 결정을 검증하며, 규정 준수를 보장하여 AI 우선 세계에서 고객 경험을 혁신하고 AI 기반 상호 작용에 대한 중요한 신뢰 계층을 제공합니다.
ManagePrompt는 개발 중 모든 API 호출을 캡처하는 오픈 소스 로컬 LLM 호출 디버거입니다. 로컬 웹 UI에서 전체 요청/응답 세부 정보, 토큰 사용량, 비용 추정 및 지연 시간을 제공하여 다양한 LLM 제공업체와 작업하는 개발자의 디버깅 프로세스를 간소화합니다.
AI 앱
Deployo는 직관적이고 클라우드에 구애받지 않으며 안전한 인프라를 통해 AI 모델을 프로덕션 준비 애플리케이션으로 변환합니다. 머신러닝 워크플로우를 간소화하여 사용자가 몇 분 안에 학습에서 확장 가능한 API로 전환할 수 있도록 하여 배포 복잡성과 시간을 줄입니다.
AI 앱
Backmesh는 LLM API 키를 안전하게 보호하고 유출을 방지하며 비용을 제어하는 오픈 소스 백엔드입니다. JWT 인증, 사용자별 속도 제한, API 리소스 액세스 제어를 제공하여 승인된 사용자만 민감한 LLM 기능에 액세스할 수 있도록 보장합니다. 또한 LLM 사용자 분석 기능도 제공합니다.
Elixir Observability는 멀티모달, 오디오 우선 대화형 AI 에이전트를 위한 AI Ops & QA 플랫폼입니다. 프로덕션 환경에서 음성 에이전트의 안정성과 예상대로의 성능을 보장하기 위해 자동화된 테스트, 통화 검토, 모니터링, 분석 및 추적 기능을 제공합니다.
AI 앱
mpathic AI는 대화 및 맥락 데이터를 분석하는 인간 중심의 AI 안전 플랫폼을 제공합니다. 이 플랫폼은 AI 빌더가 전문가 주도의 레드팀 활동과 과학적으로 검증된 인간 데이터 벤치마킹을 통해 인간 대면 모델을 평가, 스트레스 테스트 및 개선하여 더 안전하고 매력적인 AI를 보장하도록 돕습니다.
AI 앱
Remyx AI는 AI 팀을 위한 의사 결정 인텔리전스를 제공하여 다음에 무엇을 출시할지 결정하도록 돕습니다. 평가, 실험 및 프로덕션 결과를 분석하여 가장 영향력 있는 변경 사항을 추천하고 성능을 개선하지 못할 변경 사항을 걸러냅니다. 이 플랫폼은 기존 스택과 통합되어 AI 개발 수명 주기를 간소화합니다.
AI 앱
Eden AI는 LLM을 포함한 500개 이상의 선도적인 AI 모델에 액세스할 수 있는 통합 API를 제공하며, 음성, 비전 및 OCR을 위한 전문 AI도 지원합니다. 비용, 성능 및 지역에 기반한 스마트 라우팅을 가능하게 하며, 향상된 견고성과 제어를 위한 내장형 대체 기능을 제공합니다.
ModelsLab는 개발자가 1000개 이상의 생성형 AI 모델에 액세스할 수 있는 통합 API를 제공합니다. 이미지, 비디오, 오디오를 생성하고 LLM을 활용하여 빠르고 확장 가능하며 비용 효율적인 AI 기반 애플리케이션을 구축하세요. 단일의 간단한 인터페이스를 통해 다양한 최첨단 AI 도구로 구축하세요.
AI 플랫폼
Wallaroo.ai는 머신러닝 모델의 배포, 관리 및 모니터링을 위한 도구를 제공하는 AI 플랫폼입니다. MLOps 라이프사이클을 단순화하여 팀이 더 빠르고 자신 있게 AI를 프로덕션 환경에 적용할 수 있도록 지원합니다. 이 플랫폼은 다양한 모델 유형을 지원하며 기존 워크플로우와 통합됩니다.
AI 플랫폼
Seldon Core는 Kubernetes에서 AI 시스템을 배포, 관리 및 확장하기 위한 MLOps 및 LLMOps 프레임워크입니다. 파이프라인, 자동 확장, 다중 모델 서빙과 같은 기능을 통해 클라우드 전반에 걸쳐 다양한 모델 유형의 표준화된 배포를 가능하게 하여 모듈식 및 데이터 중심 애플리케이션을 지원합니다.
AI 플랫폼
Cortex는 프로덕션 환경에서 머신러닝 모델을 배포, 관리 및 확장하기 위한 확장 가능한 클라우드 인프라를 제공합니다. 서버리스 및 배치 처리, 자동화된 클러스터 관리, CI/CD 통합 기능을 제공하며, 안정적이고 비용 효율적인 ML 운영을 위해 AWS EKS를 기반으로 구축되었습니다.
AI 플랫폼
KServe는 자체 호스팅 AI 추론을 위한 오픈 소스 Kubernetes 네이티브 플랫폼입니다. 생성형 AI와 예측형 AI 모두에 대한 통합 솔루션을 제공하며, GPU 가속 및 자동 확장을 포함한 기능을 통해 빠른 설정부터 까다로운 엔터프라이즈 워크로드까지 배포를 간소화합니다.
SUPERWISE AMP는 규제 산업을 위한 Agentic Management Platform으로, 완전한 가시성, 실시간 가드레일 및 정책 시행을 제공합니다. PII 탐지 및 감사 추적과 같은 기능을 통해 기업이 AI 에이전트를 안전하고 규정을 준수하며 구축, 관리 및 거버넌스할 수 있도록 지원하여 신뢰할 수 있는…
AI 플랫폼
DKube는 기업이 안전하고 프로덕션 준비가 된 프라이빗 AI 시스템을 배포할 수 있도록 지원합니다. 온프레미스 및 하이브리드 환경 전반에 걸쳐 AI 솔루션을 구축할 수 있도록 하여 완전한 제어, 규정 준수 및 소유권을 보장합니다. DKube의 포괄적인 플랫폼으로 AI 배포를 몇 주에서 몇 달로 단축하십시오.
AI 플랫폼
DVC는 데이터 과학 및 머신러닝 프로젝트를 위한 오픈 소스 버전 관리 시스템입니다. Git과 유사한 경험을 제공하여 데이터, 모델 및 실험을 관리하며, 소프트웨어 엔지니어링 모범 사례를 AI/ML 워크플로우 및 데이터 인프라에 적용합니다.
AI 모델
Together AI는 AI 모델을 위한 플랫폼입니다. 다양한 모델에 대한 액세스를 제공하여 개발자가 고급 AI 기능을 애플리케이션에 통합할 수 있도록 합니다. 이 플랫폼은 AI 개발 및 배포를 위한 강력한 환경을 제공하는 데 중점을 두어 AI 기반 프로젝트의 혁신과 효율성을 지원합니다.
AI 프레임워크
OpenVINO는 다양한 하드웨어에서 고성능 AI 솔루션을 배포하기 위한 오픈 소스 툴킷입니다. 개발자는 클라우드, AI PC 및 엣지 디바이스에서 효율적인 배포를 지원하며, 인기 있는 프레임워크의 생성형 및 기존 AI 모델 모두에 대한 추론을 변환, 최적화 및 실행할 수 있습니다.
AI 프레임워크
Weights & Biases는 AI 모델 개발 및 LLM 애플리케이션 배포를 위한 플랫폼을 제공합니다. 실험 추적, 평가, 관찰 도구와 함께 서버리스 추론, 학습, 샌드박스를 위한 관리형 서비스를 제공하여 AI 개발 워크플로우를 간소화합니다.
AI 프레임워크
SHAP(SHapley Additive exPlanations)는 머신러닝 모델 출력을 설명하기 위한 게임 이론적 접근 방식입니다. Shapley 값을 사용하여 최적의 신용 할당을 로컬 설명과 연결하여 다양한 모델 유형 및 데이터 모달리티에 걸쳐 특성이 예측에 어떻게 영향을 미치는지에 대한 통찰력을 제공합니다.
LIME는 머신러닝 모델 예측에 대한 로컬적이고 해석 가능하며 모델에 구애받지 않는 설명을 생성하는 Python 패키지입니다. 이 도구는 복잡한 모델을 사용자에게 더 투명하고 신뢰할 수 있게 만들어, 특정 결과에 가장 많이 기여한 특징을 강조함으로써 모델이 특정 결정을 내리는 이유를 이해하도록 돕습니다.
AI 프레임워크
AI Fairness 360 (AIF360)는 머신러닝 모델의 원치 않는 편향을 탐지, 이해 및 완화하는 데 도움이 되도록 설계된 오픈 소스 툴킷입니다. 공정한 AI 시스템을 촉진하기 위한 포괄적인 공정성 지표 및 완화 알고리즘 세트를 제공합니다.
AI 프레임워크
Fairlearn은 AI 시스템의 공정성을 평가하고 개선하기 위해 설계된 오픈 소스 툴킷입니다. 머신러닝 모델의 불공정성을 식별하고 완화하는 도구를 제공하여 개발자가 보다 공평한 AI 애플리케이션을 구축하도록 돕습니다. 이 프레임워크는 다양한 공정성 지표와 완화 전략을 지원합니다.
AI 프레임워크
ONNX(Open Neural Network Exchange)는 1.23.0 버전에 대한 문서를 제공합니다. 핵심 개념, Python 통합, API 참조, 버전 관리, 데이터 구조 및 연산자를 다룹니다. 이 문서는 데이터 저장, 보안 및 백엔드 및 실험적 연산자에 대한 구현 가이드와 같은 기술적 측면을 자세히 설명합니다.
AI 프레임워크
LiteRT는 Google의 고성능 온디바이스 머신러닝 프레임워크로, GenAI 및 ML 모델을 엣지 플랫폼에 배포할 수 있습니다. TensorFlow Lite를 기반으로 효율적인 변환, 런타임 및 최적화를 제공하며, 수십억 개의 디바이스에서 낮은 지연 시간과 높은 개인 정보 보호를 지원합니다.
AI 프레임워크
Core ML은 개발자가 머신러닝 모델을 앱에 직접 통합할 수 있도록 지원하는 Apple 프레임워크입니다. 모델에 대한 통합된 표현을 제공하여 온디바이스 예측 및 학습을 가능하게 합니다. Core ML은 CPU, GPU, Neural Engine과 같은 기기 하드웨어를 활용하여 성능을 최적화하고 개인 정보 보호 및…
AI 프레임워크
TensorFlow Extended (TFX)는 Google 프로덕션 규모의 머신러닝 플랫폼입니다. ML 시스템을 정의, 실행 및 모니터링하기 위한 일반 구성 요소를 통합하는 구성 프레임워크와 공유 라이브러리를 제공합니다. TFX를 통해 프로덕션 환경에서 ML 워크플로를 구축 및 관리하고 다양한 플랫폼에서 파이프라인을…
AI 프레임워크
BigDL-LLM은 노트북부터 클라우드 GPU까지 Intel XPU 하드웨어에서 대규모 언어 모델(LLM)을 실행하기 위한 오픈 소스 라이브러리입니다. 낮은 지연 시간 추론을 위한 INT4/FP4/INT8/FP8 양자화를 지원하며 PyTorch 모델에 대한 포괄적인 파인튜닝 기능을 제공합니다.
AI 프레임워크
DeepDetect는 딥러닝 모델 배포 및 관리를 위한 AI 프레임워크입니다. 머신러닝 모델 서빙 프로세스를 간소화하여 개발자가 AI 기능을 애플리케이션에 효율적으로 통합할 수 있도록 지원합니다. 이 플랫폼은 실시간 추론 및 모델 모니터링을 위한 강력한 백엔드를 제공하는 데 중점을 둡니다.
AI 프레임워크
Cortex는 대규모 머신러닝을 위한 프로덕션 인프라를 제공하여 ML 모델의 배포, 관리 및 확장을 지원합니다. 자동화된 클러스터 관리, 자동 확장, CI/CD 통합을 통해 서버리스, 실시간, 비동기 및 배치 워크로드를 지원하며 AWS EKS를 기반으로 구축되었습니다.
AI 프레임워크
Seldon Core 2는 ML 및 LLM 시스템을 대규모로 배포하고 관리하기 위한 Kubernetes 네이티브 프레임워크입니다. 온프레미스, 하이브리드 및 멀티 클라우드 환경을 위한 유연하고 모듈식 아키텍처를 제공하여 MLOps 및 LLMOps를 위한 표준화, 향상된 가시성 및 비용 효율성을 보장합니다.
AI 프레임워크
BentoML은 AI 시스템을 배포하고 확장하기 위한 통합 추론 플랫폼입니다. 복잡한 인프라 관리 없이 프로덕션 수준의 안정성으로 모든 클라우드에서 모든 모델을 제공할 수 있어 AI 시스템 개발을 가속화하고 효율적인 확장을 가능하게 합니다. 사용자 정의 모델을 지원하며 보안을 보장합니다.
AI 커뮤니티
Flyte는 오픈 소스 워크플로우 오케스트레이션 플랫폼입니다. 이 커뮤니티 리소스 허브는 이벤트, 사례 연구, 블로그 및 문서에 대한 액세스를 제공합니다. 전 세계 AI 및 ML 빌더와 연결하여 질문하고, 아이디어를 공유하고, 실험에서 프로덕션까지 AI 시스템을 확장하는 방법을 알아보세요.
AI 에이전트
AgentOps는 안정적인 AI 에이전트를 추적, 디버깅 및 배포하기 위한 플랫폼을 제공합니다. 세션 재생, 타임 트래블 디버깅, 로그 및 오류에 대한 전체 데이터 추적 기능을 제공하여 엔지니어가 자신감과 비용 제어를 통해 엔터프라이즈급 에이전트를 구축하고 확장할 수 있도록 지원합니다.
AI 에이전트
Wayfound는 비즈니스 사용자를 위한 AI 에이전트 감독 기능을 제공하여 엔터프라이즈 전반의 성능 모니터링 및 위험 감소를 지원합니다. AI 에이전트가 목표 및 정책에 부합하도록 보장하며, 점수표, 권장 사항, 알림을 제공하여 결과를 개선하고 모든 AI 에이전트 또는 워크플로우의 자체 개선을 자동화합니다.
AI 에이전트
Chat Arena는 대규모 언어 모델(LLM)을 평가하고 비교하기 위한 오픈 소스 플랫폼입니다. 사용자가 대화형 배틀에서 다양한 AI 모델을 서로 겨루게 하여 AI 연구 및 개발을 위한 독특한 환경을 제공합니다.
AI 앱
ZETIC Melange는 모든 기기에서 어떤 모델이든 온디바이스 AI 배포를 자동화합니다. 전직 Qualcomm 엔지니어들이 개발했으며, NPU 가속을 최적화하고 200개 이상의 기기에서 벤치마킹하며, 단 세 줄의 코드로 몇 시간 내에 배포를 가능하게 하여 비용과 지연 시간을 줄입니다.
AI 앱
Cleanlab는 팀이 사용자에게 도달하기 전에 잘못된 응답을 감지하고 수정하여 더 안전한 AI 에이전트를 구축할 수 있도록 지원합니다. 이를 통해 AI 출력이 안전성, 규정 준수 및 신뢰성 표준을 대규모로 충족하도록 보장하며, 다양한 애플리케이션에 필수적인 제어 기능을 갖춘 AI 에이전트를 프로덕션 준비 상태로…
AI 앱
Zenbase는 AI 애플리케이션 생성을 간소화하는 개발자 중심 플랫폼입니다. 개발자가 AI 모델을 효율적으로 구축, 테스트 및 확장할 수 있도록 도구와 인프라를 제공합니다. 이 플랫폼은 AI 개발 수명 주기를 간소화하여 팀이 더 쉽게 접근하고 관리할 수 있도록 하는 것을 목표로 합니다.
AI 앱
GPUX는 AI 모델을 위한 서버리스 GPU 추론 기능을 제공하여 머신러닝 워크로드의 빠른 배포 및 실행을 가능하게 합니다. 빠른 콜드 스타트, Stable Diffusion XL 및 Whisper와 같은 다양한 AI 모델 지원, 개인 모델에 대한 추론 실행 또는 요청 판매 기능을 제공하여 AI를 더욱 접근 가능하고…
AI 모바일 앱
AI-Mask는 사용자의 기기에서 직접 브라우저 내 AI 모델 실행을 가능하게 하는 Chrome 확장 프로그램입니다. 로컬 AI 처리가 필요한 웹 애플리케이션을 위한 게이트웨이 역할을 하며, Llama2, Gemma, Mistral과 같은 모델에 대해 무료이며 개인적인 추론을 제공합니다. 데이터를 컴퓨터 외부로 전송하지…
AI 앱
Langdrive는 AI 애플리케이션을 배포하기 위한 플랫폼입니다. 사용자가 첫 번째 앱을 출시하는 과정을 안내하는 호스팅 문서를 제공합니다. 사이트에서는 앱이 배포되지 않았거나 사용자 지정 도메인 설정이 완료되지 않은 경우 '사이트를 찾을 수 없음' 오류가 표시될 수 있다고 안내합니다.
AI 앱
Raindrop는 AI 에이전트를 위한 가시성 및 모니터링 플랫폼으로, 모든 프로덕션 실행을 캡처하고, 환각 및 루프와 같은 침묵의 실패를 자동으로 감지하며, 팀이 문제를 추적하고, 분류하고, 수정 사항을 입증할 수 있도록 합니다.
AI 앱
Runware는 이미지, 비디오, 오디오, 3D, LLM 및 비전 모델을 위한 통합 API를 제공하는 생성 AI 추론 플랫폼입니다. 400K 이상의 모델, 관리되는 인프라 및 맞춤형 추론 엔진을 기반으로 한 사용량 기반 가격 책정을 제공합니다.
AI 앱
코딩 에이전트를 위해 구축된 추론 플랫폼으로, 빠른 프론티어 모델과 코드 검색, 수정 적용, 컨텍스트 압축 및 모니터링을 위한 전문 모델을 제공하며, 하나의 OpenAI 호환 API를 통해 접근할 수 있습니다.
AI 앱
Currai는 실제 대화를 의도, 사용자 스토리, 정책 위반 및 오류로 전환하여 사용자가 보고하지 않는 침묵의 실패를 포착하고 증거 기반 경고를 Slack으로 전송하는 채팅 및 음성 에이전트 모니터링 및 제품 분석 도구입니다.
AI 앱
Chirpz AI는 에이전트 엔지니어링에 중점을 둔 응용 AI 연구소입니다. 그 제품인 PandaProbe는 AI 에이전트를 추적, 평가 및 모니터링할 수 있는 오픈 소스 플랫폼으로, 팀이 이를 디버깅하고 생산 환경에서 개선할 수 있도록 합니다.
AI 앱
코딩 에이전트를 위한 지능형 모델 라우터로, 각 요청을 가장 적합한 모델로 라우팅하여 엔지니어링 팀이 비용의 일부로 최전선 품질의 결과를 달성하도록 돕습니다.
AI 앱
오픈, 독점 및 맞춤형 모델을 하나의 OpenAI 호환 API 뒤에 호스팅하는 전문 AI 추론 및 통합 제공업체로, 사용량 기반 요금제, 더 높은 속도 제한 및 코드 없는 대시보드를 제공합니다.
AI 앱
목적에 맞게 설계된 ASIC 인프라를 통해 모델을 제공하는 고속 AI 추론 제공업체로, OpenAI 호환 API를 통해 지연에 민감한 작업 부하인 코딩 에이전트 및 실시간 음성에 대해 낮은 첫 번째 토큰 시간과 높은 처리량을 제공합니다.
Aurikо는 LLM 추론을 위한 AI 제어 플레인으로, 모델 게이트웨이, 지능형 라우팅, 가시성 및 FinOps를 단일 플랫폼에서 제공합니다. 이를 통해 사용자는 기존 AI 생태계에 원활하게 통합하면서 비용과 성능을 최적화할 수 있습니다.
RunInfra는 GPU 벤치마킹, 커널 최적화 및 생산 API 배포를 수행하는 채팅 네이티브 AI 모델 최적화 플랫폼입니다. 이 플랫폼은 팀이 전체 스택에 대한 소유권과 투명성을 보장하면서 AI 애플리케이션을 효율적으로 구축하고 배포할 수 있도록 합니다.
AI 앱
Routescope는 OpenAI, Claude 및 Gemini와 호환되는 다양한 대형 언어 모델의 형식 간 변환을 지원하는 통합 AI 모델 집계 및 배포 게이트웨이로, 개인 및 기업을 위한 중앙 집중식 모델 관리 및 게이트웨이 서비스를 제공합니다.
AI 앱
vLLM은 대형 언어 모델(LLM)을 위한 고처리량 및 메모리 효율적인 추론 및 서비스 엔진입니다. 이는 최첨단 성능을 통해 AI 모델의 빠른 배포를 가능하게 하여 다양한 산업의 사용자에게 LLM 서비스를 쉽고 빠르며 비용 효율적으로 제공합니다.
AI 앱
Opik은 개발자가 에이전트 시스템을 테스트하고 배포하며 지속적으로 개선하는 데 도움을 주는 오픈 소스 AI 가시성 플랫폼입니다. LLM 애플리케이션을 효과적으로 평가하고 모니터링하는 도구를 제공합니다.
AI 앱
W&B Weave는 생산 에이전트의 관찰 가능성을 향상시켜 실제 경험으로부터 학습하고 개선할 수 있도록 합니다. 이 도구는 지속적인 모니터링과 평가를 통해 AI 애플리케이션의 신뢰성과 성능을 유지하는 데 도움을 줍니다.
AI 앱
Adaline은 자기 개선 AI 에이전트를 위해 설계된 관찰 가능성 및 평가 플랫폼입니다. 이 플랫폼은 생산 추적을 실행 가능한 행동, 평가, 합성 데이터 세트 및 검증된 개선 사항으로 변환하여 팀이 AI 시스템을 효율적이고 효과적으로 향상시킬 수 있도록 합니다.
모자이크 AI 모델 서빙은 데이터 워크플로우와 원활하게 통합되는 확장 가능한 실시간 모델 추론을 제공합니다. 다양한 AI 모델을 지원하여 AI 기능을 효과적으로 활용하려는 기업을 위한 효율적인 배포 및 거버넌스를 보장합니다.
Hugging Face의 추론 엔드포인트는 사용자가 몇 분 안에 Hugging Face Hub에서 AI 모델을 배포할 수 있도록 합니다. 완전 관리형 플랫폼을 제공하여 개발자가 인프라 설정에 대한 걱정 없이 AI 애플리케이션 구축에 집중할 수 있게 합니다.
NVIDIA 다이나모-트라이톤은 TensorRT, PyTorch 및 ONNX와 같은 다양한 프레임워크에서 AI 모델을 배포할 수 있게 해줍니다. 실시간, 배치 및 스트리밍 작업을 지원하여 다양한 AI 애플리케이션에 적합합니다.
토요타는 구글 클라우드와 협력하여 공장 바닥에서 AI를 민주화합니다. 하이브리드 클라우드 아키텍처는 제조 효율성을 향상시켜 근로자들이 기계 학습 모델을 쉽게 개발하고 프로세스를 최적화하며 수작업 작업을 줄일 수 있도록 합니다.
AI GitHub 저장소
에이전틱 GenAI 유지보수 코파일럿은 회전 장비 조사를 위해 설계된 Azure 배포 도구입니다. 이 도구는 LangGraph, RAG 및 FastAPI를 활용하며, 신뢰할 수 있는 분석 및 의사 결정을 보장하기 위해 사람의 승인 과정을 포함합니다.
ToolPotion은 사람들이 최고의 MLOps 및 모델 배포를 찾기 위해 탐색하는 AI 도구 디렉토리입니다. 등록은 무료이며 모든 제출물은 편집자가 검토합니다 — 검색이 시작되는 곳에 귀하의 도구를 배치하세요.