Unity 게이트웨이는 조직 전반에서 사용되는 모델, MCP 서버, 에이전트 전반에 걸친 AI 비용, 보안, 접근을 관리하는 기업 제어 플레인입니다.
메모
릴리스가 단계적으로 진행됩니다. Azure Databricks 계정은 초기 릴리스일로부터 일주일 이상 지나서야 새로운 기능으로 업데이트될 수 있습니다.
OpenAI GPT-6 아스트라는 현재 Unity Gateway에서 이용 가능합니다
2026년 9월 4일
OpenAI GPT-6 Astra 는 현재 Unity Gateway에서 기업 추론, 구조화된 문서 처리, 코딩, 에이전트 검색, 다중 모달 입력, 장기 컨텍스트 작업 등에 사용할 수 있습니다. 파운데이션 모델 API 토큰당 종량제로 이 모델에 액세스할 수 있습니다.
고객은 해당 약관을 준수할 책임이 있습니다.
구글 제미니 3.8 플래시가 이제 Databricks 호스팅 모델로 제공됨
2026년 9월 2일
Model Serving은 이제 Databricks 호스팅 모델로서 Google Gemini 3.8 Flash 를 지원합니다. Foundation Model API를 사용하여 이 모델에 액세스할 수 있습니다.
고객은 해당 약관을 준수할 책임이 있습니다.
Anthropic Claude Fable 5.1이 이제 Databricks 호스팅 모델로 제공됨
2026년 9월 1일
Unity Gateway는 이제 Databricks 호스팅 모델로서 Anthropic Claude Fable 5.1을 지원합니다. Foundation Model API를 사용하여 이 모델에 액세스할 수 있습니다.
고객은 해당 약관을 준수할 책임이 있습니다.
Zhipu AI GLM 5.3이 현재 Databricks 호스팅 모델로 제공됨
2026년 8월 29일
Azure Databricks에서는 GLM 5.3이 Databricks가 제공하는 ADI Services를 통해 지원되는 미국 지역에서 Databricks 호스팅 모델로 제공됩니다. 이 텍스트 전용 전문가 혼합(MoE) 모델은 최대 1,048,576개의 컨텍스트 윈도우, 최대 65,536개의 출력 토큰, 함수 호출, 구조화된 출력, 코딩, 에이전트 도구 사용, 그리고 항상 켜져 있는 추론을 지원합니다. 설정 및 접근에 대해서는 ADI 서비스를 참조하세요.
고객은 해당 약관을 준수할 책임이 있습니다.
외부 제공자 비용을 모니터링하고 제한하세요
2026년 8월 28일
Unity Gateway는 이제 Azure Databricks가 제공하는 모델뿐만 아니라 Amazon Bedrock, Azure AI Foundry와 같은 외부 모델 제공자에 대한 지출을 추적하고 제한할 수 있습니다. 조직이 이미 공급업체와 직접 용량 약속을 맺고 있다면, Unity Gateway는 그 사용량을 추적하고 팀과 사용 사례 전반에 걸쳐 지출 한도를 적용할 수 있는 단일 지점이 됩니다. 켜려면 계정 콘솔 리뷰 페이지에서External Model Spend in Budgets(베타)를 활성화한 후, Unity Gateway 리소스 유형에 적용된 예산을 생성할 때 'Include external model usage'를 선택하세요.
외부 모델 사용 포함을 참조하세요.
Zhipu AI GLM 5.3 플래시가 이제 Unity Gateway에서 이용 가능합니다
2026년 8월 26일
Azure Databricks에서는 Zhipu AI GLM 5.3 Flash가 ADI Services를 통해 Unity Gateway를 통한 통합 거버넌스를 통해 멀티모달 추론, 코딩, 에이전트 작업 작업을 지원합니다. 다른 모델과 동일한 거버넌스 API를 통해 접근하며, 중앙 권한, 가드레일, 지출 통제, 관측 가능성을 갖추고 있으며, 애플리케이션 코드를 변경하지 않고도 모델을 전환할 수 있습니다.
고객은 해당 약관을 준수할 책임이 있습니다.
설정 및 접근에 대해서는 ADI 서비스를 참조하세요.
Unity 게이트웨이는 이제 프로비저닝된 처리량을 지원합니다
2026년 8월 24일
Unity 게이트웨이를 통해 프로비저닝 처리량(PT) 트래픽을 관리하여, PT 모델을 다른 모델 트래픽과 동일한 접근 제어, 사용 추적, 속도 제한, 페이로드 로깅, 가드레일 하에 둡니다.
Unity 게이트웨이를 이용한 AI 거버넌스를 참고하세요.
통합 추적 테이블(베타)으로 모든 AI 활동을 모니터링하세요
2026년 8월 21일
통합 트레이스 테이블은 베타 버전입니다. Unity Gateway 서비스 전반의 모든 요청과 응답을 하나의 Unity 카탈로그 테이블로 OpenTelemetry 형식으로 캡처하여 모든 AI 활동을 모니터링, 디버깅, 보안 및 감사할 수 있는 단일 장소를 제공합니다.
통합 추적 테이블을 이용한 모든 AI 활동을 모니터링하기를 참조하세요.
Google Gemini 3.7 Flash가 이제 Unity Gateway에서 이용 가능합니다
2026년 8월 13일
Google Gemini 3.7 Flash는 이제 Unity Gateway에서 빠르고 비용 효율적인 일상 작업을 위해 제공되고 있습니다. 다른 모델과 동일한 거버넌스 API를 통해 접근하며, 중앙 권한, 가드레일, 지출 통제, 관측 가능성을 갖추고 있으며, 애플리케이션 코드를 변경하지 않고도 모델을 전환할 수 있습니다.
고객은 해당 약관을 준수할 책임이 있습니다.
모델을 쿼리하고 지원되는 영역을 보려면, '기초 모델 사용(Use foundation models)'을 참조하세요.
요청 및 응답에서 민감한 데이터를 차단하거나 편집하세요
2026년 8월 13일
민감 데이터 감지 가드레일(베타)은 구조화된 민감한 데이터(사회보장번호, 신용카드 번호, IBAN, 전화번호 등)를 감지하여 상호작용을 차단하거나 일치하는 값을 삭제합니다. 탐지는 결정론적이며(정규 표현식과 체크섬, 맥락 키워드, 평가자 모델 없음), 100턴 대화에서 50ms 미만의 시간을 더하며 매번 같은 결과를 반환합니다. 사용하려면 계정 콘솔 Previews 페이지에서 향상된 Unity Gateway 미리보기를 활성화하세요.
이번 릴리스에는 다음과 같은 개선 사항도 포함되어 있습니다:
- 차단된 상호작용은 이제 4xx 오류 대신 블록 이유가 포함된 표준 HTTP 200 응답을 반환하여, 기록을 재전송하는 코딩 에이전트가 매 턴 같은 블록을 다시 트리거하지 않습니다.
- 내장된 심사자 역할의 LLM 가드레일은 이제 최신 메시지만이 아니라 최근 몇 개의 대화 턴 범위나 전체 대화 기록을 평가할 수 있습니다.
- 새로운 실행 흐름 뷰는 가드레일이 끝에서 끝까지 어떻게 작동하는지 보여줍니다.
서비스 정책을 이용한 민감한 데이터 감지를 참조하세요.
스마트 라우팅: 각 작업을 올바른 모델로 라우팅하여 AI 비용을 절감합니다
2026년 8월 13일
스마트 라우팅(베타)은 복잡성, 권한, 예산을 바탕으로 각 작업에 적합한 모델과 에이전트 하네스를 자동으로 선택합니다. 일상 업무를 저비용 모델로 전환하고, 프런티어 모델은 어려운 문제에 대해서만 남겨두며, 모든 라우팅 결정이 가시적이고 감사 가능합니다. 스마트 라우팅은 Claude 코드와 Codex를 Omnigent 또는 ucode로 실행하면 독점 모델과 오픈 모델 모두에서 라우팅됩니다. 오직 옴니전트만이 모델에만 국한되지 않고 여러 코딩 하니스 전반에 걸쳐 라우팅할 수 있습니다. 내부 벤치마크에서는 프런티어 수준의 품질을 달성하면서 전체 작업 비용을 30%이상 절감했습니다.
코딩 에이전트에 대해서는 스마트 라우팅을 참조하세요.
ABAC GRANT 정책은 이제 Unity Gateway 리소스 유형(베타)을 포함합니다
2026년 8월 11일
속성 기반 접근 제어(ABAC) GRANT 정책은 조건에 맞는 태그가 있는 보안 대상에 대해 Unity 카탈로그 권한을 동적으로 부여합니다. 이들은 현재 Unity Gateway가 관리하는 자원 유형인 모델 서비스, 모델 제공자 서비스, 모델 컨텍스트 프로토콜(MCP) 서비스, 에이전트 서비스를 지원합니다. 이렇게 하면 게이트웨이 자원에 한 번에 하나씩 할당하는 대신 태그별로 접근할 수 있습니다. 지원되는 모든 유형은 베타 버전입니다.
ABAC GRANT 정책을 참조하세요.
Databricks가 관리하는 MCP 커넥터가 이제 Unity Gateway (베타)와 통합되었습니다
2026년 8월 6일
Genie One과 Genie Code용 Databricks 관리 MCP 커넥터 는 모두 Unity 게이트웨이로 이전되었습니다. 이로 인해 Databricks가 관리하는 커넥터들이 Unity Gateway 아래에 통합되어, 다른 MCP 서버와 도구와 함께 중앙 집중식 거버넌스, 접근 제어, 가시성을 가능하게 합니다.
사용자는 Genie One과 Genie Code에서 계속 사용하려면 커넥터를 재인증해야 합니다. Genie의 알림이 영향을 받은 사용자에게 재연결하라고 안내합니다.
Unity Gateway API: SDK, CLI, Terraform으로 자원을 관리할 수 있습니다
2026년 8월 6일
UI 클릭 대신 프로그래밍으로 Unity Gateway 자원을 관리할 수 있으며, 엔드포인트, 모델 제공자, MCP 서버에 대한 완전한 생성, 읽기, 업데이트, 목록 및 삭제 지원이 가능합니다. API는 표준 Azure Databricks 개발자 도구 전반에서 제공됩니다:
- Python SDK:
databricks-sdk0.125.0 및 이후 버전 - Go SDK:
databricks-sdk-gov0.170.0 및 이후 - Java SDK:
databricks-sdk-java0.143.0 및 이후 버전 - Databricks CLI: v1.11.0 및 이후
- Terraform 제공자: 1.124.0 이후
Unity Gateway API 참고 자료를 참고하세요.
Unity 게이트웨이는 이제 일반 제공됩니다
2026년 8월 4일
Unity 게이트웨이는 이제 일반 제공됩니다. Unity Gateway는 Unity 카탈로그의 일부인 기업용 AI용 Azure Databricks 거버넌스 솔루션입니다. Unity Gateway를 통해 다음과 같은 기능이 있습니다:
- 어떤 AI 서비스 팀이 사용할 수 있는지 통제하세요.
- 공급자 간 AI 트래픽을 라우팅하고 관리하세요.
- 접근과 비용을 통제하기 위해 MCP 서버를 거버넌스하세요.
- 사용량, 비용, 접근성, 혈통을 한 곳에서 모니터링하세요.
서비스 정책과 에이전트 서비스 등 일부 기능은 여전히 베타 버전에 머물러 있습니다.
Unity 게이트웨이와AI 거버넌스 가이드를 참고하세요.
Unity 게이트웨이를 사용하면서 본인의 Claude 엔터프라이즈 구독을 이용하세요
2026년 7월 30일
기존 Claude Pro, Max, Enterprise 또는 Team 구독을 통해 Unity Gateway를 통해 추가 모델 비용 없이 Claude 코드를 라우팅할 수 있으며, 조직은 중앙 집중식 거버넌스, 사용 추적, 접근 제어를 유지할 수 있습니다. Azure Databricks는 각 요청 시 Anthropic OAuth 토큰을 전달하므로 자격 증명은 저장되지 않으며, 요청 비용은 Anthropic 구독에 청구됩니다. 접근은 등록한 모델 제공자의 표준 Unity 카탈로그 권한에 의해 관리되며, 사용 추적, 추론 테이블, 속도 한도, 지출 추적과 같은 게이트웨이 기능도 계속 작동합니다.
Claude Max와 Anthropic Enterprise 지원 항목을 참고하세요.
외부 모델 제공자를 연결하고 관리하세요
2026년 7월 17일
Unity 게이트웨이를 통해 OpenAI, Anthropic, Amazon Bedrock, 그리고 Meta의 Muse Spark 1.1과 같은 신규 모델 등 외부 모델 제공자를 연결하고 관리할 수 있습니다. 공급자를 거버넌스가 적용되는 Unity Catalog 보안 대상으로 한 번만 등록하면, 모든 팀이 Unity Gateway를 통해 완전한 거버넌스와 가시성을 바탕으로 이를 쿼리할 수 있습니다.
외부 모델 제공자를 통해 다음과 같은 결과를 얻을 수 있습니다:
- 선택: 첫날부터 어떤 모델이든 채택하고, 모델이나 OpenAI 호환 제공업체를 전환하면서 재통합 없이 전환하세요.
-
제어: 표준
GRANT및REVOKE(EXECUTE는 조회용,MANAGE는 업데이트용)으로 액세스를 제어하고, 모든 요청에 적용되는 속도 제한과 가드레일을 설정합니다. - 명확성: 사용 및 지출 추적이 기본적으로 켜져 있으며, 토큰 수, 지연 시간, 사용자 및 팀 또는 앱별 비용 귀속이 적용됩니다. 추론 테이블을 연결하여 전체 요청 및 응답 페이로드를 거버넌스가 적용된 델타 테이블에 기록합니다.
외부 모델 제공업체 관리(모델 제공업체 서비스)를 참조하세요.