Veilfire
AI 안전성 평가

Insight

다섯 가지 축에 걸친 포괄적 AI 안전성 평가로 배포 전과 배포 중 모두 AI 시스템이 안전 기준을 충족하도록 보장합니다. Lens 거버넌스 플랫폼의 평가 모듈인 Insight는 시나리오 기반 테스트, 전체 증거 로깅, 국제 표준에 근거한 인증 대응 컴플라이언스 보고서를 제공합니다.

Veilfire 플랫폼의 일부이며, 모든 유료 티어에 포함됩니다.

Insight AI 안전성 평가 및 컴플라이언스
콘솔에서 직접 확인하세요

주장이 아닌 증거

컨트롤 플레인의 가치를 증명

컨트롤 플레인의 가치를 증명

같은 에이전트를 Lens 시행이 완전히 적용된 Controlled 모드, 원본 모델을 그대로 쓰는 Open 모드, 그리고 Simulated 모드에서 각각 실행한 뒤 안전성 점수를 비교해 거버넌스가 위험을 얼마나 줄이는지 정량화하세요.

에이전트 추론의 모든 단계를 검사

에이전트 추론의 모든 단계를 검사

추론, 도구 호출, 반영, 메모리까지 에이전트의 전체 궤적을 턴 단위로 따라갑니다. 민감한 페이로드를 감사 추적 뒤에 두는 동일한 단계적 공개 방식이 그대로 적용됩니다.

심사 모델을 직접 선택

심사 모델을 직접 선택

OpenAI, Anthropic, Veilfire Platform 호스팅 모델 중 원하는 모델로 채점하세요. 키는 서버 측에 보관되므로 모든 평가의 비용, 벤더, 데이터 소재지를 직접 통제할 수 있습니다.

직접 만든 시나리오로 확장

직접 만든 시나리오로 확장

코드 없이 검증된 YAML로 평가 시나리오를 작성하고 버전이 관리되는 프리셋에 고정해 모든 실행을 재현하고 시점 간에 비교할 수 있습니다.

AI 안전성의 5대 축

포괄적 안전성 평가

Insight는 다섯 가지 핵심 차원에서 AI 시스템을 평가해 안전 요구 사항을 빠짐없이 다룹니다.

정책 준수

에이전트가 정의된 정책을 따르나요?

거버넌스 규칙이 실효성 있게 작동하는지 확인합니다

도구 안전성

도구 호출이 안전하고 승인된 것인가요?

비인가 행위를 차단합니다

데이터 안전성

민감한 데이터가 유출로부터 보호되나요?

데이터 프라이버시와 컴플라이언스를 유지합니다

에이전트 무결성

에이전트가 일관된 행동을 유지하나요?

페르소나 드리프트와 기만 행동을 탐지합니다

오용 조장 가능성

에이전트가 해를 끼치도록 조작될 수 있나요?

적대적 사용에 대한 취약점을 식별합니다

누구에게 필요한가

팀을 위한 설계

AI 엔지니어

"릴리스 속도를 늦추지 않으면서 안전성을 검증해야 합니다"

지속적인 안전성 테스트를 위한 CI/CD 통합을 제공합니다. 통과 임계치를 설정하고 자동 게이팅을 적용해 배포 파이프라인의 일부로 평가를 실행하세요.

AI 거버넌스 담당자

"정책이 실제로 효과가 있다는 증거가 필요합니다"

시나리오 기반 테스트로 실제 공격 패턴에 맞서 거버넌스 규칙을 검증합니다. UN UDHR, GDPR, EU AI Act, IEEE, NIST의 윤리적 근거와 함께 전체 증거를 기록합니다.

AI 안전 팀

"배포 전에 안전성을 검증하고 회귀를 잡아내야 합니다"

채점 루브릭, 재현성을 위한 모델 스냅샷, HTML/JSON 보고서를 갖춘 5축 평가 프레임워크입니다. 평가 위험 점수는 FireDeck으로 바로 전달되어 운영 위험 가시성을 제공합니다.

평가 기능

완전한 테스트 프레임워크

배포 전 AI 안전성을 검증하고 회귀를 지속적으로 감시하는 데 필요한 모든 것을 갖췄습니다.

어서션을 포함한 시나리오 기반 테스트
도구 호출과 파라미터까지 담은 전체 증거 로깅
통과 임계치를 설정할 수 있는 채점 루브릭
이해관계자 검토를 위한 HTML/JSON 보고서
지속적 안전성 테스트를 위한 CI/CD 통합
재현성을 위한 모델 스냅샷
평가 위험 점수 산정: eval_risk = 1 - (overall_score / 100)
에이전트 버전별 위험 추적(예: v1.0.0 vs v1.1.0)
평가 결과가 FireDeck 운영 위험 대시보드로 연동
동작 방식

평가 흐름

1

실행 생성

시나리오를 정의하고 평가 파라미터를 설정합니다

2

실행

데몬이 시나리오를 원자적으로 클레임해 실행합니다

3

분석

도구 호출 상세까지 포함한 전체 증거를 기록합니다

4

보고

점수와 결과를 이해관계자에게 전달합니다

컴플라이언스 보고서

인증 대응 보고서

감사 팀을 위한 포괄적인 컴플라이언스 증거 모음을 클릭 한 번으로 생성합니다.

제공되는 통제·증거 팩

  • EU AI Act(고위험 AI 시스템) - 조항별 평가
  • ISO/IEC 42001 - AI 경영 시스템 인증
  • NIST AI RMF - GOVERN, MAP, MEASURE, MANAGE 기능
  • 캐나다 AI 거버넌스(PIPEDA, OPC 지침, 연방 지침, 제안된 AIDA) — 프라이버시 및 AI 책임성 툴킷
  • SOC 2 + AI - AI 통제를 반영한 Trust Services Criteria
  • GDPR + AI - AI 처리에 대한 데이터 보호

보고서 기능

  • 통제 항목별 컴플라이언스 점수
  • Lens, Insight, Ember에서 수집한 증거
  • 우선순위가 매겨진 권고를 포함한 갭 분석
  • 암호학적으로 서명된 확인서
  • 감사인을 위한 증거 패키지(ZIP)
캐나다 AI 거버넌스 준비 팩

캐나다에서 만들었습니다. 캐나다 거버넌스에 맞췄습니다.

캐나다의 AI 규제 환경은 네 가지 서로 다른 프레임워크로 이루어져 있습니다. 캐나다 AI 거버넌스 준비 팩은 이 네 가지를 모두 다루며, 3개 이상 팩 번들에 포함되거나 단독 구매도 가능합니다. 가격은 $9,000 / year.

PIPEDA

연방 프라이버시 법

개인정보 처리, 동의 규칙, 유출 통지, 개인의 열람권을 개인정보를 처리하는 AI 시스템에 적용합니다.

OPC 지침

프라이버시 커미셔너 사무국

자동화 시스템에 대한 캐나다 프라이버시 실무를 형성하는 집행 우선순위, 분야별 지침, 최근 결정 사항입니다.

연방 AI 지침

재무위원회 정책

자동화 의사결정에 관한 지침, 알고리즘 영향평가 요건, 연방 AI 활용을 위한 인접 정책 수단을 다룹니다.

제안된 AIDA

Bill C-27 — 아직 제정 전

고영향 AI 평가, 위험 완화, 투명성, 책임 의무를 다룹니다. 팩 업데이트는 Bill C-27의 입법 진행 상황을 추적합니다.

Veilfire는 캐나다 기업입니다. 캐나다 컴플라이언스는 우리의 거버넌스 작업이 시작된 지점입니다.

규제 정합성

컴플라이언스를 위한 설계

Insight는 정책 근거와 평가 기능을 기본 내장해 주요 AI 규제의 요건을 충족하도록 지원합니다.

규제요건Insight의 지원 방식
EU AI Act인간의 감독(제14조)Lens 연동을 통한 고위험 결정의 HITL 워크플로
EU AI Act투명성(제13조)정책 근거가 포함된 암호학적 감사 추적
EU AI Act위험 관리(제9조)5축 안전성 평가 프레임워크
GDPR데이터 최소화(제5조)데이터 안전성 축이 PII 처리를 검증
GDPR책임성(제5조)위변조 감지가 가능한 기록과 전체 증거 로깅
NIST AI RMFGOVERN, MAP, MEASURE, MANAGE전체 수명 주기 거버넌스 평가
Canadian AI GovernancePIPEDA + OPC + 연방 지침 + 제안된 AIDA 영향평가캐나다 AI 거버넌스 준비 팩 — 프라이버시, 책임성, AI 지침
왜 Veilfire인가

우리의 차별점

항목Lens + Insight대안 제품
프라이버시 보존메타데이터만 수집, 콘텐츠 미기록콘텐츠 전체 기록
암호학적 감사머클 체인 + KMS 서명데이터베이스 로그
안전성 평가증거 기반 5축 프레임워크임시방편 테스트
윤리적 근거 인용UN, GDPR, EU AI Act, IEEE, NIST없음
HITL 워크플로2초 미만 에스컬레이션 기본 내장수동
컴플라이언스 보고서EU AI Act, ISO 42001, NIST AI RMF, 캐나다 AI 거버넌스수작업 감사

Lens와 함께 완성됩니다

Insight와 Lens는 함께 Veilfire의 포괄적 AI 거버넌스 플랫폼을 이룹니다. Insight가 배포 전 평가와 지속적 평가를 담당한다면, Lens는 프로덕션에서 실시간 정책 시행을 수행합니다.

Lens 살펴보기

하나의 플랫폼, 모든 단계

Insight는 Veilfire 플랫폼을 구성하는 요소 중 하나입니다.

통합 플랫폼. 런타임 정책 적용, 아이덴티티, 평가, HITL, 암호화 감사 증적이 모두 포함됩니다.