splunk background

토크노믹스

AI 비용 및 토크노믹스

모든 토큰을 작업에 연결하여 각 모델의 규모를 최적화하고 비용이 청구되기 전에 과도한 지출을 파악하세요.

무료 에디션 신용카드 등록 없이, 14일간 무료로 체험해 보세요.
가이드식 둘러보기 단 5분! 어떻게 작동하는지 확인해 보세요.
토크노믹스
bg-image

AI 비용은 예산에서 가장 빠르게 증가하는 항목입니다.

토큰당 가격은 계속 하락하고 있지만 에이전트는 훨씬 더 많은 토큰을 소비합니다. 이러한 지출을 관리하려면 별도의 전문적인 접근 방식이 필요합니다.

bg-image

토크노믹스 인사이트를 통한 AI 비용 최적화

Splunk는 실제 AI 비용을 보여주고 예산 범위 내에서 비용을 관리할 수 있도록 지원합니다.

에이전트 비용 평가

요청, 모델, 에이전트, 워크플로별 토큰 사용량과 비용을 추적하여 지출 내역을 명확하게 파악할 수 있습니다. 비용은 에이전트가 실행되는 인프라와 연계되며, 평가용으로 특별히 설계된 소형 모델인 Luna가 합리적인 비용으로 에이전트를 평가합니다.

토큰 사용량 및 임계값 관리

워크플로우별 토큰 사용량을 측정하고 귀속한 다음 임계값과 경고를 설정하여 과도한 지출을 조기에 파악합니다. 에이전트는 계획을 수립하고 재시도하며 컨텍스트를 다시 읽기 때문에 단계별 비용이 낮아 보이는 워크플로우라도 전체 비용이 빠르게 증가할 수 있습니다. Splunk는 사용자가 설정한 예산 범위 내에서 비용을 유지합니다.

모델 비용과 품질 비교

더 저렴한 모델이 동일한 품질을 제공한다면 해당 모델로 요청을 라우팅합니다. 모든 모델과 워크플로우의 비용과 품질을 하나의 차트에서 나란히 보여주므로 이러한 결정을 더 쉽게 내릴 수 있습니다.

.conf26 프로모션 이미지

Splunk 직접 체험하기

9월 14일부터 17일까지 미국 콜로라도주 덴버에서 열리는 몰입형 학습 및 네트워킹 이벤트에 참여하세요.

.conf26 등록하기

기능

에이전틱 AI 비용 관리

문서 살펴보기
비용 가시성 확보 및 비용 절감 비용 가시성 확보 및 비용 절감

적정 규모의 모델로 라우팅

요청, 모델, 에이전트 및 워크플로우별 품질과 토큰 비용을 나란히 확인합니다. 더 작은 모델이 동일한 점수를 받으면 해당 모델로 요청을 라우팅하여 절감한 비용을 유지할 수 있습니다.

지출 지출

인보이스에 드러나지 않는 비용까지 파악

공급업체 청구 금액은 전체 비용의 일부에 불과합니다. 토큰 비용을 GPU, 메모리, 벡터 데이터베이스, 네트워크 비용과 하나의 시간 표시줄에서 연계해 확인합니다.

visibility-into-it-and-industrial-data visibility-into-it-and-industrial-data

자체 환경에서 비용 관리

오픈 웨이트 모델을 직접 보유한 하드웨어에서 구동하면, 대조해야 할 청구서 자체가 사라집니다. 자체 호스팅 환경 전반의 토큰 비용과 인프라 비용을 측정합니다.

트래픽 트래픽

네트워크 트래픽처럼 지출 관리

워크플로우별로 예산을 설정하고 임계값을 지정하여 지출이 급증하면 경고를 받을 수 있습니다. 토큰 지출을 운영 신호로 취급하고 한도와 담당자를 지정하며, 인보이스가 나오기 전에 신뢰할 수 있는 비용을 파악합니다.

priced-and-packaged-for-small-it-environments priced-and-packaged-for-small-it-environments

토큰 수가 아닌 실질 비용 측정

프롬프트 캐싱을 사용하면 고정된 접두사를 훨씬 낮은 비용으로 재사용할 수 있으므로 더 큰 프롬프트가 오히려 저렴할 때도 있습니다. 토큰 수가 아닌 실제 청구 비용을 최적화합니다.

optimize-incident-response optimize-incident-response

청구 전에 과도한 지출 파악

반복되는 재시도와 과도하게 늘어난 컨텍스트는 몇 시간 동안 토큰을 소모할 수 있습니다. 워크플로우별 사용량을 모니터링하고 임계값을 설정하여 수십만 달러에 달하는 예상치 못한 비용이 발생하지 않도록 합니다.

 

 

리소스
Splunk에 대한 추가 정보

Splunk 옵저버빌리티 + Galileo: AI 신뢰 격차 해소

블로그 읽기

AI 토크노믹스 FAQ

토크노믹스는 에이전틱 AI 비용을 관리하는 방식입니다. 팀, 앱, 워크플로우별 토큰 지출을 측정하고 귀속하며, 해당 비용을 결과물의 품질과 연결하여 비용 대비 가치가 있었는지 판단할 수 있도록 합니다.

단일 쿼리에는 수백 개의 토큰이 사용되지만, 에이전틱 작업에는 10,000~50,000개의 토큰이 소모될 수 있습니다. 에이전트가 계획을 수립하고 재시도하며 툴을 호출하고 컨텍스트를 다시 읽기 때문이며, 이로 인해 팀이 수십만 달러에 달하는 예상치 못한 인보이스를 받을 수 있습니다.

요청, 모델, 에이전트 및 워크플로우별 품질과 토큰 비용을 나란히 확인합니다. 더 작은 모델이 특정 작업에서 동일한 점수를 받는다면 해당 모델로 요청을 라우팅하여 비용을 절감할 수 있습니다.

아니요. 공급업체 청구 금액은 전체 비용의 일부에 불과하며, 프롬프트 캐싱을 사용하면 더 큰 프롬프트가 오히려 더 저렴할 수 있습니다. GPU, 메모리, 벡터 데이터베이스 및 네트워크에도 비용이 발생하므로 단순 토큰 수보다 실질 비용이 더 중요합니다.

예. 오픈 웨이트 모델을 자체 하드웨어에서 운영할 경우 대조가 필요한 청구서가 존재하지 않으므로, Splunk는 전체 자체 호스팅 환경의 토큰 비용과 인프라 비용을 측정하고 사용자가 설정한 한도 내에서 관리할 수 있도록 지원합니다.

관련 제품

Splunk 클라우드 플랫폼

모든 도메인에 걸쳐 데이터, 컨텍스트 및 액션을 통합합니다.

자세히 알아보기

Splunk Enterprise Security

에이전트 기반 SOC를 통합 위협 탐지, 조사 및 대응을 제공합니다.

자세히 알아보기

Splunk IT 서비스 인텔리전스

AI 기반 서비스 모니터링을 통해 IT 문제를 예측하고 예방합니다.

자세히 알아보기
Splunk 시작하기

모든 에이전트의 비용과 가치를 살펴보세요.

데모 요청하기
무료 평가판 살펴보기