JSCODE Logo
JSCODE 박재성JSCODE 제이온JSCODE 시니
온라인 강의프로그래밍 과외책/전자책무료 강의
유튜브블로그
후기
완강 후기 이벤트블로그 리뷰 이벤트AWS SAA 합격 후기 이벤트
회사명 : JSCODE대표 : 박재성사업자 등록번호 : 244-22-01557통신판매업 : 제 2023-인천미추홀-0381 호

서울특별시 구로구 경인로 20가길 11(오류동, 아델리아)

Copyright ⓒ 2026 JSCODE - 최상위 현업 개발자들의 프로그래밍 교육 All rights reserved.

이용약관개인정보처리방침

실무에 바로 적용하는 Spring AI: Spring 서비스에 챗봇·RAG·MCP 도입하기

백엔드 개발자를 위한 LLM 기초

Prompt란 무엇일까?
Tokens란 무엇일까? /
Embeddings란 무엇일까? / Semantic Space
Fine Tuning이란 무엇일까?
RAG란 무엇일까?
AI Models란 무엇일까?
AI Model Providers란 무엇일까?

Spring AI 기본기

Spring AI란 무엇일까? / 백엔드 개발자가 왜 Spring AI를 배워야할까?
Spring AI 1.0 GA의 탄생
Spring AI와 LangChain - 어떤 도구를 선택해야 할까?
Spring AI와 LangChain - Chat Model 쉽게 이해하기
Spring AI와 LangChain - VectorStore 인터페이스

Spring AI 핵심 구성요소

핵심 컴포넌트 - ChatClient, Advisors, Prompts, Models, Structured Output
Spring AI ChatClient란 무엇일까?
Spring AI Advisor란 무엇일까?
Spring AI Prompts란 무엇일까?
Spring AI Models이란 무엇일까?
Spring AI Structured Output이란 무엇일까?

Spring AI로 만드는 채팅 API — 클라우드(OpenAI)와 로컬(Ollama

[실습] Spring AI 로컬 환경 설정 - Spring Boot 4.x, Gradle
[실습] OpenAI API Key 발급받기
[실습] OpenAI API를 활용한 채팅 API 환경 구축
[실습] Swagger UI를 활용한 테스트 - OpenAI API
[실습] Ollama 설치하기 / Hugging Face란 무엇일까? / GGUF
[실습] Ollama를 활용한 채팅 API 환경 구축
[실습] Swagger UI를 활용한 테스트 - Ollama
Spring AI 응답의 형태 - ChatClient Responses
[실습] Streaming으로 Flux 형태로 응답받기

실무에 쓰는 챗봇 만들기 - ‘대화 기억’부터 ‘CS 문의 자동 분류’까지

Spring AI Prompts - Chat Options란 무엇일까?
Spring AI Prompts - 프롬프트 엔지니어링 9가지 패턴
[실습] CLI 챗봇 개발 환경 아키텍처 미리보기
[실습] Chat Memory Advisor로 메모리 기능 추가하기
[실습] Chat Service 구현 - Advisor, CONVERSATION_ID
[실습] Spring Boot에서 CLI 기능 구현 및 테스트하기
[실습] Chat Controller 구현 - call과 stream 방식의 Chat REST API
[실습] Structured Output Converter를 통한 쇼핑몰 CS 문의 긴급도 분류하기

Vector Database와 유사도 검색 - RAG를 위한 핵심 개념

Vector Database란 무엇일까?
Vector Database Cosine Similarity란 무엇일까? / Spring AI의 Similarity Score
Spring AI Vector Store API
Metadata Filters란 무엇일까?

RAG 챗봇 만들기 - 데이터 전처리부터 ElasticSearch 연동까지

LLM 한계 극복을 위한 RAG 도입
실무에서 Spring AI를 통한 RAG 구현 방법
고품질 RAG를 위한 데이터 전처리 - Extract, Transform, Load
Spring AI RAG 기본 설계
[실습] RAG 챗봇 개발을 위한 로컬 환경 구축
[실습] RAG ETL 파이프라인 구현
[실습] RAG Advisors 구현
[실습] RAG Service 구현
[실습] RAG CLI 구현 및 실행 테스트
[실습] RAG REST API 구현
[실습] Docker 설치
[실습] ElasticSearch 기반 VectorStore로 변경하기

AI와 외부 시스템 연결하기 - Tool Calling으로 API 호출 자동화

Spring AI Tool Calling과 작동 프로세스
[실습] Tool Calling 개발 환경 구축
[실습] 지역별 날씨 조회 외부 API Tool 구현
[실습] Tool Service 구현
[실습] ToolCallingManager 설정
[실습] ToolChatConfig, ToolController 구현 - CLI, REST API
[실습] CLI 및 REST API 테스트

MCP로 완성하는 AI 연동 - Client & Server 개발과 외부 서버 활용

MCP란 무엇일까?
Tool Calling VS MCP
[실습] 아키텍처 미리보기
[실습] MCP Client 개발 환경 구축
[실습] MCP Server 개발 환경 구축
[실습] 외부 MCP Server와 연동한 실시간 날씨 조회 - MCP Client 개발
[실습] 외부 MCP Server와 연동한 실시간 날씨 조회 - MCP Server 개발
[실습] 외부 MCP Server와 연동한 실시간 날씨 조회 - MCP 연동
[실습] CLI 및 RestAPI 테스트
← 블로그 목록으로 돌아가기

Spring AI Prompts - Chat Options란 무엇일까?

JSCODE 시니
JSCODE 시니
2026. 06. 13.
author
JSCODE 시니
category
Spring AI
createdAt
Jun 13, 2026 09:52 AM
isPublic
isPublic
series
실무에 바로 적용하는 Spring AI: Spring 서비스에 챗봇·RAG·MCP 도입하기
slug
understanding-spring-ai-chat-options
type
post
updatedAt

✅ 1. Spring AI Prompts란 무엇일까?

notion image
흔히 AI에게 질문을 던질 때 하나의 긴 텍스트 문장만 보낸다고 생각하기 쉬움. 하지만 Spring AI에서 AI 모델로 전달되는 최종 형태는 문자열이 아니라 Prompt라는 전용 객체임
  • Prompt 객체의 내부 구조
    • List<Message> : 대화의 맥락을 구성하는 여러 종류의 메시지 묶음
    • ChatOptions : 온도(Temperature), 사용할 모델명(GPT-4)와 같은 AI 실행 옵션
 
 
 

✅ 2. Chat Options란 무엇일까?

우리가 스마트폰 카메라를 사용할 때도, 자동 모드로 찍을 수도 있지만 더 퀄리티 높은 사진 촬영을 위해 프로 모드로 들어가서 ISO, 셔터 스피드, 화이트 밸런스 같은 상세값을 조절하곤 한다.
  • Chat Options는 바로 AI 모델의 프로 모드 설정이라고 생각하면 된다.
  • AI가 답변을 생성할 때 얼마나 창의적일지, 얼마나 길게 말할지 등 응답의 특성을 제어할 수 있는 공통 옵션 설정
 
 
 

✅ 3. 핵심 공통 옵션

  • Temperature(온도)
    • notion image
    • 응답이 얼마나 창의적이고 무작위적으로 생성될지 결정
    • 0.0 ~ 0.3(낮은 온도)
      • 매우 결정적이고 일관된 응답
      • 언제 물어봐도 똑같이 정답을 말해야 하는 사실 기반 답변, 데이터 분류, 코드 생성에 적합
    • 0.4 ~ 0.7(중간 온도)
      • 균형 잡힌 응답
      • 일반적인 대화나 정보 제공용 챗봇에 가장 많이 쓰는 표준 값
    • 0.8 ~ 1.0(높은 온도)
      • 창의적이고 다양한 응답
      • 엉뚱하고 기발한 생각이 필요한 스토리텔링, 소설 쓰기, 아이디어 브레인스토밍에 적합
  • Output Length (최대 길이 제한)
    • 모델이 한 번에 생성할 수 있는 최대 토큰 수를 제한
    • 5 ~ 25
      • 한두 단어, 짧은 구절, 혹은 "긍정/부정" 같은 분류 라벨
    • 50 ~ 500
      • 하나의 깔끔한 문단이나 짧은 설명을 원할 때 적합
    • 1000+
      • 장문의 글, 소설 스토리, 복잡한 로직의 아키텍처 설명
  • Sampling Controls (샘플링 제어)
    • AI가 다음에 올 단어(토큰) 후보군을 추려내는 고도의 필터링 기법
    • Top-K(상위 K개 필터링)
      • 다음 토큰을 선택할 때, 확률이 가장 높은 상위 K개의 토큰으로만 후보군을 제한
      • 값이 클수록 다양한 단어가 섞여 나와 다양성이 증가하고, 작을수록 늘 쓰던 단어만 써서 결정적인 답변이 나옴
      • OpenAI의 모델(GPT 시리즈)들은 이 Top-K 옵션을 지원하지 않으니 주의할 것!
    • Top-P (누적 확률 필터링 / Nucleus Sampling)
      • 후보 단어들을 확률 높은 순으로 줄 세운 뒤, 누적 확률이 P(예: 90%)를 초과하기 전까지만 동적으로 단어 후보군을 선택
      • 상위 90%의 안전한 단어들 안에서만 고르게 하므로 문맥이 꼬이지 않으면서도 자연스러운 변화를 줌
      • 일반적으로 0.8 ~ 0.95 사이의 값을 사용
 
💁‍♀️
정답은 없지만 일반적으로 금융 챗봇을 만든다면 Temperature를 0.1로 낮춰서 절대 거짓말(환각 현상)을 안 하도록 묶어야 하고, 반대로 카피라이팅 AI를 만든다면 0.9로 높이는 게 좋습니다. 프로그래밍적으로 이 레버들을 조절하는 것이 백엔드 엔지니어의 핵심 역할임을 기억하세요!