

- 신영선의 AI탐구
- 조코딩 JoCoding
- CONNET AI LAB
- 편집자P
- 필로소피AI
- 코드팩토리
- 코난쌤
- 메타코드M
- 개발동생
- 메이커에반
- 바이브랩스
- 단테랩스
- 괴발자
- 홍정모AI
- 한빛미디어
- 칼퇴왕김과장N8N
- 퀀텀점프클럽N8N
- 짐코딩
- 시현의모험
- AI겸임교수 이종범
- AI ON
- 태오의실행비즈니스
- 오후다섯씨
- 코드깎는노인
- 데브남
- 스테판초 AI
- 빌더조쉬
- Claudical (클로디컬)
- 테크브릿지
- 실밸개발자
- Ai 서대표
- 일하는 Ai
- 시민개발자 구씨
- 일잘러 장피엠
- 이동훈의 루트ai
- 조태호교수
- 아는개발자 캐슬
- Jay Choi 인디해커
- 기술노트with일렉
- 제초초토크
- Ai IMPACT
- 오늘노트
- 알쓸신작 AI 이야기
- AI 튜터랩
- CODE DECK ★ 중요함
- 샘호트만 AI엔지니어
- 테디노트
- 경희대학교 SW사업단
- 강원대학교 SW사업단
- 지투지 AI STUDY
- 바퍼
- 소스놀이터
파일 넣으면 AI가 멍청해지는 이유
파일 업로드 기능 넣었는데 AI 비용이 폭발적으로 나오고 있나요?
원인은 간단합니다. 파일을 통째로 메인 AI에게 넘기고 있기 때문입니다.
Gemini Flash 2.5로 먼저 요약하고, 그 요약만 GPT/Claude에 넘기면
비용이 줄고 성능이 오히려 올라갑니다.
⏱️ 타임스탬프
0:00 파일 통째로 넣으면 돈 날리는 이유
0:11 이거 하나면 비용 줄고 성능 올라옴
0:19 비유: 비싼 컨설턴트에게 100페이지 PDF
0:32 AI도 똑같이 집중 못하는 문제 발생
0:48 해결책: AI 두 명 쓰기
1:00 첫 번째 AI — Gemini Flash 2.5 역할
1:20 두 번째 AI — 메인 AI (GPT/Claude) 역할
1:42 왜 효과적인가 3가지 이유
1:42 이유 ① 역할 분담 (싼 AI가 읽고, 비싼 AI가 분석)
2:08 이유 ② 비용이 확 줄어드는 원리
2:26 이유 ③ 성능이 오히려 올라가는 이유
2:48 실제로 어떻게 작동하는가
3:10 메인 AI → Flash 툴 호출 흐름
3:25 파일 없는 질문은 바로 답, 있으면 Flash 통과
3:34 고급: 목적에 따라 다르게 요약시키기
3:56 핵심 원칙 — 뭘 보여주냐가 아니라 뭘 걸러주냐
4:06 요약 & 지금 바로 적용하는 방법
🔔 구독 & 좋아요 누르면 다음 영상에서 실제 코드로 구현하는 법 올려드립니다!
#AI에이전트 #GeminiFlash #GPT #Claude #AI개발 #LLM #비용절감 #AI챗봇 #파일업로드 #멀티에이전트

