| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | ||||
| 4 | 5 | 6 | 7 | 8 | 9 | 10 |
| 11 | 12 | 13 | 14 | 15 | 16 | 17 |
| 18 | 19 | 20 | 21 | 22 | 23 | 24 |
| 25 | 26 | 27 | 28 | 29 | 30 | 31 |
- 바이브
- AI 에이전트
- 허깅페이스
- AI모델
- Ai
- 바이브코딩
- google antigravity
- OpenAI
- 오픈소스ai
- ai studio
- 바이브 코딩
- Coding
- Gemma4
- djai
- ViBe
- openrouter
- 코딩
- ai모델비교
- AntiGravity
- 나 혼자 산다
- ChatGPT
- llm
- gemini
- Anthropic
- GitHub
- 피지컬ai
- AI에이전트
- 로컬llm
- vlm
- Today
- Total
DigitalJoy AI 님의 블로그
구글 Gemini 3.8 Flash 출시: 코딩 능력은 올랐지만 Pro는 여전히 없고, Antigravity는 제대로 적용됐다 본문

구글 Gemini 3.8 Flash 출시: 코딩 능력은 올랐지만 Pro는 여전히 없고, Antigravity는 제대로 적용됐다
2026년 9월 2일, 구글이 Gemini 3.8 Flash를 정식 출시했다. 3.7 Flash가 나온 지 불과 3주 만이다. 6주 만에 3번째 Flash 모델이 나오면서, 구글이 Flash 라인업에 얼마나 집중하고 있는지 알 수 있다. 하지만 정작 많은 사용자가 기다리는 건 Flash가 아니라 Pro 버전이다. 이 글에서는 3.8 Flash의 실제 변화와 한계, 그리고 Antigravity 적용 여부를 확인한 내용을 정리한다.
3.8 Flash, 무엇이 달라졌나
Gemini 3.8 Flash의 핵심 개선점은 코딩과 에이전트 워크플로우다. 구글은 이 모델을 "장기 코딩(long-horizon coding)과 자율 에이전트 작업에 최적화"되었다고 설명한다. Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
구체적인 벤치마크 수치를 보면:
- Terminal-Bench 2.1: 90.8% (3.7 Flash는 81.6%)
- HLE-Verified: 54.9% (STEM, 인문학, 전문 분야 멀티스텝 추론 평가)
- Vals Finance Agent V2 및 Harvey's Legal Agent Benchmark에서 3.7 Flash와 다른 프런티어 모델 성능 초과
DataCamp - Gemini 3.8 Flash Features, Benchmarks, and Pricing
가격은 입력 토큰당 $0.75, 출력 토큰당 $3.75로, 2026년 12월 31일까지 프로모션 가격이다. Neowin - Google launches Gemini 3.8 Flash
지식 컷오프는 2026년 3월로, 일부 도메인에서는 업데이트된 정보를 기대할 수 있지만 다른 도메인에서는 그렇지 않을 수 있다고 구글은 안내했다. Gemini 3.8 Flash Model Card
작성자 관찰: 3.7보다 확실히 달라진 점
3.7 Flash를 사용해보지 않았다면 3.8의 변화를 체감하기 어렵겠지만, 3.7을 일상적으로 쓰던 입장에서 3.8은 확실히 다르다. 특히 코딩 작업에서 차이난다. 3.7은 복잡한 리팩토링 요청에서 중간에 맥락을 잃거나, 이미 수정한 부분을 다시 수정하는 경우가 있었다. 3.8에서는 이런 "되돌아가는" 현상이 줄었다.
다만 여기서 솔직하게 짚어야 할 부분이 있다. 구글이 "문제를 다했다"고 주장하는 벤치마크 수치와 실제 사용 경험은 갭이 있다. Terminal-Bench 2.1이 90.8%로 올랐다는 건 사실이지만, 이건 특정 벤치마크 환경에서의 점수다. 실제 프로젝트에서 여러 파일에 걸친 리팩토링, 기존 코드베이스와의 호환성 고려, 팀 코딩 스타일 유지 같은 작업에서는 여전히 3.7과 비슷한 한계를 보인다. 벤치마크는 올랐지만, 사용자가 체감하는 "문제 해결 능력"은 벤치마크 상승폭만큼 따라오지 못하는 경우가 있다. 이것이 "제미나이는 문제를 다했다고 하지만, 실제로는 안 한 게 문제다"라는 말의 의미다.
또 한 가지. 3.8 Flash는 3.7보다 평균적으로 작업당 11,000개 더 많은 토큰을 출력한다. Hacker News Discussion 출력이 길어졌다는 건 더 상세한 설명을 제공한다는 의미일 수도 있지만, 불필요한 내용이 늘어났을 가능성도 있다. 토큰 사용량이 5% 정도 증가했다는 보고도 있으니, 비용 민감한 환경에서는 이 부분을 고려해야 한다. Reddit - Gemini 3.8 Flash Benchmarks
Pro 버전은 언제 나오나
많은 사용자가 Flash보다 기다리는 게 Pro 버전이다. 하지만 2026년 초 이후 구글은 프런티어급 Gemini Pro 모델을 출시하지 않았다. Ars Technica - Google releases Gemini 3.8 Flash Flash 모델만 계속 나오고 있는 상황이다.
구글 내부적으로는 다음 Pro 버전을 준비 중일 것이지만, 공식 일정이 발표되지 않은 상태에서 "곧 나온다"는 식의 추측성 정보를 전달하는 건 옳지 않다. 현재로선 Flash 라인업이 코딩과 에이전트 작업에 집중되고 있고, Pro는 상대적으로 업데이트 속도가 느리다는 점만 확인할 수 있다.
Pro를 기다리는 사용자에게 현실적인 대안은 두 가지다. 첫째, 3.8 Flash의 성능이 상당 부분 Pro급 작업도 커버할 수 있다는 점을 확인하고, 실제 작업에서 검증해보는 것. 둘째, 코딩 작업이라면 Antigravity 플랫폼을 통해 3.8 Flash를 활용하는 것이다.
Antigravity에 3.8 Flash 적용되었나
"안티그라비티에도 적용이 되었겠지? 제발 안했는데 했다고 얘기하는 경우가 없어졌으면 좋겠다"
결론: 적용되었다.
구글 AI for Developers 문서에 따르면, "Antigravity agent in Gemini Managed Agents is now built with Gemini 3.8 Flash by default"라고 명시되어 있다. What's new in Gemini 3.8 Flash - Google AI for Developers
Google Antigravity 공식 X 계정에서도 "Introducing Gemini 3.8 Flash in Antigravity!"라고 발표했으며, Antigravity X Post DeepMind 모델 카드에서는 "Gemini 3.8 Flash builds a fully functional DOS version of Google Maps in a single prompt in Google Antigravity"라는 예시를 들고 있다. Gemini 3.8 Flash Model Card
즉, Antigravity 사용자가 별도로 모델을 선택하지 않아도 기본값으로 3.8 Flash가 적용된다. "안 했는데 했다고" 말하는 경우는 이제 없을 것이다.
실제 적용 시 고려할 점과 한계
3.8 Flash를 실제 프로젝트에 적용할 때 주의할 점을 정리하면:
1. 지식 컷오프 제한 2026년 3월 이후 정보는 반영되지 않는다. 최신 라이브러리 업데이트, 새로운 API, 최근 변경된 프레임워크 문법 등을 물어볼 때는 공식 문서를 함께 참고해야 한다.
2. 출력 토큰 증가 앞서 언급했듯이 3.8은 3.7보다 더 많은 토큰을 사용한다. API를 대량으로 호출하는 환경에서는 비용 증가로 이어질 수 있으니, 프로모션 가격 종료 후인 2027년 1월 이후 비용 변화를 미리 계산해두는 게 좋다.
3. 벤치마크와 실제 성능의 차이 Terminal-Bench나 HLE-Verified 같은 벤치마크 점수는 특정 작업 유형에 최적화된 환경에서의 결과다. 실제 프로젝트에서는 코드베이스 크기, 팀 협업 패턴, 기존 아키텍처 제약 등 벤치마크에 반영되지 않는 변수가 많다. 벤치마크 점수만으로 "3.7보다 훨씬 좋다"고 단정하기보다, 자신의 작업 환경에서 직접 테스트해보는 게 필수다.
4. Pro 부재의 한계 Flash 모델은 속도와 비용 효율성에 최적화된 모델이다. 복잡한 추론, 장문 분석, 고도의 창의성이 필요한 작업에서는 여전히 Pro 모델이 필요하다. 하지만 Pro가 출시되지 않는 상황에서, Flash로 커버 가능한 작업 범위를 정확히 파악하는 게 현실적인 대응책이다.
누구에게 도움이 되는가
3.8 Flash는 다음과 같은 사용자에게 특히 유용하다:
- 에이전트 워크플로우를 구축하는 개발자: 멀티스텝 추론 능력이 개선되어, 여러 도구를 순차적으로 호출하는 복잡한 작업에서 성능 향상을 기대할 수 있다.
- 코딩 보조 도구를 사용하는 개발자: Antigravity나 Gemini API를 통해 코드 생성, 디버깅, 리팩토링 작업을 하는 경우, 3.7보다 더 안정적인 결과를 얻을 가능성이 높다.
- 비용 효율성을 고려하는 팀: Pro 모델 대비 저렴한 가격으로 상당 수준의 성능을 제공하므로, 대량 API 호출이 필요한 서비스에 적합하다.
반면 다음과 같은 경우에는 기대치를 조절해야 한다:
- 최신 정보를 기반으로 한 분석: 지식 컷오프가 2026년 3월이므로, 그 이후 변경된 사항에 대해서는 정확한 답변을 기대하기 어렵다.
- 고도의 추론이 필요한 복잡한 작업: Flash 모델의 한계로, Pro 모델이 필요한 작업에서는 여전히 부족할 수 있다.
마무리
Gemini 3.8 Flash는 코딩과 에이전트 작업에서 의미 있는 개선을 보여준다. 특히 Antigravity에 기본 적용되면서, 별도 설정 없이도 최신 모델을 사용할 수 있게 된 점은 긍정적이다.
하지만 Pro 버전 부재는 여전히 해결되지 않은 문제다. 구글이 Flash 라인업에 집중하는 동안, Pro를 기다리는 사용자는 6개월 이상 기다리고 있다. 벤치마크 수치가 올랐다는 것과 실제 사용성이 개선되었다는 것은 다른 문제다. 이 차이를 정확히 인지하고, 자신의 작업 환경에서 직접 검증하는 것이 3.8 Flash를 현명하게 사용하는 방법이다.
"안 했는데 했다고" 말하는 경우는 없었으면 좋겠다.

'AI' 카테고리의 다른 글
| OpenAI GPT-6 Astra 공개: 무엇이 달라졌고, Plus 구독자는 언제 쓸 수 있나 (0) | 2026.09.04 |
|---|---|
| 2026년 2차 모두의 창업 프로젝트 지원 전략: '나다' 앱 아이디어로 도전하기 (0) | 2026.09.03 |
| 허깅페이스 마이크로덕, 피지컬 AI를 귀엽게 만나다 (0) | 2026.09.02 |
| 페이블 5.1 출시, Max 2 요금제로 바로 써보니 Opus 5와 무엇이 다른가 (0) | 2026.09.02 |
| 구글 북스 인기무료 1위 '도시의 초인'을 제미나이 노트북으로 읽는 법 — 줄거리·캐릭터·오디오북까지 한 번에 (0) | 2026.08.30 |