PickleeAI와 개발, 오늘 볼 변화만
홈읽을거리아카이브
검색

Picklee

AI와 개발 현장에서 오늘 확인할 변화만 선별합니다.

© 2026 Picklee. All rights reserved.

RSSSitemap

읽을거리

2026년 7월 26일

Google, Gemini 3.6 Flash·3.5 Flash-Lite·3.5 Flash Cyber 공개

Google이 7월 21일 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 공개했다. 3.6 Flash는 3.5 Flash 대비 출력 토큰 사용량을 17% 낮췄다고 밝히며, 입력·출력 가격은 각각 $1.50/$7.50 per 1M tokens다.

본문 읽기원문 보기

발행일

2026년 7월 26일

업데이트

2026년 7월 26일

주제

AI
Gemini
모델
에이전트
원문 보기

배경 및 맥락

Production AI agent의 병목은 단순한 모델 지능만이 아니다. 긴 컨텍스트, 반복 tool call, 재시도, 대량 하위 작업이 누적되면 latency와 출력 토큰 비용이 시스템 단위 TCO를 좌우한다. Google은 이 문제를 겨냥해 2026년 7월 21일 Gemini Flash 계열을 역할별로 확장했다.


핵심 내용

Gemini 3.6 Flash는 코딩·knowledge work·multimodal 작업을 목표로 하며 Google은 3.5 Flash 대비 출력 토큰 사용량 17% 감소와 DeepSWE에서 최대 65% 감소를 제시했다. 가격은 입력 $1.50, 출력 $7.50 per 1M tokens다. 3.5 Flash-Lite는 350 output tokens/s, 입력 $0.30·출력 $2.50 per 1M tokens로 고처리량 agentic search·문서 처리용 포지션이다. 3.5 Flash Cyber는 CodeMender 안에서 여러 에이전트가 취약점을 탐지·검증·수정하도록 설계됐고, 정부와 신뢰 파트너에 한정한 pilot으로 제공된다.


경쟁 구도 / 비교

3.6 Flash는 master agent나 복잡한 코딩·computer use 작업에, Flash-Lite는 대량 분류·추출·서브태스크에 더 자연스럽다. 한 모델을 모든 단계에 쓰는 접근보다 품질·속도·가격 특성이 다른 모델을 orchestration 계층에서 배치하는 방식이다. Cyber 모델은 일반 공개 API가 아니라 제한된 defensive workflow에 묶어 dual-use 위험을 낮추려는 배포 모델도 함께 제시한다.


의미

팀은 벤치마크 점수뿐 아니라 task 완료당 output token, tool-call 수, retry율, latency를 함께 관찰해야 한다. 에이전트 플랫폼의 핵심 경쟁력이 모델 선택에서 workload-aware routing과 운영 통제로 이동하고 있음을 보여주는 발표다.

이어 읽기

관련 읽을거리

전체 보기
2026년 7월 28일Moonshot AI, Kimi K3 공개 weights 배포: 2.8T MoE의 실제 serving 경로 확인Moonshot AI가 Hugging Face에 Kimi K3의 full weights를 Kimi K3 License로 공개했다. 2.8T total / 104B activated parameter의 native multimodal MoE 모델로, 1M-token context, 896개 expert 중 16개 선택, MXFP4 weight·MXFP8 activation 기반 QAT를…2026년 7월 27일Anthropic, Claude Sonnet 5 출시: 에이전트 성능과 비용 효율 강화Anthropic은 Claude Sonnet 5를 출시했다. 브라우저·터미널 같은 도구를 사용해 계획을 세우고 자율 실행하는 agentic 작업을 겨냥하며, Claude API와 Claude Code에서 claude-sonnet-5로 제공된다. 출시 프로모션 가격은 2026년 8월 31일까지 입력 $2·출력 $10 per 1M tokens이며 이후 $3·$15다.2026년 7월 27일NVIDIA, Cosmos 3 Edge 공개: 4B 온디바이스 Physical AI 모델NVIDIA는 Cosmos 3 Edge를 공개했다. Nemotron 기반 4B 모델로, NVIDIA Jetson Thor 등 엣지 컴퓨터에서 vision reasoning과 로봇 action 생성을 로컬로 수행하도록 설계됐으며 Cosmos 3 오픈 월드 모델 계열의 edge 배포판이다.2026년 7월 17일Moonshot, 2.8T Kimi K3 공개…7월 27일 full weights 배포Moonshot AI가 7월 17일 2.8T-parameter, 1M-token context의 Kimi K3를 Kimi·Kimi Work·Kimi Code·Kimi API에 공개했다. Kimi Delta Attention과 Attention Residuals를 적용한 MoE 구조로, 896개 expert 중 16개를 활성화하며 full model weights는 7월 27일 공개할…