PickleeAI와 개발, 오늘 볼 변화만
홈읽을거리아카이브
검색

Picklee

AI와 개발 현장에서 오늘 확인할 변화만 선별합니다.

© 2026 Picklee. All rights reserved.

RSSSitemap

읽을거리

2026년 7월 27일

NVIDIA, Cosmos 3 Edge 공개: 4B 온디바이스 Physical AI 모델

NVIDIA는 Cosmos 3 Edge를 공개했다. Nemotron 기반 4B 모델로, NVIDIA Jetson Thor 등 엣지 컴퓨터에서 vision reasoning과 로봇 action 생성을 로컬로 수행하도록 설계됐으며 Cosmos 3 오픈 월드 모델 계열의 edge 배포판이다.

본문 읽기원문 보기

발행일

2026년 7월 27일

업데이트

2026년 7월 27일

주제

AI
모델
오픈소스
에이전트
원문 보기

배경 및 맥락

로봇, 자율주행, 산업용 카메라 같은 physical AI는 대규모 언어 모델의 추론 능력만으로 완성되지 않는다. 현장의 영상·센서 데이터는 지연과 연결 불안정의 제약을 받으며, 실제 행동 정책은 로봇의 형태와 환경에 맞춰 반복적으로 적응해야 한다. NVIDIA는 Cosmos 3 계열을 world understanding, world generation, action generation을 결합한 오픈 physical AI 스택으로 확장해 왔다.


핵심 내용

Cosmos 3 Edge는 NVIDIA Nemotron 기반의 4-billion-parameter 모델로, 주변을 이해하고 실시간으로 추론하며 로봇 action을 생성하는 용도를 표방한다. NVIDIA는 특정 로봇, 차량, 센서, 환경에 맞춰 약 하루 안에 모델을 적응시킬 수 있다고 설명하며, Jetson Thor를 포함한 edge computer에서의 deployment를 제시했다. 이 발표는 NVIDIA Metropolis libraries 및 agentic vision AI 개발 흐름과 연결되어, 비전 에이전트와 로봇 정책을 현장에 가깝게 배치하는 경로를 제공한다.


경쟁 구도 / 비교

클라우드 중심의 멀티모달 모델은 대규모 지식과 생성 품질에서 유리하지만, 로봇 제어에는 네트워크 왕복과 데이터 반출 문제가 남는다. Cosmos 3 Edge의 포지션은 더 큰 Cosmos 3 모델의 대체가 아니라, 엣지에서 빠르게 동작할 수 있도록 축소·특화한 실행 계층이다. NVIDIA는 Jetson, RTX, DGX를 잇는 경로를 제시해 개발·post-training·현장 추론을 하나의 하드웨어 생태계로 묶으려 한다.


의미

실무에서 중요한 검증 단위는 데모 영상이 아니라 실제 운영 환경의 안전성과 재현성이다. 팀은 센서 지연, 조도·날씨·가림 같은 distribution shift, 긴급 정지, 사람 개입, 버전 rollback을 평가 시나리오에 넣어야 한다. 오픈 모델·도구가 제공되더라도, robot policy의 권한 경계와 현장 안전 기준은 애플리케이션 수준에서 별도로 책임져야 한다.

이어 읽기

관련 읽을거리

전체 보기
2026년 7월 28일Moonshot AI, Kimi K3 공개 weights 배포: 2.8T MoE의 실제 serving 경로 확인Moonshot AI가 Hugging Face에 Kimi K3의 full weights를 Kimi K3 License로 공개했다. 2.8T total / 104B activated parameter의 native multimodal MoE 모델로, 1M-token context, 896개 expert 중 16개 선택, MXFP4 weight·MXFP8 activation 기반 QAT를…2026년 7월 17일Moonshot, 2.8T Kimi K3 공개…7월 27일 full weights 배포Moonshot AI가 7월 17일 2.8T-parameter, 1M-token context의 Kimi K3를 Kimi·Kimi Work·Kimi Code·Kimi API에 공개했다. Kimi Delta Attention과 Attention Residuals를 적용한 MoE 구조로, 896개 expert 중 16개를 활성화하며 full model weights는 7월 27일 공개할…2026년 7월 17일Thinking Machines, 975B MoE 오픈 웨이트 Inkling 공개Thinking Machines Lab가 7월 15일 975B total·41B active parameter의 MoE 모델 Inkling을 full weights로 공개했다. 최대 1M-token context와 text·image·audio native reasoning을 지원하며, 45T token의 text·image·audio·video 데이터로 pretraining됐다.…2026년 5월 2일NVIDIA Nemotron 3 Nano Omni — multimodal agent 스택이 모델 조합에서 단일 perception sub-agent로 수렴NVIDIA는 2026년 4월 28일 vision·audio·video·text를 한 모델에서 처리하는 오픈 multimodal reasoning model Nemotron 3 Nano Omni를 발표했다. 이 모델은 30B-A3B hybrid MoE, 256K context를 기반으로 document intelligence·video/audio understanding…