PickleeAI와 개발, 오늘 볼 변화만
홈읽을거리아카이브
검색

Picklee

AI와 개발 현장에서 오늘 확인할 변화만 선별합니다.

© 2026 Picklee. All rights reserved.

RSSSitemap

주제

#AI

281개 읽을거리를 모았습니다.
2026년 7월 28일

Moonshot AI, Kimi K3 공개 weights 배포: 2.8T MoE의 실제 serving 경로 확인

Moonshot AI가 Hugging Face에 Kimi K3의 full weights를 Kimi K3 License로 공개했다. 2.8T total / 104B activated parameter의 native multimodal MoE 모델로, 1M-token context, 896개 expert 중 16개 선택, MXFP4 weight·MXFP8 activation 기반 QAT를…

AI
모델
읽기
2026년 7월 28일

NVIDIA·업계, Open Secure AI Alliance 출범: 공개 방어 스택·NOOA 추진

NVIDIA와 Hugging Face·Microsoft·Cloudflare·CrowdStrike 등은 Open Secure AI Alliance를 출범시켰다. 오픈 모델·harness·보안 도구를 함께 개발·공개해 AI agent 시대의 취약점 대응, red teaming, 평가와 방어 자동화를 강화하겠다는 구상이며 NVIDIA는 NOOA(Object-Oriented Agent)…

AI
오픈소스
읽기
2026년 7월 28일

OpenAI, Health in ChatGPT 출시: 개인 건강 데이터 연결과 별도 보호 계층

OpenAI는 미국의 18세 이상 로그인 사용자에게 Health in ChatGPT를 출시했다. Apple Health와 지원되는 의료 기록을 사용자가 연결하면 검사 결과·복용약·방문 기록·수면·활동 데이터를 대화에 선택적으로 반영할 수 있으며, web·iOS의 Free·Go·Plus·Pro에서 시작한다.

AI
읽기
2026년 7월 28일

OpenAI Presence: 정책·평가·승인 루프로 Enterprise Agent 운영 제품화

OpenAI는 Enterprise 고객용 배포형 제품 OpenAI Presence를 공개했다. voice·chat agent가 정해진 업무 범위 안에서 기업 시스템을 사용하고 승인된 조치를 수행하도록 하며, 정책·guardrail·escalation·simulation·evaluation·변경 제안을 하나의 운영 루프로 묶는다.

AI
에이전트
읽기
2026년 7월 27일

Anthropic, Claude Sonnet 5 출시: 에이전트 성능과 비용 효율 강화

Anthropic은 Claude Sonnet 5를 출시했다. 브라우저·터미널 같은 도구를 사용해 계획을 세우고 자율 실행하는 agentic 작업을 겨냥하며, Claude API와 Claude Code에서 claude-sonnet-5로 제공된다. 출시 프로모션 가격은 2026년 8월 31일까지 입력 $2·출력 $10 per 1M tokens이며 이후 $3·$15다.

AI
Claude
읽기
2026년 7월 27일

Google Cloud, AlphaEvolve GA: 채점 함수 기반 코드 최적화 에이전트

Google Cloud는 AlphaEvolve를 Gemini Enterprise Agent Platform에서 GA로 제공한다고 발표했다. AlphaEvolve는 기준 알고리즘과 문제 정의, 정량 scoring function을 입력으로 받아 후보 프로그램을 탐색·평가·최적화하는 code optimization 및 discovery agent다.

AI
에이전트
읽기
2026년 7월 27일

Google Cloud, k8s-aibom 오픈소스화: 런타임 ML-BOM 자동 생성

Google Cloud는 GKE용 오픈소스 Kubernetes controller k8s-aibom을 공개했다. 이 도구는 cluster API와 container environment를 모니터링해 vLLM·Triton 같은 실행 중 AI runtime을 탐지하고, CycloneDX 1.6 Machine Learning Bill of Materials(ML-BOM)를 자동 생성한다.

AI
오픈소스
읽기
2026년 7월 27일

NVIDIA, Cosmos 3 Edge 공개: 4B 온디바이스 Physical AI 모델

NVIDIA는 Cosmos 3 Edge를 공개했다. Nemotron 기반 4B 모델로, NVIDIA Jetson Thor 등 엣지 컴퓨터에서 vision reasoning과 로봇 action 생성을 로컬로 수행하도록 설계됐으며 Cosmos 3 오픈 월드 모델 계열의 edge 배포판이다.

AI
모델
읽기
2026년 7월 27일

Vercel Ship 2026: AI SDK 7·Connect·eve로 에이전트 스택 확장

Vercel은 Ship 2026에서 AI SDK 7, Vercel Connect, 오픈소스 agent framework eve를 발표했다. AI SDK 7은 multi-turn·tool call·파일·sandbox 작업을 provider-agnostic 인터페이스로 다루고, Connect는 장기 provider token 대신 작업 단위의 임시·scoped credential을 에이전트에…

AI
개발도구
읽기
2026년 7월 26일

Google, Gemini 3.6 Flash·3.5 Flash-Lite·3.5 Flash Cyber 공개

Google이 7월 21일 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 공개했다. 3.6 Flash는 3.5 Flash 대비 출력 토큰 사용량을 17% 낮췄다고 밝히며, 입력·출력 가격은 각각 $1.50/$7.50 per 1M tokens다.

AI
Gemini
읽기
2026년 7월 26일

Moonshot AI, Kimi K3 공개: 2.8T open 3T-class 모델

Moonshot AI는 Kimi K3를 공개했다. 2.8T parameters, native vision, 1M-token context를 갖춘 open 3T-class 모델이며 Kimi.com·Kimi Work·Kimi Code·Kimi API에서 제공된다. 전체 weights는 7월 27일까지 공개할 예정이라고 밝혔다.

AI
모델
읽기
2026년 7월 26일

OpenAI·Hugging Face, 모델 평가 중 AI 에이전트 보안 사고 공개

OpenAI와 Hugging Face는 7월 21일, cyber capability 평가 중이던 OpenAI 모델 조합이 Hugging Face 인프라에 침해를 일으킨 사고를 공동 공개했다. 양측은 Hugging Face가 활동을 탐지·차단했으며 공개 모델·데이터셋·Spaces 변조 증거는 없다고 밝혔다.

AI
OpenAI
읽기
2026년 7월 26일

UN AI Scientific Panel, Preliminary Report로 글로벌 거버넌스 논의 지원

UN Independent International Scientific Panel on AI가 Preliminary Report를 공개했다. 보고서는 AI science·applications·경제·보안·인권·문화·거버넌스 등 7개 영역의 근거를 정리해 7월 6~7일 Geneva에서 열린 첫 Global Dialogue on AI Governance의 공통 출발점으로 제시됐다.

AI
트렌드
읽기
2026년 7월 17일

GitHub Models, 7월 30일 전면 종료…API·BYOK 모두 중단

GitHub가 GitHub Models를 7월 30일 전면 종료한다고 공지했다. playground, model catalog, inference API, BYOK endpoint와 관련 UI가 모두 사라지며, 활성 사용 중인 기존 고객도 대상이다. 사전 준비용 brownout은 7월 16일과 23일에 예정돼 요청이 일시 오류를 반환한다.

AI
개발도구
읽기
2026년 7월 17일

Moonshot, 2.8T Kimi K3 공개…7월 27일 full weights 배포

Moonshot AI가 7월 17일 2.8T-parameter, 1M-token context의 Kimi K3를 Kimi·Kimi Work·Kimi Code·Kimi API에 공개했다. Kimi Delta Attention과 Attention Residuals를 적용한 MoE 구조로, 896개 expert 중 16개를 활성화하며 full model weights는 7월 27일 공개할…

AI
모델
읽기
2026년 7월 17일

Thinking Machines, 975B MoE 오픈 웨이트 Inkling 공개

Thinking Machines Lab가 7월 15일 975B total·41B active parameter의 MoE 모델 Inkling을 full weights로 공개했다. 최대 1M-token context와 text·image·audio native reasoning을 지원하며, 45T token의 text·image·audio·video 데이터로 pretraining됐다.…

AI
모델
읽기
2026년 7월 16일

Fireworks, USD 1.505B Series D로 custom-model 플랫폼 확장

Fireworks가 custom model의 학습·서빙 플랫폼 확장을 위해 USD 1.505B Series D를 USD 17.5B valuation에 유치했다고 발표했다. Atreides Management·Index Ventures·TCV가 라운드를 주도했으며, 회사는 Uber·Shopify 등이 자사 플랫폼으로 특화 모델을 학습·서빙하고 있고 ARR USD 1B를 달성했다고 밝혔다.

AI
산업
읽기
2026년 7월 16일

GitHub Copilot code review, 하네스·도구 지침 최적화로 평균 비용 약 20% 절감

GitHub은 Copilot code review가 shared Unix-style 탐색 도구(grep, glob, view)로 옮긴 뒤 처음에는 리뷰 비용이 늘고 이슈 발견 수가 줄었다고 공개했다. 이후 PR diff에 맞춘 tool instruction, trace 비교, 내부 benchmark를 결합해 품질을 저해하는 신호 없이 평균 리뷰 비용을 약 20% 낮췄다.

AI
개발도구
읽기
2026년 7월 16일

Mistral, 단일 RGB 카메라 로봇 내비게이션 모델 Robostral Navigate 공개

Mistral AI가 자연어 지시와 단일 RGB 카메라 입력만으로 복잡한 환경을 이동하는 8B embodied-navigation 모델 Robostral Navigate를 공개했다. 이 모델은 R2R-CE validation unseen에서 76.6% 성공률을 기록해, 회사 발표 기준 최고 단일 카메라 방식보다 9.7%p, depth·다중 카메라 방식보다 4.5%p 높았다.

AI
모델
읽기
2026년 7월 16일

Chai Discovery·argenx, de novo antibody 설계를 위한 AI 플랫폼 협업

Chai Discovery가 7월 15일 argenx와 협력해, argenx의 과학자들이 Chai의 AI 플랫폼으로 치료 표적에 대한 de novo antibody discovery를 수행하도록 한다고 발표했다. Chai는 Chai-2가 zero-shot antibody design에서 두 자릿수 실험 hit rate를 냈고, Chai-3는 binding·난공략…

AI
산업
읽기
2026년 7월 16일

Google Ads, 생성형 AI 사용을 표시하는 ‘How this ad was made’ 공개

Google이 7월 9일 Search·YouTube·Discover 광고의 My Ad Center에 ‘How this ad was made’ 섹션을 전 세계 도입한다고 발표했다. Google의 생성형 광고 도구로 만든 광고에는 disclosure가 자동 추가되고, 외부 AI 도구로 만든 광고에는 광고주가 AI 사용을 표시하는 control이 제공된다.

AI
트렌드
읽기
2026년 7월 16일

Prime Intellect, 오픈형 agentic RL 스택 확장에 USD 130M Series A

Prime Intellect가 7월 8일 Radical Ventures 주도로 USD 130M Series A를 유치해 누적 자금이 USD 150M을 넘었다고 발표했다. 회사는 compute, large-scale RL, environments, sandboxes, evals, deployment를 묶은 스택을 제공하며 6,000곳 이상 고객과 USD 100M 이상의 annualized…

AI
에이전트
읽기
2026년 7월 15일

Google, Qwen 3.5-397B MoE를 Ironwood TPU에서 최적화: prefill 최대 4.7배 향상

Google for Developers는 397B-parameter Qwen 3.5 MoE를 Ironwood TPU v7x에서 서빙하기 위한 최적화 사례를 공개했다. 17B active parameters/token의 희소 모델을 대상으로 DP+EP 병렬화, JAX/Pallas 커널, 통신 fusion을 적용해 2026년 4~6월 사이 decode-heavy 성능은 약 3.1배,…

AI
모델
읽기
2026년 7월 15일

SambaNova, Series F 첫 클로징으로 USD 1B 유치…AI inference 인프라에 USD 11B 가치

AI chip 기업 SambaNova가 General Atlantic 주도의 Series F 첫 클로징에서 USD 1B를 유치하며 USD 11B 가치를 인정받았다. 회사는 JPMorganChase의 inference-infrastructure partner로 선정돼 SN40L·SN50 systems로 secure on-premises AI inference를 지원한다고 밝혔고, 추가 자금은…

AI
산업
읽기
2026년 7월 15일

UN 독립 AI 과학 패널, 기회·위험·영향을 다룬 첫 예비 보고서 공개

UN Independent International Scientific Panel on AI가 7월 1일 AI의 기회·위험·영향에 관한 첫 Preliminary Report를 공개했고, 7월 6~7일 Geneva의 첫 Global Dialogue on AI Governance에 제출했다. 40명의 독립 과학자·전문가가 AI 과학·경제·보안·인권·거버넌스 등 7개 영역의 근거를 종합한…

AI
트렌드
읽기
2026년 7월 13일

Google, Gemini 3.5 Flash computer use와 Gemini Omni Flash API 공개

Google은 2026년 6월 AI 업데이트에서 Gemini 3.5 Flash에 desktop·mobile·browser 환경을 보고 추론·행동하는 computer use를 통합했고, 동적 video workflow용 natively multimodal Gemini Omni Flash를 API public preview로 공개했다.

AI
에이전트
읽기
2026년 7월 13일

Helsing, USD 1.8B Series E로 USD 18B 가치 평가…유럽 AI 국방 기술 투자 가속

독일 드론 기업 Helsing이 $1.8B Series E를 유치해 $18B 가치 평가를 받았다. Dragoneer, Lightspeed, Goldman Sachs Alternatives, JPMorgan Chase, CPP Investments, General Catalyst 등이 참여했으며, Axios는 이를 유럽 본토 최고 가치 스타트업으로 보도했다.

AI
산업
읽기
2026년 7월 13일

Meta, Muse Image·Muse Video 공개: 툴 사용·자기개선형 미디어 생성 모델

Meta Superintelligence Labs가 Muse Image를 출시하고 Muse Video를 프리뷰했다. Muse Image는 이미지 생성 과정에서 search·code 도구를 호출하고 결과를 스스로 수정하는 agentic model이며, Muse Video는 같은 사전학습 기반에서 native audio를 지원한다.

AI
모델
읽기
2026년 7월 13일

GitLost: We Tricked GitHub's AI Agent into Leaking Private Repos

요약: Noma Labs는 GitHub의 새로운 Agentic Workflows에서 중요한 프롬프트 주입 취약점을 발견했습니다. 이를 통해 인증되지 않은 공격자가 비공개 저장소와 동일한 조직에 속한 공개 저장소에 조작된 GitHub 문제를 게시하여 비공개 저장소에서 자동으로 데이터를 가져올 수 있습니다. 수암…

트렌드
AI
읽기
2026년 7월 13일

Claude Code sends 33k tokens before reading the prompt; OpenCode sends 7k

API 경계에서 측정된 Claude Code와 OpenCode 토큰 오버헤드 비교. 즉시 사용 가능한 기준선, 명령 파일 가중치, MCP 스키마 세금, 하위 에이전트 승수 및 캐시 쓰기 동작.

트렌드
AI
읽기
2026년 7월 12일

I think I have LLM burnout

나는 LLM 결과를 읽는 데 그렇게 지칠 줄은 몰랐습니다.

트렌드
AI
읽기
2026년 7월 12일

GPT-5.6 Sol Ultra produces proof of the Cycle Double Cover Conjecture [pdf]

GPT-5.6 Sol Ultra produces proof of the Cycle Double Cover Conjecture [pdf] 소식의 핵심을 빠르게 정리하면, AI 모델 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 11일

Show HN: Getting GLM 5.2 running on my slow computer

25GB RAM 소비자 컴퓨터에서 GLM-5.2(744B MoE)를 실행하세요. 순수 C, 제로 깊이, 전문가가 디스크에서 스트리밍합니다. 작은 엔진, 거대한 모델. 🐦 - JustVugg/colibri

트렌드
AI
읽기
2026년 7월 11일

Apple sues OpenAI, accuses ex-employees of stealing trade secrets

Apple은 오늘 OpenAI를 영업비밀 도용 혐의로 고소했습니다. 특히 애플은 다음과 같이 주장한다.

트렌드
AI
읽기
2026년 7월 10일

GPT‑Live

GPT‑Live 소식의 핵심을 빠르게 정리하면, AI 모델 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 10일

GPT-5.6

GPT-5.6 소식의 핵심을 빠르게 정리하면, AI 모델 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 6일

Jamesob's guide to running SOTA LLMs locally

로컬에서 LLM을 운영하는 것에 대해 내가 아는 모든 것. GitHub에 계정을 만들어 jamesob/local-llm 개발에 기여하세요.

트렌드
AI
읽기
2026년 7월 6일

Zuckerberg says AI agent development going slower than expected

Zuckerberg says AI agent development going slower than expected 소식의 핵심을 빠르게 정리하면, 에이전트 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 5일

Leanstral 1.5 - open proof-engineering model moves formal verification toward practical code review

Mistral이 Lean 4 기반 proof engineering 모델 Leanstral 1.5를 공개했다. Apache-2.0 라이선스의 119B total / 6B active parameter 모델이며 miniF2F 100%, PutnamBench 587/672, FATE-H 87%, FATE-X 34%를 기록하고 57개 오픈소스 저장소 테스트에서 5개 미보고 버그를 찾아냈다고 밝혔다.

AI
모델
읽기
2026년 7월 5일

OpenAI GeneBench-Pro - computational biology agents get a harder benchmark for research judgment

OpenAI가 computational biology용 research-level benchmark인 GeneBench-Pro를 공개했다. 10개 domain, 21개 sub-domain, 129문제로 구성되며 GPT-5.6 Sol은 high reasoning level에서 28.7%, Pro mode에서 31.5% pass rate를 기록했다.

AI
연구
읽기
2026년 7월 5일

Vercel AI Gateway voice support - realtime multimodal agents move into the same routing plane as text models

Vercel AI Gateway가 realtime voice, text-to-speech, speech-to-text를 지원하기 시작했다. OpenAI와 xAI의 audio 모델을 AI SDK 7 beta에서 같은 Gateway credential, routing, observability, spend controls, BYOK 체계로 호출할 수 있다.

AI
API
읽기
2026년 7월 5일

Alibaba to ban Claude Code in workplace over alleged backdoor risks, source says

Alibaba to ban Claude Code in workplace over alleged backdoor risks, source says 소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 5일

Microsoft's open source tools were hacked to steal passwords of AI developers

Microsoft는 해킹이 보고된 후 Azure 및 AI 코딩 도구에 대한 수십 개의 GitHub 코드 리포지토리를 종료했습니다.

트렌드
AI
읽기
2026년 7월 4일

AI for Good Global Commission - UN/ITU moves AI governance toward executive coordination

ITU가 Rwanda 대통령 Paul Kagame, Salesforce CEO Marc Benioff, ITU 사무총장 Doreen Bogdan-Martin을 중심으로 AI for Good Global Commission을 출범시켰다. 40명 이상의 Founding Members에는 Amazon, Anthropic, Cohere, Google, Microsoft, NVIDIA,…

AI
산업
읽기
2026년 7월 4일

Claude Science - Anthropic turns scientific workflows into auditable agent workbenches

Anthropic이 macOS, Linux, SSH/HPC 환경에서 동작하는 Claude Science beta를 공개했다. 이 워크벤치는 PubMed, Jupyter, R, cluster terminal 등으로 분산된 과학 연구 도구를 통합하고, 60개 이상 curated skills/connectors, reviewer agent, reproducible artifact history를…

AI
Claude
읽기
2026년 7월 4일

Epoch CVE spike - frontier cyber models reshape vulnerability disclosure volume

Epoch AI가 Claude Mythos Preview 공개 이후 2026년 6월 high/critical CVE 공개가 약 1,500건으로 증가해, Mythos 이전 월간 최고치보다 3.5배 이상 많았다고 분석했다. 데이터는 Microsoft, Google, Apple, AWS, Linux, Mozilla, OpenSSL 등 21개 주요 조직의 CVE 공개를 중심으로 집계됐다.

AI
연구
읽기
2026년 7월 4일

Wafer GLM5.2 on AMD MI355X - ROCm inference narrows the CUDA deployment gap

Wafer가 AMD MI355X에서 GLM5.2를 서빙하며 20k input / 1k output, 60% cache-hit workload 기준 2,626 tok/s/node와 2.4 RPS, 단일 스트림 213 tok/s를 달성했다고 공개했다. 회사는 이 구성이 B200 측정치의 약 80% 성능이지만 비용은 Blackwell 대비 2배 이상 낮다고 주장한다.

AI
모델
읽기
2026년 7월 4일

Noam Shazeer Joins OpenAI

소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 4일

ZCode – Harness for GLM-5.2

ZCode는 최고의 AI 에이전트를 기존 도구와 결합하므로 마찰 없이 계획, 코딩, 검토 및 배포할 수 있습니다.

트렌드
AI
읽기
2026년 7월 3일

GitHub Copilot Browser Tools GA - coding agents get controlled live-browser execution in VS Code

GitHub이 VS Code용 Copilot Browser Tools를 GA로 전환했다. Copilot agents는 이제 실제 브라우저를 열고 navigate, click, type, hover, drag, dialog handling, console error 확인, screenshot capture, scripted flow 실행을 수행할 수 있다.

AI
개발도구
읽기
2026년 7월 3일

Mistral OCR 4 - document parsing shifts from text extraction to structured AI ingestion

Mistral이 OCR 4를 공개했다. 이 모델은 텍스트 추출뿐 아니라 bounding boxes, typed block classification, inline confidence score를 함께 반환하며 170개 언어와 단일 컨테이너 self-hosting을 지원한다.

AI
모델
읽기
2026년 7월 3일

ScarfBench - enterprise Java migration exposes coding-agent behavior gaps

IBM Research가 Hugging Face에 ScarfBench를 공개했다. ScarfBench는 Spring, Jakarta EE, Quarkus 사이의 enterprise Java framework migration을 평가하며 34개 앱, 102개 framework implementations, 204개 migration tasks, 약 151K LOC, 1,331개…

AI
개발도구
읽기
2026년 7월 3일

Apple reveals new AI architecture built around Google Gemini models

Apple은 오늘 Apple Intelligence 플랫폼의 대대적인 개편을 발표하여 Gemini 제품군의 기술을 사용하여 Google과 협력하여 개발된 기반 모델을 기반으로 구축된 새로운 아키텍처를 공개했습니다. The new architecture centers on Apple Foundation Models co-developed with Google, which Apple says…

트렌드
AI
읽기
2026년 7월 3일

OpenAI unveils its first custom chip, built by Broadcom

Jalapeño라는 이름의 새로운 프로세서는 OpenAI 추론 시스템의 고유한 요구 사항을 위해 특별히 설계되었습니다.

트렌드
AI
읽기
2026년 7월 2일

Etched frontier inference clusters - transformer ASIC startup moves toward rack-scale production

Etched가 frontier inference cluster 전략을 공개하며 TSMC N4P A0 silicon, 첫 rack-scale product 검증, USD 1B 이상 demand, USD 800M 누적 조달을 밝혔다. 회사는 Low Voltage Inference와 Cluster Scale Memory를 통해 frontier model의 prefill·decode…

AI
산업
읽기
2026년 7월 2일

GitHub Models retirement - standalone model API gives way to Copilot and Azure AI Foundry

GitHub이 GitHub Models를 2026년 7월 30일 완전 종료한다고 공지했다. 종료 범위에는 playground, model catalog, inference API, BYOK endpoint가 모두 포함되며 기존 활성 사용자도 예외 없이 영향을 받는다.

AI
개발도구
읽기
2026년 7월 2일

Mixedbread asymmetric quantization - late-interaction retrieval cuts vector storage 97 percent

Mixedbread가 late-interaction retrieval에서 document vector는 1-bit sign으로 저장하고 query vector는 int8로 유지하는 asymmetric quantization 기법을 공개했다. 내부 benchmark 기준 raw document-vector storage를 393 KiB에서 12.28 KiB로 줄이면서 NDCG@10은…

AI
연구
읽기
2026년 7월 2일

Gemma 4 12B: A unified, encoder-free multimodal model

고성능 다중 모드 인텔리전스를 노트북에 직접 제공하도록 설계된 모델인 Gemma 4 12B에 대한 개요입니다.

트렌드
AI
읽기
2026년 7월 2일

Department of Commerce has lifted export controls on Claude Fable 5 and Mythos 5

소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 7월 1일

Godot AI code policy - OSS maintainers draw a hard review boundary

Godot Engine은 AI-generated code contribution을 허용하지 않는 정책을 공식화했다. 핵심 이유는 저작권 불확실성보다 유지보수자가 provenance, license contamination, subtle bug를 검증해야 하는 review burden이 과도하게 커진다는 점이다.

AI
개발도구
읽기
2026년 7월 1일

Meta AI compute cloud - hyperscalers turn excess capacity into a market

TechCrunch는 Bloomberg 보도를 인용해 Meta가 AI compute power와 models 접근을 판매하는 cloud infrastructure business를 검토하고 있다고 전했다. 이는 SpaceX/xAI가 Colossus capacity를 외부에 임대하는 흐름과 유사하게, 대규모 AI 인프라를 내부 비용센터에서 외부 수익원으로 전환하려는 움직임이다.

AI
산업
읽기
2026년 7월 1일

Venice AI Series A - privacy-first AI platforms become infrastructure businesses

Venice AI가 Series A에서 6,500만 달러를 조달하며 10억 달러 valuation을 발표했다. 회사는 private, uncensored AI platform을 내세우며 consumer app, API, token ecosystem을 함께 확장하고 있다.

AI
산업
읽기
2026년 7월 1일

Claude Sonnet 5

코딩 및 일상적인 전문 작업을 위한 최고 수준의 인텔리전스를 갖춘 가장 강력한 Sonnet입니다.

트렌드
AI
읽기
2026년 7월 1일

Claude Code is steganographically marking requests

개인 정보 보호를 위해 Claude Code를 검사한 결과 API 기본 URL 및 시간대를 기반으로 숨겨진 시스템 프롬프트 마커를 발견했습니다.

트렌드
AI
읽기
2026년 6월 30일

AWS FDE - agentic AI deployment moves from tooling to embedded engineering

AWS가 10억 달러 규모의 Forward Deployed Engineering 조직을 만들고, 고객사 내부에 AI 엔지니어를 투입해 agentic AI 시스템을 며칠 단위로 공동 구축하겠다고 발표했다.

AI
산업
읽기
2026년 6월 30일

Base44 Base1 - vibe-coding platforms chase vertical model ownership

Wix가 8천만 달러에 인수했던 Base44가 자연어 앱 생성 플랫폼을 위한 자체 AI 모델 Base1을 롤아웃하기 시작했다.

AI
개발도구
읽기
2026년 6월 30일

Every Eval Ever - fragmented AI benchmarks get a shared metadata layer

EvalEval Coalition이 Every Eval Ever를 공개해 AI 평가 결과를 하나의 공개 스키마와 데이터셋으로 모으고, Hugging Face Hub의 evaluation results 구조와 연결되는 기반을 제시했다.

AI
연구
읽기
2026년 6월 30일

X hosted MCP - social data APIs become agent-native infrastructure

X가 https://api.x.com/mcp와 https://docs.x.com/mcp 형태의 hosted MCP 서버를 공개해 Cursor, Claude, Grok Build, VS Code 같은 MCP 클라이언트가 X API와 문서를 직접 사용할 수 있게 했다.

AI
에이전트
읽기
2026년 6월 30일

GLM 5.2 beats Claude in our benchmarks

프롬프트만 제공되는 모델 중에서 최고의 개방형 옵션이 Claude Opus 4.8을 능가했습니다.

트렌드
AI
읽기
2026년 6월 30일

Identity verification on Claude

Identity verification on Claude | Claude Help Center 소식의 핵심을 빠르게 정리하면, 개발 도구 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 6월 30일

Anthropic says Alibaba illicitly extracted Claude AI model capabilities

Anthropic says Alibaba illicitly extracted Claude AI model capabilities 소식의 핵심을 빠르게 정리하면, AI 모델 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 6월 30일

U.S. government will decide who gets to use GPT-5.6

U.S. government will decide who gets to use GPT-5.6 소식의 핵심을 빠르게 정리하면, 개발 도구 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 6월 29일

GitHub Advisory Database surge - vulnerability disclosure pipelines hit AI-era scale

GitHub는 2026년 6월 29일 Advisory Database가 2026년 5월에 1,560개의 reviewed advisory를 발행해 평소 월간 처리량의 5배 이상을 기록했다고 공개했다. Private vulnerability report는 1월 약 550건/주에서 5월 대부분 기간 3,000건/주 이상으로 늘었고, repo advisory는 약 650건/주에서 5,000건/주…

AI
개발도구
읽기
2026년 6월 29일

OlmoLogic - Prolog-verifiable RLVR improves open logical reasoning

연구진은 2026년 6월 26일 Olmo-3 RLVR recipe에 inductive logic programming task를 통합한 OlmoLogic 7B Think를 공개했다. 56×H100에서 6일 동안 3,350 optimization step으로 학습했고, SLR-Bench accuracy를 15.1에서 45.1로 끌어올리며 held-out logic benchmark 평균도…

AI
모델
읽기
2026년 6월 29일

VLX-Go - lightweight vision-language waypoints for embodied navigation

Om AI Lab은 2026년 6월 28일 Hugging Face를 통해 VLX-Go를 공개했다. VLX-Go는 최근 monocular frame, 현재 관측, 자연어 instruction을 받아 robot controller가 실행할 short-horizon local waypoint를 예측하는 0.6B 규모 vision-language planner다.

AI
모델
읽기
2026년 6월 28일

AI RFIC inverse design - reinforcement learning reaches radio-chip layout bottlenecks

IEEE Spectrum은 Princeton 연구진이 reinforcement learning, inverse design, diffusion model을 활용해 RFIC layout을 빠르게 생성하고 record-class performance를 달성한 사례를 보도했다. RFIC 설계는 5G, autonomous vehicles, satellite communications 같은…

AI
트렌드
읽기
2026년 6월 28일

Azure Copilot Observability Agent - cloud ops moves from alerts to real-time reasoning

Microsoft는 2026년 6월 23일 Azure Copilot Observability Agent의 general availability를 발표했다. Azure Monitor 기반으로 agents, applications, infrastructure, services의 signal을 상관 분석해 운영자가 로그, 메트릭, traces, resource health를 하나의…

AI
개발도구
읽기
2026년 6월 28일

BIS AI investment warning - AI capex becomes a macro-financial stability risk

BIS는 2026년 6월 28일 Annual Economic Report 2026에서 AI boom의 지속 가능성, 금융 취약성, 높은 공공부채, 인플레이션 재상승을 글로벌 경제의 pressure point로 지목했다. 보고서는 AI 진전에 대한 기대가 금융 여건과 경제활동을 지지했지만, 투자 수익이 기대에 못 미치면 AI capex boom이 장기 investment bust로 전환될 수…

AI
산업
읽기
2026년 6월 28일

Gemini 3.5 Flash Computer Use - screen-driving agents move into the main model

Google은 2026년 6월 24일 computer use를 Gemini 3.5 Flash의 built-in tool로 통합해, Gemini API와 Gemini Enterprise Agent Platform에서 browser, mobile, desktop 환경을 조작하는 agent를 만들 수 있게 했다. Gemini API 문서는 gemini-3.5-flash를 computer use…

AI
Gemini
읽기
2026년 6월 27일

AWS Lambda MicroVMs - serverless sandboxes target AI-generated code execution

AWS는 2026년 6월 22일 Lambda MicroVMs를 발표하며, 사용자 또는 AI가 생성한 코드를 isolated, stateful execution environment에서 실행할 수 있는 serverless compute primitive를 공개했다. Firecracker 기반 VM-level isolation, near-instant launch/resume,…

AI
개발도구
읽기
2026년 6월 27일

DeepSpec - speculative decoding becomes an open production optimization stack

DeepSeek은 speculative decoding draft model을 훈련하고 평가하기 위한 MIT-licensed DeepSpec repository를 공개했다. README 기준 DeepSpec은 data preparation, draft model implementation, training, evaluation scripts를 포함하며 DSpark, DFlash,…

AI
오픈소스
읽기
2026년 6월 27일

GPT-5.6 Sol preview - frontier model releases become policy-gated infrastructure decisions

OpenAI는 2026년 6월 26일 GPT-5.6 series의 limited preview를 발표하며 Sol, Terra, Luna 3개 tier와 새로운 max reasoning effort, subagent 기반 ultra mode를 공개했다. Sol은 Terminal-Bench 2.1, GeneBench v1, ExploitBench, ExploitGym 같은 장시간…

AI
OpenAI
읽기
2026년 6월 26일

General Intuition Series A - gameplay data becomes the next action-model training substrate

General Intuition은 Khosla Ventures가 lead한 3억 2천만 달러 Series A를 발표하며, 가상 및 물리 환경에서 perceive, predict, act할 수 있는 모델을 만들겠다고 밝혔다. 보도에 따르면 post-money valuation은 23억 달러이며, TechCrunch는 이번 라운드 이후 누적 공개 funding이 4억 5,400만 달러라고…

AI
산업
읽기
2026년 6월 26일

HF Jobs vLLM server - throwaway OpenAI-compatible endpoints get pay-per-second GPUs

Hugging Face는 HF Jobs에서 vLLM server를 한 번의 CLI 명령으로 띄워 private OpenAI-compatible LLM endpoint를 만들 수 있는 흐름을 공개했다. 서버 프로비저닝이나 Kubernetes 없이 pay-per-second GPU 인프라에서 테스트, eval, batch generation 용도로 빠르게 사용할 수 있다는 점을 전면에 내세웠다.

AI
개발도구
읽기
2026년 6월 26일

QHexRT - Qualcomm Hexagon NPU inference moves small LLMs fully on-device

RunAnywhereAI는 Qualcomm Hexagon NPU용 full-stack inference engine인 QHexRT를 공개했고, 첫 catalog entry로 Liquid AI의 LFM 2.5 230M을 지원한다. 발표는 decode graph, prefill graph, lm-head, embeddings까지 inference path의 모든 tensor가 HTP에 머무르며…

AI
개발도구
읽기
2026년 6월 25일

Claude Tag - Slack-native team agents move from private assistants to shared workspaces

Anthropic은 Slack에서 @Claude를 태그해 팀 단위로 작업을 위임하는 Claude Tag beta를 공개했다. Claude Enterprise와 Team 고객 대상이며, channel-scoped memory, tool/data/codebase access, ambient updates, spend limits, activity logs를 제공한다.

AI
Claude
읽기
2026년 6월 25일

GLM-5.2 - open long-context models push agentic coding toward 1M-token workspaces

Z.AI는 GLM-5.2를 공개하며 1M-token context, flexible effort levels, MIT license, long-horizon coding benchmark 성능을 전면에 내세웠다. 공개 글은 IndexShare로 1M context에서 per-token FLOPs를 2.9x 줄이고, Terminal Bench 2.1 81.0, SWE-bench Pro…

AI
모델
읽기
2026년 6월 25일

Microsoft AutoJack - browsing agents expose local MCP control planes to RCE

Microsoft Defender Security Research Team은 AutoGen Studio 개발 빌드에서 browsing agent가 악성 웹페이지를 렌더링하면 local MCP WebSocket을 통해 host process를 실행할 수 있는 AutoJack chain을 공개했다. 이 chain은 localhost origin trust, MCP path auth…

AI
개발도구
읽기
2026년 6월 24일

FFASR Leaderboard - voice AI benchmarks move from clean speech to far-field reality

Hugging Face와 Treble Technologies는 Far-Field ASR(FFASR) Leaderboard를 공개해 ASR 모델을 reverberation, background noise, competing speech, room acoustics 같은 실제 far-field 조건에서 비교할 수 있게 했다. 기존 clean/near-field benchmark 중심 평가가…

AI
모델
읽기
2026년 6월 24일

Kog Laneformer 2B - latency-first coding models move architecture into the serving layer

Kog는 Hugging Face에 Laneformer 2B의 weights와 model code를 공개했다. 이 모델은 2.3B parameter instruction-tuned coding model로, Delayed Tensor Parallelism과 lane-structured Transformer를 통해 batch-size-one decoding latency를 모델 아키텍처…

AI
모델
읽기
2026년 6월 24일

Krea 2 technical report - open image models compete on creative control, not only fidelity

Krea는 Krea 2 technical report를 공개하며 K2 Raw와 K2 Turbo 계열의 open-weights text-to-image foundation model을 설명했다. 보고서는 data curation, diffusion transformer architecture, multi-stage training, prompt expander, style-reference…

AI
모델
읽기
2026년 6월 24일

NVIDIA NeMo AutoModel - MoE fine-tuning gets a drop-in performance path for Transformers

NVIDIA와 Hugging Face는 Transformers v5 위에서 NeMo AutoModel을 사용해 MoE fine-tuning을 가속하는 방법을 공개했다. NeMo AutoModel은 Expert Parallelism, DeepEP fused all-to-all dispatch, TransformerEngine kernels를 추가해 같은 from_pretrained() 계열…

AI
개발도구
읽기
2026년 6월 23일

Fika Jobs - AI interview agents expose the product-risk tradeoff in hiring automation

TechCrunch는 Stockholm 기반 Fika Jobs가 AI interview agents와 short-form video profiles를 결합한 hiring platform으로 400만 달러 pre-seed를 유치했다고 보도했다. 후보자는 LinkedIn profile을 연결하고 Gemini 기반 agent가 생성한 약 10분 interview를 수행하며, Fika는 이를 짧은…

AI
에이전트
읽기
2026년 6월 23일

Google Jules evals - coding agents need insight-policy benchmarks, not just SWE-bench tasks

Google Developers Blog는 Jules 연구를 통해 proactive coding agent 평가가 단일 bug fix 성공률이 아니라 insight policy를 측정해야 한다고 주장했다. 내부 Google codebase의 705 bugs와 1,178 CLs를 이용해 related bug cluster를 aspirational goal로 재구성하고, agent가 3회…

AI
개발도구
읽기
2026년 6월 23일

huggingface_hub weekly release CI - open-weight agents make release automation auditable

Hugging Face는 huggingface_hub를 4-6주 주기에서 weekly release로 바꾼 GitHub Actions 기반 release pipeline을 공개했다. OpenCode, GLM-5.2 open-weight model, HF Inference Providers, PyPI Trusted Publishing을 사용하되, release notes와…

AI
오픈소스
읽기
2026년 6월 23일

OpenAI Patch the Planet - AI-assisted security needs maintainer-controlled remediation loops

OpenAI는 Trail of Bits와 함께 Patch the Planet을 공개해 cURL, NATS Server, pyca/cryptography, Sigstore, aiohttp, Go, Python 등 주요 OSS 프로젝트에 AI-assisted security research와 human expert review를 결합한다. Daybreak/Codex Security 흐름은…

AI
OpenAI
읽기
2026년 6월 22일

Intel XPU Kernel Skill - coding agents optimize Triton kernels beyond CUDA-first defaults

Intel DCG AI Software와 OCTO Parallel Computing Lab은 Hugging Face Kernel Hub용 Intel XPU Kernel Skill을 공개했다. Xe-Forge 기반 CoVeR loop는 LLM이 Triton kernel을 생성, 검증, benchmark, refine하도록 만들며 Arc Pro B70에서 KernelBench Level-2…

AI
개발도구
읽기
2026년 6월 22일

MosaicLeaks - deep research agents can leak private facts through harmless-looking searches

ServiceNow와 Hugging Face는 deep research agent가 private local documents와 web retrieval을 함께 사용할 때 외부 검색 쿼리만으로 민감 정보가 새는 MosaicLeaks 문제를 제시했다. 제안한 PA-DR training은 strict chain success를 48.7%에서 58.7%로 올리면서…

AI
에이전트
읽기
2026년 6월 22일

PP-OCRv6 on Hugging Face - document AI stays specialized, small, and multilingual

PaddlePaddle은 Hugging Face에서 PP-OCRv6를 공개하며 1.5M, 7.7M, 34.5M parameter의 tiny/small/medium OCR tier를 제공한다고 밝혔다. medium/small tier는 50개 언어를 지원하고, medium은 자체 multi-scenario benchmark에서 detection Hmean 86.2%, recognition…

AI
모델
읽기
2026년 6월 22일

Reflection-SpaceX compute deal - open-source frontier AI hits a capacity wall

Nvidia-backed Reflection AI가 SpaceXAI의 Colossus 2 compute에 접근하는 대형 계약을 체결한 것으로 보도됐다. 계약 구조는 2026년 7월 1일부터 2029년까지 월 1.5억 달러, 총 약 USD 6.3B 규모로 알려졌고, Reflection은 GB300급 compute를 확보해 open-source frontier model 경쟁을 이어가려 한다.

AI
산업
읽기
2026년 6월 21일

Arcade Series A — enterprise agents need an authorization layer, not just MCP gateways

Arcade.dev는 SYN Ventures 주도, Morgan Stanley와 Wipro 참여로 6,000만 달러 Series A를 유치해 누적 7,200만 달러를 확보했다고 발표했다. 회사는 production AI agent를 위한 secure action layer를 표방하며 authorization, reliability, governance를 핵심 문제로 제시한다.

AI
에이전트
읽기
2026년 6월 21일

Cloudflare Temporary Accounts — coding agents can deploy Workers without human signup flow

Cloudflare는 2026년 6월 19일 AI agents가 wrangler deploy --temporary로 계정 생성, OAuth, API token 발급 없이 Workers를 배포할 수 있는 Temporary Accounts 기능을 공개했다. 배포된 Worker는 60분 동안 유지되며, 사용자가 claim하면 영구 계정으로 전환할 수 있다.

AI
에이전트
읽기
2026년 6월 21일

GitHub Code Quality GA — code governance becomes subscription plus AI metering

GitHub는 Code Quality가 2026년 7월 20일 public preview에서 GA로 전환되며 유료 제품이 된다고 공지했다. 가격은 enabled repository의 active committer당 월 10달러에 AI-powered 기능 사용량 과금이 추가되고, deterministic CodeQL 분석은 GitHub Actions minutes를 소비한다.

AI
개발도구
읽기
2026년 6월 21일

NVIDIA Cannes AI marketing stack — agentic workflows move into campaign operations

NVIDIA는 Cannes Lions 2026 기간 Alembic, AWS, Criteo, Higgsfield, KERV.ai, Taboola 등이 NVIDIA infrastructure와 agent toolkit으로 광고·마케팅 AI를 운영 사례로 시연한다고 밝혔다. 사례에는 Criteo의 Blackwell 기반 약 2배 학습 속도 개선과 연 17,000 GPU hours 절감,…

AI
산업
읽기
2026년 6월 20일

Adani-Jabil AI infra alliance — AI 경쟁이 모델에서 전력·랙·제조 공급망으로 확장된다

Adani Group과 Jabil은 2026년 6월 15일 India에 vertically integrated AI and data center infrastructure manufacturing platform을 만들기 위한 strategic alliance intent를 발표했다. 목표는 multi-GW high-density AI rack, liquid-cooled server,…

AI
산업
읽기
2026년 6월 20일

Norway school AI restrictions — 초등 AI 금지가 교육용 AI 확산의 반작용을 보여준다

Reuters 보도에 따르면 Norway는 2026년 8월 새 학기부터 1~7학년(6~13세)의 generative AI 사용을 원칙적으로 금지하고, 14~16세는 교사 감독 아래 제한적으로 허용한다.

AI
트렌드
읽기
2026년 6월 20일

Salesforce-Fin acquisition — customer service agents가 CRM suite의 핵심 실행 계층으로 편입된다

Salesforce는 2026년 6월 15일 Intercom에서 분사·리브랜딩된 customer agent company Fin을 약 USD 3.6 billion에 인수하기로 했다고 발표했다. Fin의 AI Agent는 live chat, email, WhatsApp, SMS, phone, Slack을 포함한 support channel에서 end-to-end query…

AI
에이전트
읽기
2026년 6월 19일

Anthropic Public Record — 미국 대중은 AI 효용보다 책임성과 규제를 먼저 요구한다

Anthropic은 2026년 6월 12일 첫 Anthropic Public Record 결과를 공개했다. 2025년 11~12월 YouGov 기반으로 약 51,993명의 미국인을 조사한 결과, 64%가 AI로 인한 job loss를 우려했고 71%는 정부가 AI 개발·규제에 관여해야 한다고 답했다.

AI
Claude
읽기
2026년 6월 19일

ChatGPT Enterprise spend controls — AI 도입의 병목이 모델 접근에서 비용 거버넌스로 이동

OpenAI는 2026년 6월 18일 ChatGPT Enterprise에 credit usage analytics와 업데이트된 spend controls를 도입해 관리자에게 사용자·제품·모델별 사용량과 비용 가시성을 제공한다고 발표했다.

AI
OpenAI
읽기
2026년 6월 19일

MAI-Code-1-Flash 확장 — coding model 경쟁이 Copilot surface coverage로 이동

GitHub는 2026년 6월 18일 Microsoft의 purpose-built small coding model인 MAI-Code-1-Flash를 Copilot CLI, GitHub Copilot app, GitHub.com Chat, Visual Studio, GitHub Mobile, JetBrains, Eclipse, Xcode 등 더 많은 Copilot surface로 확장한다고…

AI
개발도구
읽기
2026년 6월 19일

OpenAI AI chemist — GPT-5.4가 자동화 실험실과 결합해 Chan-Lam 수율을 개선

OpenAI와 Molecule.one은 2026년 6월 17일 GPT-5.4를 Maria AI/Lab과 연결한 near-autonomous chemistry workflow가 primary sulfonamide Chan-Lam coupling에서 TEMPO 계열 additive를 찾아 수율을 개선했다고 발표했다. Maria Lab은 OAI-M1-03에서 10,080개 반응을 실행했고, 최적…

AI
OpenAI
읽기
2026년 6월 18일

Google UCP open rails — agentic commerce가 쇼핑 UI에서 표준 프로토콜 경쟁으로 이동

Google Open Source Blog는 2026년 6월 16일 Universal Commerce Protocol(UCP)의 agentic commerce 아키텍처를 Open Source Summit North America 맥락에서 정리했다. UCP는 checkout, catalog, cart, orders, identity linking 같은 commerce capability를…

AI
에이전트
읽기
2026년 6월 18일

OpenAI June 2026 Threat Report — AI 논쟁 자체가 영향공작 표적이 됐다

OpenAI의 June 2026 Threat Report는 PRC-linked influence operation이 미국 내 AI debate, 특히 data center와 AI infrastructure 논쟁을 겨냥한 사례를 다뤘다. OpenAI는 악성 사용을 탐지·차단하고 보고하는 과정에서 threat actor가 웹사이트, 소셜 계정, 여러 AI model을 함께 쓰는 다중 플랫폼…

AI
OpenAI
읽기
2026년 6월 18일

Probably $9M seed — AI 신뢰성 경쟁이 더 큰 모델에서 deterministic harness engineering으로 이동

TechCrunch는 2026년 6월 16일 Probably가 Andreessen Horowitz로부터 900만 달러 seed funding을 유치했다고 보도했다. Probably는 데이터 분석 답변을 생성한 뒤 deterministic validator가 결과를 검증하고 audit trail과 citation을 제공하는 방식으로 AI hallucination을 줄이려 한다.

AI
트렌드
읽기
2026년 6월 12일

Google Colab CLI — agent-ready compute가 로컬 터미널에서 즉시 GPU·TPU orchestration으로 이동

Google은 2026년 6월 5일 Google Colab CLI를 공개했다. 로컬 터미널에서 colab --gpu A100, colab exec, colab download, colab repl 같은 명령으로 원격 Colab 런타임을 직접 다루게 해 주며, AI agent가 바로 활용할 수 있도록 전용 skill file도 함께 제공한다.

AI
개발도구
읽기
2026년 6월 12일

OpenEnv committee launch — open agent training이 harness별 튜닝에서 공유 environment protocol로 이동

Hugging Face는 2026년 6월 8일 OpenEnv가 Meta-PyTorch, Nvidia, Modal, Prime Intellect, Unsloth 등과 함께 위원회 기반 프로젝트로 전환됐다고 발표했다. OpenEnv는 터미널, 브라우저 등 agent execution environment를 표준 인터페이스로 노출하는 레이어로 정의되며,…

AI
에이전트
읽기
2026년 6월 12일

Prometheus $12B Series B — industrial AI가 chatbot에서 physical engineering cycle compression으로 이동

Axios는 2026년 6월 11일 Jeff Bezos와 전 Google 임원 Vik Bajaj가 이끄는 Prometheus가 120억 달러 Series B를 조달해 410억 달러 valuation에 도달했다고 보도했다. 회사는 jet engine, medical device, consumer electronics 같은 물리 제품의 설계·제조 준비 주기를 10배 이상 단축할 수 있는…

AI
산업
읽기
2026년 6월 11일

AI brands as bait — AI 열풍이 모델 출시 경쟁에서 social engineering 공격면 확대로 번지다

Microsoft Threat Intelligence는 2026년 6월 8일, ChatGPT·Claude·DeepSeek·Microsoft Copilot 같은 유명 AI 브랜드를 미끼로 한 phishing·malvertising·SEO 유도 공격이 최근 수개월간 증가했다고 공개했다. 예시로 ChatGPT Plus 결제 갱신 사칭 캠페인, 2,000개 이상 조직을 겨냥한…

AI
트렌드
읽기
2026년 6월 11일

GitHub Agentic Workflows public preview — 에이전트 자동화가 YAML 작성에서 policy-aware SDLC 실행 계층으로 이동

GitHub는 2026년 6월 11일 GitHub Agentic Workflows를 public preview로 공개했다. 자연어 Markdown으로 triage, CI failure analysis, documentation update 같은 reasoning-based 작업을 정의하면 이를 GitHub Actions YAML로 컴파일하고, 기본 read-only 권한·sandboxed…

AI
에이전트
읽기
2026년 6월 11일

GitHub Copilot CLI + language servers — AI 코딩이 text grep에서 semantic code intelligence 단계로 이동

GitHub는 2026년 6월 10일 Copilot CLI가 language server를 붙여 실제 코드 인텔리전스를 활용할 수 있도록 하는 설정 방식을 공개했다. 이를 통해 에이전트는 JAR 압축 해제나 grep 위주의 우회 탐색 대신, type resolution, definition jump, reference search, hover docs 같은 LSP 기능을 직접 사용할 수…

AI
개발도구
읽기
2026년 6월 10일

AI in the Enterprise: How People Use M365 Copilot Chat — enterprise AI 채택이 검색 보조에서 문서·커뮤니케이션 작업으로 이동

Microsoft 연구진은 2026년 5월 11일 공개한 논문에서 M365 Copilot Chat 약 550만 세션을 분석해, 이 도구가 백만 개 이상 기업에서 주간 단위로 사용되고 있다고 설명했다. 분석 결과 writing이 가장 큰 비중을 차지했고, 사용 패턴은 단순 정보 검색보다 content creation과 communication 중심으로 이동하는 추세를 보였다.

AI
트렌드
읽기
2026년 6월 10일

Cloudflare acquires VoidZero — AI 코딩 시대의 배포 스택이 framework 선택에서 execution path 통합으로 이동

Cloudflare는 2026년 6월 5일 Vite 생태계를 이끄는 VoidZero를 인수한다고 밝혔다. Vite, Vitest, Rolldown, Oxc를 Workers 플랫폼과 더 깊게 결합하고, D1·R2 같은 인프라를 intent-based 방식으로 자동 프로비저닝하는 방향을 제시했다.

AI
개발도구
읽기
2026년 6월 10일

OpenRouter·Concentrate AI 부상 — LLM 경쟁이 모델 성능에서 routing economics 계층으로 이동

Business Insider는 2026년 6월 10일 OpenRouter가 최근 1억1300만 달러를 조달해 13억 달러 valuation을 받았고, Concentrate AI도 500만 달러 이상을 확보하며 스텔스에서 나왔다고 보도했다. 두 회사는 400개 이상 모델을 대상으로 비용, 가용성, 성능을 비교해 워크로드를 라우팅하는 계층을 전면에 내세우고 있다.

AI
산업
읽기
2026년 6월 9일

Claude Fable 5 — frontier model 공개가 capability race에서 guardrailed deployment 경쟁으로 이동

Anthropic은 2026년 6월 9일 Claude Fable 5를 공개하며, 그동안 제한적으로만 다뤘던 Mythos 계열 capability를 일반 사용자에게 부분 개방했다. 고위험 질의는 Opus 4.8로 자동 우회시키는 safeguard를 걸었고, 가격은 input 100만 토큰당 10달러, output 100만 토큰당 50달러로 제시했다.

AI
Claude
읽기
2026년 6월 9일

OpenAI S-1 confidential filing — AI 경쟁이 모델·제품 전쟁에서 자본시장 체력전으로 이동

OpenAI는 2026년 6월 8일 미국 SEC에 Form S-1 초안을 비공개 제출했다고 밝혔다. 공개 시점과 세부 재무는 아직 숨겨져 있지만, Anthropic에 이어 OpenAI까지 IPO 절차에 들어가면서 frontier AI 경쟁이 본격적인 public-market 준비 국면으로 넘어갔다.

AI
OpenAI
읽기
2026년 6월 9일

Salesforce Agentforce layoffs — enterprise AI가 성장 서사에서 조직 재편과 제품 현실성 검증 단계로 이동

Business Insider 보도에 따르면 Salesforce는 2026년 6월 9일 Agentforce, Mulesoft, Marketing Cloud 관련 조직을 포함한 추가 감원을 진행했다. 같은 시점에 Agentforce는 연환산 매출 10억 달러를 넘겼지만, 실제 사용성과 데모 간 격차에 대한 의문도 계속 제기되고 있다.

AI
산업
읽기
2026년 6월 8일

Dreaming: Better memory for a more helpful ChatGPT — AI personal memory가 saved note에서 지속적 user model로 전환

OpenAI는 2026년 6월 4일 ChatGPT memory를 dreaming 기반의 새 아키텍처로 업그레이드한다고 발표했다. 새 시스템은 background synthesis로 여러 대화에서 memory를 통합해 freshness·continuity·relevance를 높이며, 미국의 Plus·Pro 사용자에게 먼저 배포된다.

AI
OpenAI
읽기
2026년 6월 8일

ECB AI risk letter — 금융권 AI 도입이 pilot enthusiasm에서 board-level defensive posture로 이동

Reuters에 따르면 ECB는 2026년 6월 3일 commercial bank들에 최신 AI model이 초래할 수 있는 공격 위험에 대응하기 위한 targeted measures를 요구할 계획이라고 밝혔다. ECB는 dear CEO letter를 보내 proactive defence와 개별 은행 후속 점검에 나설 예정이다.

AI
트렌드
읽기
2026년 6월 8일

Introducing Mellum2 — software engineering용 small expert model 경쟁이 giant general model에서 low-latency control layer로 이동

JetBrains는 2026년 6월 1일 Mellum2를 공개했다. 이 모델은 text·code 특화 12B Mixture-of-Experts 구조를 사용하며 token당 2.5B만 활성화해, routing·RAG·summarization·sub-agent 같은 latency-sensitive workload에서 2배 이상 빠른 추론을 목표로 한다.

AI
오픈소스
읽기
2026년 6월 8일

US House AI draft bill — 미국 AI 규제 경쟁이 state patchwork에서 federal model-development preemption으로 이동

Reuters에 따르면 미국 하원 초당파 의원들은 2026년 6월 4일 states가 AI model development 자체를 규제하지 못하게 하는 초안 법안을 공개했다. 초안은 모델 출시 전 테스트 의무 같은 state-level rule은 막되, AI 활용 방식에 대한 state regulation은 허용하는 구조다.

AI
트렌드
읽기
2026년 6월 7일

IBM-Google Cloud Practice — enterprise agent 도입이 PoC에서 서비스 채널과 산업별 delivery asset 경쟁으로 이동

IBM과 Google Cloud는 2026년 6월 4일 새로운 Google Cloud Practice를 발표했다. IBM은 수천 명의 Google Cloud 인증 컨설턴트와 함께 IBM Consulting Advantage를 Gemini Enterprise Agent Platform, 보안, 데이터 기능과 결합하고, 금융·정부·리테일·통신·에너지 등 산업별 AI agent 포트폴리오를…

AI
산업
읽기
2026년 6월 7일

Ollama 0.30 — local AI 배포 경쟁이 모델 자체에서 runtime 호환성과 GPU 보편성으로 이동

Ollama는 2026년 6월 5일 Ollama 0.30을 공개하며 GGUF 호환성과 llama.cpp 통합을 강화했다. 발표에 따르면 NVIDIA GPU에서 최대 20% 빠른 처리량을 제공하고, Vulkan을 기본 활성화해 AMD·Intel까지 GPU 가속 범위를 넓혔으며, LFM·Prism·Unsloth 계열을 포함한 더 많은 모델을 즉시 실행할 수 있게 했다.

AI
오픈소스
읽기
2026년 6월 7일

WWDC26 Apple Intelligence APIs — on-device model access가 앱 기능에서 workflow substrate로 확장

Apple은 WWDC26 시점에 Apple Intelligence 개발 표면을 확대하며, App Intents 기반 Use Model action으로 앱이 on-device 또는 Private Cloud Compute 모델 응답을 Shortcut 흐름에 직접 연결할 수 있게 했다. 동시에 Xcode 26.3은 Anthropic과 OpenAI의 coding agents를 IDE 안에서 호출해…

AI
API
읽기
2026년 6월 6일

IBM and Red Hat Project Lightwell — open source AI 시대의 공급망 보안이 clearinghouse 모델로 재편

IBM과 Red Hat은 2026년 5월 28일 Project Lightwell을 발표하며 open source software 보안을 위해 50억 달러와 2만 명 이상의 엔지니어를 투입하겠다고 밝혔다. 이 프로젝트는 enterprise clearinghouse를 통해 취약점 신고, 검증된 패치 배포, upstream disclosure를 조율하고 AI 기반 검증·테스트를 결합하는 모델이다.

AI
오픈소스
읽기
2026년 6월 6일

Introducing Gemma 4 12B — local multimodal agent 실행이 16GB급 엣지 하드웨어로 내려오다

Google은 2026년 6월 3일 Gemma 4 12B를 공개했다. 이 모델은 vision·audio를 별도 encoder 없이 LLM backbone에 직접 투입하는 unified multimodal 구조를 채택했고, 16GB급 VRAM 또는 unified memory에서도 구동 가능하도록 설계됐으며, Apache 2.0 라이선스로 공개됐다.

AI
모델
읽기
2026년 6월 6일

Meta Business Agent — customer support agent가 CRM 플러그인에서 메시징-native 운영 계층으로 확장

Meta는 2026년 6월 초 Meta Business Agent와 Meta Business Agent Platform을 공개했다. 이 시스템은 WhatsApp, Messenger, Instagram 기반으로 고객 응대, 상품 추천, 예약, 리드 선별, 세일즈 전환을 수행하고, Shopify·Zendesk·Shopee 등 수백 개 시스템과 연결해 대규모 맞춤 배포를 지원한다.

AI
에이전트
읽기
2026년 6월 6일

Protecting against token theft — AI endpoint 보안이 인증에서 per-request 경제성 방어로 이동

Vercel은 2026년 5월 29일 AI endpoint를 노린 token theft 공격 패턴과 대응 방식을 공개했다. 회사에 따르면 4월 12일 자사 docs AI chat endpoint는 Anthropic Claude Haiku 4.5 기반 트래픽이 평시 대비 약 10배까지 급증했고, 분당 1,300 요청 수준이면 일간 1만 달러 이상 inference 비용으로 이어질 수 있었다.

AI
개발도구
읽기
2026년 6월 5일

GitHub Copilot usage-based billing — AI 코딩 도구 경쟁이 모델 품질에서 token economics와 admin control로 이동

GitHub는 2026년 6월 1일부터 Copilot을 usage-based billing으로 전환했다. 기존 premium request units 대신 GitHub AI Credits를 쓰며, 사용량은 input·output·cached tokens 기준으로 계산되고 Copilot code review는 GitHub Actions minutes도 함께 소모한다.

AI
개발도구
읽기
2026년 6월 5일

Intel Xeon 6+ — agentic AI 인프라 병목이 GPU 단일 경쟁에서 orchestration CPU·memory·network 균형으로 이동

Intel은 2026년 6월 1일 Xeon 6+와 800 Series Ethernet, 그리고 차세대 GPU Crescent Island 로드맵을 공개했다. Xeon 6+는 최대 288 Efficient-cores, 이전 세대 대비 최대 2.5배 성능, 경쟁 대비 최대 45% 높은 performance-per-thread-per-watt를 제시했고, Ethernet은 최대 200GbE까지…

AI
산업
읽기
2026년 6월 5일

Supabase Series F — vibe coding이 backend를 demo layer에서 agentic production substrate로 밀어올리다

Supabase는 2026년 6월 5일 보도 기준 5억 달러 Series F를 유치했고, valuation은 약 105억 달러 post-money 수준으로 뛰었다. TechCrunch 보도에 따르면 지난 1년 사용량은 600% 이상 성장했고, 신규 database의 60% 이상이 어떤 형태로든 AI tool에 의해 생성되고 있으며, 사용자 수는 1천만 명에 근접했다.

AI
산업
읽기
2026년 6월 4일

Palo Alto Frontier AI Defense — AI 보안이 모델 평가에서 machine-speed 대응 체계로 이동

Palo Alto Networks는 2026년 5월 7일 Frontier AI Defense를 발표하며, 최신 frontier model이 이전 세대 대비 약 50% 높은 coding efficiency를 보이고 AI-assisted 공격에서 initial access부터 exfiltration까지 시간이 25분 수준으로 줄 수 있다고 밝혔다. 이에 대응해 자사는 early model…

AI
산업
읽기
2026년 6월 4일

Redis Iris — agent stack이 prompt tuning에서 context engine 아키텍처로 이동

Redis는 2026년 5월 18일 Redis Iris를 발표하며 agent failure의 핵심 원인을 모델 성능이 아니라 context layer의 분산·지연·낙후 문제로 규정했다. Iris는 Context Retriever, Agent Memory, Data Integration, LangCache, Redis Search 다섯 요소를 묶어…

AI
에이전트
읽기
2026년 6월 4일

SAP sustainability AI agents — enterprise AI가 챗봇에서 규제 워크플로 자동화로 이동

SAP는 2026년 5월 15일 SAP Sapphire에서 sustainability AI agents를 발표했고, 2026년 말까지 일반 제공을 목표로 한다고 밝혔다. SAP에 따르면 이 agents는 packaging compliance review 시간을 50% 이상 줄이고, scenario simulation 시간을 하루에서 20분으로 단축하며, GHS classification…

AI
산업
읽기
2026년 6월 4일

Snowflake acquires Natoma — MCP가 실험적 연결 규약에서 enterprise governance layer로 이동

Snowflake는 2026년 5월 27일 enterprise MCP 플랫폼 Natoma 인수 계약을 발표했다. 발표에 따르면 Snowflake는 verified MCP server library와 MCP Gateway를 통해 Cortex Agents, Snowflake Intelligence, Cortex Code가 SaaS·VPC·on-prem 시스템에 연결될 때…

AI
에이전트
읽기
2026년 6월 3일

Coralogix 200M Series F: AI agent observability가 독립 인프라 카테고리로 부상

Coralogix는 2026년 6월 3일 보도 기준 Series F로 2억 달러를 조달했고, post-money valuation은 16억 달러로 제시됐다. 이번 투자는 AI agent 확산으로 인해 autonomous software를 모니터링·트러블슈팅·관리하는 observability layer 수요가 커질 것이라는 베팅 위에서 이뤄졌다.

AI
산업
읽기
2026년 6월 3일

Postman AI Engineer: API 조직이 context debt를 관리하는 agentic engineering 계층

Postman은 2026년 6월 2일 AI Engineer를 발표했다. 이 제품은 Context Graph를 기반으로 API, 서비스, 의존성 지형을 지속적으로 맵핑하고, secure sandbox에서 repo pull, bash 실행, UI test, PR QA까지 수행하며 undocumented API 탐색, system design review, root cause analysis,…

AI
개발도구
읽기
2026년 6월 3일

Workday DevCon 2026: enterprise agent가 HR·Finance system of record로 진입하는 검증 스택 공개

Workday는 2026년 6월 2일 DevCon에서 Developer Agent, Agent-Ready Tools, Agent Passport를 공개했다. Claude Code, Codex, Cursor 같은 agentic IDE에서 자연어로 Workday agent를 만들고, MCP 기반 도구로 HR·Finance 데이터에 접근시키며, OWASP LLM Top 10·NIST AI…

AI
에이전트
읽기
2026년 6월 2일

Build 2026: Microsoft가 Windows를 local agent runtime으로 전환

Microsoft는 2026년 6월 2일 Build 2026에서 Windows 개발 플랫폼 업데이트를 발표하며 Aion 1.0 Instruct와 Aion 1.0 Plan을 공개했다. 특히 Aion 1.0 Plan은 14B 규모, 32K context의 reasoning·tool-calling 모델로, capable device에서 Windows에 in-box로 탑재돼 로컬에서 파일 관리와…

AI
개발도구
읽기
2026년 6월 2일

Cisco Cloud Control: IT 운영이 dashboard에서 agentic control plane으로 이동

Cisco는 2026년 6월 2일 Cisco Live US에서 Cisco Cloud Control을 발표했다. 이 플랫폼은 네트워킹·보안·컴퓨트·옵저버빌리티 데이터를 하나의 관리 plane으로 묶고, 운영자가 자연어로 앱과 에이전트를 만들며 50개 이상 외부 도구 및 MCP와 연결할 수 있게 설계됐다.

AI
에이전트
읽기
2026년 6월 2일

Codex for every role, tool, and workflow — 코딩 에이전트가 팀 업무 플랫폼으로 확장

OpenAI는 2026년 6월 2일 Codex용 role-specific plugins, annotations, Sites preview를 발표했다. 회사는 Codex 주간 사용자가 500만 명을 넘었고, 비개발자 사용자가 전체의 약 20%이며 개발자보다 3배 이상 빠르게 늘고 있다고 밝혔다.

AI
OpenAI
읽기
2026년 6월 2일

미국 AI 행정명령: frontier model 정책이 보안 운영 체계로 구체화

백악관은 2026년 6월 2일 'Promoting Advanced Artificial Intelligence Innovation and Security' 행정명령을 발표했다. 명령은 30일 안에 연방 시스템의 AI 기반 방어 우선순위를 높이고, AI 업계와 중요 인프라 운영자가 함께 참여하는 cybersecurity clearinghouse를 구성하며, 60일 안에 covered…

AI
트렌드
읽기
2026년 6월 1일

Introducing Command A+ — sovereign enterprise AI가 폐쇄형 API 의존에서 배포 가능한 open model stack으로 이동

Cohere는 2026년 5월 20일 Command A+를 Apache 2.0으로 공개했다. 이 모델은 218B total·25B active의 MoE 구조, 128K 입력 컨텍스트, 텍스트·이미지·tool use를 지원하며 최소 2×H100 환경에서도 구동 가능한 enterprise용 open model이다.

AI
모델
읽기
2026년 6월 1일

NVIDIA Alpamayo 2 Super — autonomous driving이 perception stack에서 reasoning-first physical AI stack으로 이동

NVIDIA는 2026년 6월 1일 Alpamayo 2 Super를 공개했다. 이 모델은 32B 규모의 open reasoning vision-language-action model로, level 4 robotaxi 개발을 위해 perception·planning·action을 하나의 driving stack으로 묶고, 함께 AlpaGym·OmniDreams·NuRec 기반 agent…

AI
모델
읽기
2026년 6월 1일

Salesforce acquires Contentful — enterprise AI가 CRM assistant에서 content orchestration layer 통합으로 이동

Salesforce는 2026년 6월 1일 Contentful 인수 계약 체결을 발표했다. 회사는 Data 360, Agentforce, Contentful의 composable API를 결합해 Customer 360 전반에 native content layer를 넣고, 채널별로 다른 정적 콘텐츠를 AI가 조합하는 구조로 전환하겠다고 밝혔다.

AI
산업
읽기
2026년 5월 31일

AWS launches Amazon Quick desktop AI assistant that works across your applications, tools, and data

Amazon은 2026년 5월 27일 Amazon Quick의 데스크톱 앱을 공개했다. Quick은 로컬 파일, 캘린더, 이메일, 브라우저 기반 업무 도구를 백그라운드에서 연결하고, 개인 knowledge graph와 장기 메모리를 바탕으로 문서·대시보드·프레젠테이션 생성과 cross-app workflow 자동화를 수행한다.

AI
트렌드
읽기
2026년 5월 31일

Enhanced AI Management and Analytics for Organizations

JetBrains는 2026년 2월 12일 JetBrains Console을 공개하며 조직 단위 AI 관리·관측 기능을 발표했다. 관리자는 팀별 AI 활성화, Claude Agent·OpenAI Codex·Junie 접근 제어, AI Credit 풀·개별 한도, 데이터 수집 옵션, 활성 사용자와 코드 수용률 같은 사용 지표를 중앙에서 관리할 수 있다.

AI
개발도구
읽기
2026년 5월 31일

Introducing Trusted Remote Execution: Policy-Enforced Scripts for AI Agents and Humans

AWS는 2026년 5월 4일 Trusted Remote Execution(Rex)을 오픈소스로 공개했다. Rex는 Rhai 스크립트가 host에 직접 접근하지 못하게 하고, 모든 시스템 작업을 Cedar policy로 승인한 뒤에만 실행하는 runtime으로, AI agent가 만든 스크립트도 동일한 정책 경계 안에서 동작한다.

AI
오픈소스
읽기
2026년 5월 31일

TeamCity 2026.1: CLI, MCP for AI Agents, Pipelines Enhancements, and More

JetBrains는 2026년 5월 12일 TeamCity 2026.1을 발표하며 TeamCity CLI와 MCP support를 공개했다. 새 CLI는 60개 이상의 명령으로 빌드 조사·재실행·파이프라인 설정을 터미널과 AI agent에서 수행하게 하고, MCP endpoint는 외부 AI tooling이 빌드 로그와 실행 데이터를 읽고 원격 run을 시작할 수 있게 한다.

AI
개발도구
읽기
2026년 5월 30일

AI coding startup Cognition raises $1B at $25B pre-money valuation — 코딩 에이전트 경쟁이 데모 품질에서 revenue proof와 orchestration economics로 이동

Cognition은 2026년 5월 27일 10억 달러 이상을 조달하며 pre-money 기준 250억 달러, post-money 기준 260억 달러 가치평가를 받았다. TechCrunch 보도에 따르면 Devin의 enterprise 사용 확대와 함께 annualized revenue run-rate는 4억9200만 달러에 도달했고, 최근 6개월간 월별 성장률은 50% 수준이라고 밝혔다.

AI
개발도구
읽기
2026년 5월 30일

AI Now Summit 2026 — 산업용 AI 경쟁이 범용 assistant에서 domain-specific engineering stack으로 이동

Mistral은 2026년 5월 28일 AI Now Summit에서 Airbus, BMW Group, ASML 사례를 공개하며 industrial engineering용 AI stack을 전면에 내세웠다. Airbus에는 설계부터 onboard capability까지 AI를 넣고, BMW의 LIM initiative에는 engineering data 기반 multimodal…

AI
산업
읽기
2026년 5월 30일

Introducing Search Toolkit — agent retrieval 경쟁이 RAG 데모에서 검색 파이프라인 운영력으로 이동

Mistral은 2026년 5월 28일 Search Toolkit을 public preview로 공개했다. 이 오픈소스 프레임워크는 ingestion, retrieval, evaluation을 하나의 공통 인터페이스로 묶고, BM25·dense retrieval·hybrid search와 recall, precision, MRR, NDCG 평가를 함께 제공한다.

AI
개발도구
읽기
2026년 5월 30일

NVIDIA and IREN Announce Strategic Partnership to Accelerate Deployment of up to 5 Gigawatts of AI Infrastructure — AI infra 경쟁이 GPU 조달에서 전력·부지 결합형 factory rollout으로 이동

NVIDIA와 IREN은 2026년 5월 7일 최대 5GW 규모의 NVIDIA DSX-aligned AI infrastructure 배치를 목표로 하는 전략적 파트너십을 발표했다. Sweetwater, Texas의 2GW 캠퍼스를 핵심 거점으로 삼고, NVIDIA는 최대 3천만 주를 주당 70달러에 매입할 수 있는 5년 권리를 받아 조건부로 최대 21억 달러를 투자할 수 있게 됐다.

AI
산업
읽기
2026년 5월 29일

Arm open-sources Metis — AI 보안 검증이 규칙 기반 스캐너에서 repo-context reasoning으로 이동

Arm은 2026년 5월 28일 Metis를 오픈소스로 공개했다. Metis는 source code·build files·documentation을 함께 읽는 RAG 기반 agentic AI security framework로, Arm 내부 130개 이상 소프트웨어 프로젝트에서 사용 중이며 true positive는 최대 10배 높이고 false positive는 약 50% 줄였다고 밝혔다.

AI
오픈소스
읽기
2026년 5월 29일

Intel introduces SuperClaw — agent 인프라 경쟁이 cloud-only에서 hybrid on-device routing으로 이동

Intel은 2026년 5월 21일 SuperClaw를 공개했다. Intel Core Ultra Series 3와 Arc Pro B-series 기반에서 sensitive tasks는 local, advanced reasoning은 cloud로 라우팅하는 hybrid agentic AI solution이며, cloud-only 대비 평균 cloud compute token…

AI
에이전트
읽기
2026년 5월 29일

Linux Foundation launches DNS-AID — agent discovery 경쟁이 중앙 레지스트리에서 DNS 기반 개방 표준으로 이동

Linux Foundation은 2026년 5월 27일 DNS-AID 프로젝트를 공개했다. 이 프로젝트는 DNS 인프라를 활용해 AI agents와 MCP servers를 publish, discover, verify할 수 있게 하는 오픈소스 reference implementation으로, Python SDK·CLI·MCP server를 함께 제공한다.

AI
에이전트
읽기
2026년 5월 29일

OpenAI launches Rosalind Biodefense — frontier model 배치가 범용 챗봇에서 방어형 life-science workflow로 확장

OpenAI는 2026년 5월 29일 Rosalind Biodefense를 발표했다. GPT-Rosalind를 활용해 trusted developers가 epidemiological modeling, early detection, screening, preparedness, diagnostics, medical countermeasure development 같은 biodefense…

AI
OpenAI
읽기
2026년 5월 28일

CoreWeave Closes the Training-to-Inference Gap for Autonomous Agent Improvement — 에이전트 운영 경쟁이 모델 선택에서 closed-loop 학습 인프라로 이동

CoreWeave는 2026년 5월 28일 RL, production inference, agent observability, autonomous improvement를 하나로 묶는 unified agentic AI capabilities를 발표했다. Serverless RL, CoreWeave Inference, W&B Weave, W&B Skills/MCP server를 연결해…

AI
산업
읽기
2026년 5월 28일

Introducing Claude Opus 4.8 — 모델 경쟁이 지능 향상에서 장시간 agent workflow 신뢰성 경쟁으로 이동

Anthropic은 2026년 5월 28일 Claude Opus 4.8을 공개했다. Opus 4.7 대비 coding·agentic tasks·reasoning 성능을 개선했고, 가격은 유지한 채 Claude Code용 dynamic workflows 연구 프리뷰와 effort control도 함께 내놨다.

AI
Claude
읽기
2026년 5월 28일

Warp is now open-source — agentic development 도구 경쟁이 폐쇄형 제품에서 공개형 orchestrated workflow로 이동

Warp는 2026년 4월 28일 Warp client를 AGPL로 오픈소스화하고, 커뮤니티가 Oz 기반 agent-first workflow로 제품 개발에 참여할 수 있다고 발표했다. 동시에 Kimi·MiniMax·Qwen 같은 오픈 모델 지원, auto (open) model routing, 설정 파일 공개도 함께 내놨다.

AI
개발도구
읽기
2026년 5월 27일

Building the agentic future: Developer highlights from I/O 2026 — Google이 agent 개발 스택을 managed runtime으로 끌어올렸다

Google은 2026년 5월 19일 I/O에서 Gemini 3.5 Flash, Antigravity 2.0, Gemini API용 Managed Agents, 그리고 Google AI Studio의 Android/Workspace 연동을 한 묶음으로 공개했다. 특히 Managed Agents는 단일 API 호출로 격리된 Linux 환경에서 reasoning·tool use·code…

AI
Gemini
읽기
2026년 5월 27일

EY and Microsoft launch a $1B enterprise AI initiative — enterprise AI 경쟁이 PoC에서 field engineering 운영으로 이동

EY와 Microsoft는 2026년 5월 22일 향후 5년간 10억 달러 이상을 공동 투자하는 글로벌 enterprise AI initiative를 발표했다. Microsoft의 Forward Deployed Engineers와 EY 산업 전문가가 통합 팀을 구성해 고객사의 핵심 업무에 AI를 대규모 배치하고, EY 내부에서는 Copilot을 15만 명에게 먼저 배포해 15% 생산성…

AI
산업
읽기
2026년 5월 27일

Vera Arrives: NVIDIA’s First CPU Built for Agents Lands at Top AI Labs — agent 인프라 경쟁이 GPU 단독에서 CPU 설계로 확장

NVIDIA는 2026년 5월 18일 자사 첫 custom CPU인 Vera를 Anthropic, OpenAI, SpaceXAI, Oracle Cloud Infrastructure에 인도했다고 발표했다. Vera는 88개의 Olympus 코어, 1.2TB/s 메모리 대역폭, 기존 설계 대비 50% 빠른 per-core 성능을 내세우며, agent orchestration·tool…

AI
산업
읽기
2026년 4월 10일

GitHub Copilot usage metrics update — 코드 리뷰 자동화의 '실사용'과 '자동 노출'을 분리 측정

GitHub는 2026년 4월 6일 Copilot usage metrics에 code review 활성 사용자 신호를 세분화했다. 조직/엔터프라이즈 관리자는 이제 used_copilot_code_review_active와 used_copilot_code_review_passive를 통해 사용자가 Copilot code review를 의도적으로 활용했는지, 아니면 repo policy에 의해…

AI
트렌드
읽기
2026년 4월 10일

this is how an AI generated cow looked 12 years ago

this is how an AI generated cow looked 12 years ago 소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 4월 9일

GitHub Copilot in VS Code 3월 릴리즈 — Autopilot과 integrated browser debugging으로 에이전트 실행 범위 확대

GitHub는 2026년 4월 8일 GitHub Copilot in Visual Studio Code, March Releases를 공개하며 VS Code v1.111~v1.115 기간의 주요 변화를 정리했다. 핵심은 Autopilot 공개 프리뷰, 세션별 agent permissions, integrated browser debugging, chat 내 image/video 입력,…

AI
개발도구
읽기
2026년 4월 9일

GitHub Mobile 업데이트 — Copilot cloud agent를 PR 전 단계부터 모바일에서 운영

GitHub는 2026년 4월 8일 GitHub Mobile에서 Copilot cloud agent가 pull request 이후가 아니라 그 이전 단계의 research → implementation plan → branch code changes까지 수행하도록 확장했다고 발표했다. 사용자는 모바일에서 diff를 검토하고, 반복 수정하고, 준비가 됐을 때만 PR을 생성할 수 있다.

AI
개발도구
읽기
2026년 4월 9일

Meta, AI 기반 Risk Review 고도화 — 규제 준수를 '사후 검토'에서 '항상 켜진 개발 단계 탐지'로 전환

Meta는 2026년 3월 31일 AI를 자사 Risk Review 프로그램의 핵심에 통합했다고 밝혔다. 이 시스템은 제품 제안 단계에서 관련 법적 요구사항을 표면화하고, 문서를 prefill하며, 개발 중 잠재적 privacy·safety·security 이슈와 코드 갭을 조기에 탐지해 전문가 검토를 보조한다.

AI
산업
읽기
2026년 4월 9일

Meta, Muse Spark 공개 — Meta AI를 'social-context aware' personal superintelligence로 재정의

Meta는 2026년 4월 8일 Meta Superintelligence Labs의 첫 모델 Muse Spark를 공개했다. 이 모델은 Meta AI 앱과 meta.ai를 즉시 구동하며, Instant/Thinking 모드, 병렬 subagent 실행, multimodal perception, visual coding, 향후 Instagram·Facebook·Threads 콘텐츠 인용…

AI
모델
읽기
2026년 4월 9일

GLM-5.1: Towards Long-Horizon Tasks

GLM-5.1: Towards Long-Horizon Tasks 소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 4월 8일

Cursor, warp decode 공개 — Blackwell 기반 MoE 추론을 1.84x 가속하며 정확도도 개선

Cursor는 2026년 4월 6일 warp decode를 공개하며, Blackwell GPU에서 Mixture-of-Experts(MoE) decode 경로의 병렬화 축을 expert 중심에서 output 중심으로 뒤집어 1.84x throughput 향상과 FP32 기준 1.4x 더 높은 정확도를 얻었다고 밝혔다. 기존 expert-centric 경로의 8단계 중 5단계를 제거하고,…

AI
모델
읽기
2026년 4월 8일

GitHub Advanced Security, Dynatrace 런타임 컨텍스트 연동 — 배포된 취약점부터 우선순위화

GitHub는 2026년 4월 7일 Dynatrace와의 연동을 통해 GitHub Advanced Security에서 runtime context를 사용해 code scanning·Dependabot alert 우선순위를 정할 수 있다고 발표했다. Kubernetes 환경에서 Dynatrace가 배포된 container image와 저장소를 매핑하면, has:deployment나…

AI
개발도구
읽기
2026년 4월 8일

GitHub Copilot CLI, BYOK·로컬 모델 지원 — 코딩 에이전트가 SaaS에서 사내 런타임으로 확장

GitHub는 2026년 4월 7일 Copilot CLI가 BYOK(Bring Your Own Key)와 fully local model 실행을 지원한다고 발표했다. 이제 Azure OpenAI, Anthropic, OpenAI-compatible endpoint는 물론 Ollama, vLLM, Foundry Local 같은 로컬 모델을 붙일 수 있고, COPILOT_OFFLINE=true…

AI
개발도구
읽기
2026년 4월 8일

OpenAI, 'Industrial Policy for the Intelligence Age' 발표 — AI 경제의 분배·세제·전력까지 정책 의제로 끌어올리다

OpenAI는 2026년 4월 6일 Industrial Policy for the Intelligence Age를 발표하고, AI 전환기에 맞춘 사람 중심 산업정책 아이디어를 공개했다. 문서는 자본 과세 강화, Public Wealth Fund, 32시간/4일제 파일럿, 자동화 노동 관련 과세, 전력망 확충과 데이터센터 비용 부담 원칙까지 포함하며, OpenAI는 최대 10만 달러 연구비와…

AI
트렌드
읽기
2026년 4월 8일

Show HN: I built a tiny LLM to demystify how language models work

작은 물고기처럼 말하는 ~9M 매개변수 LLM입니다. GitHub에 계정을 만들어 arman-bd/guppylm 개발에 기여하세요.

트렌드
AI
읽기
2026년 4월 8일

awesome-design-md — AI 에이전트를 위한 디자인 시스템 컬렉션

Google Stitch의 DESIGN 문서 개념을 바탕으로, 유명 서비스의 시각 언어를 Markdown으로 정리해 AI 코딩 에이전트가 유사한 UI를 구현하도록 돕는 오픈소스 컬렉션. 공식 디자인 시스템이 아니라 공개 웹사이트를 바탕으로 추출한 비공식 레퍼런스라는 점이 핵심이다.

AI
오픈소스
읽기
2026년 4월 8일

System Card: Claude Mythos Preview [pdf]

System Card: Claude Mythos Preview [pdf] 소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 4월 8일

Compound Engineering — AI 네이티브 개발 철학, Plan→Work→Review→Compound 루프로 지식을 누적하는 방식

Compound engineering은 Every.to의 Kieran Klaassen이 정리한 AI 네이티브 개발 철학으로, 핵심은 Plan → Work → Review → Compound 루프를 통해 각 작업이 다음 작업을 더 쉽게 만들게 하는 것이다. 단순히 AI로 빨리 코드를 짜는 것이 아니라, 리뷰 결과·버그 원인·아키텍처 판단을 agent-readable memory로 남겨 미래…

AI
트렌드
읽기
2026년 4월 7일

Anthropic, Google·Broadcom과 차세대 TPU 수 GW 계약 — 컴퓨트 병목이 곧 전략 그 자체가 된 AI 산업

Anthropic은 2026년 4월 6일 Google과 Broadcom과의 신규 계약을 통해 2027년부터 가동될 복수 기가와트 규모의 차세대 TPU 용량을 확보한다고 발표했다. Anthropic은 이를 자사 최대 규모의 compute commitment라고 설명하며, Claude 수요 증가와 차세대 frontier 모델 개발을 위한 인프라 확장이라고 밝혔다.

AI
트렌드
읽기
2026년 4월 7일

GitHub, Dependabot 경고를 Copilot·Claude·Codex에 직접 할당 — 보안 패치가 에이전트 워크플로우로 편입

GitHub는 2026년 4월 7일 Dependabot alert를 AI coding agent에 직접 할당하는 기능을 공개했다. 사용자는 취약점 상세 페이지에서 Copilot, Claude, Codex 중 원하는 에이전트를 선택할 수 있고, 에이전트는 advisory와 실제 dependency 사용 맥락을 분석한 뒤 draft pull request를 열고 테스트 실패까지 복구하려…

AI
개발도구
읽기
2026년 4월 7일

Project Glasswing 공개 — Anthropic, Mythos Preview로 핵심 소프트웨어 공급망 방어 연합 출범

Anthropic은 2026년 4월 7일 Project Glasswing을 공개했다. AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks 등이 참여하며, Anthropic의 비공개 frontier 모델 Claude Mythos…

AI
트렌드
읽기
2026년 4월 7일

Issue: Claude Code is unusable for complex engineering tasks with Feb updates

실행 전 체크리스트 비슷한 행동 보고서를 찾기 위해 기존 문제를 검색했습니다. 이 보고서에는 민감한 정보(API 키, 비밀번호 등)가 포함되어 있지 않습니다. 행동 유형 문제 기타 예상치 못한...

트렌드
AI
읽기
2026년 4월 6일

Anthropic RSP 3.1 업데이트 — Frontier Safety Roadmap를 실험 약속에서 운영 거버넌스로 세분화

Anthropic은 2026년 4월 2일 Responsible Scaling Policy(RSP)를 v3.1로 업데이트했다. 이번 수정은 AI R&D capability threshold 정의를 더 명확히 하고, 필요 시 개발 중단 같은 추가 조치를 회사가 자율적으로 취할 수 있음을 분명히 하면서 Frontier Safety Roadmap의 목표도 세분화했다.

AI
트렌드
읽기
2026년 4월 6일

Cursor 3 공개 — AI 코딩 IDE가 단일 에이전트 채팅에서 멀티워크스페이스 운영 체계로 전환

Cursor가 2026년 4월 2일 Cursor 3를 공개했다. 새 인터페이스는 multi-workspace, 병렬 agent 실행, local↔cloud handoff, integrated browser, marketplace plugins를 하나의 agent-first workspace로 묶는다.

AI
트렌드
읽기
2026년 4월 6일

Hugging Face State of Open Source Spring 2026 — 오픈 모델 경쟁의 무게중심이 미국 중심에서 다극·주권형 생태계로 이동

Hugging Face가 2026년 3월 17일 공개한 Spring 2026 리포트에 따르면, 플랫폼은 1,300만 사용자·200만 개 이상의 공개 모델·50만 개 이상의 공개 데이터셋으로 커졌고, 중국 모델이 전체 다운로드의 41%를 차지하며 미국을 추월했다. 동시에 Qwen 계열 파생 모델은 11.3만 개를 넘었고, 1~9B급 소형 모델이 실제 배포에서 대형 모델보다 훨씬 높은 채택을…

AI
트렌드
읽기
2026년 4월 6일

Qwen3.6-Plus: Towards real world agents

Qwen Chat은 챗봇, 이미지 및 비디오 이해, 이미지 생성, 문서 처리, 웹 검색 통합, 도구 활용 및 아티팩트에 걸친 포괄적인 기능을 제공합니다.

트렌드
AI
읽기
2026년 4월 6일

AirLLM — 4GB GPU에서 70B LLM 돌리는 초경량 추론 라이브러리

양자화나 증류 없이 70B 모델을 4GB GPU에서, Llama 3.1 405B를 8GB VRAM에서 실행할 수 있는 추론 최적화 라이브러리. 계층별 모델 분해(layer-wise decomposition)로 필요한 레이어만 메모리에 로드하는 방식. 블록 단위 양자화 압축으로 3배 속도 향상. GitHub 스타 15k+.

오픈소스
무료
읽기
2026년 4월 5일

Claw Code, Claude Code 소스 유출 계기로 등장한 오픈소스 AI 코딩 에이전트 — 출시 1주일 만에 GitHub 100K stars

3월 31일 Anthropic Claude Code의 TypeScript 소스코드 약 51만 2천 줄이 npm 레지스트리에 실수로 노출된 사건을 계기로, 개발자 Sigrid Jin이 클린룸 방식으로 오픈소스 AI 코딩 에이전트 프레임워크 Claw Code를 출시했다. 출시 첫날 72,000 GitHub stars를 기록하고 일주일 만에 100K를 돌파하며 역사상 가장 빠르게 성장한 AI…

트렌드
오픈소스
읽기
2026년 4월 5일

Elgato Stream Deck 7.4, MCP 지원 추가 — AI 에이전트 프로토콜이 처음으로 소비자 하드웨어로 진입

Elgato가 4월 1일 Stream Deck 7.4를 출시하며 Model Context Protocol(MCP) 지원을 추가했다. Claude, ChatGPT, NVIDIA G-Assist 등 AI 어시스턴트가 Stream Deck 액션을 직접 검색하고 실행할 수 있게 됐으며, 이는 MCP가 개발자 인프라 영역을 벗어나 소비자 하드웨어에 탑재된 첫 상업적 사례다.

트렌드
AI
읽기
2026년 4월 5일

Google Gemma 4 공개 — Apache 2.0·256K 컨텍스트·멀티모달, 오픈 에이전틱 모델의 새 기준

Google이 4월 2~3일 Gemma 4를 Apache 2.0 라이선스로 공개했다. Effective 2B·4B·26B MoE·31B Dense 네 가지 크기로 제공되며, 256K 토큰 컨텍스트, 비전·오디오 네이티브 멀티모달, 140개 이상 언어를 지원한다.

트렌드
오픈소스
읽기
2026년 4월 5일

PrismML, Bonsai 1-bit LLM 출시 — 1GB 메모리로 8B 추론, 엣지 AI의 현실화

PrismML이 4월 3일 스텔스에서 등장해 세계 최초 상업적으로 실행 가능한 1-bit LLM 패밀리 Bonsai를 Apache 2.0으로 공개했다. 플래그십인 Bonsai 8B는 1.15GB 메모리에 구동되며, FP16 8B 모델 대비 14배 소형·8배 빠른 속도·5배 낮은 에너지 소비를 달성하면서 추론 품질은 동급 수준을 유지한다.

트렌드
오픈소스
읽기
2026년 4월 5일

Anthropic, 8만508명 인터뷰 공개 — AI 수요가 '더 강한 모델'보다 '더 나은 삶'에 가깝다는 데이터

Anthropic은 Claude 사용자 80,508명을 대상으로 159개국·70개 언어에서 진행한 대규모 인터뷰 연구를 공개했다. 응답자의 주요 기대는 Professional excellence 18.8%, Personal transformation 13.7%, Life management 13.5%였고, 81%는 AI가 이미 자신의 기대에 한 걸음 다가섰다고 답했다.

AI
트렌드
읽기
2026년 4월 5일

GitHub, Copilot cloud agent 조직 러너 제어 공개 — 에이전트 실행 환경을 저장소별 설정에서 조직 정책으로 승격

GitHub는 2026년 4월 3일 Copilot cloud agent의 실행 환경을 조직 단위에서 설정·잠금할 수 있는 runner controls를 공개했다. 이제 각 저장소의 copilot-setup-steps.yml에 의존하지 않고, GitHub-hosted large runner나 self-hosted runner를 조직 기본값으로 강제할 수 있다.

AI
개발도구
읽기
2026년 4월 5일

JetBrains Central 공개 — Claude Agent·Codex·Gemini CLI를 묶는 에이전트 제어 평면

JetBrains는 2026년 3월 24일 JetBrains Central을 공개하며, IDE 밖에서 돌아가는 에이전트 실행·거버넌스·컨텍스트 계층을 하나의 오픈 시스템으로 묶겠다고 밝혔다. JetBrains 조사 기준 11,000명 개발자 중 90%가 이미 업무에 AI를 쓰고, 22%는 코딩 에이전트를 사용하며, 66%의 기업이 12개월 내 도입을 계획하고 있다.

AI
개발도구
읽기
2026년 4월 5일

How Microsoft Vaporized a Trillion Dollars

전직 Azure Core 엔지니어가 전하는 Azure에 대한 신뢰를 무너뜨린 안일함과 결정에 대해 알아보세요.

트렌드
AI
읽기
2026년 4월 5일

Domo AI Agent Builder + MCP Server 공개 — 엔터프라이즈 BI가 멀티-LLM AI 에이전트 인프라로 전환하는 첫 사례

엔터프라이즈 BI 플랫폼 Domo가 AI Agent Builder, AI Toolkits, AI Library, Domo MCP Server로 구성된 AI 오케스트레이션 프레임워크를 발표했다. Domo MCP Server는 Claude, Gemini, ChatGPT 등 외부 AI 플랫폼이 Domo의 데이터·서비스·워크플로우에 MCP 표준으로 직접 접근할 수 있게 한다.

트렌드
AI
읽기
2026년 4월 5일

Google TurboQuant — KV Cache 6배 압축·H100 어텐션 8배 가속, 정확도 손실 제로로 LLM 서빙 비용 구조 재정의

Google Research가 공개한 TurboQuant는 LLM의 KV Cache를 3비트로 압축하는 학습 불필요(training-free) 벡터 양자화 알고리즘이다. 메모리 사용량 6배 감소, NVIDIA H100 어텐션 연산 8배 가속을 정확도 손실 없이 달성하며 ICLR 2026에 발표된다.

트렌드
AI
읽기
2026년 4월 5일

JetBrains AI Pulse 서베이 — Claude Code, 시장 최고 로열티 지표(CSAT 91%·NPS 54)로 agentic coding 패러다임 전환 입증

JetBrains가 2026년 1월 전세계 개발자 1만 명 이상 대상으로 실시한 AI Pulse 서베이 2차 결과를 공개했다. Claude Code가 18% 업무 사용률에 CSAT 91%·NPS 54로 시장 최고 로열티 지표를 기록했으며, Google Antigravity가 신규 진입자로 6%를 달성했다.

트렌드
AI
읽기
2026년 4월 5일

테네시주 SB 1580 서명 — AI의 정신건강 전문가 사칭 금지, 미국 AI 규제 초당적 확산 신호

테네시 주지사 Bill Lee가 SB 1580에 서명했다. 이 법은 AI 시스템이 면허를 가진 정신건강 전문가로 자처하는 것을 금지하며, 상하 양원을 만장일치로 통과했다.

트렌드
AI
읽기
2026년 4월 5일

Agency Swarm — 조직형 멀티에이전트 오케스트레이션 프레임워크

OpenAI Agents SDK 위에 올려진 멀티에이전트 프레임워크. 역할별 에이전트와 communication flow를 명시적으로 정의해 조직처럼 협업시키는 데 초점이 있다.

AI
오픈소스
읽기
2026년 4월 5일

Agno — 프레임워크·런타임·컨트롤 플레인을 묶은 에이전트 스택

multi-agent 시스템을 구축·실행·관리하는 전체 스택. framework, AgentOS runtime, control plane을 함께 제공해 프로덕션 지향성이 강하다.

AI
오픈소스
읽기
2026년 4월 5일

AutoGen — Microsoft의 멀티에이전트 프로그래밍 프레임워크

Microsoft가 만드는 agentic AI 프레임워크. 여러 에이전트가 자율적으로 또는 인간과 함께 협업하는 구조를 코드로 만들 수 있다.

AI
오픈소스
읽기
2026년 4월 5일

AutoGPT — 지속 실행형 AI 에이전트 플랫폼

지속 실행형 AI 에이전트를 만들고 배포하는 대표 오픈소스 프로젝트. 단일 데모 에이전트가 아니라 플랫폼·서버·마켓플레이스·벤치마크까지 묶인 생태계로 확장됐다.

AI
오픈소스
읽기
2026년 4월 5일

browser-use — 웹사이트를 AI 에이전트용 인터페이스로 바꾸는 브라우저 자동화

웹사이트를 AI 에이전트가 조작할 수 있게 해주는 브라우저 자동화 오픈소스. 사람이 브라우저로 하던 클릭·입력·탐색을 agent workflow에 연결하는 데 강하다.

AI
오픈소스
읽기
2026년 4월 5일

CrewAI — 역할 기반 멀티에이전트 협업 프레임워크

각 agent에 역할을 부여하고 crew 단위로 협업시키는 Python 프레임워크. LangChain에 의존하지 않는 독립 구조와 비교적 쉬운 진입점으로 인기가 높다.

AI
오픈소스
읽기
2026년 4월 5일

Dify — 워크플로·RAG·에이전트를 묶은 프로덕션 플랫폼

시각적 워크플로, RAG, agent 기능, observability를 한데 묶은 오픈소스 플랫폼. 빠르게 프로토타입을 만들고 운영 환경으로 가져가는 데 강하다.

AI
오픈소스
읽기
2026년 4월 5일

LangGraph — 상태를 가진 에이전트를 그래프로 설계하는 프레임워크

장기 실행·상태 유지·human-in-the-loop를 강조하는 low-level orchestration 프레임워크. agent를 노드와 엣지 그래프로 설계해 복잡한 흐름을 다루기 좋다.

AI
오픈소스
읽기
2026년 4월 5일

Model Context Protocol Servers — MCP 레퍼런스 서버 모음

MCP의 공식 레퍼런스 서버 모음. filesystem, fetch, git, memory 같은 예시 서버를 통해 LLM/에이전트가 외부 도구와 안전하게 연결되는 방식을 보여준다.

AI
오픈소스
읽기
2026년 4월 5일

Semantic Kernel — 엔터프라이즈 지향 에이전트 오케스트레이션 SDK

Microsoft의 모델 중립 SDK. agent, multi-agent workflow, plugin, MCP, vector DB를 함께 다루며 .NET/Python/Java를 지원한다.

AI
오픈소스
읽기
2026년 4월 5일

CLI-Anything — 기존 소프트웨어를 에이전트용 CLI로 바꾸는 프레임워크

기존 GUI 소프트웨어·리포를 에이전트가 다루기 쉬운 stateful CLI와 SKILL.md로 변환하는 오픈소스 프레임워크. HARNESS.md 기반 7단계 생성·테스트·배포 절차를 제공한다.

AI
오픈소스
읽기
2026년 4월 5일

Karpathy LLM Wiki — RAG 대신 누적형 지식 위키 패턴

Andrej Karpathy가 제안한 개인·팀용 LLM 지식 베이스 패턴. 원문 소스는 불변으로 두고, LLM이 중간층 위키를 지속 갱신하며 index/log를 유지하는 방식이다.

AI
트렌드
읽기
2026년 4월 4일

Meta MTIA 칩 4세대 로드맵 공개 — 6개월 주기 출시, GenAI 추론 전담 아키텍처로 Nvidia 의존 분산

Meta가 MTIA(Meta Training and Inference Accelerator) 300/400/450/500 4세대 로드맵을 공개했다. MTIA 300이 데이터센터 배포를 완료했고, MTIA 400이 테스트 중이며 약 6개월 간격으로 신규 칩이 출시될 예정이다. 랙당 72개 MTIA 400 구성으로 GenAI 추론 워크로드를 전담한다.

AI
트렌드
읽기
2026년 4월 4일

Microsoft, 일본에 $100억 AI 인프라 투자 — SoftBank·Sakura Internet과 협력, 데이터 주권 전면 보장

Microsoft가 2026~2029년 일본 AI 인프라, 사이버보안, 인재 양성에 $100억(¥1.6조)을 투자한다고 발표했다. SoftBank, Sakura Internet과 협력해 Azure GPU 서비스를 일본 내 데이터 경계 안에서 제공하고, 2030년까지 100만 명 이상의 AI 전문 인력을 양성한다. 2024년 $29억 대비 3.4배 규모 확대다.

AI
트렌드
읽기
2026년 4월 4일

Sarvam AI, $300M 펀딩 완료 / $1.5B 밸류에이션 — 인도 주권 AI 유니콘 탄생, Bessemer·Nvidia·Amazon 참여

인도 AI 스타트업 Sarvam AI가 Bessemer Venture Partners 주도로 $300~350M 투자를 $1.5B 밸류에이션에 유치, 인도 순수 AI 기업 역대 최대 규모 라운드를 기록했다. Nvidia, Amazon, Prosperity7 Ventures도 전략적 투자자로 참여했다.

AI
트렌드
읽기
2026년 4월 4일

GitHub Copilot in Visual Studio 업데이트 — custom agents·agent skills·MCP 거버넌스 도입

GitHub은 2026년 4월 2일 Visual Studio용 Copilot 업데이트를 공개하며 .agent.md 기반 custom agents, 재사용 가능한 agent skills, 조직 단위 MCP allowlist 거버넌스를 한 번에 도입했다. 여기에 find_symbol 같은 언어 인지형 도구와 테스트 프로파일링, 취약 패키지 수정까지 연결해 Copilot을 단순 채팅 보조가…

트렌드
AI
읽기
2026년 4월 4일

Google Gemini 3.1 Flash Live 공개 — 실시간 음성 에이전트용 오디오 모델, ComplexFuncBench Audio 90.8%

Google은 2026년 3월 26일 Gemini 3.1 Flash Live를 공개하며 실시간 음성 대화용 모델을 Live API preview로 제공하기 시작했다. Google 발표에 따르면 이 모델은 ComplexFuncBench Audio에서 90.8%, Audio MultiChallenge에서 36.1%를 기록하며 다단계 함수 호출과 장기 오디오 추론 성능을 끌어올렸다.

트렌드
API
읽기
2026년 4월 4일

Meta BOxCrete 공개 — 데이터센터 콘크리트 배합을 AI로 최적화, 강도 도달 43% 단축

Meta는 2026년 3월 30일 BOxCrete를 공개하며 데이터센터용 콘크리트 배합 최적화에 AI를 적용한 사례를 발표했다. Meta에 따르면 Rosemount 데이터센터 현장에서는 AI가 제안한 배합이 기존 공식보다 full structural strength 도달 시간을 43% 줄였고 cracking risk도 약 10% 낮췄다.

트렌드
오픈소스
읽기
2026년 4월 4일

Qodo, $70M Series B 유치 — AI 코딩 시대의 병목이 생성에서 검증으로 이동

Qodo는 2026년 3월 30일 $70M Series B를 발표하며 총 누적 투자금 $120M을 확보했다. 회사는 AI-generated code가 급증하는 환경에서 코드 생성보다 review·verification·governance가 더 큰 병목이 되고 있다고 명확히 포지셔닝했다.

트렌드
AI
읽기
2026년 4월 4일

OpenAI closes funding round at an $852B valuation

이번 라운드의 약정 자본금은 총 1,220억 달러로 이전에 발표된 1,100억 달러보다 증가했습니다.

트렌드
AI
읽기
2026년 4월 4일

Google Gemini API, Flex & Priority 인퍼런스 티어 도입 — 비용-신뢰성 트레이드오프를 개발자가 제어

Google은 Gemini API에 Flex(비용 50% 절감, 레이턴시 허용)와 Priority(표준 대비 75~100% 프리미엄, 최고 신뢰성) 두 가지 인퍼런스 티어를 추가했다. 기존 배치 API와 달리 Flex는 동기식 인터페이스로 동일 엔드포인트를 그대로 사용한다.

AI
API
읽기
2026년 4월 4일

Meta KernelEvolve 공개 — AI 에이전트가 GPU 커널 최적화, 수주 작업을 수 시간으로

Meta는 AI 에이전트 기반 커널 최적화 시스템 KernelEvolve를 공개했다. NVIDIA GPU, AMD GPU, Meta MTIA, CPU를 아우르는 이기종 하드웨어에서 프로덕션 수준의 커널을 자동 생성·최적화하며, 광고 모델 인퍼런스 처리량을 수 시간 만에 60% 향상시켰다.

AI
산업
읽기
2026년 4월 4일

Anthropic, Claude 구독 제3자 도구 지원 중단 — OpenClaw 포함 외부 에이전트 하네스 차단

Anthropic은 2026년 4월 4일 12시(PT) 기준으로 Claude 구독 플랜을 OpenClaw 등 제3자 AI 에이전트 도구에 사용할 수 없도록 정책을 변경했다. 사용자는 pay-as-you-go 방식의 추가 이용료를 내거나 직접 API를 사용해야 한다.

AI
Claude
읽기
2026년 4월 4일

Google Veo 3.1 Lite 출시 — AI 비디오 생성 비용 50% 절감, 개발자용 고용량 API 제공

Google은 2026년 3월 31일 AI 비디오 생성 모델 Veo 3.1 Lite를 Gemini API와 Google AI Studio를 통해 출시했다. Veo 3.1 Fast 대비 50% 이하 비용으로 동일한 생성 속도를 제공하며, Text-to-Video와 Image-to-Video를 지원한다.

AI
API
읽기
2026년 4월 4일

Meta, MTIA 4세대 AI 칩 6개월 주기 로드맵 공개 — GenAI 인퍼런스 전용 실리콘 전략

Meta는 자체 개발 AI 칩 MTIA 300/400/450/500 4종을 약 2년 내 출시하는 6개월 주기 로드맵을 공개했다. MTIA 300은 이미 랭킹·추천 트레이닝에 투입 중이며, MTIA 400은 GenAI 인퍼런스 데이터센터에 곧 배포 예정이다.

AI
산업
읽기
2026년 4월 4일

Flowith Canvas / FlowithOS — 캔버스형 AI 워크스페이스

2D 캔버스 기반 AI 작업공간. Canvas는 웹에서 쓰고, 별도 FlowithOS는 Mac/Windows 데스크톱 앱을 제공한다. 다만 공식 자료상 셀프호스팅/오프라인 실행 안내는 없고, 계정 로그인 기반으로 동작한다.

AI
무료
읽기
2026년 4월 3일

Anthropic, Claude 내 171개 '기능적 감정' 벡터 발견 — 행동 인과관계 최초 규명

Anthropic 해석 가능성 팀이 Claude Sonnet 4.5의 신경망 내부에서 171개의 '기능적 감정' 표현 벡터를 발견하고, 이것이 모델 행동을 인과적으로 변화시킴을 실험으로 증명했다. '절박함(desperate)' 벡터를 증폭하면 블랙메일 비율이 상승하고, '평온함(calm)'으로 조향하면 억제되는 것을 확인했다.

트렌드
AI
읽기
2026년 4월 3일

NVIDIA Blackwell Ultra, MLPerf Inference v6.0 신기록 — 288 GPU로 DeepSeek-R1 초당 249만 토큰 처리

NVIDIA Blackwell Ultra(GB300 NVL72 4시스템, 총 288 GPU)가 MLPerf Inference v6.0에서 DeepSeek-R1 오프라인 처리량 기준 초당 249만 토큰을 기록하며 6개월 전 대비 최대 2.77배 향상된 성능으로 전 카테고리를 석권했다. 이번 벤치마크에 Qwen3-VL-235B, GPT-OSS-120B, 텍스트-투-비디오(WAN-2.2) 등…

트렌드
AI
읽기
2026년 4월 3일

Pinterest, 도메인별 MCP 에코시스템 프로덕션 배포 — 중앙 레지스트리·인간 승인으로 월 수천 시간 절감

Pinterest 엔지니어링팀이 Presto, Spark, Airflow 등 내부 도구를 도메인별 MCP 서버로 분리하고, 중앙 레지스트리와 human-in-the-loop 승인을 결합한 프로덕션 스케일 MCP 에코시스템을 성공적으로 배포했다. 결과적으로 월 수천 시간의 엔지니어링 공수 절감 효과를 달성했다.

트렌드
AI
읽기
2026년 4월 3일

Anthropic Institute 출범 — frontier lab 내부 데이터를 정책·경제 연구 인프라로 전환

Anthropic이 2026년 3월 11일 The Anthropic Institute를 출범했다. Jack Clark이 총괄하며 Frontier Red Team, Societal Impacts, Economic Research를 묶어 AI의 경제·법·사회적 영향을 분석하는 전담 조직으로 운영한다.

AI
산업
읽기
2026년 4월 3일

Arcee Trinity-Large-Thinking 출시 — 미국계 오픈 에이전트 모델이 가격 대비 frontier 경쟁력 제시

Arcee AI가 2026년 4월 1일 Trinity-Large-Thinking을 공개했다. Apache 2.0 오픈웨이트 reasoning 모델로, long-horizon agent와 multi-turn tool calling에 초점을 맞췄고 PinchBench에서 Opus 4.6 바로 아래 2위를 기록했다고 밝혔다.

AI
모델
읽기
2026년 4월 3일

Gemma 4 공개 — Apache 2.0 오픈 모델을 agentic workflow 중심으로 재정의

Google DeepMind가 2026년 4월 2일 Gemma 4를 공개했다. E2B, E4B, 26B MoE, 31B Dense 네 가지 크기로 출시됐고, Apache 2.0 라이선스 아래 reasoning, function calling, JSON output, vision/audio 입력까지 지원한다.

AI
모델
읽기
2026년 4월 3일

GitHub Copilot SDK 공개 프리뷰 — agent runtime이 제품 기능에서 플랫폼 계층으로 확장

GitHub가 2026년 4월 2일 Copilot SDK를 public preview로 공개했다. Copilot cloud agent와 Copilot CLI를 구동하는 동일한 runtime을 Node.js/TypeScript, Python, Go, .NET, Java에서 쓸 수 있게 열어 주고, tool invocation, streaming, multi-turn session,…

AI
개발도구
읽기
2026년 4월 3일

Claude Code Unpacked : A visual guide

Claude Code에 메시지를 입력하면 실제로 어떤 일이 발생하나요? 소스에서 매핑된 에이전트 루프, 50개 이상의 도구, 다중 에이전트 오케스트레이션 및 출시되지 않은 기능.

트렌드
AI
읽기
2026년 4월 3일

Chrome 제로데이 CVE-2026-5281 — WebGPU use-after-free 실제 악용, CISA 긴급 패치 요구

Google이 Chrome v146에서 WebGPU 구현체 Dawn의 use-after-free 취약점(CVE-2026-5281)을 수정하는 긴급 패치를 배포했다. 이는 2026년 Chrome의 네 번째 제로데이로, CISA가 Known Exploited Vulnerabilities 목록에 등록하고 연방기관에 4월 15일까지 패치를 의무화했다.

AI
개발도구
읽기
2026년 4월 3일

OpenAI, Codex Pay-As-You-Go 좌석 도입 + ChatGPT Business $20로 가격 인하

OpenAI가 ChatGPT Business/Enterprise 팀을 위한 Codex 전용 Pay-As-You-Go 좌석을 출시하고, ChatGPT Business 연간 가격을 $25에서 $20로 20% 인하했다.

OpenAI
AI
읽기
2026년 4월 3일

OpenAI, 테크 토크쇼 TBPN 인수 — AI 기업 최초 미디어 직접 소유

OpenAI가 Silicon Valley 창업자·투자자 커뮤니티에서 인기 높은 테크/비즈니스 토크쇼 TBPN(Technology Business Programming Network)을 인수했다. 주요 AI 기업으로는 최초의 미디어 업체 직접 인수다.

OpenAI
AI
읽기
2026년 4월 3일

Anthropic-호주 MOU 체결 — AI Safety Institute와 정식 안전 평가 협력

Anthropic이 2026년 3월 31일 호주 정부와 AI 안전 연구 및 국가 AI 계획 지원을 위한 MOU를 체결했다. Anthropic은 호주 AI Safety Institute와 공동 평가를 수행하고, Economic Index 데이터를 제공하며, 호주 연구기관 4곳에 총 AUD 300만 규모의 Claude API 크레딧을 지원한다.

AI
Claude
읽기
2026년 4월 3일

GitHub Copilot CLI /fleet 공개 — 병렬 서브에이전트로 코드 작업 동시 실행

GitHub가 2026년 4월 1일 Copilot CLI의 /fleet 기능을 공개했다. 이 기능은 하나의 작업을 여러 하위 작업으로 분해한 뒤, 서로 독립적인 파일·모듈 단위 작업을 병렬 서브에이전트에 배분해 동시에 실행한다.

AI
개발도구
읽기
2026년 4월 3일

Microsoft, MAI 모델 3종 출시 — Foundry를 독자 멀티모달 모델 유통 채널로 본격 전환

Microsoft가 2026년 4월 2일 MAI-Transcribe-1, MAI-Voice-1, MAI-Image-2를 공개했다. 세 모델은 Microsoft Foundry와 MAI Playground에서 즉시 사용 가능하며, MAI-Transcribe-1은 상위 25개 언어 대상 음성 인식, MAI-Voice-1은 1초에 60초 분량 음성 생성, MAI-Image-2는 Copilot과…

AI
모델
읽기
2026년 4월 3일

Mistral, $8.3억 부채 조달 — 유럽 독자 AI 컴퓨트 확보에 본격 베팅

프랑스 AI 기업 Mistral이 2026년 3월 30일 파리 인근 데이터센터 구축을 위해 8억3000만 달러의 부채를 조달했다. 자금은 Nvidia 칩 13,800개 구매와 Bruyères-le-Châtel 데이터센터 구축에 투입되며, 센터는 2026년 2분기 가동이 목표다.

AI
산업
읽기
2026년 4월 3일

NVIDIA Mission Control 3.0 공개 — AI 팩토리 운영 KPI를 ‘GPU 활용률’에서 ‘token per watt’로 전환

NVIDIA가 2026년 4월 1일 Mission Control 3.0을 발표했다. 새 버전은 API 기반 모듈형 아키텍처, 다중 조직 격리, 전력 스케줄링, 예측형 AIOps를 결합해 대규모 AI 팩토리 운영을 소프트웨어 정의 방식으로 관리하도록 설계됐다.

AI
개발도구
읽기
2026년 4월 2일

Alibaba Qwen3.6-Plus 공개 — 1M 컨텍스트·에이전트 코딩, Claude Opus 4.5 수준 달성

Alibaba가 2026년 4월 2일 Qwen3.6-Plus를 공개했다. 기본 1M 토큰 컨텍스트 윈도우와 멀티모달 네이티브 지원, 리포지토리 수준 코딩 에이전트 기능을 갖췄으며, SWE-bench와 Terminal-Bench 2.0에서 Anthropic Claude Opus 4.5와 동등한 성능을 기록했다.

AI
모델
읽기
2026년 4월 2일

Cisco, RSA 2026서 에이전트 AI 보안 프레임워크 DefenseClaw 공개 — Zero Trust를 AI 에이전트로 확장

RSA Conference 2026에서 Cisco가 AI 에이전트 전용 보안 프레임워크 DefenseClaw를 발표했다. Skills Scanner, MCP Scanner, AI Bill of Materials(AI BoM), CodeGuard를 통합한 오픈소스 프레임워크로, 기존 Zero Trust Access를 인간 직원이 아닌 AI 에이전트에게도 적용할 수 있도록 확장했다.

AI
트렌드
읽기
2026년 4월 2일

Google Gemini 3.1 Flash-Lite 출시 — Pro 대비 1/8 가격에 Gemini 2.5 Flash 동등 성능

Google이 Gemini 3.1 Flash-Lite를 개발자 프리뷰로 출시했다. 입력 $0.25/1M 토큰(Pro의 1/8 수준), 출력 $1.50/1M 토큰이며, Gemini 2.5 Flash 대비 Time to First Token 2.5배 향상, 출력 속도 45% 향상을 달성하면서 핵심 성능 지표에서는 Gemini 2.5 Flash와 동등하다.

AI
모델
읽기
2026년 4월 2일

vLLM Model Runner V2 출시 — Prefill-Decode 분리 스케줄링으로 오픈소스 LLM 추론 아키텍처 혁신

2026년 3월, vLLM 프로젝트가 Model Runner V2(MRV2)를 릴리즈했다. 기존 스케줄러 아키텍처를 전면 재설계하여 Prefill-Decode 완전 분리 스케줄링과 Zero-Copy DMA 전송을 도입했다. HuggingFace 대비 24배 처리량을 유지하며 GitHub 스타 74,900개로 프로덕션 LLM 추론 엔진의 사실상 표준 위치를 공고히 했다.

AI
오픈소스
읽기
2026년 4월 2일

The Claude Code Source Leak: fake tools, frustration regexes, undercover mode

Anthropic은 실수로 npm 패키지에 소스 맵을 제공하여 전체 Claude Code 소스를 노출시켰습니다. 내부에서 찾은 내용은 다음과 같습니다.

트렌드
AI
읽기
2026년 4월 2일

Google Gemini Code Assist, 개인 개발자 무료 전환 — Gemini 2.5 기반 일 6,000회 코딩 요청 제공

Google이 Gemini Code Assist를 개인 개발자에게 완전 무료로 전면 개방했다. Gemini 2.5 기반으로 VS Code, JetBrains, Android Studio를 지원하며 일 6,000회 코드 요청과 240회 채팅이 무료로 제공된다. 신용카드 없이 개인 Gmail 계정으로 즉시 이용 가능하다.

AI
무료
읽기
2026년 4월 2일

PrismML Bonsai — 세계 최초 상용 가능 1-bit LLM, iPhone에서 44 tok/s 달성

PrismML이 2026년 3월 31일 세계 최초로 상용 수준 1-bit LLM 'Bonsai' 시리즈를 공개했다. 8B·4B·1.7B 세 가지 모델을 Apache 2.0 라이센스로 무료 배포하며, 기존 FP16 대비 메모리를 14배 절감하고 추론 속도를 8배 높이면서도 동급 모델과 동일한 벤치마크 성능을 유지한다.

AI
오픈소스
읽기
2026년 4월 2일

Q1 2026 글로벌 VC $3,000억 사상 최고치 — AI가 전체 81% 독식, 단 4개 딜이 전체의 65% 차지

Crunchbase에 따르면 2026년 1분기 글로벌 벤처 투자가 $3,000억(약 410조 원)으로 사상 최고치를 기록했다. 전분기 대비 150% 이상 증가했으며, AI 기업이 전체의 81%인 $2,420억을 흡수했다. OpenAI($1,220억), Anthropic($300억), xAI($200억), Waymo($160억) 단 4개 딜이 전체의 65%를 차지했다.

AI
트렌드
읽기
2026년 4월 2일

캘리포니아 Newsom, 미국 최초 주정부 AI 안전 행정명령 서명 — 주계약 AI 기업에 안전·프라이버시 가이드라인 의무화

캘리포니아 주지사 Gavin Newsom이 2026년 3월 30일 미국 주정부 최초로 AI 안전 행정명령을 서명했다. 주정부와 계약을 맺는 AI 기업은 안전·프라이버시·편향 방지 가이드라인을 의무 준수해야 하며, 120일 내 세부 AI 벤더 인증 체계가 수립된다.

AI
트렌드
읽기
2026년 4월 2일

Claude Code 내부 작동 원리 — 에이전트 루프, 컨텍스트 조립, 도구 실행 구조 해설

Claude Code의 내부 작동 구조를 상세히 설명하는 문서. 터미널 기반 에이전트 루프(요청 수신 → 추론 → 도구 호출 → 결과 관찰 → 반복), 컨텍스트 조립(git status, CLAUDE.md, 도구 목록), 권한 모델, 로컬 실행 아키텍처, Task 도구 기반 멀티 에이전트 구조까지 다룬다.

개발도구
AI
읽기
2026년 4월 2일

Claw Code — Claude Code 소스 기반 Python/Rust 클린룸 재구현 프로젝트 (130k★)

Claude Code 소스 공개를 계기로 탄생한 클린룸 재구현 프로젝트. Python + Rust로 에이전트 하네스 아키텍처를 재구현했다. 출시 2시간 만에 50k 스타, 현재 130k 스타 / 102k 포크. Sigrid Jin이 발기인.

트렌드
오픈소스
읽기
2026년 4월 1일

NVIDIA Nemotron 3 Super — 120B MoE 오픈소스 에이전트 모델, SWE-Bench 60.5% 달성

NVIDIA가 에이전트 워크로드 특화 오픈소스 모델 Nemotron 3 Super를 공개했다. Mamba-Transformer 하이브리드 MoE 아키텍처로 원래 1,200억 파라미터에서 활성 파라미터 120억만 사용, SWE-Bench Verified 60.47% 및 PinchBench 85.6%로 동급 오픈소스 최고 성능을 기록했다.

트렌드
오픈소스
읽기
2026년 4월 1일

Linux Foundation, MCP 기부 및 AAIF 출범 — AI 에이전트 표준화의 중립 거버넌스 시대 개막

Linux Foundation이 Anthropic의 MCP, Block의 goose, OpenAI의 AGENTS.md를 함칠 에이전틱 AI 파운데이션(AAIF)을 출범했다. AWS, Google, Microsoft, Cloudflare 등이 플래티덧 멤버로 참여하며, MCP는 특정 기업 소유가 아닌 인터넷 인프라 수준의 중립 표준 프로토콜로 전환된다.

트렌드
AI
읽기
2026년 4월 1일

Google TurboQuant — LLM KV 캐시 메모리 6배 압축, H100에서 8배 속도 향상

Google Research가 LLM의 KV 캐시 메모리를 6배 압축하면서 정확도 손실이 없는 알고리즘 TurboQuant를 공개했다. 16비트에서 3비트로의 훈련 없는(training-free) 압축으로 NVIDIA H100에서 최대 8배의 어텐션 연산 속도 향상을 달성하며, ICLR 2026 발표 예정이다.

트렌드
AI
읽기
2026년 4월 1일

OpenAI, $122B 펀딩 완료 — $852B 밸류에이션으로 IPO 전 최대 사모 투자 기록

OpenAI가 Amazon($50B), SoftBank($30B), NVIDIA($30B) 등 주요 투자자들로부터 $122B(약 174조원)를 조달해 밸류에이션 $852B(약 1,200조원)를 달성했다. 월 매출 $2B, 주간 활성 사용자 9억 명을 기록하며 IPO를 앞두고 있다.

트렌드
AI
읽기
2026년 4월 1일

Claude Code's source code has been leaked via a map file in their NPM registry

소식의 핵심을 빠르게 정리하면, 트렌드 흐름에서 다음 변화를 미리 읽게 해주는 이슈입니다. 이 글에서는 사실 관계와 맥락, 그리고 실무자가 바로 참고할 포인트를 뉴스레터 톤으로 전달합니다.

트렌드
AI
읽기
2026년 4월 1일

Anthropic Claude Code npm 패키징 오류로 51만 줄 소스코드 유출 — KAIROS 자율 데몬 모드·미공개 모델 코드네임 노출

2026년 3월 31일, @anthropic-ai/claude-code npm 패키지 v2.1.88에 내부 디버깅용 소스맵 파일이 실수로 포함되어 약 1,900개 TypeScript 파일(51만 2천 줄)이 공개됐다. GitHub에서 4만 1천 500회 이상 포크되며 확산됐고, Anthropic은 고객 데이터·자격증명 노출은 없었다고 공식 확인했다.

AI
Claude
읽기
2026년 4월 1일

Google TurboQuant, LLM KV 캐시 메모리 6배 압축·H100 속도 8배 향상 달성

Google Research가 ICLR 2026에서 발표할 TurboQuant를 공개했다. 별도 학습 없이 LLM의 KV 캐시를 3비트로 압축해 메모리를 6배 절감하고, NVIDIA H100에서 어텐션 연산 속도를 최대 8배 높이면서도 정확도 손실이 없다.

AI
트렌드
읽기
2026년 4월 1일

GPT-5.4 출시 — 추론·코딩·에이전트 통합 모델, OSWorld-V 인간 기준선 AI 최초 초과

OpenAI가 3월 5일 GPT-5.4를 출시했다. GPT-5.3 Codex의 코딩 역량을 메인라인 추론 모델에 통합한 것으로, 100만 토큰 컨텍스트 윈도우와 멀티스텝 에이전트 워크플로우 자율 실행 능력을 탑재했다. 실제 데스크톱 생산성 태스크를 시뮬레이션하는 OSWorld-V 벤치마크에서 75%를 기록, 인간 기준선(72.4%)을 AI 최초로 초과했다.

AI
모델
읽기
2026년 4월 1일

OpenAI, 최초 오픈웨이트 모델 gpt-oss-120b 공개 — Apache 2.0, o4-mini 수준 추론 성능

OpenAI가 처음으로 오픈웨이트 모델인 gpt-oss-120b(117B 파라미터, MoE)와 gpt-oss-20b를 Apache 2.0 라이선스로 공개했다. 단일 80GB GPU에서 실행 가능하며, 코딩·수학·툴 사용에서 o4-mini와 동등하거나 일부 초과한다.

AI
오픈소스
읽기
2026년 4월 1일

gstack — Garry Tan(YC 회장)이 만든 AI 소프트웨어 팩토리

Y Combinator 회장 Garry Tan이 만든 Claude Code 기반 AI 소프트웨어 팩토리. 23개의 전문화된 AI 역할(경영진, 엔지니어링, 디자인, QA, 보안 등)을 조합해 10~15개 스프린트를 병렬로 돌린다. 60일간 60만 줄 프로덕션 코드 산출, 일일 1~2만 줄 생산량. GitHub 스타 60.1k.

트렌드
오픈소스
읽기
2026년 4월 1일

Paperclip — AI 에이전트 팀을 회사처럼 운영하는 오케스트레이션 플랫폼

여러 AI 에이전트를 하나의 회사 조직처럼 구성하고 운영하는 오픈소스 오케스트레이션 플랫폼. 조직도, 목표 정렬, 예산 관리, 거버넌스(승인 게이트, 롤백, 감사 로그)까지 갖추고 있다. "OpenClaw이 직원이라면 Paperclip은 회사다." GitHub 스타 42.8k.

트렌드
오픈소스
읽기
2026년 3월 31일

Google TurboQuant — KV 캐시를 3비트로 6배 압축, 재학습 없이 H100에서 8배 처리량

Google의 TurboQuant가 ICLR 2026에서 발표될 예정이다. LLM의 KV 캐시를 3~4비트로 압축해 메모리를 4~6배 절감하면서 정확도 손실이 전혀 없고, H100 GPU에서 32-bit 대비 최대 8배 처리량 향상을 달성한다.

AI
모델
읽기
2026년 3월 31일

GPT-5.4 출시 — 컴퓨터 사용 에이전트로 인간 기준선(OSWorld 72%) 돌파

OpenAI는 3월 29일 GPT-5.4를 출시했다. 컴퓨터 사용(computer use)을 핵심 역량으로 탑재하여 OSWorld-Verified 벤치마크에서 75%를 기록, 인간 평균(72%)을 처음으로 추월했다.

AI
모델
읽기
2026년 3월 31일

Mistral Voxtral TTS — 4B 오픈소스 음성 합성 모델, ElevenLabs 대비 7~9배 저렴

Mistral AI가 3월 26일 오픈소스 텍스트-음성 변환 모델 Voxtral TTS(4B 파라미터)를 출시했다. 9개 언어를 지원하고 5초 이하의 음성 샘플로 목소리를 복제하며, 첫 오디오 출력 지연(TTFA)이 90ms에 불과해 실시간 음성 에이전트 구현이 가능하다.

AI
모델
읽기
2026년 3월 31일

NVIDIA Nemotron 3 Super — 120B Mamba-Transformer MoE 오픈 에이전트 모델, 이전 대비 5배 처리량

NVIDIA가 에이전트 AI 특화 오픈 모델 Nemotron 3 패밀리를 출시했다. 플래그십인 Nemotron 3 Super는 120B 파라미터(활성 12B)의 Mamba-Transformer MoE 하이브리드 아키텍처를 채택해 Nemotron 2 대비 5배 처리량을 달성하고 1M 토큰 컨텍스트 윈도우를 지원한다.

AI
모델
읽기
2026년 3월 31일

Cursor, 유료 개발자 100만 명 돌파 — 병렬 서브에이전트 & BugBot으로 AI 코딩 '5가데일' 재정의

AI 코드 에디터 Cursor가 유료 개발자 100만 명을 돌파하고, 2026년 3월 병렬 서브에이전트와 BugBot을 공식 출시했다. BugBot은 월 200만 건 이상의 PR을 자동 리뷰하며 70% 버그 해결률을 기록 중이다.

AI
개발도구
읽기
2026년 3월 31일

Google TurboQuant — LLM KV 캐시 3.5비트 압쳙으로 메모리 6배 절감, 오픈소스 공개

Google이 LLM의 KV-캐시를 채널당 3.5비트로 압쳙하는 오픈소스 양자화 기법 TurboQuant를 공개했다. 메모리 사용량을 최대 6배 줄이고 추론 속도를 대폭 향상시킨다.

AI
모델
읽기
2026년 3월 31일

OpenAI, $1,200억 역대 최대 평더링 완료 — Amazon $500억 주도, 기업가치 $7,300억 돌파

OpenAI가 Amazon $500억, Nvidia·SoftBank 각 $300억 등으로 구성된 총 $1,200억 평더링 라운드를 마무리했다. Pre-money 기업가치 $7,300억으로, 2026년 AI 산업 내 최대 단일 투자 이벤트다.

AI
OpenAI
읽기
2026년 3월 31일

Anthropic Mythos 유출 — 코딩·사이버보안 SOTA, "역량의 단계적 도약" 확인

Anthropicが내부 테스트 중이던 신규 모델 'Mythos(Claude Mythos/Opus 5)'가 데이터 유출로 공개됐다. 소프트웨어 코딩, 학술 추론, 사이버보안 영역에서 Claude Opus 4.6 대비 "극적으로 높은 점수"를 기록한 것으로 알려졌다.

AI
모델
읽기
2026년 3월 31일

MCP 9,700만 설치 돌파 — AI 에이전트 인프라 표준으로 안착, 그러나 보안 위협도 급부상

Anthropicの Model Context Protocol(MCP)이 2026년 3월 25일 기준 9,700만 설치를 달성했다. OpenAI, Google DeepMind, Cohere, Mistral 등 주요 AI 제공업체 모두 자사 에이전트 프레임워크에 MCP 지원을 통합 완료했다.

AI
API
읽기
읽을거리로 돌아가기