PickleeAI와 개발, 오늘 볼 변화만
홈읽을거리아카이브
검색

Picklee

AI와 개발 현장에서 오늘 확인할 변화만 선별합니다.

© 2026 Picklee. All rights reserved.

RSSSitemap

주제

#연구

10개 읽을거리를 모았습니다.
2026년 7월 16일

Mistral, 단일 RGB 카메라 로봇 내비게이션 모델 Robostral Navigate 공개

Mistral AI가 자연어 지시와 단일 RGB 카메라 입력만으로 복잡한 환경을 이동하는 8B embodied-navigation 모델 Robostral Navigate를 공개했다. 이 모델은 R2R-CE validation unseen에서 76.6% 성공률을 기록해, 회사 발표 기준 최고 단일 카메라 방식보다 9.7%p, depth·다중 카메라 방식보다 4.5%p 높았다.

AI
모델
읽기
2026년 7월 16일

Chai Discovery·argenx, de novo antibody 설계를 위한 AI 플랫폼 협업

Chai Discovery가 7월 15일 argenx와 협력해, argenx의 과학자들이 Chai의 AI 플랫폼으로 치료 표적에 대한 de novo antibody discovery를 수행하도록 한다고 발표했다. Chai는 Chai-2가 zero-shot antibody design에서 두 자릿수 실험 hit rate를 냈고, Chai-3는 binding·난공략…

AI
산업
읽기
2026년 7월 16일

Prime Intellect, 오픈형 agentic RL 스택 확장에 USD 130M Series A

Prime Intellect가 7월 8일 Radical Ventures 주도로 USD 130M Series A를 유치해 누적 자금이 USD 150M을 넘었다고 발표했다. 회사는 compute, large-scale RL, environments, sandboxes, evals, deployment를 묶은 스택을 제공하며 6,000곳 이상 고객과 USD 100M 이상의 annualized…

AI
에이전트
읽기
2026년 7월 5일

Leanstral 1.5 - open proof-engineering model moves formal verification toward practical code review

Mistral이 Lean 4 기반 proof engineering 모델 Leanstral 1.5를 공개했다. Apache-2.0 라이선스의 119B total / 6B active parameter 모델이며 miniF2F 100%, PutnamBench 587/672, FATE-H 87%, FATE-X 34%를 기록하고 57개 오픈소스 저장소 테스트에서 5개 미보고 버그를 찾아냈다고 밝혔다.

AI
모델
읽기
2026년 7월 5일

OpenAI GeneBench-Pro - computational biology agents get a harder benchmark for research judgment

OpenAI가 computational biology용 research-level benchmark인 GeneBench-Pro를 공개했다. 10개 domain, 21개 sub-domain, 129문제로 구성되며 GPT-5.6 Sol은 high reasoning level에서 28.7%, Pro mode에서 31.5% pass rate를 기록했다.

AI
연구
읽기
2026년 7월 4일

Epoch CVE spike - frontier cyber models reshape vulnerability disclosure volume

Epoch AI가 Claude Mythos Preview 공개 이후 2026년 6월 high/critical CVE 공개가 약 1,500건으로 증가해, Mythos 이전 월간 최고치보다 3.5배 이상 많았다고 분석했다. 데이터는 Microsoft, Google, Apple, AWS, Linux, Mozilla, OpenSSL 등 21개 주요 조직의 CVE 공개를 중심으로 집계됐다.

AI
연구
읽기
2026년 7월 3일

ScarfBench - enterprise Java migration exposes coding-agent behavior gaps

IBM Research가 Hugging Face에 ScarfBench를 공개했다. ScarfBench는 Spring, Jakarta EE, Quarkus 사이의 enterprise Java framework migration을 평가하며 34개 앱, 102개 framework implementations, 204개 migration tasks, 약 151K LOC, 1,331개…

AI
개발도구
읽기
2026년 7월 2일

Mixedbread asymmetric quantization - late-interaction retrieval cuts vector storage 97 percent

Mixedbread가 late-interaction retrieval에서 document vector는 1-bit sign으로 저장하고 query vector는 int8로 유지하는 asymmetric quantization 기법을 공개했다. 내부 benchmark 기준 raw document-vector storage를 393 KiB에서 12.28 KiB로 줄이면서 NDCG@10은…

AI
연구
읽기
2026년 6월 30일

Every Eval Ever - fragmented AI benchmarks get a shared metadata layer

EvalEval Coalition이 Every Eval Ever를 공개해 AI 평가 결과를 하나의 공개 스키마와 데이터셋으로 모으고, Hugging Face Hub의 evaluation results 구조와 연결되는 기반을 제시했다.

AI
연구
읽기
2026년 6월 30일

GLM 5.2 beats Claude in our benchmarks

프롬프트만 제공되는 모델 중에서 최고의 개방형 옵션이 Claude Opus 4.8을 능가했습니다.

트렌드
AI
읽기
읽을거리로 돌아가기