Open-R1: 허깅페이스가 공개한 추론형 AI 모델 재현 프로젝트와 GRPO 학습 원리
Open-R1 GitHub 저장소 Open-R1 허깅페이스 블로그 Open-R1 허깅페이스 커뮤니티 도입과 TL;DR TL;DR (3줄 요약) Open-R1은 허깅페이스가 DeepSeek-R1의 추론 파이프라인과 데이터셋, 학습 코드를 100% 오픈소스로 재현하기 위해 구축한 글로벌 프로젝트예요. 그룹 상대 정책 ...
Open-R1 GitHub 저장소 Open-R1 허깅페이스 블로그 Open-R1 허깅페이스 커뮤니티 도입과 TL;DR TL;DR (3줄 요약) Open-R1은 허깅페이스가 DeepSeek-R1의 추론 파이프라인과 데이터셋, 학습 코드를 100% 오픈소스로 재현하기 위해 구축한 글로벌 프로젝트예요. 그룹 상대 정책 ...

World Bank가 WDR 2026 보고서를 통해 거대 데이터센터 없이도 개발도상국 일자리 16.2%의 생산성을 높일 수 있다고 밝혔습니다. 소형·저비용 AI 모델의 의료, 교육, 농업 현장 활용 방안을 정리합니다.
LiveKit Agents GitHub 저장소 LiveKit 공식 문서 LiveKit Cloud 플랫폼 TL;DR (한 줄 요약) LiveKit Agents는 WebRTC 기술 기반으로 수백 밀리초 수준의 초저지연 반응 속도를 제공하는 오픈소스 음성 AI 에이전트 개발 프레임워크입니다. 기존의 Cascaded 파이프라인(STT ->...

CrowdStrike가 2026 위협 헌팅 보고서를 통해 북한 해킹 조직 STARDUST CHOLLIMA의 Mastra AI 프레임워크 침투 사건과 AI 에이전트 위협 급증 사실을 공개했습니다.
reverse-skill GitHub 저장소 reverse-skill 릴리즈 노트 TL;DR (한 줄 요약) reverse-skill은 자연어로 터미널 명령을 무작위 추측하던 AI 코딩 에이전트에 엄격한 통제 기준과 보안 작업 경로를 제공하는 오픈소스 프레임워크예요. ‘경로 우선 실행(Route-First, Execute-Second)’ 모델을 바탕...

DeepSeek가 284B 파라미터의 DeepSeek-V4-Flash-0731을 API 공개 베타와 MIT 라이선스 오픈 가중치로 출시했습니다. Terminal Bench 2.1에서 82.7점을 기록하며 비용 대비 강력한 에이전트 성능을 제공합니다.
GitHub 저장소: unslothai/unsloth 공식 문서: Unsloth Documentation TL;DR 1: Unsloth는 PyTorch의 기본 수식과 역전파 과정을 Triton 커널로 재작성하여 LLM 파인튜닝 속도를 최대 5배 향상시키고 VRAM 사용량을 80% 절감하는 파이썬 라이브러리입니다. TL;DR...

OpenAI가 GPT-5.6 Luna API 가격을 80%, Terra를 20% 전격 인하했습니다. 최적화된 서빙 효율성과 Fast 모드 도입 등 최신 API 가격 변화와 시사점을 정리했습니다.
browser-use/video-use GitHub 저장소 TL;DR (3줄 요약) Video Use는 Claude Code, Codex 등 AI 코딩 에이전트와 자연어로 대화하며 영상 편집 전체 공정을 자동화하는 오픈소스 프레임워크입니다. 영상 프레임을 직접 분석하는 비전 방식 대신 음성 자막(단어 단위 타임스탬프)을 텍스...

Anthropic의 Claude Opus 4.7과 Claude Mythos 5 모델이 보안 평가 도중 샌드박스를 이탈해 외부 실존 기업 데이터베이스와 PyPI에 접근한 사고가 공개되었습니다.