- GRASP: 개인 정보 보호를 위한 새로운 모델 제안
- Granite-Switch 아키텍처 및 llama.cpp 백엔드 추가
- 메타, 30B 파라미터 모델 Muse Glimmer 공개
- 토스 엔지니어들, 모노리포 장점 활용을 위한 카탈로그 도입
- 모델 ML, GPT-5.6 Sol을 활용한 금융 업무 지원
- OpenAI, LLM Astra의 안전성 문제로 개발 일시 중단
- LangChain OpenAI 1.4.3 버전 업데이트 내역
- Claude Opus 5의 수출 통제 대응과 업데이트
- Claude Code, Auto mode로 새로운 세션 시작
- LaunchDarkly CodeControl로 AI 코드 관리하기
- 솔리드, C·Go 개발자를 위한 새로운 시스템 언어 발표
- 소프트웨어 품질은 에이전트의 제약에 달려있다
- SQLite 텍스트 기록 보관을 위한 압축 프로토타입
- 코랄 AI 랩스, 에이전트라디오 공개
- AI의 전력 수요: Nvidia와 아마존의 대규모 인프라 투자
- 스탠포드, 3만7000개 AI로 신약 후보물질 설계
- 차세대 LLM을 향한 스타트업의 도전
- 클리카, 싱가포르·프랑스 AI 국방 협력 프로그램 선정
- 엔비디아, 전이중 음성 AI 모델 공개
- 실제 동물을 수집 카드로 변환하는 게임 ‘스나웃라스’
GRASP: 개인 정보 보호를 위한 새로운 모델 제안
GRASP(Group-Relative Anonymization via Self-refinement Policy-optimization)라는 새로운 모델이 제안되었다. 이 모델은 로컬 익명성을 강화하며, 익명자, 적대자 및 유틸리티 판단자로 기능하는 단일 소형 모델로 설계되었다. GRASP는 자기 생성 보상에 기반하여 속성을 숨기면서 의미를 유지하는 방식으로 훈련된다. Llama-3.1-8B를 기반으로 훈련된 GRASP는 DPO(Direct Preference Optimization) 기반 모델에 비해 개인 정보 및 유용성 간의 균형을 개선하였으며, Gemini 2.5 Flash 및 Claude와 같은 고급 모델의 적대적 익명화에 대해 더 많은 개인 정보를 제거하면서도 유사하거나 더 나은 성능을 보였다. 이 모델은 완전히 디바이스에서 실행되며, GPT-4o 교사의 비용의 약 1%로 운영될 수 있다. 한국 개발자는 GRASP 모델을 통해 개인 정보 보호 기능을 강화한 애플리케이션을 개발할 수 있다.
원문에서 자세히 보기: arXiv cs.CL
Granite-Switch 아키텍처 및 llama.cpp 백엔드 추가
새로운 granite-switch 아키텍처는 밀집된 모든 주의 방식의 Granite-4.1 모델로, 제어 토큰에 따라 N개의 LoRA 어댑터를 매핑하여 사용한다. 주요 개선 사항으로는 GGUF-PY 스키마와 GraniteSwitchModel 변환기가 포함되며, C++ 아키텍처 등록과 per-token switched-LoRA 그래프 로딩 기능이 추가되었다. 모델은 CPU에서 3b 체크포인트를 변환하고, 기본 및 제어 토큰 경로에서 생성 작업을 수행할 수 있다. Mac(메탈)에서 실행할 수 있는 자가 포함된 스크립트도 포함되어 있어, 중간 시퀀스 어댑터 전환의 데모를 수행할 수 있다. 이번 버전에서는 전역 인덱스를 대신하는 인-그래프 라우터 주의 방식으로 개선되어 여러 시퀀스에 대한 동시성 문제를 해결하였다. 개발자는 이 아키텍처를 통해 텍스트 생성 및 모델 수정을 지원할 수 있다.
원문에서 자세히 보기: llama.cpp Releases
메타, 30B 파라미터 모델 Muse Glimmer 공개
메타가 새로운 오픈모델 Muse Glimmer를 공개했다. 이 모델은 30억 개의 파라미터를 가지고 있으며, 소비자 하드웨어에서 실행될 수 있도록 최적화되어 제작되었다. Muse Glimmer는 최대 20GB의 메모리로 동작할 수 있으며, 주로 로컬 AI 작업에 활용된다. 메타 CEO 마크 저커버그는 이 모델의 출시와 함께 AI 연구에 대한 규제 완화 필요성을 강조했다. 사용자들은 Ollama 플랫폼을 통해 Muse Glimmer를 사용할 수 있으며, 향후 다양한 플랫폼에서 최적화된 지원이 예정되어 있다.
참고 출처 (5개 매체 종합)
- GeekNews (전체)
- Ollama Releases
- THE DECODER
- NVIDIA Technical Blog
- ai-news-daily (Local LLM Aggregator)
토스 엔지니어들, 모노리포 장점 활용을 위한 카탈로그 도입
토스의 100명 이상의 엔지니어들이 모노리포 아키텍처의 장점을 극대화하기 위해 카탈로그 시스템을 도입한 사례를 소개한다. 카탈로그는 코드 관리 및 배포의 효율성을 높이고, 팀 간 협업을 개선하는 데 중점을 두고 설계되었다. 이를 통해 엔지니어들은 각자의 작업을 더 쉽게 관리하고, 버전 호환성 문제를 줄일 수 있는 이점을 얻었다. 이번 도입은 토스 내 다양한 서비스의 일관성을 유지하는 데에도 기여할 예정이다. 한국 개발자는 유사한 시스템을 통해 모노리포의 효과적인 관리 방안을 고민해 볼 수 있다.
원문에서 자세히 보기: 토스 기술 블로그
모델 ML, GPT-5.6 Sol을 활용한 금융 업무 지원
모델 ML은 GPT-5.6 Sol을 기반으로 하여 금융 관련 업무를 지원한다. 해당 모델은 연구 및 분석을 통해 생성된 내용을 편집 가능하고 추적할 수 있는 PowerPoint 프레젠테이션 및 Excel 워크북 형식으로 제공한다. 이를 통해 사용자들은 데이터 분석 및 보고서 작성의 효율성을 높일 수 있다. 금융 분야에서의 실질적인 활용을 목표로 하며, 기업의 의사결정 과정에 기여할 수 있는 도구로 기능한다. 한국 개발자는 이를 활용하여 금융 분석 및 프레젠테이션 자동화를 진행할 수 있다.
원문에서 자세히 보기: OpenAI News
OpenAI, LLM Astra의 안전성 문제로 개발 일시 중단
OpenAI는 차기 대형 언어 모델 Astra가 제로데이 취약점을 탐지하고 공격 코드를 자동으로 생성할 위험이 높다고 판단하여 이를 ‘Critical’ 등급으로 분류했다. 이에 따라 OpenAI는 Astra의 내부 개발 및 평가를 일시 중단하고, 격리 환경 및 엄격한 보안 조치를 적용하기로 했다. 이러한 조치는 신뢰할 수 없는 공격 도구가 생성될 가능성을 차단하기 위한 것이다. Astra의 자율적인 해킹 도구 생성 위험성은 AI 안전 문제에 대한 심각한 우려를 불러일으키고 있다.
참고 출처 (3개 매체 종합)
LangChain OpenAI 1.4.3 버전 업데이트 내역
LangChain OpenAI의 새로운 버전 1.4.3이 출시되었다. 이 업데이트에서는 유효하지 않은 도구 호출을 필터링하는 기능이 추가되었으며, OpenAI 호환 제공자에 대한 응답 API에 대한 가이드라인이 업데이트되었다. 또한, ‘include_response_headers’에 대한 문서 문자열도 수정되었다. 한국 개발자는 이 업데이트를 통해 API의 안정성을 높이고 문서화된 기능을 활용할 수 있다.
원문에서 자세히 보기: LangChain Releases
Claude Opus 5의 수출 통제 대응과 업데이트
Claude Fable 5와 Claude Mythos 5는 2026년 6월 12일부터 7월 1일까지 접근이 중단됐다.
원문에서 자세히 보기: Simon Willison
Claude Code, Auto mode로 새로운 세션 시작
2026년부터 Claude Code의 신규 세션이 Auto mode로 시작되어 자동 판별을 통한 안전성을 지원한다.
원문에서 자세히 보기: GeekNews (전체)
LaunchDarkly CodeControl로 AI 코드 관리하기
LaunchDarkly CodeControl은 AI 코드의 모니터링 및 관리를 간소화하는 강력한 도구입니다.
원문에서 자세히 보기: TLDR Tech
솔리드, C·Go 개발자를 위한 새로운 시스템 언어 발표
솔리드는 C·Go 개발자를 위한 Go의 부분집합 시스템 언어로 구문 강조와 패키지 관리를 지원한다.
원문에서 자세히 보기: GeekNews (전체)
소프트웨어 품질은 에이전트의 제약에 달려있다
소프트웨어 품질은 에이전트의 제약에 따라 달라지며, 높은 품질 소프트웨어 제공이 가능해진다.
원문에서 자세히 보기: TLDR Tech
SQLite 텍스트 기록 보관을 위한 압축 프로토타입
SQLite의 텍스트 기록을 Zstandard 압축해 효과적인 데이터 저장 방안을 제안했다.
원문에서 자세히 보기: Simon Willison
코랄 AI 랩스, 에이전트라디오 공개
코랄 AI 랩스가 에이전트 간 실시간 협업을 위한 ‘에이전트라디오’를 공개했다.
원문에서 자세히 보기: AI Times
AI의 전력 수요: Nvidia와 아마존의 대규모 인프라 투자
Nvidia가 30억 달러를 투자하여 AI 산업의 전력 인프라를 확장하고 있다.
원문에서 자세히 보기: THE DECODER
스탠포드, 3만7000개 AI로 신약 후보물질 설계
스탠포드대 연구진이 3만7000개의 AI 에이전트로 신약 후보물질을 설계했다.
원문에서 자세히 보기: AI Times
차세대 LLM을 향한 스타트업의 도전
차세대 LLM 관련 스타트업들이 급속히 발전하며 산업에 변화를 주고 있습니다.
원문에서 자세히 보기: MIT Technology Review
클리카, 싱가포르·프랑스 AI 국방 협력 프로그램 선정
클리카가 싱가포르·프랑스 정부의 ‘AI 조인트 챌린지’에서 최종 선정됐다.
원문에서 자세히 보기: AI Times
엔비디아, 전이중 음성 AI 모델 공개
엔비디아가 110억 매개변수의 전이중 음성 AI 모델을 공개했다.
원문에서 자세히 보기: AI Times
실제 동물을 수집 카드로 변환하는 게임 ‘스나웃라스’
실제 동물을 카드로 수집하는 참신한 게임 ‘스나웃라스’ 소개.
원문에서 자세히 보기: Reddit r/vibecoding