- M2 Max를 위한 fa-vec 조정 추가
- LiteLLM v1.99.0 릴리스 노트
- Claude Fable 5.1 업데이트 발표
- 오픈소스 AI 플랫폼 오픈클로, 대규모 업데이트 발표
- Solaris: 실시간 인터페이스 생성 모델 발표
- Vercel AI SDK 4.0.51 버전 업데이트
- LangChain 1.4.0a3: 새로운 MCP 네임스페이스 추가
- OpenAI Codex Multi Agents v2의 서브 에이전트 모델 지정 기능
- Darling: Linux에서 macOS 직접 실행
- Alteon, 1년 비행 목표의 자율 항공기 개발
- 소형 Transformer, 경제적 학습 성과 기록
- 소프트웨어 공학의 변화 가속화: LLM 및 AI 도구의 도입
- ChatGPT Work와 Codex의 협업 도구 활용 방안
- BYOA 모델, 사용자 친화적 도구들의 목록 구축
- 인텔리빅스, 신세계면세점에 AI 영상분석시스템 공급
- AI 에이전트의 자율성과 통제 문제
- AWS 에이전트 시스템 구축 안내
- Matic, 1만 가정에 로봇 투입하기까지의 여정
- diffium-db: 실시간 데이터베이스 변화 확인
- Muse Code: 효율적인 코딩 에이전트
M2 Max를 위한 fa-vec 조정 추가
이 업데이트는 M2 Max에서 30개의 GPU 코어를 활용하기 위한 fa-vec 조정을 포함하고 있으며, ‘ggml-metal-tuning fa-vec —dtype f16,q8_0’ 명령어로 수집된 데이터가 fa_vec_tuned_table에 추가되었습니다. 지원되는 플랫폼은 macOS, Linux, Android 및 Windows를 포함하고 있으며, 각각의 CPU 및 GPU 환경에 맞춰 다양한 버전이 제공됩니다. macOS는 Apple Silicon과 Intel 아키텍처용으로 제공되며, Linux는 여러 CPU 아키텍처와 Vulkan, ROCm, OpenVINO, SYCL 등의 GPU 프레임워크를 지원합니다. Windows 플랫폼에서는 CUDA와 Vulkan, OpenVINO, SYCL 등을 포함한 다양한 환경에서의 사용이 가능합니다. 업데이트된 소프트웨어는 다양한 운영체제와 하드웨어에 최적화 되어 있어 사용자들은 선택한 플랫폼에 맞춰 효율적으로 활용할 수 있습니다. 한국 개발자는 특정 아키텍처에 맞춘 성능 조정 데이터를 활용해 소프트웨어 최적화를 진행할 수 있다.
원문에서 자세히 보기: llama.cpp Releases
LiteLLM v1.99.0 릴리스 노트
LiteLLM Docker 이미지는 cosign으로 서명되며, 모든 릴리스는 동일한 키로 서명된다. 이미지의 서명을 확인하려면 고정 커밋 해시 또는 릴리스 태그를 사용하여 cosign verify 명령어를 실행한다. 이번 버전에서는 1,300개의 Typings 오류 수정, OpenAI 프리픽스용 WebSocket 패스스루 등록, 파일 업로드 시 반환되는 FileObject의 크기 보고, AWS Bedrock의 배치 취소 지원 등 여러 수정과 기능 추가가 포함되었다. UI 관련한 기능으로는 복합성 라우터의 기본 모델 핀 추가와 사용자, 제작자, 팀, 조직에 대한 링크 키 정보 헤더 추가 등이 있다. 한국 개발자는 업그레이드된 기능을 활용하여 LiteLLM의 성능을 최적화할 수 있다.
원문에서 자세히 보기: LiteLLM Releases
Claude Fable 5.1 업데이트 발표
Claude Fable 5.1이 새로운 기본 모델로 추가되어 1M의 컨텍스트를 지원하며, Mtok당 비용은 $10/$50로 설정되었다. 이 버전은 사용자 환경에 따라 클라우드 메타데이터 자격 증명 검색 및 교차 테넌트 접근을 자동 승인하지 않도록 하는 규칙을 포함하고 있다. 또한, 새로운 시간 형식 및 시간대 설정 기능이 추가되었으며, 환경 설정에 대한 개선도 이루어졌다. 이와 더불어, 최초 파일 읽기 시 경고 메시지가 추가되어 사용자에게 외부 디렉터리에서의 읽기 권한 차단 옵션을 제공하고 있다.
참고 출처 (3개 매체 종합)
오픈소스 AI 플랫폼 오픈클로, 대규모 업데이트 발표
오픈소스 AI 에이전트 플랫폼인 오픈클로가 사상 최대 규모의 업데이트인 ‘오픈클로 2.0’을 공개했다. 이번 업데이트는 1만6000개 이상의 풀 리퀘스트를 반영하여 설치 과정, 메시징, 메모리, 모델, 자동화, 앱 및 보안 등 시스템 전반을 재설계한 것이 특징이다. 이 프로젝트에는 933명의 개발자가 참여했으며, 이 중 569명은 신규 개발자다. 오픈클로 팀은 작업량 증가로 인해 과거의 프로세스를 재조정해야 했다고 밝혔다.
참고 출처 (3개 매체 종합)
Solaris: 실시간 인터페이스 생성 모델 발표
Solaris는 사용자와의 상호작용에 따라 프레임 단위로 실시간 인터페이스를 생성하는 Interface World Model이다. 이 모델은 렌더링과 상호작용을 동시에 처리하여 중간 표현 없이 매 프레임과 사용자 입력에 대한 응답을 생성한다. Solaris는 웹사이트, 애플리케이션 및 기타 온라인 인터페이스 제작에 새로운 가능성을 열어준다. 또한 더 역동적인 환경에서 에이전트를 훈련시키는 데에도 사용될 수 있다.
참고 출처 (3개 매체 종합)
Vercel AI SDK 4.0.51 버전 업데이트
Vercel AI SDK의 4.0.51 버전에서는 배치 프로세스에서 도구 호출 지원 기능이 추가되었습니다. 이 업데이트는 도구 호출 사용자에게 배치 작업을 보다 효율적으로 수행할 수 있는 기능을 제공합니다. 해당 기능은 기본적으로 기존 API와 함께 사용될 수 있습니다. 한국 개발자는 이 새로운 기능을 활용하여 보다 복잡한 프로세스를 자동화할 수 있는 응용 프로그램을 개발할 수 있다.
원문에서 자세히 보기: Vercel AI SDK Releases
LangChain 1.4.0a3: 새로운 MCP 네임스페이스 추가
이번 LangChain 1.4.0a3 릴리스는 MCP 클라이언트 통합을 위한 MCPAdapter를 통해 다양한 도구를 지원합니다. 이로 인해 서버와의 상호작용이 한층 더 유연해지며, 클라이언트 측 반응을 효과적으로 캐싱할 수 있는 기능이 추가되었습니다. LangChain 사용자들은 이 버전을 통해 더욱 개선된 도구 통합 경험을 누릴 수 있을 것입니다.
원문에서 자세히 보기: LangChain Releases
OpenAI Codex Multi Agents v2의 서브 에이전트 모델 지정 기능
OpenAI Codex Multi Agents v2는 서브 에이전트에서 사용할 모델을 지정할 수 있게 되었습니다.
원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)
Darling: Linux에서 macOS 직접 실행
Darling은 macOS 소프트웨어를 Linux에서 네이티브 실행할 수 있는 변환 계층입니다.
원문에서 자세히 보기: GeekNews (전체)
Alteon, 1년 비행 목표의 자율 항공기 개발
Alteon은 바다의 바람에서 에너지를 수확하여 항공기를 1년 이상 비행시키는 목표를 설정했다.
원문에서 자세히 보기: TLDR Tech
소형 Transformer, 경제적 학습 성과 기록
소형 Transformer가 67센트로 ARC-AGI-1에서 44% 성능 향상을 기록했습니다.
원문에서 자세히 보기: GeekNews (전체)
소프트웨어 공학의 변화 가속화: LLM 및 AI 도구의 도입
2023년 1월 이후 소프트웨어 공학의 변화가 LLM과 AI 도구의 채택으로 가속화되고 있다.
원문에서 자세히 보기: The Pragmatic Engineer
ChatGPT Work와 Codex의 협업 도구 활용 방안
ChatGPT Work와 Codex의 도구들이 협업과 자동화를 돕는 레퍼런스를 제공합니다.
원문에서 자세히 보기: GeekNews (전체)
BYOA 모델, 사용자 친화적 도구들의 목록 구축
BYOA 모델을 기반으로 한 AI 도구 목록을 제안하며, 사용자 친화적 가격을 강조합니다.
원문에서 자세히 보기: Reddit r/vibecoding
인텔리빅스, 신세계면세점에 AI 영상분석시스템 공급
인텔리빅스는 신세계면세점에 AI 영상분석시스템을 공급하여 예방 중심 안전관제를 구현했다.
원문에서 자세히 보기: AI Times
AI 에이전트의 자율성과 통제 문제
AI 에이전트 자율성 문제는 보안 및 통제로 이어지며 인적 감독이 중요해집니다.
원문에서 자세히 보기: TLDR AI
AWS 에이전트 시스템 구축 안내
AWS는 에이전트 시스템 구축을 위한 가이드를 제공하여 실질적인 도움을 줍니다.
원문에서 자세히 보기: TLDR AI
Matic, 1만 가정에 로봇 투입하기까지의 여정
Matic은 6-7년의 개발 끝에 미국산 가정용 로봇을 1만 가정에 공급했다.
원문에서 자세히 보기: TLDR Tech
diffium-db: 실시간 데이터베이스 변화 확인
diffium-db는 실시간으로 데이터베이스의 변화를 보여주는 TUI입니다.
원문에서 자세히 보기: TLDR AI
Muse Code: 효율적인 코딩 에이전트
Muse Code는 명령어를 처리하는 터미널 코딩 에이전트입니다.
원문에서 자세히 보기: TLDR AI