SOWN - Daily News

SomeWhere Olny We Know

Daily News #2026-08-02



  • LiteLLM v1.95.0-rc.3 버전 발표
  • llama.cpp 버전 b10218 발표 요약
  • AI 모델 주의를 공동 설계하여 빠른 장기 맥락 추론 지원
  • OpenAI, 새로운 모델 ‘Astra’ 발표 및 수학 문제 해결 성과
  • DeepSeek V4-Flash 0731 모델 출시 및 가격 인하
  • 오픈AI, GPT-5.6 시리즈 가격 대폭 인하 및 사용자 수 10억 돌파
  • DeepMind, Gemini Robotics 2 공개
  • AI 코딩 에이전트, 연구 소프트웨어 현대화 가능
  • Gemini Spark, Chrome에 로그인 정보 활용 자동화 기능 추가
  • 몬태나의 ‘시도할 권리’ 법안, 바이오테크 혁신 촉진
  • Stateless MCP 2.0의 새로운 장 (MCP)
  • 바이트댄스, Seedance 2.5 공개로 짧은 AI 영상 제작 가능
  • ChatGPT, 사용자 취향 반영한 자동 업무 수행 기능 확대
  • OpenAI 모델, 운영 비용 절감
  • 문샷 AI, 알리바바로부터 2만 개 엔비디아 GPU 클러스터 확보
  • AI 에이전트, 4일 반 동안의 자율적 행동
  • 싱킹 머신즈, 효율성 강조한 오픈웨이트 모델 잉클링-스몰 공개
  • LG AI연구원, K-엑사원 2.0 공개로 성능 개선
  • 모델 평가 프레임워크 ‘smevals’ 발표
  • 미니맥스, 멀티모달 영상 생성 모델 H3 발표

LiteLLM v1.95.0-rc.3 버전 발표

LiteLLM v1.95.0-rc.3에서 Docker 이미지의 서명을 cosign을 통해 검증할 수 있도록 안내하며, 두 가지 방법을 제시한다. 첫 번째 방법은 커밋 해시를 사용하여 서명 키의 진위를 검증하는 것이며, 두 번째 방법은 릴리스 태그를 이용한 더 간단한 방법이다. 이 버전에서는 내부 스테이징을 메인으로 승격하는 작업이 여러 번 이루어졌고, Azure AI와 관련된 1M 컨텍스트 윈도우 지원과 기타 UI 수정이 포함되었다. 특정 사용자 인터페이스 요소의 스타일과 크기를 조정하고, Python 설치 시 명시적인 버전 요청을 전달하는 등의 버그 수정도 진행되었다. 이후 릴리스를 이용해 자신이 개발 중인 프로젝트의 Docker 이미지 서명을 검증할 수 있다.

원문에서 자세히 보기: LiteLLM Releases

llama.cpp 버전 b10218 발표 요약

이번 버전에서는 minicpmv46 다운샘플 기능이 추가되었으며, 코드에서 다운샘플 모드가 gguf 내부에 통합되었습니다. mtmd_image_preprocessor_llava_uhd의 빌드가 이루어졌고, 관련된 여러 코드가 수정되었습니다. 4배 무시 vit 병합 기능도 추가되었습니다. 이 업데이트는 macOS, Linux, Android, Windows, openEuler 플랫폼에서 사용 가능하며, 다양한 CPU 및 GPU 옵션을 지원합니다. 한국 개발자는 이 버전을 이용해 다양한 하드웨어 환경에 맞춘 최적화된 애플리케이션을 개발할 수 있다.

원문에서 자세히 보기: llama.cpp Releases

AI 모델 주의를 공동 설계하여 빠른 장기 맥락 추론 지원

최근 긴 맥락을 가진 작업이 증가하면서, 긴 맥락의 처리에서 주의 메커니즘이 차지하는 비율도 커지고 있다. NVIDIA에서는 AI 모델의 효율성을 높이기 위해 새로운 공동 설계 접근 방식을 개발하였다. 이 방법론은 모델의 성능을 극대화하고 동시에 추론 속도를 개선하며, 다양한 맥락 길이에 대해 빠른 응답을 가능하게 한다. 이 기술은 특히 대화형 AI와 같이 긴 맥락 정보를 필요로 하는 어플리케이션에 적합하다. 새로운 접근 방식을 통해 추론 시간의 최적화가 이루어진다. 개발자들은 이를 활용하여 장기 맥락 처리 능력을 강화할 수 있다.

원문에서 자세히 보기: NVIDIA Technical Blog

OpenAI, 새로운 모델 ‘Astra’ 발표 및 수학 문제 해결 성과

OpenAI는 새로운 모델 패밀리 ‘Astra’를 발표하며, 이 모델이 여러 에이전트가 복잡한 문제를 함께 해결할 수 있도록 할 것이라고 밝혔다. 이미 샘 올트먼 CEO는 이 모델을 워싱턴의 정책 결정자들에게 시연한 바 있다. Astra의 명칭이 GPT-6이 될지 아니면 GPT-5의 변형이 될지는 아직 결정되지 않았다. 또한 OpenAI는 기하학, 암호학, 복잡성 이론 등에서 오랫동안 해결되지 않았던 수학 문제에 대한 새로운 결과를 공유했다.

참고 출처 (2개 매체 종합)

DeepSeek V4-Flash 0731 모델 출시 및 가격 인하

DeepSeek이 V4-Flash 0731 모델을 MIT 라이선스 하에 공개하며, 해당 모델은 304억 개의 매개변수를 포함하고 있다. 가격은 100만 토큰당 $0.28로, 기존 모델 대비 4배 저렴하다. 새로운 DSpark 디코딩 모듈 덕분에 생성 속도가 60~85% 향상되었으며, 성능면에서도 MiniMax M3와 같은 상위 등급 모델을 초월한 것으로 평가된다. 이 모델은 특히 비용 대비 지능이 뛰어나 많은 사용자들로부터 주목받고 있다.

참고 출처 (5개 매체 종합)

오픈AI, GPT-5.6 시리즈 가격 대폭 인하 및 사용자 수 10억 돌파

오픈AI가 새로운 GPT-5.6 시리즈의 가격을 대폭 인하하며, 현재 10억 명 이상의 사용자가 활성화된 상태라고 발표했다. 이는 AI 서비스의 가격 인하가 사용자 증가에 기여하고 있으며, 이러한 수요 증가는 차세대 모델과 인프라 개발에 대한 투자로 이어지는 ‘AI 선순환’ 전략을 강화하고 있음을 보여준다. 기업 고객 수는 200만 개 이상으로, 개인 사용자뿐만 아니라 기업에서도 AI 도입이 활발하게 이루어지고 있는 상황이다.

참고 출처 (2개 매체 종합)

DeepMind, Gemini Robotics 2 공개

Google DeepMind가 다양한 로봇을 지원하는 고급 비전-언어-행동 모델인 Gemini Robotics 2를 발표.

원문에서 자세히 보기: THE DECODER

AI 코딩 에이전트, 연구 소프트웨어 현대화 가능

AI 코딩 에이전트가 연구 소프트웨어를 최대 60배 빠르게 현대화할 수 있으나, 과학적 정확성 판단은 어려움.

원문에서 자세히 보기: THE DECODER

Gemini Spark, Chrome에 로그인 정보 활용 자동화 기능 추가

Google의 Gemini Spark가 Chrome에 로그인 정보 활용 웹 자동화 기능을 추가했다.

원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)

몬태나의 ‘시도할 권리’ 법안, 바이오테크 혁신 촉진

몬태나에서 바이오테크 회사들이 초기 테스트를 통과한 약물 사용을 촉진하는 법안이 제정되었습니다.

원문에서 자세히 보기: MIT Technology Review

Stateless MCP 2.0의 새로운 장 (MCP)

Stateless MCP 2.0의 출시로 단일 HTTP 요청을 통해 구현이 간소화되었다.

원문에서 자세히 보기: Simon Willison

바이트댄스, Seedance 2.5 공개로 짧은 AI 영상 제작 가능

바이트댄스가 Seedance 2.5를 공개해 AI로 짧은 영상을 제작할 수 있게 했다.

원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)

ChatGPT, 사용자 취향 반영한 자동 업무 수행 기능 확대

ChatGPT가 사용자 취향에 따라 자동으로 업무를 수행하는 기능을 확대하고 있다.

원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)

OpenAI 모델, 운영 비용 절감

OpenAI 모델들이 새로운 방식으로 운영 비용을 줄이고 있는 점이 주목받고 있다.

원문에서 자세히 보기: The Rundown AI

문샷 AI, 알리바바로부터 2만 개 엔비디아 GPU 클러스터 확보

문샷 AI가 알리바바로부터 2만 개의 엔비디아 GPU 클러스터를 확보했습니다.

원문에서 자세히 보기: AI Times

AI 에이전트, 4일 반 동안의 자율적 행동

AI 에이전트가 4일 반 동안 17,600개 행동을 자율적으로 수행했습니다.

원문에서 자세히 보기: ai-news-daily (Local LLM Aggregator)

싱킹 머신즈, 효율성 강조한 오픈웨이트 모델 잉클링-스몰 공개

싱킹 머신즈가 오픈웨이트 모델 잉클링-스몰을 발표하며 효율성을 강조했습니다.

원문에서 자세히 보기: AI Times

LG AI연구원, K-엑사원 2.0 공개로 성능 개선

LG AI연구원이 K-엑사원 2.0 모델을 공개하고 성능을 크게 개선했다.

원문에서 자세히 보기: GENEXIS-AI DailyNews (openchoi 이어받음)

모델 평가 프레임워크 ‘smevals’ 발표

smevals는 다양한 모델 성능을 측정하는 새로운 평가 툴이다.

원문에서 자세히 보기: Simon Willison

미니맥스, 멀티모달 영상 생성 모델 H3 발표

미니맥스가 차세대 멀티모달 영상 생성 모델 H3를 공개했습니다.

원문에서 자세히 보기: AI Times