44M 파라미터 초소형 LLM 'SHADOW-50M' 공개
Sera Daily Brief — 2026-09-15 — 45B 토큰으로 학습된 44M 규모의 초소형 모델로, CPU에서 초당 1,900토큰의 매우 빠른 추론 속도를 구현했습니다.
Items
1. NVIDIA Ampere GPU 최적화 llama.cpp 커스텀 포크 공개
- Source: r/LocalLLaMA (Local Inference) | Novelty: update
- Summary: RTX 3090 등 Ampere 아키텍처에 최적화되어 추론 속도를 대폭 향상시킨 llama.cpp 커스텀 포크가 공개되었습니다. 최대 240K 컨텍스트와 높은 TPS를 지원하여 로컬 LLM 실행 효율을 극대화할 수 있습니다.
- Projects: nanoflow
- Action: try
- 원문
2. 하이브리드 RAG 기반 기업 고객 지원 멀티 에이전트 프레임워크 ShopEase
- Source: ArXiv cs.CL (Research Paper) | Novelty: new
- Summary: LLaMA 3.2와 하이브리드 RAG를 결합하여 고객 지원을 자동화하는 ShopEase 프레임워크를 제안하고 다양한 검색 알고리즘의 성능을 비교 분석했습니다. 특히 밀집 검색(FAISS) 기반 방식이 가장 높은 정확도를 보였으며, 추가적인 리랭킹 과정이 오히려 지연 시간을 늘리고 성능 향상에 기여하지 않음을 입증했습니다.
- Projects: seronote
- Action: read
- 원문
3. 소프트웨어 엔지니어링 사고방식에 영향을 준 블로그 포스트 추천
- Source: Simon Willison (Best Practice) | Novelty: recurring
- Summary: 추상화의 법칙, 기술 부채 해결을 위한 마이그레이션, 엔지니어-매니저 간의 역할 전환 등 커리어 성장에 도움이 되는 핵심 개념들을 소개합니다. 이는 개발자가 기술적 깊이와 관리 역량을 동시에 갖추는 유연한 커리어 경로를 설계하는 데 중요한 통찰을 제공합니다.
- Projects: —
- Action: read
- 원문
4. 구글-NASA 협력: 크리스티나 코흐 우주비행사와 제임스 매니카의 기술 및 우주 탐사 대담
- Source: Google AI Blog (Other) | Novelty: recurring
- Summary: NASA의 크리스티나 코흐 우주비행사와 구글의 제임스 매니카가 우주 탐사에서 AI와 로보틱스의 역할에 대해 논의했습니다. 이는 최첨단 기술이 인류의 우주 확장과 지구 보호에 어떻게 기여하는지를 보여줍니다.
- Projects: —
- Action: watch
- 원문
5. 리톨츠 웰스 매니지먼트, 전사적 Claude 도입 위해 Hadrius AI 거버넌스 채택
- Source: Anthropic (GNews) (Other) | Novelty: new
- Summary: 리톨츠 웰스 매니지먼트가 Hadrius의 AI 거버넌스 솔루션을 통해 앤스로픽의 Claude를 전사적으로 도입합니다. 이는 금융 서비스 분야에서 AI 모델의 안전한 배포와 규제 준수를 위한 거버넌스 체계의 중요성을 보여줍니다.
- Projects: —
- Action: read
- 원문
6. iOS/macOS 비공개 코드서 Siri의 외부 AI(Claude, ChatGPT) 교체 가능성 발견
- Source: GeekNews (Community Shift) | Novelty: new
- Summary: iOS 27 및 macOS Golden Gate의 비공개 코드에서 Siri의 서버 모델을 외부 AI로 교체하거나 연결할 수 있는 구조가 확인되었습니다. 이는 애플 생태계 내에서 사용자가 선호하는 LLM을 Siri의 두뇌로 사용할 수 있는 가능성을 시사합니다.
- Projects: —
- Action: read
- 원문
7. 44M 파라미터 초소형 LLM 'SHADOW-50M' 공개
- Source: r/MachineLearning (Local Inference) | Novelty: new
- Summary: 45B 토큰으로 학습된 44M 규모의 초소형 모델로, CPU에서 초당 1,900토큰의 매우 빠른 추론 속도를 구현했습니다. 모델 크기를 19.8MB까지 줄여 저사양 환경에서의 추론 효율성과 추론 능력 실험 가능성을 제시했습니다.
- Projects: nanoflow
- Action: read
- 원문
8. 도구 실패 후 LLM의 허위 정보 생성 분석 및 해결 방안
- Source: ArXiv cs.CL (Research Paper) | Novelty: new
- Summary: 도구 증강 언어 모델이 도구 호출 실패 시 잘못된 값을 확신하며 답변하는 '패브리케이션' 현상을 분석하고, 상태 플래그 출력 강제를 통해 이를 획기적으로 줄이는 방법을 제시했습니다. 이는 에이전트 시스템의 신뢰성과 정직성을 확보하는 데 중요한 가이드라인을 제공합니다.
- Projects: seronote, nanoflow
- Action: read
- 원문
9. 애플 시리(Siri), 클로드 및 ChatGPT 등 외부 AI 모델로 교체 가능 확인
- Source: Hacker News (AI) (Framework Update) | Novelty: update
- Summary: iOS 27 및 macOS 프레임워크 분석 결과, 시리의 기본 AI 모델을 GPT-5.6나 클로드 같은 외부 모델로 완전히 대체하거나 연동할 수 있는 구조가 발견되었습니다. 이는 애플 생태계 내 AI 모델의 개방성을 높여 사용자 선택권을 넓히고 시스템 제어 능력을 확장할 수 있음을 시사합니다.
- Projects: seronote
- Action: read
- 원문
10. 2026 구글 DevFest 개최: 에이전트 시대의 개발과 확장
- Source: Google AI Blog (Community Shift) | Novelty: recurring
- Summary: 구글이 10월부터 12월까지 전 세계 115개국에서 커뮤니티 주도 기술 컨퍼런스인 DevFest 2026을 개최합니다. 이번 행사는 '에이전트 시대'를 주제로 Gemini와 Google AI Studio 등 최신 AI 도구의 실무 적용과 보안 및 확장에 집중합니다.
- Projects: —
- Action: read
- 원문
Stats
- Collected: 41262 | Deduped (kept): 38561 | Triaged: 39216 | Enriched: 1999
- Sources represented: 8/16
- Generated: 2026-09-15 06:06
