Liquid AI LFM2.5-Embedding-350M과 LFM2.5-ColBERT-350M 분석: 엣지 디바이스 시대의 다국어 듀얼 검색 모델
Liquid AI가 엣지 디바이스용 다국어 검색을 위해 350M 파라미터 규모의 LFM2.5-Embedding-350M과 LFM2.5-ColBERT-350M 두 모델을 동시에 공개했다. Dense Bi-Encoder와 Late-Interaction 듀얼 구조의 특징과 전략적 의의를 분석
ai_opensource_automatic
Liquid AI가 엣지 디바이스용 다국어 검색을 위해 350M 파라미터 규모의 LFM2.5-Embedding-350M과 LFM2.5-ColBERT-350M 두 모델을 동시에 공개했다. Dense Bi-Encoder와 Late-Interaction 듀얼 구조의 특징과 전략적 의의를 분석
로컬 Qwen 3.6 27B는 클라우드 SOTA 대비 범용 벤치마크 점수에서 열위에 있지만, 외부 반출이 어려운 고객 데이터와 내부 텔레메트리 처리에서 운영적 가치를 제공한다. 고정 비용 구조, 데이터 주권, 단일 벤더 종속 리스크 완화라는 세 가지 강점을 중심으로, 로컬과 클라우드를
Noam Shazeer가 Google Gemini 공동 리드 자리에서 2026년 6월 OpenAI 합류를 공식 발표했다. Transformer 공동 저자이자 Character.ai 창업자까지, LLM 1세대 아키텍처 지적 계보의 한 회사 응집 신호와 업계 함의를 정리한다.
Perplexity Brain은 Computer 에이전트의 작업 이력을 컨텍스트 그래프로 축적하고, 하룻밤 복기로 정답률·재현율·비용 개선을 겨냥한 자기 개선 메모리 시스템으로 소개된다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다.
AWS가 2026년 6월 Amazon Bedrock AgentCore harness를 정식 출시했다. CreateHarness와 InvokeHarness 두 API로 에이전트를 정의·실행하는 서버리스형 관리형 런타임으로, 격리 환경과 메모리·스킬·도구를 표준 제공한다.
OpenAI 추론 모델이 희귀 유전 질환 진단 보조에 활용되어 18건의 새로운 진단을 도출한 연구를 OpenAI Blog가 공식 게재했다. 의료 AI의 임상적 성과와 한계, 향후 과제를 분석한다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무 적용 포인트를 함께 정
LLM long-context 추론에서 KV Cache 압축은 핵심 최적화 과제입니다. TurboQuant의 양자화, OSCAR의 메모리·디스크 오프로딩, EpiCache의 eviction·prefetch 정책을 정확도 손실, 압축률, TTFT, 처리량 기준으로 비교합니다.
앤트로픽이 2026년 6월 17일 서울 여의도 콘래드 호텔에서 기자간담회를 열고 서울 사무소를 공식 출범했다. 한국은 도쿄·벵갈루루에 이은 세 번째 APAC 거점으로, 1인당 Claude 사용량이 세계 평균의 3.5배에 이른다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다.
OpenAI가 2026년 6월 공개한 LifeSciBench는 750개 실제 생명과학 연구 과제로 구성된 벤치마크로, 전문가 작성 루브릭으로 AI 연구 역량을 다면 평가한다. 기존 벤치마크와의 차별점과 산업·학술적 영향을 정리한다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다.
Vercel이 공개한 오픈소스 에이전트 프레임워크 eve는 ‘에이전트=디렉터리’라는 파일 시스템 중심 설계를 채택해 durable execution, sandbox, approvals, connections, channels, evals를 내장했다. 본문에서 그 컨셉과 워크플로우를 분석