OpenAI, 저지연 음성 에이전트용 GPT-Realtime-2.1 시리즈를 API에 공개하다
OpenAI가 GPT-Realtime-2.1과 추론 기능을 갖춘 GPT-Realtime-2.1-mini를 Realtime API에 추가했다. p95 레이턴시 최소 25% 절감, 동일 가격대 유지, WebRTC 공식 지원으로 저지연 음성 에이전트 구현이 한층 수월해졌다.
ai_opensource_automatic
OpenAI가 GPT-Realtime-2.1과 추론 기능을 갖춘 GPT-Realtime-2.1-mini를 Realtime API에 추가했다. p95 레이턴시 최소 25% 절감, 동일 가격대 유지, WebRTC 공식 지원으로 저지연 음성 에이전트 구현이 한층 수월해졌다.
GLM 5.2 오픈 가중치 모델이 Opus·GPT급 에이전트 작업에 근접한 품질을 보이며 $25/MTok 추론비 구조와 호환 API 전환 비용을 통해 폐쇄형 프런티어 모델의 추론 마진에 어떤 압력을 주는지 분석한 글. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무
텐센트가 공개한 Hy3는 총 295B 파라미터 중 토큰당 21B만 활성화하는 하이브리드 MoE 오픈소스 LLM이다. 256K 컨텍스트와 Apache 2.0 라이선스, SWE-Bench Verified 78.0 점수까지 핵심 사양과 경쟁 구도를 정리한다. 핵심 쟁점과 실무 적용 포인트를
Anthropic이 Claude 구독 사용처를 자사 도구 중심으로 제한하고 제3자 에이전트에 별도 과금을 적용하는 정책 변화를 정리한다. 개발자 비용 구조, Vertex AI 연동 차별화, 오픈소스 대안 확산 가능성까지 다룬 산업 리포트. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다
허깅페이스 모델 카드에서 아마존 세이지메이커 스튜디오 실험 환경으로 이어지는 딥링크 통합의 동작 방식, 개발자 워크플로우 변화, 파운데이션 모델 프로토타이핑 효과를 정리한 분석 글. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다.
AWS ML Blog의 1차 공식 자료를 바탕으로 Amazon Bedrock 환경에서 미니맥스(MiniMax) 모델을 호출하는 절차, 온디맨드 추론의 자동 스케일링 구조, 그리고 에이전트·장문 문서 분석·소프트웨어 엔지니어링 워크플로우 세 가지 대표 활용 사례를 정리한 실무 가이드.
LeRobot v0.6.0 릴리스를 분석한 글. 8명의 메인테이너 공동 작업과 Imagine-Evaluate-Improve 컨셉으로 정책 시뮬레이션과 평가 파이프라인을 통합한 오픈소스 로봇 정책 생태계 변화를 다룬다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무
OpenScience는 Apache-2.0 기반 오픈소스 AI 워크벤치로, 프론티어 모델과 오픈웨이트 모델을 모두 지원하는 모델 비종속 구조다. 머신러닝·생물학·물리학·화학 4개 분야를 단일 환경에서 다루며 250개 이상 편집 가능 스킬과 조회형 과학 데이터베이스를 기본 탑재해 데이터
AI가 코드 작성과 테스트를 직접 수행하는 시대에 개발자의 역할은 단순 코딩 실행자에서 문제 정의, 작업 설계, 검증, 제품화를 아우르는 상위 설계자로 이동하는 흐름을 한국 개발자 현장 사례와 함께 분석한 해설. 핵심 쟁점과 실무 적용 포인트를 함께 정리합니다. 핵심 쟁점과 실무 적용
장문맥 LLM 학습에서 LM head와 Cross Entropy Loss가 만드는 logits 메모리 병목의 구조적 원리와 분리형 Cross Entropy로 이를 해소하는 접근을 16B 모델과 128K context 사례를 중심으로 해부한다. 핵심 쟁점과 실무 적용 포인트를 함께 정리합