GLM, 자체 추론 인프라 구축
GLM이 자체 추론 인프라를 직접 구축했다는 소식이 전해졌다. 구체적인 사양이나 성능 지표는 아직 공개되지 않았다.
모델 제공사가 인프라까지 직접 통제하면 API 비용 구조와 지연 시간이 달라질 수 있어 도구 선택 시 참고할 지점이다.
GLM이 자체 추론 인프라를 직접 구축했다는 소식이 전해졌다. 구체적인 사양이나 성능 지표는 아직 공개되지 않았다.
모델 제공사가 인프라까지 직접 통제하면 API 비용 구조와 지연 시간이 달라질 수 있어 도구 선택 시 참고할 지점이다.
OpenAI가 모델의 misalignment(정렬 이탈)를 추적, 조사, 공개하는 프레임워크를 공유했다. 이와 함께 예상치 못하거나 우려되는 모델 행동 사례 6건도 함께 공개했다.
모델의 예상 밖 행동을 어떻게 탐지·보고하는지 알면 자사 시스템의 위험 모니터링 및 안전 점검 설계에 참고할 지점이 생긴다.
비공개 법원 문건이 공개되며 Microsoft가 내부적으로 OpenAI의 데이터 관행을 "절도"라 불렀던 사실이 드러났다. 두 회사는 New York Times의 유료 콘텐츠를 스크래핑해 데이터셋을 구축했고, 내부적으로 이것이 언론사들을 무너뜨릴 것이라 경고했다.
학습 데이터 출처와 저작권 소송 리스크가 모델 라이선스 계약과 데이터 파이프라인 설계에 직접적인 법적 부담으로 이어진다.
Claude Code가 Projects 기능을 개편해 여러 AI 에이전트를 하나의 클라우드 환경에서 관리할 수 있게 했다. 각 프로젝트는 공유 메모리, 목표, 파일 및 아티팩트 라이브러리를 갖추며 코디네이터가 여러 병렬 작업 스레드를 관리하고, 각 스레드는 자체 브랜치와 리포지토리 복사본에서 작동하는 별도의 클라우드 세션으로 겹치는 작업은 일반 PR처럼 머지 충돌로 처리된다.
병렬 에이전트 작업 흐름을 코드 리뷰 및 머지 프로세스에 통합해야 하는 개발팀의 워크플로 설계와 충돌 관리 방식에 직접 닿는다.
Google과 Google DeepMind 연구자들이 AGI의 안전한 개발과 사회적 영향을 연구·토론하는 DeepMind Institute(DMI)를 출범시켰다. 기술 개발뿐 아니라 일자리, 경제 정책, 인간 가치, 제도와 거버넌스까지 다루며 인문학·예술·정부 등 외부 참여도 확대할 계획이다.
AGI 안전과 거버넌스 논의가 기술 회사 내부 정책·연구 로드맵으로 제도화되는 흐름이라 관련 규제·윤리 대응을 준비하는 개발 조직의 설계 방향에 참고 지점이 생긴다.
Hacker News에 삼진(ternary) LLM의 1.58비트 한계를 넘어서는 연구가 소개됐다. 세부 방법과 수치는 공개되지 않았다.
모델 경량화·양자화로 추론 비용을 줄이려는 개발자라면 삼진 LLM의 압축 한계 돌파 시도를 눈여겨볼 지점이다.
OpenSpec은 가볍고 설정 가능한 AI 스펙 프레임워크로 소개됐다. Hacker News에 공개되어 개발자 커뮤니티의 주목을 받고 있다.
AI 기반 프로젝트에서 스펙을 정의하고 관리하는 새로운 경량 도구를 검토할 필요가 있는 개발자에게 닿는 소식이다.