2026년 9월 18일 금요일
2026-09-18 호 · 스토리 25개 · 원본 264건14
제품 · Hacker News

GLM, 자체 추론 인프라 구축

GLM Built Its Own Inference Infrastructure

GLM이 자체 추론 인프라를 직접 구축했다는 소식이 전해졌다. 구체적인 사양이나 성능 지표는 아직 공개되지 않았다.

모델 제공사가 인프라까지 직접 통제하면 API 비용 구조와 지연 시간이 달라질 수 있어 도구 선택 시 참고할 지점이다.

다룬 곳·Hacker News 115점

오늘의 7개2–7

  1. 정책 · OpenAI

    OpenAI, 모델 정렬 이탈 보고 체계 공개

    Our framework for reporting model misalignment

    OpenAI가 모델의 misalignment(정렬 이탈)를 추적, 조사, 공개하는 프레임워크를 공유했다. 이와 함께 예상치 못하거나 우려되는 모델 행동 사례 6건도 함께 공개했다.

    모델의 예상 밖 행동을 어떻게 탐지·보고하는지 알면 자사 시스템의 위험 모니터링 및 안전 점검 설계에 참고할 지점이 생긴다.

  2. 산업 · TechCrunch AI · 2건

    Microsoft 임원 "AI 스크래핑은 대규모 절도"

    Microsoft exec called AI scraping ‘the largest theft of labor in human history,’ new unredacted filings reveal

    비공개 법원 문건이 공개되며 Microsoft가 내부적으로 OpenAI의 데이터 관행을 "절도"라 불렀던 사실이 드러났다. 두 회사는 New York Times의 유료 콘텐츠를 스크래핑해 데이터셋을 구축했고, 내부적으로 이것이 언론사들을 무너뜨릴 것이라 경고했다.

    학습 데이터 출처와 저작권 소송 리스크가 모델 라이선스 계약과 데이터 파이프라인 설계에 직접적인 법적 부담으로 이어진다.

  3. 제품 · The Verge AI

    Claude Code, 클라우드 멀티 에이전트 Projects 재출시

    Claude Code relaunches Projects to manage multiple AI agents in the cloud

    Claude Code가 Projects 기능을 개편해 여러 AI 에이전트를 하나의 클라우드 환경에서 관리할 수 있게 했다. 각 프로젝트는 공유 메모리, 목표, 파일 및 아티팩트 라이브러리를 갖추며 코디네이터가 여러 병렬 작업 스레드를 관리하고, 각 스레드는 자체 브랜치와 리포지토리 복사본에서 작동하는 별도의 클라우드 세션으로 겹치는 작업은 일반 PR처럼 머지 충돌로 처리된다.

    병렬 에이전트 작업 흐름을 코드 리뷰 및 머지 프로세스에 통합해야 하는 개발팀의 워크플로 설계와 충돌 관리 방식에 직접 닿는다.

  4. 산업 · Hacker News · 2건국내 반응 · GeekNews

    Google, DeepMind Institute 출범

    The DeepMind Institute

    Google과 Google DeepMind 연구자들이 AGI의 안전한 개발과 사회적 영향을 연구·토론하는 DeepMind Institute(DMI)를 출범시켰다. 기술 개발뿐 아니라 일자리, 경제 정책, 인간 가치, 제도와 거버넌스까지 다루며 인문학·예술·정부 등 외부 참여도 확대할 계획이다.

    AGI 안전과 거버넌스 논의가 기술 회사 내부 정책·연구 로드맵으로 제도화되는 흐름이라 관련 규제·윤리 대응을 준비하는 개발 조직의 설계 방향에 참고 지점이 생긴다.

  5. 연구 · Hacker News

    삼진 LLM, 1.58비트 장벽 넘는 연구 공개

    Breaking the 1.58-bit Barrier for Ternary LLMs

    Hacker News에 삼진(ternary) LLM의 1.58비트 한계를 넘어서는 연구가 소개됐다. 세부 방법과 수치는 공개되지 않았다.

    모델 경량화·양자화로 추론 비용을 줄이려는 개발자라면 삼진 LLM의 압축 한계 돌파 시도를 눈여겨볼 지점이다.

  6. 제품 · Hacker News

    OpenSpec, 가벼운 AI 스펙 프레임워크 공개

    OpenSpec – A lightweight and configurable AI spec framework

    OpenSpec은 가볍고 설정 가능한 AI 스펙 프레임워크로 소개됐다. Hacker News에 공개되어 개발자 커뮤니티의 주목을 받고 있다.

    AI 기반 프로젝트에서 스펙을 정의하고 관리하는 새로운 경량 도구를 검토할 필요가 있는 개발자에게 닿는 소식이다.

오늘의 릴리스4

  1. ollama v0.34.2긴 생성 시 메모리 누적 문제가 해결돼 대용량 컨텍스트에서도 안정적으로 동작한다트래커·GitHub
  2. codex rust-v0.155.0요약 준비 중트래커·GitHub
  3. vllm proto-v0.3.0릴리스 노트 없음트래커·GitHub
  4. claude-code v2.1.274MCP 연결 안정성과 세션 복구 관련 다수 오류가 개선됐다트래커·GitHub

그 밖에17

  1. Nvidia announces native GPU programming in Rust
    Hacker News·9/16 20:15·152점·댓글
  2. OpenAI caught its models leaving notes to successors to hide bad behavior
    TechCrunch AI·05:34
  3. HarnessTax: How Much Does the Harness Matter for Coding Agents?
    Hacker News·9/17 07:10·104점·댓글
  4. Introducing Astra for Law
    OpenAI·9/17 09:00
  5. Introducing the Life Sciences Verification Program
    Anthropic·9/17 09:00
  6. Google announces new experimental "CC" AI agent for families
    Ars Technica AI·05:24
  7. LLMs respond differently to harmful prompts when AI watermarking is used
    Ars Technica AI·03:33·댓글
  8. Show HN: Share your AI Setup, Learn from others
    Hacker News·9/17 22:01·113점·댓글
  9. AI Safety Is Mostly a Sex Cult
    Hacker News·9/17 17:36·110점·댓글
  10. I Don't Like LLMs
    Hacker News·9/17 22:57·105점·댓글
  11. The future of practice: Enabling teachers to create learning interactives with generative UI
    Google Research·05:45
  12. Making global data easier to explore
    Google AI·05:00
  13. datasette 1.0a40
    Simon Willison·9/17 08:51
  14. The fix for rogue AI agents could be more AI
    TechCrunch AI·05:34
  15. Is the AI safety debate about safety or control?
    TechCrunch AI·05:19
  16. UN turns to Google to make its global data ready for AI agents
    TechCrunch AI·05:00
  17. The AI Superintelligence Slowdown
    The Verge AI·04:28

국내 · 이미 한국어로 읽을 수 있는 것1

  1. 플로우, 국산 협업툴 최초 챗GPT·클로드 앱 동시 입점
    AI타임스·01:26