2026년 9월 23일 수요일
2026-09-23 호 · 스토리 25개 · 원본 271건19
출시 · TechCrunch AI · 6건국내 반응 · AI타임스 · GeekNews

앤트로픽, Claude Opus 5.5 공개…비용 40% 인하

Anthropic releases Opus 5.5 with lower prices and Fable-level performance

앤트로픽이 Claude 5.5 제품군의 첫 모델인 Claude Opus 5.5를 공개했다. 복잡한 추론·에이전틱 코딩·컴퓨터 사용 벤치마크에서 최고 성능을 기록했으며, 기본 설정 작업 기준 운영 비용을 이전 모델 대비 40% 절감했고 테스트 샌드박스 탈출 시도 등 위험 행동에 대한 안전장치도 강화됐다.

에이전틱 코딩·복잡한 추론 작업에 Claude를 쓰는 개발자라면 동일 작업의 API 비용이 40% 줄어드는 만큼 모델 전환과 비용 재계산을 고려할 시점이다.

오늘의 7개2–7

  1. 출시 · TechCrunch AI · 3건국내 반응 · GeekNews

    OpenAI, GPT-6 Sol·Luna 출시

    OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes

    OpenAI가 GPT-6 Astra와 유사한 방식으로 훈련한 GPT-6 Sol과 Luna를 출시했다. 전문 업무, 사실 정확성, 코딩, 컴퓨터 사용, 정렬 성능을 더 빠르고 저렴한 모델로 확장하며 캐싱과 추론 효율 개선을 반영해 API 가격을 인하했다.

    API 비용을 낮추면서 코딩·정확성 성능은 유지했다는 점에서, 기존 모델을 쓰던 개발자는 모델 선택과 비용 구조를 다시 계산해볼 필요가 있다.

  2. 정책 · Hacker News

    AI 과신, 이란 학교 오폭 원인 지목

    Overreliance on AI contributed to missile strike on Iran school – Pentagon

    미 국방부가 이란 학교 미사일 오폭에 AI에 대한 과도한 의존이 영향을 미쳤다고 밝혔다. 관련 세부 내용은 추가로 공개되지 않았다.

    고위험 의사결정 시스템에서 AI 출력을 과신할 때 실제 피해로 이어질 수 있다는 점을 보여주며, 인간 검토와 검증 단계 설계의 필요성을 시사한다.

  3. 제품 · Hacker News

    AI 코딩이 빨라지자 CI가 병목이 됐다

    AI coding has made CI a bottleneck, so we reworked ours to keep up

    AI 코딩 도구의 확산으로 코드 생성 속도가 빨라지면서 CI(지속적 통합) 파이프라인이 개발 속도의 병목으로 지적됐다. 이에 한 팀이 CI 시스템을 이 속도에 맞춰 재구성했다고 밝혔다.

    AI로 코드 작성 속도가 빨라질수록 빌드·테스트·배포 파이프라인 설계와 CI 인프라 투자 우선순위를 재점검해야 한다는 신호다.

  4. 정책 · OpenAI

    OpenAI, 제3자 AI 안전성 평가 원칙 공개

    Priorities and principles for effective third party assessments

    OpenAI가 프런티어 모델과 안전장치에 대한 독립적인 제3자 평가를 위한 우선순위와 원칙을 발표했다. 평가는 엄격성, 보안성, 독립성을 갖춰야 한다고 강조했다.

    외부 감사·레드팀 기준이 표준화되면 프런티어 모델을 다루는 개발팀의 안전성 검증 및 규제 대응 절차 설계에 영향을 준다.

  5. 연구 · Hugging Face

    UK AISI·EvalEval, 벤치마크 재현성 개선

    How UK AISI and EvalEval Are Making Benchmark Results Reproducible

    UK AISI와 EvalEval이 벤치마크 평가 결과의 재현성을 높이기 위한 작업을 진행하고 있다. Hugging Face 블로그가 이 협업 내용을 다뤘다.

    모델 평가 결과를 신뢰하고 비교할 때 벤치마크 재현성 기준이 도구 선택과 성능 검증 방식에 영향을 준다.

  6. 제품 · Hugging Face

    Transformers, llama.cpp 양자화 모델 지원

    Transformers now runs llama.cpp quants

    Hugging Face의 Transformers 라이브러리가 llama.cpp의 quant 포맷 모델을 실행할 수 있게 됐다. 이를 통해 llama.cpp로 양자화된 모델을 Transformers 생태계에서 바로 활용할 수 있다.

    Transformers 사용자가 별도 변환 없이 llama.cpp 양자화 모델을 불러와 추론 파이프라인과 도구 선택 범위를 넓힐 수 있는 지점에 닿는다.

오늘의 릴리스3

  1. ollama v0.34.3모델의 thinking 설정 정보를 API와 CLI에서 바로 확인할 수 있게 됐다트래커·GitHub
  2. codex rust-v0.156.0전체화면 UI와 음성 대화, 사용량 대시보드가 새로 추가됐다트래커·GitHub
  3. claude-code v2.1.280Opus 5.5가 기본 모델이 되고 다이얼로그·터미널 입력 버그가 대거 수정됐다트래커·GitHub

그 밖에18

  1. Better prompt caching for GPT-6
    OpenAI·06:00
  2. Jev introduces a new shape of LLM - System One, aka Decision Models
    Simon Willison·9/22 08:09
  3. Qualcomm launches two new smartphone chips with emphasis on AI
    TechCrunch AI·05:00
  4. Microsoft disrupts AI-assisted platform that compromised 12,000 accounts
    Ars Technica AI·04:45·댓글
  5. Lawsuit demands OpenAI pay for new school after ChatGPT used in shooting
    Ars Technica AI·04:28·댓글
  6. OpenAI GPT–6 Astra breaks Enigma message that has resisted solution since 2005
    Hacker News·9/22 22:52·173점·댓글
  7. OpenAI is well positioned to fast-follow Jev
    Hacker News·9/22 23:42·136점·댓글
  8. AI Has No Wisdom and Neither Will You
    Hacker News·9/22 21:11·113점·댓글
  9. Can gzip be a language model?
    Hacker News·9/22 15:08·115점·댓글
  10. Claude Status – Elevated errors for multiple models
    Hacker News·9/22 10:05·109점·댓글
  11. Transformers Explained Visually
    Hacker News·9/22 04:43·103점·댓글
  12. Frontier AI on Your Own Hardware
    Hacker News·9/22 03:53·106점·댓글
  13. llm-typesafe 0.1a0
    Simon Willison·00:54
  14. Cloudflare Python Workers are now generally available
    Simon Willison·9/22 07:25
  15. Meta admits Muse’s likeness to OpenClaw isn’t a coincidence
    TechCrunch AI·04:09
  16. Jun Kim, oMLX creator and maintainer, joins Hugging Face to support the MLX community
    Hugging Face·9/22 09:00
  17. Quoting @therealcornpop
    Simon Willison·03:03
  18. Jev: System One models for Prod, not God — with Diogo Almeida, CEO, TypeSafe AI
    Latent Space·9/22 07:13