-
연구 · Hacker News · 2건국내 반응 · GeekNews
GPT-5.6 Luna vs. GPT-6 Astra: Is a $1.20 Model Good Enough for Code Review?
공개 PR 50개 검토에서 GPT-5.6 Luna는 검증된 버그 69개, GPT-6 Astra는 92개를 발견했다. Luna는 Astra 대비 버그 발견 수의 75%를 비용의 3.6%로 달성했으나, Luna가 지적한 93건 중 24건만 검증을 통과해 정확도 차이는 뚜렷했다.
코드 리뷰 자동화 도구를 고를 때 비용 대비 오탐률까지 함께 봐야 한다는 판단 근거를 제공한다.
-
제품 · Hacker News · 2건국내 반응 · GeekNews
Building a Linux GPU Driver for the M4 Mac Mini in One Month
Cody Ho와 Niklas가 약 한 달 만에 M4 Mac Mini와 MacBook Neo용 OpenGL ES 3.0 완전 준수 GPU 드라이버를 개발했다. 기존 하이퍼바이저로 macOS의 GPU 동작을 관찰·재생하며 AGX 펌웨어 ABI를 역공학했고, Apple 바이너리를 보지 않는 클린룸 방식으로 진행했다.
Apple Silicon 리눅스 GPU 드라이버의 클린룸 역공학 방식과 개발 속도는 향후 M시리즈 기기에서 리눅스 그래픽 스택을 직접 다루려는 개발자에게 참고할 수 있는 접근법을 보여준다.
-
산업 · Hacker News
There's a 100% Chance AI Agents Are Ruining the Internet
AI 에이전트가 인터넷을 망치고 있다는 주장을 담은 글이 Hacker News에서 화제가 됐다. 제목 외 구체적인 근거나 수치는 확인되지 않았다.
AI 에이전트를 웹에 배포할 때 발생하는 스팸·트래픽 오염 등 부작용을 개발자가 설계 단계에서 점검해야 한다는 경고로 닿는다.
-
연구 · Hacker News
How much of F-Droid is LLM generated?
Hacker News에서 오픈소스 앱스토어 F-Droid의 코드나 기여물 중 얼마나 많은 부분이 LLM으로 생성되었는지에 대한 논의가 제기됐다. 구체적인 수치나 조사 결과는 알려지지 않았다.
오픈소스 프로젝트에 LLM 생성 기여물이 얼마나 섞여 있는지는 코드 신뢰성 검증과 리뷰 프로세스 설계에 영향을 준다.
-
산업 · Hacker News
Hugging Face is billing OpenAI $100M for hacking it
Hugging Face가 OpenAI에 해킹 관련으로 1억 달러를 청구했다는 소식이 전해졌다. 자세한 경위는 아직 알려지지 않았다.
두 주요 AI 인프라 업체 간 법적·재정적 분쟁이 불거지면 모델 호스팅과 플랫폼 이용에 따른 리스크 관리 기준을 다시 점검할 필요가 생긴다.
-
그 밖에 · Hacker News
Why I'm still bearish on LLMs after Navier-Stokes
한 개발자가 Navier-Stokes 관련 사례를 언급하며 LLM에 대한 회의적 시각을 밝힌 글이 Hacker News에 올라왔다. 구체적인 논거나 데이터는 스니펫에 제공되지 않았다.
LLM을 수학·과학 난제 해결 도구로 신뢰할지 판단할 때 참고할 반론 사례로, 도구 선택 시 과대평가를 경계하게 하는 지점이다.