Skip to content

2026-08-24 Ai Daily 0700 Summary

수집일시: 2026-08-24 07:00:26 KST

전체 원본 보기

주요 뉴스

  • GLM-5.3 오픈 웨이트, Anthropic·OpenAI 모델을 5분의 1 비용으로 제침 - GLM-5.3 은 28개 실무 과제를 모두 통과하고 품질 점수 9.3을 받았으며, 전체 비용도 약 $0.28 로 gpt-5.5의 약 5분의 1에 그침 평가는 17개 모델에 동일한 프롬프트·API 호출·OpenRouter 스트리밍 경로와 결정론적 자동 채점 을 적용한 단일 시험이...
  • 태블릿 소유권을 되찾는 데 266달러와 AI 모델 4개를 썼고, GLM-5.3이 하루 만에 끝냈다 - 하루 최대 두 번 완전히 꺼지는 Amazon Fire HD 10에서 보호된 패키지를 제거하려고 5개월간 AI 모델 4개 를 동원했으며, 태블릿 가격의 두 배가 넘는 266.15달러 를 지출함 Kimi K3는 Fire OS 7.3.2.6에 남은 CVE-2022-38181 을 찾아 30시간·621개 ...
  • Linus Torvalds가 AI로 Intel GPU 드라이버 버그를 추적한 과정 - Intel Xe GPU 드라이버가 압축 하드웨어용 flat CCS 저장공간 일부를 VRAM으로 잘못 할당해 Battlemage G21 시스템에서 검은 화면과 gdm 재시작 루프를 일으킴 get_flat_ccs_offset() 이 CCS 시작 주소를 128KiB 단위로 올림하면서 실제 경계와 계산값 사이의 메모리까지...
  • Claude보다 Codex를 더 많이 써본 일주일 - 일주일간 비교해 보니 Claude는 사용자의 의도를 추측해 요청 이상으로 확장하는 반면, Codex는 명시된 범위에 집중 하고 완료 가능성이 보이면 멈추는 차이가 두드러졌음 Ruby/Rails 작업에서 Codex는 주석과 추상화, Sorbet 시그니처, 타입 별칭을 덜 추가해 더 단순한 코드...
  • 소프트웨어가 계속 느린 데는 이유가 있다 - LLM이 최적화 구현 비용을 낮춰도 성능 예산·우선순위 와 프로덕션 출시 비용까지 해결하지는 못하므로, 소프트웨어가 더 이상 느릴 이유가 없다는 전제는 현실에서 자주 무너짐 에이전트 작업이 비동기화되고 기능이 늘면서 사용자가 지연을 받아들이는 범위는 넓어지는 반면, 기업은...
  • 기억해 둘 만한 작은 네이티브 웹 기법 - 별도 라이브러리 없이 브라우저가 이미 제공하는 HTML/CSS/JS만으로 UI와 상호작용을 네이티브하게 구현하는 법 을 정리한 레퍼런스 사이트 :has() , @scope , Container Query처럼 컴포넌트 구조를 단순하게 만드는 CSS부터 dialog , Popover, ...
  • 로컬 LLM이 실제 성능보다 더 멍청하게 느껴지는 이유 - 같은 모델이라도 GPU·추론 엔진·어텐션 구현·양자화 방식 이 달라지면 계산 결과가 조금씩 달라지고, 긴 문맥에서는 그 차이가 실제 응답과 도구 호출 실패로 이어질 수 있음 약 10만 토큰의 실제 에이전트 작업 문맥에서 Qwen3.6-27B를 비교한 결과, 어텐션 백엔드만 바꿔도 후반부에...

상세 요약

1. GLM-5.3 오픈 웨이트, Anthropic·OpenAI 모델을 5분의 1 비용으로 제침

GLM-5.3 은 28개 실무 과제를 모두 통과하고 품질 점수 9.3을 받았으며, 전체 비용도 약 $0.28 로 gpt-5.5의 약 5분의 1에 그침 평가는 17개 모델에 동일한 프롬프트·API 호출·OpenRouter 스트리밍 경로와 결정론적 자동 채점 을 적용한 단일 시험이...

2. 태블릿 소유권을 되찾는 데 266달러와 AI 모델 4개를 썼고, GLM-5.3이 하루 만에 끝냈다

하루 최대 두 번 완전히 꺼지는 Amazon Fire HD 10에서 보호된 패키지를 제거하려고 5개월간 AI 모델 4개 를 동원했으며, 태블릿 가격의 두 배가 넘는 266.15달러 를 지출함 Kimi K3는 Fire OS 7.3.2.6에 남은 CVE-2022-38181 을 찾아 30시간·621개 ...

3. Linus Torvalds가 AI로 Intel GPU 드라이버 버그를 추적한 과정

Intel Xe GPU 드라이버가 압축 하드웨어용 flat CCS 저장공간 일부를 VRAM으로 잘못 할당해 Battlemage G21 시스템에서 검은 화면과 gdm 재시작 루프를 일으킴 get_flat_ccs_offset() 이 CCS 시작 주소를 128KiB 단위로 올림하면서 실제 경계와 계산값 사이의 메모리까지...

4. Claude보다 Codex를 더 많이 써본 일주일

일주일간 비교해 보니 Claude는 사용자의 의도를 추측해 요청 이상으로 확장하는 반면, Codex는 명시된 범위에 집중 하고 완료 가능성이 보이면 멈추는 차이가 두드러졌음 Ruby/Rails 작업에서 Codex는 주석과 추상화, Sorbet 시그니처, 타입 별칭을 덜 추가해 더 단순한 코드...

5. 소프트웨어가 계속 느린 데는 이유가 있다

LLM이 최적화 구현 비용을 낮춰도 성능 예산·우선순위 와 프로덕션 출시 비용까지 해결하지는 못하므로, 소프트웨어가 더 이상 느릴 이유가 없다는 전제는 현실에서 자주 무너짐 에이전트 작업이 비동기화되고 기능이 늘면서 사용자가 지연을 받아들이는 범위는 넓어지는 반면, 기업은...

6. 기억해 둘 만한 작은 네이티브 웹 기법

별도 라이브러리 없이 브라우저가 이미 제공하는 HTML/CSS/JS만으로 UI와 상호작용을 네이티브하게 구현하는 법 을 정리한 레퍼런스 사이트 :has() , @scope , Container Query처럼 컴포넌트 구조를 단순하게 만드는 CSS부터 dialog , Popover, ...

7. 로컬 LLM이 실제 성능보다 더 멍청하게 느껴지는 이유

같은 모델이라도 GPU·추론 엔진·어텐션 구현·양자화 방식 이 달라지면 계산 결과가 조금씩 달라지고, 긴 문맥에서는 그 차이가 실제 응답과 도구 호출 실패로 이어질 수 있음 약 10만 토큰의 실제 에이전트 작업 문맥에서 Qwen3.6-27B를 비교한 결과, 어텐션 백엔드만 바꿔도 후반부에...

관련 키워드

  • ai #daily #0700