Tag

빅테크

24편의 기록

판정 ·4분 읽기

격리는 주장이 아니라 증명이다

거부돼야 하는 요청을 CI가 매번 거부해 보이지 못하면 그것은 격리가 아니라 격리 주장이다.

노트 ·1분 읽기

80년 동안 수학자들이 풀지 못한 문제를, AI가 혼자 반증했다

에르되시의 unit distance 추측을 모델이 자율 반증했다. 검증이 가장 엄격한 도메인에서 AI가 '발견자'로 인정받은 순간.

노트 ·1분 읽기

주커버그가 직원 8천 명을 농락한 걸까?

직원 작업을 AI가 학습하고, 같은 분기에 8천 명이 감원됐다. 내 작업 흔적이 훈련 데이터가 될 때 던져지는 질문.

노트 ·1분 읽기

내 윈도우를 지켜주는 백신이 공격 통로가 됐다

MS 디펜더 제로데이 2건이 패치 전부터 실제 공격에 쓰였다. 최고 권한과 광범위 배포를 가진 백신은 매력적인 표적이다.

노트 ·2분 읽기

명령을 기다리지 않는 24시간 에이전트, Gemini Spark

'지시하면 처리'에서 '상시 위임'으로 넘어가는 첫 메이저 시도. 권한 위임 범위, 감사 경로, 회수 버튼이 다음 쟁점이다.

노트 ·1분 읽기

앱을 누르는 게 아니라, 앱한테 부탁한다

구글 Gemini Intelligence가 폰을 직접 조작하기 시작했다. AI에게 깊은 권한을 주는 만큼 공격 표면도 커진다.

노트 ·2분 읽기

npm 공급망 공격, 이번 표적은 AI 개발 회사들이다

TanStack부터 Mistral까지 한 주에 감염. 로컬에 풀어둔 API 키가 표적이다, 지금 당장 할 일 4가지.

노트 ·2분 읽기

범용을 버리고 하나를 극한까지, antirez의 로컬 LLM 엔진 ds4

284B MoE를 맥에서 초당 27토큰으로. 데이터가 밖으로 안 나가고 에이전트 루프를 돌려도 트래픽 0, 온디바이스 추론의 진짜 가치.

노트 ·1분 읽기

antirez가 만든 로컬 LLM 전용 엔진, 4일 만에 스타 4,800개

DeepSeek V4 Flash 하나만을 위한 C 싱글 파일 엔진 ds4. M3 Max에서 초당 27토큰, 실제 대화에 쓸 수 있는 속도다.

노트 ·2분 읽기

앤트로픽, 금융 에이전트 10개를 오픈소스로 풀었다

피치북 제작부터 KYC 심사까지 에이전트 10개가 한 리포에. MCP 커넥터 11개로 실무 금융 데이터에 직접 붙는다.

노트 ·1분 읽기

iOS 27, OS가 AI 모델의 시장이 된다

iOS 27 Extensions로 시리와 OS 기능이 외부 AI를 호출한다. 모델 교체 비용이 0이 되고, OS 레벨 데이터 게이트가 다음 논쟁거리.

노트 ·1분 읽기

은행권을 흔든 AI 사이버 공포, 정체는 새 데모였다

Claude Mythos 데모가 일으킨 은행권 히스테리. 새 무기가 아니라 새 데모였고, 시각화된 능력이 예산을 움직인다.

노트 ·2분 읽기

AI 에이전트 코드의 98.4%는 하네스다

Claude Code 유출 소스를 분석한 논문. 최소 스캐폴딩과 최대 하네스, 7겹 안전 레이어, 그리고 감독의 역설까지.

노트 ·1분 읽기

자신을 대체할 AI를 자기 손으로 훈련시키는 직원들

Meta가 미국 직원 PC에 추적 소프트웨어를 깔고 행동 데이터로 AI를 훈련한다. 동시에 8,000명 해고, 동의인가 21세기 인클로저인가.

노트 ·2분 읽기

Claude Mythos의 아키텍처를 역공학해봤다

가중치 없이 코드만으로 Claude Mythos 구조를 추정한 OpenMythos. 루프드 트랜스포머 실험과 LoRA 증류가 보여준 아키텍처와 행동의 분리.

노트 ·1분 읽기

Excel 파일 하나 열었더니 AI가 회사 데이터를 유출했다

Excel XSS가 Copilot Agent와 만나 클릭 없는 데이터 유출 체인이 됐다. 오래된 취약점이 AI 시대에 되살아나는 방식.

노트 ·2분 읽기

Vercel이 털렸다, 가장 위험한 단어는 '제한된 일부'다

영향 범위 비공개, 권고는 환경변수 회전 하나. 30분 내 대응 액션과 옵트인 보안 디폴트의 구조적 문제를 짚었다.

노트 ·2분 읽기

GPT-5.5 다음 주 출시 거의 확실하다?

트윗 하나에 Polymarket 확률이 87%까지. 루머를 믿지 말고 검증 절차를 믿는다, 4일 뒤 자동으로 답이 나온다.

노트 ·2분 읽기

Thunderbird 만드는 곳이 조용히 AI 앱 하나를 풀었다

MZLA의 로컬 AI 앱 Thunderbolt. 모델은 내가 고르고 데이터는 내가 소유한다는 원칙이 코드로 내려왔다.

노트 ·2분 읽기

클로드 4.7, 시스템 프롬프트 1408줄이 말하는 진짜 활용법

시스템 프롬프트 1408줄을 직접 읽고 찾아낸 4.7의 설계 변화. 공식 발표보다 프롬프트가 거짓말을 덜 한다.

노트 ·2분 읽기

모델을 고르는 능력보다 바꿀 수 있는 구조가 중요하다

7개월간 5개 모델, '최신'의 유통기한이 주 단위로 줄었다. OpenAI 코드네임 Spud로 읽는 모델 비종속 전략.

노트 ·1분 읽기

AI 에이전트의 검색 요청이 인간 유기적 검색의 88%에 도달했다

전체 웹 트래픽의 15%가 이미 AI 에이전트, 그중 95%가 OpenAI발. GA에는 안 잡힌다. SEO에서 AEO로 넘어가는 시점.

노트 ·4분 읽기

.claude/ 권한 버그, PermissionRequest hook으로 뚫는 법

문서와 코드가 다른 권한 버그를 코드 레벨로 추적, hook 자동 승인 워크어라운드를 테스트 20개로 검증하고 이슈에 남겼다.

노트 ·2분 읽기

클로드 코드는 더 똑똑해질 수 있다?

LLM은 똑똑한 봇일 뿐. 문제 유형 진단, 프레임워크 선택, 편향 체크를 거치는 메타인지 시스템으로 '똑똑한 사람'을 흉내 낸 실험.

← 태그 전체