Tag

오픈소스

35편의 기록

아티클 ·1분 읽기

아티클 렌더링 검증

장문 아티클 채널의 구조를 확인하는 검증용 문서

판정 ·4분 읽기

격리는 주장이 아니라 증명이다

거부돼야 하는 요청을 CI가 매번 거부해 보이지 못하면 그것은 격리가 아니라 격리 주장이다.

판정 ·3분 읽기

모델은 점수가 아니라 방법으로 고른다

리더보드 1.38pt 차이는 노이즈였다. 교체 판단은 사전 동결한 decision rule과 자기 워크로드 실측이 만든다.

판정 ·2분 읽기

에이전트 기억은 조회를 믿으면 안 된다

1주 211건 운영 실측에서 recall 재현율은 15.6%였다. 조회는 완전성을 보장하지 않는다.

판정 ·3분 읽기

측정하지 않은 것을 측정했다고 하지 않는다

조건 라벨을 뗀 수치는 측정이 아니라 주장이다. 라벨과 함께 쓸 수 없는 수치는 버린다.

판정 ·2분 읽기

에이전트는 모델이 아니라 배선이 결정한다

관측된 에이전트 실패는 전부 연결 방식과 강제 지점 문제였다. 모델 교체로 해결된 건 하나도 없다.

노트 ·2분 읽기

LobeHub이 자기 포지셔닝을 조용히 바꿨다

도구가 아니라 '에이전트 직원을 채용, 관리, 보고받는 운영 플랫폼'으로. 사람이 에이전트 팀의 매니저가 되는 프레임.

노트 ·1분 읽기

깃허브에서 하루에 별이 93개씩 쌓이는 리포가 있다

자율 코딩 에이전트 OpenHands. 제번스 역설대로면 코드는 줄지 않고 폭증한다, 병목은 생성이 아니라 검증으로 옮겨간다.

노트 ·2분 읽기

AI 에이전트가 굴리는 헷지펀드, 별 5.8만의 의미

애널리스트, 리스크, 포트폴리오 매니저를 에이전트가 분담한다. 창조적 파괴가 직무가 아니라 분업 구조 전체를 노린다.

노트 ·2분 읽기

npm 공급망 공격, 이번 표적은 AI 개발 회사들이다

TanStack부터 Mistral까지 한 주에 감염. 로컬에 풀어둔 API 키가 표적이다, 지금 당장 할 일 4가지.

노트 ·2분 읽기

범용을 버리고 하나를 극한까지, antirez의 로컬 LLM 엔진 ds4

284B MoE를 맥에서 초당 27토큰으로. 데이터가 밖으로 안 나가고 에이전트 루프를 돌려도 트래픽 0, 온디바이스 추론의 진짜 가치.

노트 ·1분 읽기

antirez가 만든 로컬 LLM 전용 엔진, 4일 만에 스타 4,800개

DeepSeek V4 Flash 하나만을 위한 C 싱글 파일 엔진 ds4. M3 Max에서 초당 27토큰, 실제 대화에 쓸 수 있는 속도다.

노트 ·2분 읽기

앤트로픽, 금융 에이전트 10개를 오픈소스로 풀었다

피치북 제작부터 KYC 심사까지 에이전트 10개가 한 리포에. MCP 커넥터 11개로 실무 금융 데이터에 직접 붙는다.

노트 ·1분 읽기

챗봇을 코드 없이 짜는 도구가 스타 14만 개를 찍었다

Dify가 스타 14만을 찍으며 '팀이 굴리는 에이전트' 카테고리를 열었다. 다음 병목은 권한 위임과 감사 로그다.

노트 ·1분 읽기

에이전트 스킬이 엔지니어의 새 포트폴리오가 된다

mattpocock/skills가 86일 만에 4.3만 스타. 코드가 아니라 작업 방식을 공개하는 게 채용 시그널이 되는 흐름.

노트 ·1분 읽기

GitHub에서 git push 한 번이면 서버를 장악할 수 있는 취약점이 발견됐다

CVE-2026-3854, CVSS 8.7. 푸시 권한만 있으면 트리거되는 RCE. 방치된 협업자 명단이 가장 위험하다.

노트 ·1분 읽기

이번엔 Stripe의 락인이 뒤집힐 차례다

커넥터 144개, 스타 4.2만의 hyperswitch. 멀티-PSP 오케스트레이션이 결제 락인 구조 자체를 해체하고 있다.

노트 ·1분 읽기

HWP 파일을 브라우저에서 여는 Rust 오픈소스가 나왔다

HWP/HWPX를 설치 없이 웹에서 읽고 편집하는 rhwp. Claude Code 페어 프로그래밍에 사람이 결정하는 Hyper-Waterfall 방법론까지.

노트 ·1분 읽기

AI를 얹는 회사 vs AI 위에 짓는 회사

Salesforce는 AI를 얹고, twenty는 AI 전제 위에 새로 짠다. 혁신기업의 딜레마가 도전자에게 빈틈이 되는 구조.

노트 ·2분 읽기

Claude Design 출시 72시간, 오픈소스 대안 4개가 나왔다

기업이 카테고리를 만들면 커뮤니티가 72시간 안에 열린 버전을 만든다. 합산 7,000 스타가 보여준 AI 도구 생태계의 새 속도.

노트 ·2분 읽기

Claude Mythos의 아키텍처를 역공학해봤다

가중치 없이 코드만으로 Claude Mythos 구조를 추정한 OpenMythos. 루프드 트랜스포머 실험과 LoRA 증류가 보여준 아키텍처와 행동의 분리.

노트 ·1분 읽기

당신이 증류하고 싶은 다음 직원은 동료일 필요가 없다

페르소나가 아니라 사고 구조를 증류하는 nuwa-skill. 지식은 복제할 수 있지만 사고방식은 증류해야 한다.

노트 ·2분 읽기

Vercel이 털렸다, 가장 위험한 단어는 '제한된 일부'다

영향 범위 비공개, 권고는 환경변수 회전 하나. 30분 내 대응 액션과 옵트인 보안 디폴트의 구조적 문제를 짚었다.

노트 ·2분 읽기

프레임워크를 전부 지운 592줄, self-healing 브라우저 하네스

부족한 도구를 에이전트가 helpers.py에 직접 써 넣는 자가 치유 구조. 592줄이 1만 줄 프레임워크에 던진 질문.

노트 ·2분 읽기

Thunderbird 만드는 곳이 조용히 AI 앱 하나를 풀었다

MZLA의 로컬 AI 앱 Thunderbolt. 모델은 내가 고르고 데이터는 내가 소유한다는 원칙이 코드로 내려왔다.

노트 ·1분 읽기

Claude Design 출시 하루 만에, 디자이너 아닌 사람이 먼저 '미쳤다'고 썼다

맛집 블로거의 '썸네일 진짜 잘 뽑네' 한 줄. 대체되는 건 디자이너가 아니라 디자인을 외주 맡길 이유다.

노트 ·2분 읽기

클로드 4.7, 시스템 프롬프트 1408줄이 말하는 진짜 활용법

시스템 프롬프트 1408줄을 직접 읽고 찾아낸 4.7의 설계 변화. 공식 발표보다 프롬프트가 거짓말을 덜 한다.

노트 ·2분 읽기

스스로 진화한다는 AI 에이전트, 코드를 열어보니 난독화 덩어리였다

3,500 스타 자가진화 에이전트 리포에서 발견한 난독화 코드와 라이선스 모순. 오픈소스를 감별하는 세 가지 습관을 얻었다.

노트 ·1분 읽기

헤지펀드 팀에 사람이 한 명도 없다

애널리스트, 리스크 매니저, 포트폴리오 매니저까지 전원 AI 에이전트인 ai-hedge-fund. 5.5만 스타가 증명하는 멀티에이전트 협업.

노트 ·2분 읽기

혼자서 게임 만들 때 Claude한테 전부 시키면 어떻게 되냐고?

49개 에이전트를 3단계 계층으로 나눈 Claude Code 게임 스튜디오. 12개 hook과 11개 rule이 혼자 개발의 빈틈을 잡는다.

노트 ·1분 읽기

AI 잘 쓰는 법을 오픈소스화하다, 4만 스타 Fabric

AI 프롬프트를 패턴으로 모듈화해 크라우드소싱하는 Fabric. 패턴을 복사하는 사람에겐 퇴화, 해체하는 사람에겐 성장이다.

노트 ·2분 읽기

해커는 악성코드를 .pdf로 위장한다

확장자 위장 파일을 밀리초 만에 판별하는 Google의 AI 도구 Magika. 정확도 99%, Gmail과 Drive에서 실전 검증됐다.

노트 ·1분 읽기

--fork-session이 엉뚱한 대화를 가져오는 이유

JSONL은 세션이 끝나야 디스크에 쓰인다. --fork-session과 /fork의 문서에 없는 동작 차이를 추적해 이슈로 남긴 기록.

노트 ·2분 읽기

AI가 짠 코드, 왜 리뷰하면 항상 뭔가 아쉬울까?

AI는 팀의 기준과 설계 의도를 모른다. code-convention과 ADR을 먹이고, sub agent와 fork를 컨텍스트 기준으로 갈라 쓰는 리뷰 워크플로우.

노트 ·4분 읽기

.claude/ 권한 버그, PermissionRequest hook으로 뚫는 법

문서와 코드가 다른 권한 버그를 코드 레벨로 추적, hook 자동 승인 워크어라운드를 테스트 20개로 검증하고 이슈에 남겼다.

← 태그 전체