DEV Community

Cover image for Tibo와 함께 살펴보는 Codex 개발 이야기 [동영상] · Ask GN: 3주간 코딩…다른 분들... 외 5선 | GeekNews AI
ageofclick
ageofclick

Posted on

Tibo와 함께 살펴보는 Codex 개발 이야기 [동영상] · Ask GN: 3주간 코딩…다른 분들... 외 5선 | GeekNews AI

1. Tibo와 함께 살펴보는 Codex 개발 이야기 [동영상]

Codex 팀은 모델과 하네스를 함께 설계하되, Rust 기반 에이전트 핵심부를 제품 인터페이스와 분리해 보안·정확성·확장성을 확보했습니다. 모델 역량이 높아질수록 보완 지침을 줄이고, 코드 리뷰와 회귀 탐지는 자동화해 사람의 검토를 변경 의도와 시스템 계약에 집중시키는 방향을 설명합니다.

2. Ask GN: 3주간 코딩 에이전트에게 보낸 제 메시지를 분석해 봤습니다. 40%는 실제 작업이 아니었어요. 다른 분들...

작성자는 3주간의 에이전트 대화 2,116개를 분석해 실제 작업 지시 외 교정·내용 전달·진행 확인 등이 입력의 약 40%를 차지했다고 보고합니다. 반복 규칙의 단절과 완료 알림 부재, UI 스크린샷 기반 교정이 주요 운영 비용으로 나타났습니다.

3. Pirate Face - LLM 모델을 삭제로부터 구하는 서비스

Pirate Face는 Hugging Face 모델 파일을 공식 SHA-256으로 검증한 토렌트와 웹 시드로 미러링해, 원본이 사라져도 P2P 시딩으로 배포를 이어가려는 서비스입니다. 현재는 원본 등록 모델과 일부 라이선스에 의존하지만, 가중치의 보존성과 바이트 단위 출처 검증을 함께 다룹니다.

4. Step 5 Preview: 파레토 경계 확장

Step 5 Preview는 토큰당 270억 파라미터만 활성화하는 6,000억 파라미터 MoE 모델로, 100만 토큰 컨텍스트와 이미지 입력을 지원합니다. StepFun은 코딩·에이전트 작업의 비용 효율을 강조하지만, 가장 어려운 장시간 작업에서는 최상위 모델과 여전히 격차가 있다고 공개했습니다.

5. 채팅 기반 대규모 언어 모델은 심령술사 사기의 작동 방식을 재현한다

LLMentalist 효과는 사용자가 일반적이지만 그럴듯한 챗봇 답변에 개인적 의미를 부여하면서 모델의 이해력을 과대평가할 수 있다는 가설입니다. 글은 콜드 리딩과 주관적 타당화의 구조를 비교하며, 만족스러운 대화 경험만으로 추론 능력을 판단하지 말아야 한다고 주장합니다.

6. Qwen-Image-2.1, 소형 고효율 통합 이미지 생성 모델

Qwen-Image-2.1은 7B 시각 생성부 하나로 이미지 생성·편집·투명 배경 출력을 통합하고, 최대 10장의 참조 이미지를 조합할 수 있습니다. 혼합 세분도 어텐션과 KV 캐시 재사용으로 다중 이미지 편집의 추론·메모리 비용을 낮추며, 공개 가중치는 연구·평가 용도로만 허용됩니다.

7. Show GN: AutoRAG Agent - 컴퓨터에 있는 모든 것을 검색해주는 에이전트 (파일, 메신저 대화 기록, 이메일, 노션...

AutoRAG Agent는 문서·메신저·이메일·Notion 등 분산된 로컬 데이터를 하나의 저장소로 모으지 않고, 각 소스에서 직접 탐색하는 개인 검색 에이전트입니다. 키워드·의미 검색과 증분 인덱싱을 기본 제공하며, 먼저 빠른 응답을 내고 이후 탐색을 계속해 답변을 보강하는 흐름을 제안합니다.

Top comments (0)