메커니즘 · 전문

Tablize는 어떻게 동작하나.

요약 없는 논증: 실패 양상, 기억이 장부가 아닌 이유, 관리되는 네 단계, 당신이 직접 조이는 게이트, 그리고 전체 경계. 짧은 버전은 첫 페이지에 ←

01 / 실패 양상

표 전체를 컨텍스트에, 아니면 모델을 우회하는 스크립트 — 막다른 길 둘.

50행을 잘 읽는 모델은 5,000번째 행도 똑같이 잘 읽습니다 — 달라지는 것은 그때 손에 쥐고 있는, 그 행과 무관한 표의 양입니다.

막다른 길 01

표 전체를 컨텍스트에 밀어 넣는다.

됩니다. 안 될 그 순간까지는 계속 됩니다. 주의가 지금 판단할 필요도 없는 수천 행에 흩어지고, 앞쪽 행은 창 밖으로 밀려나며, 실패가 조용합니다 — 오류도 예외도 없이 답만 서서히 흐트러집니다. 그리고 세션이 끝나면 실행도 함께 끝납니다.

막다른 길 02

스크립트를 써서 모델을 우회한다.

싸고 빠르고 반복 가능합니다 — 대가는, 모델이 해야 했던 의미 판단이 문자열 매칭으로 압축된다는 것입니다. 「이 회사는 제조사인가 무역사인가?」가 회사명에 정규식을 돌리는 일이 됩니다. 이제 스크립트가 규칙의 유일한 진술이고, 아무도 그것을 검토하지 않았으며, 틀린 행은 맞은 행과 똑같이 생겼습니다.

세 번째 길

프로세스를 서버에 두고, 작업을 나눠 준다.

당신의 agent는 다음 배치를 요청하고, 계산하고, 제출하고, 또 하나를 요청합니다: 의미 판단은 여전히 모델이 하지만 손에 쥐는 것은 넘겨받은 행뿐입니다. 그리고 계산을 당신의 agent가 하므로, 토큰당 과금되는 API 청구서 대신 월정액 coding agent 구독이 그 일을 해냅니다.

고를 문제는 애초에 「모델이냐 스크립트냐」가 아니었습니다. 고를 문제는, 이 프로세스가 잊어버리는 컨텍스트 창에 사는지, 잊지 않는 구조에 사는지입니다.

02 / 왜 장부가 필요한가

기억은 장부가 아니다.

이 절은 심판과 상태와 이유, 세 가지가 전부 일하는 쪽 안에 살고 있는 실행에 관한 얘기입니다.

독립적이지 않다

추출 로직과 그 테스트를 같은 저자가 썼다.

agent가 이번 세션에서 추출 로직을 썼습니다. 어떤 행이 이상해 보이면 같은 agent가 검증기를 손봅니다 — 그리고 그 배치는 통과합니다. 아무것도 그걸 막지 못합니다. agent 바깥에 아무것도 없었으니까요.

연속적이지 않다

컨텍스트가 사라지면 상태도 사라진다.

어떤 행을 내보냈는지, 무엇이 돌아왔는지, 무엇이 왜 반려됐는지 — 전부 대화 기록 안에 있었습니다. 새 세션은 파일과 반쯤 된 결과만 보고, 이어 달리는 대신 단서로 실행을 재구성합니다.

책임을 물을 수 없다

3주 뒤엔 아무도 대답하지 못한다.

이 행은 어느 버전 기준으로 받았나? 어느 모델이 만들었나? 전에 반려된 적이 있나? 답이 「대화 기록을 찾아봐라」라면 장부가 없는 것입니다. 기억이 있을 뿐이죠.

일하는 쪽이 심판을 고칠 수 있다면, 당신에겐 게이트가 없습니다. 프롬프트가 하나 더 있을 뿐입니다.

03 / 관리되는 구간

아주 좁은 한 구간만, 그리고 양 끝이 누구 것인지 분명히.

Tablize는 네 단계를 관리하고 나머지는 일절 자기 것이라 하지 않습니다. 각 상자 맨 아랫줄을 보세요 — 그 단계가 당신 것인지 우리 것인지 쓰여 있습니다.

1단계

원본 증거

append-only 원본 행 — 크롤링 한 번, 내보내기 한 번, 손으로 만든 CSV 하나. 중복은 남습니다. 그건 수집에 관한 사실이지 오류가 아니니까요.

당신 또는 당신의 agent가 수집 · Tablize는 가져오지 않음

2단계

agent의 시도

agent가 정해진 크기의 배치를 디스크로 받아, 당신의 모델로 당신의 프롬프트를 돌리고, 모델과 프롬프트 해시를 붙여 하나의 배치로 제출합니다.

당신의 머신, 당신의 모델 키에서 실행 · Tablize는 모델 미제공

3단계 · 선택

검수 게이트

검사 샘플 없이 라인을 만들면 게이트가 없습니다: 아무것도 판정하지 않고, 행은 미검수로 적재됩니다. 검사 샘플을 주면 정답을 아는 행이 모든 배치에 섞여 들어갑니다 — 기대값은 서버에만 있고 작업을 받아갈 때 절대 내려가지 않으며, 하나만 틀려도 배치 전체가 반려됩니다.

라인에 검사 샘플이 있으면 Tablize가 보관 · 제출하는 agent는 끝까지 읽지도 승인하지도 못함

4단계

결과 뷰

네 번째 표가 아닙니다 — 처리 기록 표를 읽는 한 방식으로, 원본 행마다 가장 최근 행을 보여줍니다. 게이트가 있으면 통과한 행만 보여주고 반려된 시도는 아무것도 움직이지 못하며, 게이트가 없으면 적재된 행을 미검수 표시와 함께 보여줍니다.

Tablize가 투영 · 하류에서 실제로 썼는지는 당신이 판단

CLI 명령이 없는 유일한 일: 게이트를 켠 구간에서, 검사 샘플을 agent 자신이 썼을 때, 그 라인은 초안 상태로 만들어지고 사람이 캔버스에서 게이트를 열기 전까지 작업을 한 건도 내보내지 않습니다. 위 재생에 나온 403 · pending_signoff가 그것입니다. 자기 답안을 자기가 승인할 수 있는 agent는 아무에게도 검사받지 않은 것입니다. 게이트를 켜지 않은 구간은 이 질문에 도달하지도 않습니다: 곧바로 작업을 내보내고, 적재되는 행에 미검수 표시를 답니다.

04 / 당신이 직접 조이는 게이트

행은 당신의 agent가 만들었습니다. 누가 검사했습니까?

당신이 그 검사를 쓰기 전까지는, 아무도 하지 않았습니다. 여기에는 「꺼 둔다」는 스위치가 없습니다: 아직 쓸 준비가 안 된 검사 샘플로 세운 게이트는 잡음 게이트이고, 잡음 게이트는 게이트가 없는 것보다 나쁩니다. 단계는 라인을 만들 때 고정됩니다. 그래서 조인다는 것은 라인을 다시 만든다는 뜻입니다: 파이프라인이 지킬 만해졌을 때 일부러 하는 동작입니다. 이전 라인이 이미 만든 결과는 그대로 남습니다.

none unverified 아무것도 판정하지 않음 observe 3/4 unverified 측정만, 막지 않음 enforce ■ accepted 하나만 틀려도 반려
모드는 셋, 차이는 하나: 틀린 행이 배치를 멈출 수 있는가. accepted는 enforce만 부여합니다.
none · 검사 샘플 파일 없음

아직 게이트가 없습니다 — 아무것도 검사되지 않습니다.

장부는 하나도 빠지지 않습니다: 모든 배치·모델·기준 버전·시각이 기록돼 있습니다. 없는 것은 그 검사입니다 — 결과를 사람이 확인한 답과 비교하는 것이 아무것도 없으므로, 결과는 미검수로 도착합니다. 이 단계는 첫 실행에는 맞고 마지막 실행에는 틀린 선택입니다.

observe · 명시해야 함

보기만 합니다 — 아무 배치도 막지 않습니다.

모든 배치가 검사 샘플과 비교되고 점수도 기록되지만, 어떤 배치도 멈추지 않으므로 결과는 여전히 미검수로 도착합니다 — 그 배치가 전부 통과했어도 그렇습니다. 게이트가 구속력이 없을 때 통과는 측정이지 인증이 아닙니다. 이 점수로, 이 샘플들이 맞는 샘플인지를 무엇이든 막게 하기 전에 판단하십시오.

enforce · 검사 샘플 있음

하나만 틀려도 배치 전체가 반려됩니다.

검사 샘플은 숨겨져 있고 구속력이 있습니다. 표본 검사에서 하나만 틀리면 배치 전체가 반려되고, 연속 반려는 그 구간을 헛돌게 두지 않고 멈춰 세웁니다. enforce 만이 「검수 통과」를 부여할 수 있습니다 — 그것이 이 단어가 아직 값을 하는 이유 전부입니다.

게이트는 장부에서 당신이 가장 먼저 조일 수 있는 부품입니다. 파이프라인을 끊기지 않게 만드는 것은 게이트가 아닙니다 — 그 부분은 게이트가 없는 라인에서 이미 돌고 있습니다.

05 / 더 많은 실물

같은 실행, 한 각도 더.

라인과 배치 장부는 첫 페이지에 있습니다. 이것은 같은 녹화 실행의 남은 한 장입니다 — 게이트가 켜진 상태(enforce)로 녹화. 무보정, 100% 배율, 이미지 헤더에 적힌 곳만 잘랐습니다.

반려된 행

반려됐다고 증발하지는 않습니다.

반려로 필터를 걸면 그 62행이 그대로 있습니다 — 회사명, 모델이 고른 분류, 그리고 그것이 판단 근거로 삼은 증거 텍스트까지.

다음 시도가 짐작이 아니라 논증이 되는 이유가 이것입니다: 무엇을 고칠지 정하기 전에, 약한 모델이 실제로 뭐라고 했는지 읽을 수 있습니다.

처리 기록 표 · 반려로 필터라이트 테마 · 시스템 열 왼쪽에서 잘라냄
상태 필터에서 rejected 62가 선택돼 있고, 아래 표에 반려된 행들: lst_0113 Linyi Chenglong Precision, lst_0085 Baoding Weiye Electronics, lst_0050 Guangzhou Brightway Rubber, lst_0014 Shaoxing Ruiheng Electronics — 모두 manufacturer로 분류되고 각자 증거 텍스트를 달고 있음.
반려 62로 필터 — 그 행들은 장부에 남아 있고, 당시 판단 근거였던 증거 열도 함께 있습니다.

스크린샷은 2026-07-28 로컬 인스턴스에서 찍었습니다. 메커니즘·id·카운트·판정·시스템 열은 제품 자신의 상태이고, 공급업체 행은 그 점검을 위해 만든 샘플 데이터입니다. 반려 스크린샷은 제품의 라이트 테마에서 찍었고 두 사이트 테마 모두에서 그대로 보입니다 — 증거에 필터를 씌우느니 라벨을 붙이는 쪽을 택했습니다.

06 / 경계

「적재됐다」가 뜻하는 것과, 뜻하지 않는 것.

이 페이지에서 가장 무게가 실린 절입니다. 자기 범위를 부풀리는 장부는 장부가 없느니만 못합니다. 사람이 그 장부가 원래 다루지 않던 부분을 더 이상 확인하지 않게 되니까요.

수집 당신 몫 · 장부 밖 장부 위 — Tablize가 관리하는 구간 원본 시도 ■ 게이트 검수 통과 소비 당신 몫 · 장부 밖
장부는 가운데 구간만 담당합니다. 양 끝은 언제나 당신 몫입니다.
이 구간 안

Tablize가 보장하는 것

검수 통과로 표시된 행은 그 시점의 기준과 검사 샘플을 통과했다는 뜻이고, 그 버전이 기록돼 있습니다. 미검수로 표시된 행은 판정된 적이 없습니다 — 표시가 어느 쪽인지 알려줍니다.

모든 시도·배치·모델·기준 변경에 장부가 있습니다 — 누가, 언제, 어느 버전으로.

실패한 시도는 남아 있고 읽을 수 있으며, 검수 통과 뷰에는 절대 들어가지 않습니다. 게이트가 없으면 남길 반려 자체가 없습니다 — 아무것도 판정하지 않으니 아무것도 반려되지 않습니다.

다음 실행은 서버 상태에서 이어 달립니다 — 미완 배치·리스·판정이 그대로 있고, 대화 기록이 전혀 필요 없습니다.

이 구간 밖

Tablize가 보장하지 않는 것

원본 데이터 자체가 사실이거나 완전하다는 것. 원본 행에 애초에 없던 증거는 게이트에서 복구되지 않습니다.

당신이 정의한 필드가 하류에서 실제로 필요한 필드라는 것. Tablize는 당신의 계약을 집행할 뿐, 대신 발견해 주지 않습니다.

그 결과를 누군가 실제로 썼다는 것. 우리 스스로의 첫 전체 실행 테넌트에서는 136행 중 128행이 통과한 뒤 하류의 무엇에도 한 번도 집히지 않았습니다 — 다섯 라운드 동안, 아무도 눈치채지 못한 채, 장부는 내내 정확했습니다.

당신의 agent가 Tablize 밖에는 아무것도 쓰지 않는다는 것. 그것은 당신의 머신과 키를 갖고 있습니다. 이 장부가 다루는 것은 한 구간이지 그 agent가 아닙니다.

퍼블릭 베타 · 무료 · macOS, Linux, Windows

원본에 없던 다음 열을 만들어 내세요.