어떤 질문은 여기에 속하지 않습니다

써 본 뒤 속하지 않는 것은 설명, 사람이 읽을 답, 열린 집합에서 이름을 만드는 일, 추론의 흔적을 남기는 일입니다. 속하는 것은 여전히 닫힌 예/아니오, 범주, 등급, 그리고 상위 단계로 넘길지입니다.

공동 작성자: folkbench.com (Folkbench는 AI API, 모델 서비스, 관련 사이트를 위한 검증 가능한 평가·선택 플랫폼입니다. 공개된 서비스 정보, 가격, 가용성, 지연, 증거 구간을 바탕으로 사용자가 경로를 비교하고 고를 수 있게 합니다.)

이 시리즈는 열 편입니다:

써 본 뒤 내가 가장 분명한 것은, Jev가 무엇을 할 수 있는지가 아닙니다. 어떤 종류의 말을 묻지 말아야 하는지입니다.

나는 그것을 관절로 받지, 입으로 받지 않습니다. 본능은 본능이 답할 수 있는 질문만 답할 수 있습니다. 펼쳐야 하는 것, 또는 사람이 보도록 추론을 놓아 두어야 하는 것을 Jev에게 물으면 대상이 잘못입니다. 사람에게 말이 끝날 때까지 말하는 것도 잘못된 물음입니다. 그것에는 문자열이 없습니다. 물어도 답을 둘 곳이 없습니다.

묻지 말아야 하는 것

채팅 모델에서 넘어오는 중이라면, 잘못 묻기 가장 쉬운 것이 아래 종류입니다.

왜인지를 설명하라고 묻지 말아야 합니다. 내가 채팅에서 가져온 습관은, 설명을 청하며 여는 것입니다. 그 습관은 여기에서는 통하지 않습니다. 설명을 청하면 도착하는 것은 판단뿐입니다. 이유는 문장으로 써야 합니다. 그것은 쓸 수 없습니다. 반환에는 “왜냐하면”이 없습니다. 원인이 어떻게 도착했는지 봐야 하는 사람에게, 그것은 그것을 줄 수 없습니다. 이유의 구간이 정말로 필요하면 내가 직접 쓰거나, 말할 수 있는 모델에게 묻고, 이미 내려진 판단에서 쓰게 합니다.

사람이 읽도록 답을 쓰라고 잘못 물은 적이 있습니다. 보내야 하는 것은 한 단락입니다. 어느 문장이 먼저인지, 어조가 얼마나 무거운지는 말 안에 있습니다. 그것이 주는 것은 선택지와 확률입니다. 그것들은 보내야 하는 단락과 맞지 않습니다. 확률이 아무리 높아도, 돌아오는 것은 내가 미리 준 항목 하나이지, 지금 쓰는 단락이 아닙니다. 나는 나중에 순서를 뒤집었습니다. 그것은 이것이 어느 종류에 속하는지, 이 단계를 상위 단계로 넘겨야 하는지만 판단합니다. 문장은 채팅 모델로 가거나, 내가 직접 씁니다.

열린 집합 안에서 스스로 이름을 생각해 내라고 물은 적이 있습니다. 쓸 수 있는 이름은 많고, 질문에 적힌 것은 작은 조각뿐입니다. 그것은 내가 준 항목 중에서만 고를 수 있습니다. 항목 안에 없는 것은 만들어 낼 수 없습니다. 후보를 나 스스로 이름 붙일 수 없으면, 아직 그것의 차례가 아닙니다. 나는 먼저 규칙으로 좁히거나, 검색으로 작은 한 줌을 꺼낸 다음 질문을 닫습니다. 나중에 이름 붙이기를 이렇게 바꿨습니다. 내가 후보 몇 개를 직접 고정한 다음 고르게 합니다. 목록 밖의 완전히 새로운 것은, 말할 수 있는 단계에 남깁니다.

모델에게 줘야 할 무거운 일처럼 보이는 종류도 있습니다. 증거를 앞뒤로 돌려야 하고, 추론은 남겨 두어야 합니다. 자료가 서로 밉니다. 한쪽을 고르기를 원하고, 어떻게 맞춰졌는지도 남기기를 원합니다. 그것에는 그 왕복이 없습니다. 요청 한 번은, 내가 상태에 넣은 것에서 나오는 빠른 판단입니다. 과정은 넘겨 볼 수 있는 텍스트가 되지 않습니다. 내가 말하는 왕복은 종종, 결론이 다음 페이지에 달려 있는데 그 페이지가 아직 상태에 없는 경우입니다. 나는 그 의존을 코드에 넣습니다. 닫힌 판단 하나를 먼저 물은 다음, 내가 증거를 가지러 가고, 돌아오면 상태를 바꾼 뒤 다시 묻습니다. 어느 페이지를 먼저 보았는지, 무엇을 배제했는지는 그것이 쓸 수 없습니다. 흔적을 남겨야 하면, 말할 수 있는 모델에게 줍니다.

물어야 하는 것

물어야 하는 것을, 나는 이제 몇 가지 모양만 알아봅니다. 이 종류인지는 바로 묻습니다. 범주는 내가 미리 고정한 것이어야 하고, 그것은 하나만 가리키면 됩니다. 심각도는 가는 숫자를 보고하게 두지 않습니다. 등급을 긋고, 어느 등급에 떨어지는지 말하게 합니다. 상위 단계로 넘길지, 이 단계를 사람에게 넘겨야 하는지도 닫힌 질문이고, 같은 번에 묻습니다. 이 바깥의 모양은 밀어 넣지 않습니다.

나는 거친 자도 하나 둡니다. 일을 이해하는 사람이 이 상태를 보면서 본능으로 가리킬 수 있으면, 그것은 이것의 질문처럼 보입니다. 가리키는 데 아직도 긴 추론이 필요하면, 나는 곧장 말할 수 있는 모델에게 넘깁니다.

상태는 내가 준비합니다. 질문은 내가 닫습니다. 컨텍스트에 들어가는 필드는 내가 고르고, 이 질문과 무관한 것은 가져가지 않습니다. 선택지와 등급의 경계는 질문에 적고, 그것이 즉흥으로 하길 바라는 곳에는 적지 않습니다. 그것은 열린 질문을 둥글게 마무리할 책임이 없고, 나를 위해 자료의 다음 페이지를 넘기지도 않습니다. 페이지를 넘기면 상태가 바뀝니다. 그것은 다음 요청이고, 여전히 내가 준비해야 합니다.

잘 닫히지 않은 질문을 밟은 적이 있습니다. 분포가 납작해집니다. 선택지 몇 개가 모여 있고, 어느 것도 머리 하나만큼 높지 않습니다. 나는 처음에는 그것이 느리다고 받았습니다. 그렇지 않았습니다. 나는 관절에게 입의 피스톤을 준 것이었습니다. 선택지가 겹치거나, 실제로 나타날 상황이 목록에 적히지 않으면, 확률은 퍼질 수밖에 없습니다. 그때는 질문을 바꾸거나, 그 단계를 말할 수 있는 모델에게 되돌립니다. 질문을 바꾼다는 것은 겹치는 항목을 합치고, 덮이지 않은 경우에 “이것들 중 어느 것도 아니다”를 주는 것입니다. 되돌린다는 것은, 말할 수 있는 모델이 상황을 먼저 분명히 말하게 한 다음, 내가 다시 닫을지를 정하는 것입니다. 계속 조이지 않습니다. 질문이 아직 열려 있는 동안, 분포는 여전히 퍼져 있습니다.

Choice와 Score

나는 Choice를 255까지 채우지 않으려 합니다. 공식 상한은 255입니다. 그것을 넘으면 그들 스스로도 먼저 점수를 매긴 다음 골라야 하고, 더 느려지기도 합니다. 255는 내가 채우러 온 숫자가 아닙니다. 가장자리 경우를 선택지로 더 많이 적을수록, 질문은 한 번도 닫히지 않은 목록처럼 보입니다. 내 질문에 출구가 자연히 수백 개라면, 나는 먼저 규칙이 후보를 자를 수 있는지, 검색이 자를 수 있는지를 묻습니다. 작은 한 줌에는 고정된 개수가 없습니다. 한눈에 이 항목들이 어떻게 다른지 아직 가를 수 있을 때, 자름이 충분히 간 것입니다. 한눈에 가를 수 없으면, 나는 요청을 너무 이르게 보내는 것입니다. 작은 한 줌으로 자른 다음, 고르러 가져갑니다.

나는 Score를 순서가 있는 등급으로 대하지, 연속된 정확한 소수로 대지 않습니다. 질문을 쓸 때 나는 보통 등급을 2에서 10까지 긋습니다. 내가 원하는 것은 등급이지, 7.63 같은 거짓 정밀도가 아닙니다. 나는 등급을 쉬운 말로 적습니다. 이 등급과 다음 등급을 다르게 다룰지를 먼저 생각합니다. 다르다면 쪼갭니다. 두 등급이 끝에서 같은 코드를 일으키면, 한 등급으로 합칩니다. 코드 안의 어느 분기도 소수점 아래 두 자리를 기다리지 않습니다. 가끔 두 등급 사이에 숫자가 떨어지고, 나는 여전히 그것을 등급으로 읽으며 임계값은 코드에 적습니다. 등급의 뜻을 분명히 적을 수 없으면, 나는 등급의 설명을 바꿉니다. 소수를 파고들지 않습니다.

demo를 보는 동안

나는 공식 Doom demo와 Wikipedia 경주를 보았고, 내 질문을 결론 내는 데 쓰지 않았습니다. Doom을 보면 화면에 휩쓸리기 쉽습니다. 화면은 게임을 하는 것처럼 보입니다. 들어가는 것은 구조화된 상태이지, 그림이 아닙니다. Doom 쪽의 규모는 초당 약 10회 질의, 시간당 약 $7입니다. 그 규모는 실시간 관절이 성립하고, 루프가 그 밀도로 돌 수 있다는 것만 보여 줍니다. 게임을 할 수 있다는 것은 보여 주지 않습니다. 그림은 먹히지 않았습니다. 다음 단계는 바깥의 코드가 상태로 묻는 것입니다.

Wikipedia 경주는, 높은 기수에서 링크를 고르는 것이 유용하다는 것을 보여 줍니다. 추론할 수 있는 모델보다 웹을 더 잘 본다는 것은 보여 주지 않습니다. 비추론 비교에서는 걸음 수가 더 적습니다. 그것은 다른 쪽이 추론을 켜지 않아서, 시연이 더 나아 보이기 때문입니다. 추론을 켜면 시연은 덜 좋아 보입니다. 걸음 수가 바뀌고, 누가 더 빠른지도 바뀝니다. 나는 “걸음이 더 적다”를 내 과제로 가져와 길을 더 잘 찾는 것으로 대하지 않습니다. 길이 계속되는지, 어디서 멈추는지는 여전히 바깥의 프로그램이 정합니다. 나는 이것을, 장난감으로 전부를 판단하지 말라는 것으로 받습니다. 시연이 보기 좋은지는, 다음에 어느 문장을 물어야 하는지를 나를 위해 정하지 않습니다.

내가 직접 쓸 때 가르기는 꽤 단단합니다. 다 적을 수 있고 조건이 안정적인 것은 여전히 규칙으로 적습니다. 묻지 않습니다. 본능이 한 번에 답할 수 있을 때, 그때 묻습니다. 묻기 전에 질문은 닫혀 있어야 하고, 나는 상태를 준비할 수 있어야 합니다. 열어서 내용을 말할 때가 되면, 채팅 모델에게 줍니다. 잘못 물으면, 느림과 비용은 내 문제입니다.

출처

시리즈