pldb: programming languages papers
PLDB: 프로그래밍 언어 논문 검색
PLDB는 1973년 첫 POPL 논문부터 올해 학회 논문까지 프로그래밍 언어 분야 논문 33,580편의 제목과 초록을 모아 검색하는 서비스입니다. 저자명이나 주제, 제목으로 검색할 수 있고 API도 제공합니다.
- 주제
AI 요약
PLDB는 프로그래밍 언어 연구 논문 33,580편의 제목과 초록을 모아 검색하는 서비스입니다. 범위는 1973년 첫 POPL(Principles of Programming Languages)부터 올해 발표된 학회 논문까지입니다. 점진적 타이핑, Xavier Leroy 저자 논문, 동시성 관련 separation logic, effect handler, e-graph, 증분 계산, 소유권 타입 등을 검색어로 제시합니다. 검색어에서 -java처럼 특정 항목을 제외할 수도 있습니다.
서비스는 웹 검색뿐 아니라 API도 제공합니다. Reddit에서는 AI 에이전트에게 논문 검색을 맡기는 방법과 비교해, 구조화된 논문 목록이 어떤 가치를 더하는지 논의했습니다. 한 이용자는 일반 검색 엔진이 학술 논문 검색에 부적합하고, 에이전트가 쓰는 검색 도구에 따라 결과 품질과 환각 문제가 달라진다고 설명했습니다.
Reddit 반응
- @u/maelstrom071 — 참고로 작성자는 AI를 꽤 자주 사용하고 “저작권 없음(No copyright)”이라는 구호를 내세웁니다. 그래서 이 프로젝트 자체도 AI로 코딩했을 가능성이 큽니다.
- @u/tending — 반대하는 건 아니지만, 에이전트에게 검색을 시키는 것과 비교해 어떤 가치를 더하나요?
- @u/yorickpeterse — 큰 AI 업체에 매달 구독료를 내지 않고도 정보를 찾을 수 있다는 점은 어떨까요?
- @u/tending — 이건 누가 봐도 바이브 코딩으로 만든 것 같습니다. AI 구독료를 감당하지 못하는 사람들을 돕자고 만든 프로젝트인지는 의문입니다.
- @u/mttd — 작성자는 아니지만 타당한 질문이라고 생각합니다. 왜 반대 투표를 받았는지는 모르겠네요. 에이전트가 처음부터 검색하면 결과가 좋지 않을 때가 있습니다. Google은 에이전트 검색에 제약이 많고, Bing은 제약이 덜하지만 결과 품질이 나쁩니다. 기본 설정으로 두면 에이전트에 환각 결과를 피하라고 따로 지시해야 합니다. 학술 논문 검색에서는 웹 검색 엔진이 대체로 좋지 않아서, 직접 검색할 때도 몇 년 전부터 Google Scholar를 권해 왔습니다. Google Scholar는 수동 검색에는 훨씬 낫지만 접근 제한이나 요청 횟수 제한이 있을 수 있습니다. 참고로 API도 있습니다: https://pldb.kirancodes.me/api
- @u/tending — 무슨 말씀인가요? GPT나 Claude가 환각한 결과를 내놓는 일은 한참 전부터 없었습니다. 요즘 모델을 써 보셨나요?
- @u/mttd — 문제는 최신 GPT나 Claude 모델이 아닙니다. 참고로 GPT-6-Astra, GPT-6.1-Sol, Opus-5.5, Fable-5.1도 어려운 언어 표준이나 의미론 질문에는 여전히 환각 답변을 할 수 있습니다. 답변을 검증하고 해당 언어 명세의 문단을 함께 제공하도록 하네스를 구성하면 비교적 쉽게 대응할 수 있지만, 그래도 발생합니다. 연구 결과를 서로 검토하던 GPT-6-Astra가 Claude Fable 5.1의 환각을 잡고, 반대로 Claude가 GPT의 환각을 잡은 일도 있었습니다. 최신 프런티어 모델에서도 꽤 흔합니다. 제가 말한 건 웹 검색 도구였습니다. 하네스에 따라 다르지만 GitHub Copilot CLI 같은 일부 코딩 하네스는 기본 웹 검색 도구가 제대로 작동하지 않습니다. 품질이 낮고 환각을 내는 구식 모델이 만든 Bing의 ‘AI 요약’을 결과로 보여주기도 합니다. 최신 Anthropic이나 OpenAI 모델을 쓰더라도 하네스가 기본 웹 검색 도구를 사용하면 환각 결과가 컨텍스트에 들어갈 수 있습니다. 더 나은 검색 도구를 쓰면 이런 문제를 피할 수 있습니다. 모델과 하네스에 관계없이 에이전트는 검색 도구와 API의 한계에 묶입니다. Google Search는 문헌 검색에 좋지 않고 자동화된 사용이 제한돼 요청 제한이나 차단을 겪을 수 있습니다. Google Scholar는 훨씬 낫지만 제한이 더 심할 수 있습니다. 헤드리스 브라우저나 MCP로 우회해도 더 빨리 제한되거나 차단될 수 있습니다. Bing은 제한이 덜하지만 품질이 더 나쁘고, 구식 모델이 만든 환각성 ‘AI 요약’이 검색 결과에 포함됩니다. ‘에이전트에게 검색을 맡긴다’는 말이 웹 검색 말고 다른 방식을 뜻했다면 더 나은 API를 쓸 수도 있습니다. PLDB API가 바로 그런 API 중 하나입니다.
원문: PLDB / 번역·요약: Trawling