진민성

진민성님의 포스트

진민성

진민성

기존에는 Perplexity같은 AI 챗봇을 활용할 때, 답변의 신뢰성을 확인하려면 출처 링크를 일일이 클릭하고 내용을 직접 찾아야 했습니다. 환각현상(Hallucination)으로 인한 잘못된 정보까지 검증하려면 추가적인 시간과 에너지가 필요했죠.
이에 저희는 ClueHunter는 AI가 참고한 출처를 단번에 검증할 수 있도록 도와주는 크롬 익스텐션을 개발했습니다.


기존에는 Perplexity에서 제공하는 출처 링크를 하나씩 클릭하고, 내용을 직접 찾아야 했다면, 이제는 ClueHunter가 출처 페이지를 자동 스크롤 & 핵심 내용 강조 표시까지 해줍니다!

현재는 Perplexity 전용 크롬 익스텐션으로 제공되지만, 앞으로 더 다양한 AI 챗봇에서도 활용할 수 있도록 확장할 예정입니다.

🛠 ClueHunter는 오픈소스 프로젝트로, 여러분의 피드백을 환영합니다!
ClueHunter 크롬 익스텐션 링크
ClueHunter.js
ClueHunter-Perpelxity

1
0
진민성

진민성

[🔥 o1-preview 2025 수능 국어 97점 달성 🔥]

2025학년도 수능 국어에서 O1-Preview가 97점이라는 놀라운 성적을 기록했습니다!

8번(3점) 한문제만 틀리고 나머지 모든 문제를 맞히는 만점에 가까운 점수를 받은 기록은 LLM이 한국어 언어능력에서 인간의 수준을 뛰어넘을 시기가 머지 않았다는 점을 보여주는것 같네요.

벤치마크에 필요한 gpu 자원과 자금의 확보가 되는대로 다른모델에 대해서도 벤치마크해서 공유하겠습니다!

추가로 리더보드에 2023 수능국어를 벤치마크 할 수 있는 튜토리얼을 업데이트했습니다!

cf)

- 본 벤치마크는 AutoRAG를 활용하여 진행했습니다!

- 실험 과정 정리 블로그: https://velog.io/@minsing-jin/%EC%86%8D%EB%B3%B4-o1-preview-2025-%EC%88%98%EB%8A%A5-%EA%B5%AD%EC%96%B4-97%EC%A0%90-%EB%8B%AC%EC%84%B1

2
0
진민성

진민성

수능 국어 LLM Leaderboard는 한국교육과정평가원(KICE)이 개발한 대학수학능력시험(수능) 국어 과목의 10개년 시험문제를 기반으로 한 벤치마크 리더보드입니다!

매년 엄선된 수능 국어 시험 문제를 통해 LLM의 성능을 평가할 수 있습니다. 평가 방식은 실제 수능과 동일하게 표준점수와 등급 체계를 사용하여, Human performance와 LLM의performance을 직접 비교할 수 있도록 구성되어 있습니다.

여러분의 한국어 언어모델을 평가해보세요! 피드백 환영합니다!

https://github.com/minsing-jin/Korean-SAT-LLM-Leaderboard

1
0