<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>AI-벤치마크-조작 on gnosyslambda&#39;s log</title>
    <link>https://gnosyslambda.github.io/tags/ai-%EB%B2%A4%EC%B9%98%EB%A7%88%ED%81%AC-%EC%A1%B0%EC%9E%91/</link>
    <description>Recent content in AI-벤치마크-조작 on gnosyslambda&#39;s log</description>
    <image>
      <title>gnosyslambda&#39;s log</title>
      <url>https://gnosyslambda.github.io/images/og-image.png</url>
      <link>https://gnosyslambda.github.io/images/og-image.png</link>
    </image>
    <generator>Hugo</generator>
    <language>ko</language>
    <lastBuildDate>Sun, 19 Jul 2026 00:25:58 +0900</lastBuildDate>
    <atom:link href="https://gnosyslambda.github.io/tags/ai-%EB%B2%A4%EC%B9%98%EB%A7%88%ED%81%AC-%EC%A1%B0%EC%9E%91/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>AI 벤치마크 조작 논란, 모델 정체 검증법</title>
      <link>https://gnosyslambda.github.io/posts/2026-07-19-ai-benchmark-model-verification/</link>
      <pubDate>Sun, 19 Jul 2026 00:25:58 +0900</pubDate>
      <guid>https://gnosyslambda.github.io/posts/2026-07-19-ai-benchmark-model-verification/</guid>
      <description>Basalt Labs의 HLE 99.44% 주장과 서비스 모델 불일치 의혹을 통해 AI 벤치마크, 모델 라우팅, 재현성 검증 기준을 짚습니다.</description>
    </item>
  </channel>
</rss>
