๐ ๊ฒ์
"AI transparency" ๊ฒ์ ๊ฒฐ๊ณผ 2๊ฑด
-
Claude Code์ 'Extended Thinking' ์ถ๋ ฅ์ด ์ค์ ์ฌ๊ณ ๊ณผ์ ์ด ์๋๋ผ๋ ์ฃผ์ฅ (HN 265์ )
Hacker News์์ 265์ ์ ๋ฐ์ผ๋ฉฐ 185๊ฐ์ ๋๊ธ์ด ๋ฌ๋ฆฐ ํ์ ์ ๊ธ์ ๋๋ค. ์์ฑ์๋ Claude Code์ 'Extended Thinking' ๊ธฐ๋ฅ์ด ๋ณด์ฌ์ฃผ๋ ํ ์คํธ๊ฐ ์ค์ ๋ชจ๋ธ์ ๋ด๋ถ ์ถ๋ก ๊ณผ์ ์ ๊ทธ๋๋ก ๋ ธ์ถํ๋ ๊ฒ์ด ์๋ ์ ์๋ค๊ณ ์ฃผ์ฅํฉ๋๋ค. ๋ง์ ๊ฐ๋ฐ์๋ค์ด ์ด ๊ธฐ๋ฅ์ ํตํด AI๊ฐ '์ด๋ป๊ฒ ์๊ฐํ๋์ง' ๋ค์ฌ๋ค๋ณผ ์ ์๋ค๊ณ ๋ฏฟ์ด์๊ธฐ ๋๋ฌธ์, ์ดโฆ
-
Claude์ ์๊ฐ์ ํ
์คํธ๋ก ๋ณํํ๋ ์์ฐ์ด ์๋์ธ์ฝ๋
Anthropic์ด ๋ฐํํ Natural Language Autoencoders ์ฐ๊ตฌ๋ Claude ๊ฐ์ ๋ํ์ธ์ด๋ชจ๋ธ(LLM)์ ๋ด๋ถ ์ฌ๊ณ ๊ณผ์ ์ ํด์ ๊ฐ๋ฅํ ํ ์คํธ๋ก ๋ณํํ๋ ๊ธฐ์ ์ ๋๋ค. ์ด ๊ธฐ์ ์ AI ๋ชจ๋ธ์ '๋ธ๋๋ฐ์ค' ํน์ฑ์ ํด๊ฒฐํ๋ ค๋ ํด์๊ฐ๋ฅ์ฑ(interpretability) ๋ถ์ผ์ ์ค์ํ ์ง์ ์ ๋๋ค. ๋ชจ๋ธ์ด ์ด๋ป๊ฒ ์๊ฐํ๊ณ ๊ฒฐ์ ํ๋์ง๋ฅผ ๋ ์ ์ดโฆ