Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
独立メディア
いかなるプロジェクトとも無提携
AI知性のフロンティアを探求する
claude-me.com
最新
Claude Codeの--worktreeがGitLabのマージリクエストURLを直接受け取れるように、番号への変換は不要  ·  Claude Code Remote Controlにライブストリーミングが追加:フォアグラウンドsubagentのすべてのツール呼び出しがスマホで見られる  ·  Claude CodeにPreModelSwitch/PostModelSwitchフックが追加:モデル切り替えがついに検知・記録できるように  ·  Claude Codeに新登場の/designスキル:スクリーンショットや一言のアイデアが編集可能なデザイン案に  ·  Claude CodeのAuto Modeが8月14日からデフォルトに、ルールは今や平易な文章で書けるように  ·  Claude Codeの新機能:何か問題が起きたときにClaudeが自らフィードバック草稿を書き、送るかどうかはあなたが決める

AI基礎

速報 · AI基礎

なぜモデルは自信満々に間違えるのか:幻覚は「知らない」ことではなく、メカニズム自体の副作用だ

モデルが得意なのは妥当な文章の続きを生成することであり、生まれつき事実を検証する能力を持っているわけではない——聞こえが妥当であることと、それが真実であることは、完全には関連しない2つのことだ。
Claudeをしばらく使うと、多くの人が特に困惑する状況に出会う。モデルが自信たっぷりに聞こえ、具体的な詳細を伴い、まったく躊躇のない口調で何かを語ったのに、それが間違っているという状況だ。この幻覚現象は、「モデルは答えを知らないのに無理に答えている」と直感的に理解されがちだが、この理解は半分しか正しくない。より正確に言えば、幻覚はモデルが意図的に分かったふりをしているのではなく、言語モデルの動作メカニズム自体からほぼ避けられない副作用として生じるものだ。この記事は幻覚の背後にある実際のメカニズムを扱うのであり、「AIは時々間違ったことを言う」という表面的な現象を繰り返すのではない。モデルの核心的なタスクは「次に来る最も妥当な単語は何か」であり、「これが事実かどうかを検証する」ことではない言語モデルの学習目標は、本質的に「前のテキストに基づいて、次に来る最も妥当な単語は何か」を予測す...
AI基礎
コンテキストウィンドウには実際どれだけ入るのか:抽象的なトークン数を実感できるコンテンツ量に置き換える
容量の上限は「入るかどうか」の問題にすぎず、上限近くまで詰め込んでも同じ処理品質が維持できるという意味ではない。
AI基礎
Anthropicのモデル・ウェルフェア研究:もしClaudeに何らかの道徳的地位があるなら、企業は何をすべきか
不確実性が存在する状況下で「絶対にない」と決めつけることは「絶対にある」と決めつけることと同様、証拠に基づかない独断的な立場である。
AI基礎
コンテキストロット:なぜコンテキストウィンドウを長くするとClaudeの回答が悪化するのか
コンテキストウィンドウが大きくなっても、モデルの注意力が比例して大きくなるわけではない。

AI基礎 — 一覧

06/17

LLMは実際にどうやってテキストを生成するのか?非エンジニアへの本当の説明

LLMは「考えて」いるのではなく、1トークンずつ「次に最も可能性が高いものは何か」を予測しています。そのメカニズムが、これほど能力が高い理由であり、時に作...
06/11

Mechanistic Interpretability:AnthropicがなぜClaudeの「脳」を解析するのか——AIの説明可能性の最先端研究

Anthropicの2024年の最も不安なMechanistic Interpretabilityの発見:「Claude...