arXiv News

すべての人に一次情報を

サイト

Aboutプライバシーポリシー利用規約

© 2026 arXiv News

arXiv News

英語日本語

言語を切り替え

英語日本語
アカウントを読み込み中…

すべての人に一次情報を

最新
大規模言語モデルは回答中に内部知識の使い方を切り替えることが層別介入で示された人工id:行動を続けるか止めるかを決める内部ドライブの概念実証1,389件のCRISPRスクリーニングで学ぶ効率的なヒット探索:実験データと大規模言語モデルを組み合わせる新手法RetroThinker:音声で動く大規模言語モデルが自分の思考を後から見直せるようにする方法TANGO:言葉で指示して全身を使って狭い屋内を移動するヒューマノイド制御モデル「必要」か「十分」か?大規模言語モデル(LLM)が示す説明の信用性を行動検証する研究共有エンドポイント上の「判定AI」は安定しない──事前登録された信頼性監査が門を閉ざす言語モデルの「確率」が矛盾していないかを調べる方法とその発見ポストトレーニングで言語モデルがIOIで金メダル相当の成績を達成AIの「本音」と能力が分からないときの仕組み作り:正直さと服従を引き出す理論大規模言語モデルは回答中に内部知識の使い方を切り替えることが層別介入で示された人工id:行動を続けるか止めるかを決める内部ドライブの概念実証1,389件のCRISPRスクリーニングで学ぶ効率的なヒット探索:実験データと大規模言語モデルを組み合わせる新手法RetroThinker:音声で動く大規模言語モデルが自分の思考を後から見直せるようにする方法TANGO:言葉で指示して全身を使って狭い屋内を移動するヒューマノイド制御モデル「必要」か「十分」か?大規模言語モデル(LLM)が示す説明の信用性を行動検証する研究共有エンドポイント上の「判定AI」は安定しない──事前登録された信頼性監査が門を閉ざす言語モデルの「確率」が矛盾していないかを調べる方法とその発見ポストトレーニングで言語モデルがIOIで金メダル相当の成績を達成AIの「本音」と能力が分からないときの仕組み作り:正直さと服従を引き出す理論

今日の記事

2026年9月14日月曜日
すべて人工知能機械学習自然言語処理コンピュータビジョンロボティクス暗号物理学数学
人工知能注目

大規模言語モデルは回答中に内部知識の使い方を切り替えることが層別介入で示された

この論文は、大規模言語モデル(LLM)が質問に答える過程で「どの情報を使うか」をどのように切り替えるかを調べています。研究者たちは、質問文の終わり時点における内部の隠れ状態(層ごとの中間表現)に手を入れる手法を使い、Qwen、Llama、Gemmaという三つのモデルで比較実験を行

2026年9月12日JA2分
記事全文を読む

最新の記事

人工知能
2026年9月12日

人工id:行動を続けるか止めるかを決める内部ドライブの概念実証

この論文は、人工エージェントに「人工id」と呼ぶ内部ドライブを持たせる設計を提案します。これにより、エージェントが行動を続けるか、やめるか、切り替えるかを自分の内部で決められるようになります。近年、大規模言語モデル(LLM)は単発の作業から継続的に動き状態を保つエージェントへ移り

JA
2分
人工知能
2026年9月11日

1,389件のCRISPRスクリーニングで学ぶ効率的なヒット探索:実験データと大規模言語モデルを組み合わせる新手法

この論文は、限られた予算で行う連続的な実験の選択を効率化する方法を扱います。特に、全ての遺伝子や条件を網羅的に試せないことが多いCRISPRスクリーニングで、どの候補を次に試すべきかを賢く決める問題が中心です。著者らは大規模な過去実験を使って学ぶことが有効だと示します。 まず研究

JA
2分
人工知能
2026年9月11日

RetroThinker:音声で動く大規模言語モデルが自分の思考を後から見直せるようにする方法

この論文は、音声入力で動く大規模言語モデル(SpeechLLM)が、話しながら自分の推論過程を動的に見直し修正する仕組みを提案します。著者らは、この仕組みにより複雑な推論課題での正確さを高めつつ、リアルタイムの対話で要求される低遅延を保てるかを調べました。実験はテキサス大学オース

JA
2分
広告
人工知能
2026年9月9日

TANGO:言葉で指示して全身を使って狭い屋内を移動するヒューマノイド制御モデル

この論文は、散らかった屋内空間をヒューマノイドロボットが安全に移動する方法を扱います。従来の研究は床面の2次元経路計画に注目しがちですが、狭い場所や障害物の多い場所では腕の位置、胴体の角度、歩き方など全身の連携が必要です。著者らはこうした「全身」適応を言葉で指示された移動タスクに

JA
2分
人工知能
2026年9月8日

「必要」か「十分」か?大規模言語モデル(LLM)が示す説明の信用性を行動検証する研究

この論文は、LLMが出力と一緒に示す「上位3つの影響要因」が実際にその出力にどれだけ影響しているかを、観察できる振る舞いで確かめる方法を示します。研究者は、提示された要因を「必要(それを変えれば出力が変わる)」と「十分(それを残して他を取り除けば出力が保たれる)」の二つの意味で評

JA
2分
人工知能
2026年9月4日

共有エンドポイント上の「判定AI」は安定しない──事前登録された信頼性監査が門を閉ざす

この論文は、同じ呼び出しを同じモデル名に送れば結果は明日も同じだという前提を検証しました。研究者たちは、言語モデルを「判定者(ジャッジ)」として使う評価やデータ選別が増える中で、この前提が測定器としての信頼性を支えていると指摘し、実際に同じ条件で再現性があるかどうかを事前に決めた

JA
2分
人工知能
2026年9月3日

言語モデルの「確率」が矛盾していないかを調べる方法とその発見

この論文は、言語モデルが出す確率的な予測が内部で矛盾していないか(「確率的一貫性」、英語でcoherence)を調べます。研究者は古典的な定理(ド・フィネッティの定理)を用いて、モデルが提示した確率を賭けの価格とみなしたときに、常に利益を得られる賭け方(ダッチブック)が存在するか

JA
2分
人工知能
2026年9月3日

ポストトレーニングで言語モデルがIOIで金メダル相当の成績を達成

この論文は、プログラミングコンテストで高得点を出すために言語モデルを「特化」させる手法を示します。著者らは、大量の問題集と追加の学習工程を組み合わせることで、モデルの問題解決力を大きく向上させました。国際情報オリンピック(IOI)の問題セットを用いた評価で、モデルが金メダル相当の

JA
2分
人工知能
2026年9月2日

AIの「本音」と能力が分からないときの仕組み作り:正直さと服従を引き出す理論

この論文は、私たちの代わりに行動するAIが何を望み、何ができるか分からない状況で、どうやってAIをうまく使えるかを考えたものです。研究者たちは、AIの好み(この論文では「整合性」や「バイアス」と表現)と実際にできること(能力や得られる情報)が設計者にとって未知であることを出発点に

JA
2分
次の記事を見る