Ask HN: ローカルモデルを実際にプロダクションで動かしている人はいますか?
このスレッドには雑音が多いものの、特定のユースケースで Mixtral や Llama 派生モデルを動かしているチームは実際に成果を上げています。ある程度のボリュームに達すればコスト計算も合ってきます。
1月 17私たちが読んでいるもの。
このスレッドには雑音が多いものの、特定のユースケースで Mixtral や Llama 派生モデルを動かしているチームは実際に成果を上げています。ある程度のボリュームに達すればコスト計算も合ってきます。
1月 17この論文は、CoT(連鎖推論)は明示的なプロンプトなしに大規模モデルで自然に現れると主張しています。プロンプトエンジニアリングへの示唆は大きく、シンプルにするほど効果的なケースが本当にあるということです。
1月 16Anthropic が人々に AI 店主を騙させ、その結果を公表しました。ネタバレをすると、人間は操作に対して創造的であり、性能の高いモデルでも騙されてしまいます。エージェントの堅牢性に関する実用的なデータとして有益です。
11月 24Microsoft が意図的に新しい Clippy を作りました。大胆な判断です。すべてに同意するのではなく反論する「Real Talk」モードは、迎合性への批判に対する直接の回答です。Microsoft 内に Twitter を読んでいる人がいるようです。
10月 28モデル自身が自分のプロンプトを自然言語で振り返るアプローチが、強化学習ベースの最適化を上回りました。勾配ではなく言葉でより良い結果を得られるなら、解釈可能性の観点からも大きな前進です。
9月 17同じツールを与えても、モデルによって異なる協働スタイルが生まれます。マルチエージェントシステムを運用している方には興味深い知見です。ベンチマークスコアだけでなく、モデルの「個性」で選ぶという視点もあるかもしれません。
8月 21