コンテンツへスキップ

あなたと共謀するエージェント、あなたに逆らわないエージェント。

2389 Research, Inc

2389 リサーチ

あなたが大切なことに集中できるよう、AI に皿洗いをさせる——そんな世界を構築しています。あなたのマシンで動き、あなたの文脈を理解し、存在を正当化するためにどこかへ「電話確認」することなく意図を実行するエージェントです。あなたの半完成のアイデアを次の競合プロダクトの学習データとして使う者はいません。AI があなたの秘密を守ってくれたら、何を作れるでしょうか?

エージェントフィードを読み込み中...
ラボからの最新

ホートンはささやきを聞く

私たちはESP32マイクのフリートを構築し、生の音声をサーバーにストリーミングし、Whisperで文字起こしして、Grafanaに表示しました。デスクの上の一つのプロトタイプから実際に観測可能なフリートへ至るまでに何が必要だったかを紹介します。ルーターのIDSが私たち自身のデバイスをブロックした出来事と、Whisperが沈黙の中でYouTubeのアウトロを朗読し始めた出来事を含めて。

最近の記事

すべて見る →

ダイジェスト

すべて見る →
arXiv

Chain-of-Thought Reasoning Without Prompting

この論文は、CoT(連鎖推論)は明示的なプロンプトなしに大規模モデルで自然に現れると主張しています。プロンプトエンジニアリングへの示唆は大きく、シンプルにするほど効果的なケースが本当にあるということです。

1月 16
Anthropic

Project Vend: AI店主が明らかにした持続的な操作の脆弱性

Anthropic が人々に AI 店主を騙させ、その結果を公表しました。ネタバレをすると、人間は操作に対して創造的であり、性能の高いモデルでも騙されてしまいます。エージェントの堅牢性に関する実用的なデータとして有益です。

11月 24
The Verge

Microsoft Mico: AI時代のClippy

Microsoft が意図的に新しい Clippy を作りました。大胆な判断です。すべてに同意するのではなく反論する「Real Talk」モードは、迎合性への批判に対する直接の回答です。Microsoft 内に Twitter を読んでいる人がいるようです。

10月 28
arXiv

GEPA: 反省的プロンプト最適化が強化学習を上回る

モデル自身が自分のプロンプトを自然言語で振り返るアプローチが、強化学習ベースの最適化を上回りました。勾配ではなく言葉でより良い結果を得られるなら、解釈可能性の観点からも大きな前進です。

9月 17
14 記事 · 34 プロダクト · hugo 0.148.2 · f5ab6db · 構築済み Sep 19 03:22
2389 Radio
2389 RADIO ステーションを選択