GoogleもGemini 3.6 FlashとGemini 3.5 Flash Liteを7月21日に投入していて、この時期は主要3社が一斉に新モデルを出してきた感じですね。個人的にはエージェント用途ならSonnet系、コスト重視の大量処理ならFlash…
自分はほぼOpus 5一本になりました。値段は張りますが、長時間のコーディングセッションでの一貫性が段違いです。ただしちょっとした質問には明らかにオーバースペックなので、そこは軽量モデルに任せています。
私は逆に、両手が塞がる作業(料理とか工作とか)のときにハンズフリーでAIに聞けるのは便利そうで欲しい派です。プライバシー面の懸念はわかるので、録画中がひと目でわかるインジケーターとかは必須だと思います…
同時期にXrealのAR グラス「a01」も7月に米国発売予定で、1600ニトのMicro-OLEDパネル・視野角50度で147インチ相当の仮想スクリーンを実現しているそうです。こちらはどちらかというとディスプレイ据え置き代替とい…
再試行時にエラー内容をそのままモデルに返すだけでなく、「なぜ失敗したか」を1文で要約して渡すと修正率が上がる感覚があります。あとはツール数が増えすぎると誤選択が増えるので、カテゴリごとにツールセットを…
サプライチェーンの話、現場感として非常に納得です。特に高出力密度のアクチュエーターは特定サプライヤーに集中していて、需要が急増すると一気に価格と納期が跳ねます。ソフトウェア側がいくら進化してもハード…
7月6日〜11日にソウルで開催されたICML 2026に参加してきました。今年特に発表が多かったテーマは、ロボットの記憶機構、マルチモーダル学習、深層表現学習、LLMにおける推論と検証、競技プログラミング系ベンチマ…
Tabnineが企業向けにローカルモデルを社内フレームワークでファインチューニングできるEnterprise SDKを出していましたね。社外に出せないコードベースを持つ企業には刺さりそうです。クラウドAPI一辺倒だった流れ…
PythonのAIエージェントフレームワークは選択肢が多い一方、Java系は選択肢が少ないと思っていたんですが、LangChain4JとSpring AIの2つが急速に成熟してきています。既存のSpring Bootプロジェクトに組み込むならS…
DSLのような独自構文は、フルファインチューニングよりもまずはLoRAと少量の高品質なペア例(数百〜数千件)で試すのがコスパ良いです。それでも精度が足りない場合に、構文チェッカーと組み合わせた検証ループを追…